KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 90 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Muse Spark 1.3 (max) 46 pt3. gpt-oss-120b (high) 39 pt4. GPT-5.6 Luna (max) 27 pt5. GPT-5.6 Terra (max) 22 pt

AI 기술 블로그

엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

ADOT 설정으로 구현하는 온프레미스·멀티클라우드 AI 에이전트 통합 모니터링

ADOT 설정으로 구현하는 온프레미스·멀티클라우드 AI 에이전트 통합 모니터링

AWS 외부 환경의 AI 에이전트 텔레메트리를 Bedrock AgentCore Observability로 통합 전송할 수 있다. ADOT 자동 계측을 통해 온프레미스, GCP, Azure에서 발생한 추론 데이터를 CloudWatch OTLP 엔드포인트

DeepGPT-5.6 Luna, 성능 유지하며 비용 25배 낮춘 에이전트 최적화 공개

GPT-5.6 Luna, 성능 유지하며 비용 25배 낮춘 에이전트 최적화 공개

GPT-5.6 모델 제품군이 출시되어 고성능 AI 에이전트 구축 비용을 획기적으로 낮췄다. Luna 모델은 기존 GPT-5.5 수준의 성능을 유지하며 비용을 33.27달러에서 1.33달러로 줄였다. 실무자는 추론 강도 조절과 모델 분리 전략을 통해 에

구글 시트 데이터를 코딩 없이 미니 앱으로 바꾸는 Sheets canvas 공개

구글 시트 데이터를 코딩 없이 미니 앱으로 바꾸는 Sheets canvas 공개

구글 시트의 행과 열을 프롬프트 하나로 인터랙티브 미니 앱으로 변환하는 Sheets canvas가 출시됐다. Gemini가 데이터 기반의 커스텀 레이아웃을 생성하며, 캔버스에서의 수정 사항은 원본 시트에 자동 동기화된다. Google AI Pro 및

Deep로봇 학습 데이터 전송량을 4배 줄이는 Hugging Face Storage Buckets 루프 구현

로봇 학습 데이터 전송량을 4배 줄이는 Hugging Face Storage Buckets 루프 구현

Strands Robots와 HF Storage Buckets를 결합해 로봇 데이터의 기록-학습-배포 루프를 단일 백엔드로 통합했다. Xet 기반의 콘텐츠 정의 청킹을 통해 데이터 전송량을 약 4배 절감하며, 500MB 파일의 1% 수정 시 5.5MB

Gemini 3.7 Flash, 3.6 대비 성능 높이고 가격은 절반으로 낮췄다

Gemini 3.7 Flash, 3.6 대비 성능 높이고 가격은 절반으로 낮췄다

코딩과 에이전트 작업에 최적화된 Gemini 3.7 Flash가 공개됐다. DeepSWE 65.3% 등 주요 벤치마크 수치를 높이면서 토큰 비용은 3.6의 절반으로 낮췄다. 실무자는 입력 $0.75/1M, 출력 $3.75/1M의 비용 구조를 기반으로

주 단위 RFP 작성을 몇 시간으로, M365에 직접 통합된 Amazon Quick 에이전트

주 단위 RFP 작성을 몇 시간으로, M365에 직접 통합된 Amazon Quick 에이전트

Amazon Quick이 Word, Excel, PowerPoint, Outlook 내에서 기업 데이터를 직접 다루는 에이전트 기능을 출시했다. RFP 작성 시간을 주 단위에서 시간 단위로 단축하며, QuickSight와 Salesforce 등 외부

Ubuntu 24.04 정식 지원과 DLSS 최적화로 낮춘 GeForce NOW의 하드웨어 제약

Ubuntu 24.04 정식 지원과 DLSS 최적화로 낮춘 GeForce NOW의 하드웨어 제약

GeForce NOW가 리눅스 전용 앱 정식 출시와 클라우드 렌더링 최적화를 단행했다. Ubuntu 24.04 지원 및 DLSS 프레임 생성 지연 시간 단축으로 4K 120fps 환경의 반응성을 높였다. 리눅스 사용자 및 신규 크롬북 구매자는 설치 경

SQL 추출부터 API 배포까지, 채용 담당자가 선택하는 데이터 포트폴리오 구축법

SQL 추출부터 API 배포까지, 채용 담당자가 선택하는 데이터 포트폴리오 구축법

단순 모델링을 넘어 비즈니스 문제 정의부터 최종 추천까지 전 과정을 보여주는 포트폴리오가 채용 확률을 높인다. DoorDash 배달 시간 예측 프로젝트를 통해 SQL 추출, 피처 엔지니어링, FastAPI 배포, Streamlit 대시보드 구현 단계를

AI는 조잡한 초기 자동차인가, 실무 도구인가: 10대들의 활용 기준과 에이전트 설계

AI는 조잡한 초기 자동차인가, 실무 도구인가: 10대들의 활용 기준과 에이전트 설계

10~18세 청소년들은 AI를 '흥미롭지만 조잡한 초기 단계'의 도구로 인식한다. 미국 10대의 57%가 정보 검색에 AI를 쓰며, 단순 활용을 넘어 5단계 멀티 에이전트 시스템으로 사회 문제를 해결하는 사례가 확인됐다. AI 제품 설계 시 단순 효율

IAM 주체별 비용 추적으로 Amazon Bedrock 낭비 지점 찾는 법

IAM 주체별 비용 추적으로 Amazon Bedrock 낭비 지점 찾는 법

Amazon Bedrock의 모든 추론 요청을 IAM 주체별로 추적해 비용을 산출하는 기능이 공개됐다. CUR 2.0의 IAM 주체 데이터를 Athena SQL로 분석하거나 CUDOS 대시보드 v5.8의 시각화 도구로 확인한다. 멀티테넌트 AI 서비스

DeepAI 에이전트 결제 증명하는 법: Amazon Bedrock AgentCore 기반 검증 워크플로우 구현

AI 에이전트 결제 증명하는 법: Amazon Bedrock AgentCore 기반 검증 워크플로우 구현

Solv Labs가 Amazon Bedrock AgentCore payments를 활용해 모든 AI 에이전트 결제 내역을 독립적으로 검증하고 감사할 수 있는 워크플로우를 구축했다. ORACLE 정책 엔진, ICME 검증 레이어, AWS Nitro En

질문 답변에서 업무 수행으로, OpenAI가 분석한 기업 AI 도입 격차

질문 답변에서 업무 수행으로, OpenAI가 분석한 기업 AI 도입 격차

기업용 AI가 단순 질의응답을 넘어 실제 업무를 완결하는 에이전트 단계로 진화하고 있다. 상위 10%의 선도 기업은 일반 기업보다 사용자당 8.3배 많은 출력 토큰을 생성하며 실행 중심의 워크플로우를 구축했다. 실무 리더는 도구 제공을 넘어 고성과자의

G6e 인스턴스로 P5급 성능을, SageMaker HyperPod의 계층형 KV 캐시 구현법

G6e 인스턴스로 P5급 성능을, SageMaker HyperPod의 계층형 KV 캐시 구현법

GPU-CPU-NVMe로 이어지는 3단계 계층형 KV 캐시 구조를 통해 LLM 추론 효율을 높였다. 공유 NVMe 풀과 지능형 라우팅으로 TTFT를 최대 2.7배 개선하고 캐시 적중률 100%를 달성했다. 프롬프트 중복률이 40% 이상인 워크로드를 운

"갤럭시 S26에서도 돌아가는 비전 AI", LFM2.5-VL-3B의 온디바이스 성능과 스펙

"갤럭시 S26에서도 돌아가는 비전 AI", LFM2.5-VL-3B의 온디바이스 성능과 스펙

3GB 메모리 점유로 모바일 기기에서 완전한 온디바이스 실행이 가능한 LFM2.5-VL-3B가 공개됐다. SigLIP2 인코더와 34T 토큰 학습을 통해 H100 단일 GPU에서 일일 약 10억 토큰의 출력 성능을 낸다. 고부하 온디바이스 워크로드가

Pixel 11, 수어-텍스트 변환 SL2T 1.0 탑재로 입력 장벽 제거

Pixel 11, 수어-텍스트 변환 SL2T 1.0 탑재로 입력 장벽 제거

구글이 Gboard와 Live Transcribe에 수어-텍스트 변환 모델 SL2T 1.0을 적용했다. Pixel 11 기기에서 추가 비용 없이 사용할 수 있으며 AISLAC의 참여형 거버넌스로 개발됐다. 실무자는 공동 영향 보고서를 통해 현재 기술의

라벨 60개로 지형 분석, OlmoEarth Studio 임베딩 내보내기 공개

라벨 60개로 지형 분석, OlmoEarth Studio 임베딩 내보내기 공개

OlmoEarth Studio가 지구 관측 데이터를 수치 벡터로 변환해 내보내는 임베딩 기능을 출시했다. int8 정수형 COG 포맷으로 제공되며, 60개의 라벨만으로 F1 스코어 0.84의 세그멘테이션이 가능하다. 위성 데이터 분석가는 모델 전체 튜

직원 승인율 99%, 젠슨 황이 2026년 최고의 CEO 1위에 오른 이유

직원 승인율 99%, 젠슨 황이 2026년 최고의 CEO 1위에 오른 이유

젠슨 황 엔비디아 CEO가 글래스도어 2026년 최고의 CEO 순위 1위를 차지했다. 직원 승인율 99%를 기록했으며, 기술 분야 CEO 9명이 50인 명단에 포함되며 업계 지배력을 보였다. 리더십 신뢰도가 10년 만에 최저점인 시장 상황에서 엔비디아

데이터 주권 위해 Llama 4 자체 호스팅, 3주 만에 50개 에이전트 구축한 OneAdvanced

데이터 주권 위해 Llama 4 자체 호스팅, 3주 만에 50개 에이전트 구축한 OneAdvanced

영국 기업 OneAdvanced가 데이터 외부 유출 방지를 위해 Llama 4 모델을 AWS에 자체 호스팅했다. vLLM과 p5.48xlarge 인스턴스로 128K 컨텍스트를 확보하고 3주 만에 50개 이상의 전문 에이전트를 배포했다. 규제 산업 실무

AI 스팸이 망치는 오픈소스 생태계, 기여자로 살아남는 실무 워크플로

AI 스팸이 망치는 오픈소스 생태계, 기여자로 살아남는 실무 워크플로

GitHub 개발자가 1.8억 명을 돌파하며 접근성은 높아졌으나, AI 생성 저품질 PR인 AI slop으로 인해 메인테이너의 피로도가 극에 달했다. 단순 코드 작성을 넘어 문서화와 이슈 트리아지 등 기여 범위를 넓히고, Upstream 동기화를 포함

DeepFirst Orion의 QA 병목 해결, Amazon Nova Act로 '셀렉터 없는 테스트' 구현

First Orion의 QA 병목 해결, Amazon Nova Act로 '셀렉터 없는 테스트' 구현

스크립트 기반 QA 자동화의 한계를 Amazon Nova Act의 AI 에이전트로 해결했다. DOM 셀렉터 대신 자연어 지시문을 사용해 UI 변경에 관계없이 테스트를 수행하는 구조다. QA 리드는 현재의 병목이 '테스트 설계'인지 '스크립트 유지보수'

단순 반복 업무만 자동화해 AI 도입률 35% 달성한 Pixieset의 전략

단순 반복 업무만 자동화해 AI 도입률 35% 달성한 Pixieset의 전략

사진 작가들의 기피 업무인 이미지 대체 텍스트 작성을 Amazon Bedrock으로 자동화했다. 컨셉부터 출시까지 4개월이 소요됐으며, 출시 첫 주에 75만 장 이상의 사진을 처리했다. AI 도입 시 '창의적 영역'이 아닌 '비창의적 마찰 지점'을 찾

NVIDIA, 5,000억 달러 규모 AI 인프라 금융 플랫폼 구축으로 컴퓨팅 자산화 추진

NVIDIA, 5,000억 달러 규모 AI 인프라 금융 플랫폼 구축으로 컴퓨팅 자산화 추진

NVIDIA가 글로벌 금융사와 협력해 5,000억 달러 규모의 AI 인프라 자금 조달 플랫폼을 구축한다. CUDA 소프트웨어 업데이트와 범용 아키텍처를 통해 AI 컴퓨팅 자원을 재배치 가능한 투자 자산으로 전환한다. 대규모 컴퓨팅 자원이 필요한 AI

구글, 대학생 200명과 제미나이 Z세대 마케팅 캠페인 전개

구글, 대학생 200명과 제미나이 Z세대 마케팅 캠페인 전개

구글이 제미나이 확산을 위해 대학생 앰배서더 2기를 선발하고 활동을 시작했다. 210개 대학 2,500명 지원자 중 200명을 선발해 5개월간 마케팅 미션을 수행한다. 비전공자 포함 다양한 전공자의 AI 활용 사례와 Z세대 맞춤형 접점 생성 여부를 확

BIM 전문가 없이도 IDS 작성이 가능한 Ishigaki-IDS의 데이터 극복 전략

BIM 전문가 없이도 IDS 작성이 가능한 Ishigaki-IDS의 데이터 극복 전략

데이터가 부족한 건설 BIM 분야에서 특화 모델 Ishigaki-IDS를 구축했다. Qwen3 기반 3단계 파이프라인과 검증 도구 기반 RLVR로 내용 일관성을 80% 이상 확보했다. 데이터가 적지만 기계적 검증 도구가 있는 도메인의 ML 엔지니어는

V8 제로데이 찾은 GPT-5.6 Cyber, AWS Bedrock의 Daybreak 모델로 공개

V8 제로데이 찾은 GPT-5.6 Cyber, AWS Bedrock의 Daybreak 모델로 공개

OpenAI의 사이버 보안 특화 모델 Daybreak Red와 Blue가 Amazon Bedrock에서 제공된다. GPT-5.6 Cyber 모델은 V8 엔진의 제로데이 취약점(CVE-2026-15903)을 찾아낼 만큼 강력한 추론력을 보였다. 보안 실

에이전트 메모리, 전체 주입 대신 '선택적 전달'로 토큰 비용 최대 85% 절감

에이전트 메모리, 전체 주입 대신 '선택적 전달'로 토큰 비용 최대 85% 절감

ALTK-Evolve는 에이전트의 과거 경험을 요약하지 않고 개별 가이드라인으로 저장해 선택적으로 전달한다. 약한 모델에서 ACE와 유사한 정확도를 유지하며 추론 비용을 1/7 수준으로 낮췄으며, 강한 모델의 고난도 작업에서 더 높은 성능을 보였다.

기존 AC 인프라 유지하며 전력 밀도 높이는 NVIDIA 800 VDC 표준

기존 AC 인프라 유지하며 전력 밀도 높이는 NVIDIA 800 VDC 표준

NVIDIA, Google, Microsoft가 OCP를 통해 800 VDC 전력 표준을 추진한다. 전력 변환 단계를 줄여 효율을 높이며, 2026년 하반기 하이브리드 랙을 시작으로 단계적 확장을 지원한다. 기존 데이터센터 설비를 유지하며 고밀도 AI

AWS 게이트웨이로 제어하는 기업용 Claude 앱 권한과 비용 관리

AWS 게이트웨이로 제어하는 기업용 Claude 앱 권한과 비용 관리

Claude Code와 Claude Desktop을 위한 중앙 집중형 거버넌스 레이어인 Claude apps gateway가 공개됐다. OIDC 인증과 YAML 기반 정책 설정을 통해 모델 접근 권한과 비용을 서버 측에서 강제하며 OTLP로 사용량을

Nemotron 3.5 Lightning 공개, 로컬 AI 운영 비용 1/3로 낮추는 라우팅 전략

Nemotron 3.5 Lightning 공개, 로컬 AI 운영 비용 1/3로 낮추는 라우팅 전략

NVIDIA가 30B MoE 오픈 가중치 모델 Nemotron 3.5 Lightning을 공개했다. 동급 모델 대비 토큰 생성 속도를 4배 높였으며, NeMo Switchyard 라우팅으로 비용을 Opus 4.8 대비 1/3로 낮췄다. 로컬 에이전트

4배 빠른 출력과 비용 1/3 절감, NVIDIA가 공개한 에이전트 최적화 모델과 라우터

4배 빠른 출력과 비용 1/3 절감, NVIDIA가 공개한 에이전트 최적화 모델과 라우터

NVIDIA가 30B MoE 모델 Nemotron 3.5 Lightning과 라우팅 라이브러리 NeMo Switchyard를 공개했다. Lightning은 기존 대비 최대 4배 빠른 출력을, Switchyard는 Opus 4.8 단독 사용 대비 비용을