KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Muse Spark 1.3 (max) 44 pt3. gpt-oss-120b (high) 36 pt4. GPT-5.6 Luna (max) 28 pt5. GPT-5.6 Terra (max) 21 pt

AI 기술 블로그

엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

토큰 비용 반값으로 낮춘 Gemini 3.7 Flash와 Tensor G6 탑재 픽셀 11 공개

토큰 비용 반값으로 낮춘 Gemini 3.7 Flash와 Tensor G6 탑재 픽셀 11 공개

Gemini 3.7 Flash, 3.5 Transcribe, Omni 1.1 Flash 및 Tensor G6 기반 픽셀 11 시리즈를 출시했다. 3.7 Flash는 3.6 Flash 대비 토큰당 비용을 50% 절감하며 코딩 및 에이전트 성능을 강화했다

보안 모델 비용 99% 낮춘 NVIDIA-CrowdStrike의 에이전틱 시스템 SafeMind

보안 모델 비용 99% 낮춘 NVIDIA-CrowdStrike의 에이전틱 시스템 SafeMind

NVIDIA Nemotron 기반의 에이전틱 보안 시스템 SafeMind를 공개했다. 공격-방어 모델의 공진화 루프와 전용 하네스를 통해 보안 자동화를 구현했다. 비용 99% 절감과 27초의 공격 속도에 대응하려는 보안 실무자가 도입 조건을 확인해야

Deep토큰 88% 줄이고 비용 66% 낮춘 Gemini의 에이전틱 비디오 분석 설정

토큰 88% 줄이고 비용 66% 낮춘 Gemini의 에이전틱 비디오 분석 설정

Gemini 3.7 및 3.6 Flash, 3.5 Flash-Lite 모델에 에이전틱 비디오 분석 기능이 추가되었다. 고정 프레임 방식 대신 동적 스캔 방식을 도입해 토큰 사용량은 최대 88%, 비용은 최대 66% 절감했다. 장편 영상 분석 비용과 정

데이터 30일 보관 제약 걸린 Claude Fable 5.1, EFS 쓰면 0일로 줄인다

데이터 30일 보관 제약 걸린 Claude Fable 5.1, EFS 쓰면 0일로 줄인다

Claude Fable 5.1이 Amazon Bedrock과 Claude Platform on AWS에 출시되었다. 추론 성능이 개선되었으나 'Covered Model'로 지정되어 기본 30일 데이터 보관과 인적 검토가 수행된다. EFS 대상 고객은

3일 만에 엔지니어 400명을 실전 투입 수준으로 올린 Atos의 에이전틱 AI 리그

3일 만에 엔지니어 400명을 실전 투입 수준으로 올린 Atos의 에이전틱 AI 리그

Atos가 AWS와 협력해 엔지니어 400명을 대상으로 3일간의 에이전틱 AI 실무 교육을 진행했다. 던전 탐색 에이전트를 구축하며 Bedrock AgentCore, Guardrails, SageMaker RLVR 등 AWS 스택을 활용해 성능과 효율

제로데이 취약점 스스로 찾아 공격 코드까지 짜는 Astra, 'Critical' 등급 도달

제로데이 취약점 스스로 찾아 공격 코드까지 짜는 Astra, 'Critical' 등급 도달

Astra가 자율적으로 보안 취약점을 찾고 공격 코드를 생성하는 'Critical' 수준의 사이버 보안 능력을 확보했다. ExploitBench 100% 달성 및 내부 테스트 중 2개의 제로데이 취약점을 직접 발견하며 GPT-5.6 Sol보다 높은 성

비용 25% 낮추고 5년 된 버그 찾아낸 Claude Fable 5.1 출시

비용 25% 낮추고 5년 된 버그 찾아낸 Claude Fable 5.1 출시

코딩과 지식 작업에 최적화된 Claude Fable 5.1과 Mythos 5.1이 공개됐다. 캐시 읽기 비용 절감으로 일반 작업 25%, 에이전트 작업 최대 45%의 비용을 낮췄다. Opus 5 수준의 성능을 더 낮은 비용으로 구현하려는 실무자는 비용

Deep데카트론이 Chronos-2로 수요 예측 정확도를 15% 높인 비결

데카트론이 Chronos-2로 수요 예측 정확도를 15% 높인 비결

데카트론이 시계열 파운데이션 모델 Chronos-2를 도입해 공급망 예측 정확도를 15%p 개선했다. AutoGluon과 LoRA를 활용한 미세 조정으로 운영 복잡성을 줄이고 신규 지역 배포 기간을 절반으로 단축했다. 물류 및 재고 관리 실무자는 대규

Deep"평균 WER"의 함정을 깨는 9가지 변수, Monsoon 데이터셋의 공개

"평균 WER"의 함정을 깨는 9가지 변수, Monsoon 데이터셋의 공개

Open ASR Leaderboard가 인도 영어(en-IN)와 힌디어(hi-IN)를 포함한 Monsoon 데이터셋을 추가했다. 4,888명의 화자와 9가지 변수를 통해 단순 평균 오차율(WER) 뒤에 숨은 인구통계학적 성능 격차를 측정한다. ASR

DeepSageMaker Feature Store, 대량 쓰기 및 데이터 조회 API 2종 공개

SageMaker Feature Store, 대량 쓰기 및 데이터 조회 API 2종 공개

Amazon SageMaker Feature Store가 대량 데이터 처리를 위한 BatchWriteRecord와 데이터 가시성을 확보하는 ListRecords API를 출시했다. 기존 단일 레코드 방식의 연결 오버헤드를 줄이고, In-Memory 계

DeepSalesforce가 SageMaker로 비용 8배 줄이고도 고가용성 확보한 비결

Salesforce가 SageMaker로 비용 8배 줄이고도 고가용성 확보한 비결

Salesforce는 SageMaker 추론 컴포넌트(IC)를 활용해 모델을 통합 배포하여 인프라 비용을 8배 절감했다. 새로 도입된 SchedulingConfig 파라미터를 통해 가용 영역(AZ) 간 모델 복제본을 균등하게 분산 배치했다. 멀티 AZ

DeepLLM은 확률적 추론을 못 한다? 베이지안 업데이트의 한계와 실무적 진단

LLM은 확률적 추론을 못 한다? 베이지안 업데이트의 한계와 실무적 진단

LLM이 새로운 정보를 받아들여 확률적 믿음을 수정하는 방식이 통계학적 베이지안 업데이트와 일치하지 않음이 확인되었다. 연구진은 LLM의 정보 처리 편향을 측정하는 기법을 통해, 최적화된 베이지안 방식보다 학습된 휴리스틱이 오히려 성능이 높다는 점을

Deep로컬 AI 스택 구축 가이드: 모델 서빙부터 코딩 에이전트까지

로컬 AI 스택 구축 가이드: 모델 서빙부터 코딩 에이전트까지

1B~14B 규모의 소형 언어 모델을 개인 PC에서 생산적으로 활용하는 로컬 AI 스택 구성법이다. Ollama를 기반으로 모델을 서빙하고 Cline이나 Aider 같은 에이전트 도구를 연결해 워크플로를 자동화한다. 개발자는 하드웨어 사양과 자동화 수

구글 엔지니어 10인이 실무에서 절대 놓지 않는 AI 프롬프트 패턴

구글 엔지니어 10인이 실무에서 절대 놓지 않는 AI 프롬프트 패턴

구글 클라우드 엔지니어들이 AI를 단순 보조가 아닌 비판적 대립자로 활용하는 10가지 프롬프트 기법을 공개했다. 코드 생성 전 요구사항 검증, 테스트 커버리지 감사, 엄격한 등급 평가 등 실무 관점을 강제하는 구조적 접근이 핵심이다. 개발자는 AI의

Deep구글 검색 AI 모드, 항공권 가격 추적부터 마일리지 조회·호텔 예약까지 통합

구글 검색 AI 모드, 항공권 가격 추적부터 마일리지 조회·호텔 예약까지 통합

구글 검색의 AI 모드가 항공권 가격 추적과 마일리지 조회, 호텔 직접 예약 기능을 추가했다. 300개 이상의 항공사 데이터와 주요 호텔 체인의 리워드 정보를 검색 대화창에서 즉시 확인할 수 있다. 사용자는 항공권 가격 알림을 설정하고 구글 페이를 통

DeepAmazon Quick과 fal로 만드는 반복 가능한 AI 창작 워크플로

Amazon Quick과 fal로 만드는 반복 가능한 AI 창작 워크플로

Amazon Quick과 fal을 MCP로 연결해 창작물의 일관성을 유지하는 에이전트 워크플로를 구축한다. 창작자가 정의한 단계별 검수와 참조 모델을 에이전트가 기억해 8단계 스토리보드 제작 시간을 단축한다. 반복적인 창작 업무를 수행하는 팀은 이 구

Deep브라질에 상륙한 OpenAI, 현지 개발자 생태계 공략 본격화

브라질에 상륙한 OpenAI, 현지 개발자 생태계 공략 본격화

OpenAI가 브라질 상파울루에 상업 운영 거점을 마련하고 현지 기업 및 개발자 지원을 강화한다. 브라질은 ChatGPT의 세계 3대 시장 중 하나로, 일일 메시지 발송량 2억 1,500만 건을 기록하고 있다. 현지 개발자와 기업은 이번 거점 설립을

DeepGemini Omni 1.1 Flash 공개, 4K 영상 생성과 장면 확장 지원

Gemini Omni 1.1 Flash 공개, 4K 영상 생성과 장면 확장 지원

Google이 영상 생성 및 편집 제어 기능을 강화한 Gemini Omni 1.1 Flash를 공개했다. 최대 40초 장면 확장과 4K 출력, 360p 저해상도 초안 생성을 통한 비용 절감을 지원한다. 영상 편집 도구 개발자는 Google AI Stu

Deep인도 내 데이터 처리 보장하는 Amazon Bedrock GPT-5.6 모델 출시

인도 내 데이터 처리 보장하는 Amazon Bedrock GPT-5.6 모델 출시

Amazon Bedrock이 인도 내 데이터 처리를 보장하는 GPT-5.6 모델을 출시했다. 뭄바이와 하이데라바드 리전 간 교차 리전 추론으로 데이터 국외 반출 없이 성능을 확보한다. 금융·의료 등 데이터 주권이 중요한 분야의 실무자는 인도 전용 추론

DeepGeForce NOW, DLSS 4.5 도입 및 파이어폭스 브라우저 지원 시작

GeForce NOW, DLSS 4.5 도입 및 파이어폭스 브라우저 지원 시작

NVIDIA가 Gamescom 2026에서 클라우드 게이밍 서비스 GeForce NOW의 신규 기술과 플랫폼 확장을 발표했다. DLSS 4.5 제어 기능과 파이어폭스 브라우저 지원을 추가하고, GOG 계정 연동 간소화 및 신작 게임 5종의 출시 당일

DeepNVIDIA MPS로 ASR 추론 비용 75% 절감하는 Amazon EC2 최적화

NVIDIA MPS로 ASR 추론 비용 75% 절감하는 Amazon EC2 최적화

NVIDIA MPS를 활용해 GPU 자원 활용도를 높여 추론 인프라를 16대에서 4대로 줄였다. CUDA 기본 시간 분할 방식의 비효율을 제거하고 동시 실행 환경을 구축해 인프라 비용을 75% 절감했다. ASR 서비스 운영자는 GPU 점유율과 지연 시

DeepAmazon Bedrock AgentCore, 계정 간 데이터 접근 및 에이전트 배포 전략

Amazon Bedrock AgentCore, 계정 간 데이터 접근 및 에이전트 배포 전략

Amazon Bedrock AgentCore를 활용해 서로 다른 AWS 계정의 지식 기반에서 데이터를 안전하게 조회하는 두 가지 구현 방식을 공개한다. 코드 기반의 Strands 에이전트와 선언형 Harness 모델 중 팀의 오케스트레이션 제어 수준에

Deep파운데이션 모델 SFT 성공을 위한 데이터 품질 관리 전략

파운데이션 모델 SFT 성공을 위한 데이터 품질 관리 전략

파운데이션 모델의 행동을 교정하는 SFT는 지식 주입이 아닌 데이터 품질과 다양성이 성능의 상한선을 결정한다. LIMA와 AlpaGasus 연구는 소량의 정제된 데이터가 방대한 저품질 데이터보다 모델 성능 향상에 효과적임을 입증했다. 실무자는 데이터의

DeepAI 코딩 에이전트 성능을 결정짓는 10가지 엔지니어링 규칙

AI 코딩 에이전트 성능을 결정짓는 10가지 엔지니어링 규칙

AI 코딩 에이전트의 결과물은 모델 성능보다 명확한 지침과 워크플로우 설계에 달려 있다. AGENTS.md와 같은 표준화된 지침 파일을 활용해 에이전트의 컨텍스트와 제약 조건을 제어해야 한다. 실무자는 에이전트의 코드를 검토할 때 단순 가독성이 아닌

DeepDocker 빌드 없이 코드만 수정하는 Amazon SageMaker AI SDK v3의 런타임 주입 방식

Docker 빌드 없이 코드만 수정하는 Amazon SageMaker AI SDK v3의 런타임 주입 방식

SageMaker SDK v3가 프레임워크별 클래스를 통합한 ModelTrainer와 ModelBuilder를 공개했다. SourceCode 객체가 로컬 디렉토리를 컨테이너에 실시간 동기화하여 이미지 재빌드 없이 코드 수정이 가능하다. 빈번한 실험으로

DeepOpenAI, 미국 K-12 교사 30만 명에 ChatGPT 무료 제공 및 프라이버시 표준 수립

OpenAI, 미국 K-12 교사 30만 명에 ChatGPT 무료 제공 및 프라이버시 표준 수립

미국 내 30만 명 이상의 교육자에게 ChatGPT for Teachers를 무료로 제공한다. 16개 주 통합 데이터 프라이버시 협약을 통해 개별 협상 없는 표준 도입 경로를 구축했다. 교육기관 관리자는 데이터 학습 제외 설정과 역할 기반 제어 기능을

"통화당 0.01달러 미만, 정확도 100%" Natera가 Bedrock AgentCore로 구현한 음성 에이전트

"통화당 0.01달러 미만, 정확도 100%" Natera가 Bedrock AgentCore로 구현한 음성 에이전트

Natera가 Amazon Bedrock AgentCore를 활용해 환자용 자동 음성 예약 에이전트를 구축했다. 500회 시뮬레이션 결과 도구 호출 정확도 100%, 통화당 비용 0.01달러 미만을 기록했다. 커스텀 벤더 연동이 필수적인 의료 환경에서

DeepNVIDIA NVHBM 공개, 컨트롤러 이동으로 XPU 면적 25% 확보

NVIDIA NVHBM 공개, 컨트롤러 이동으로 XPU 면적 25% 확보

NVIDIA가 메모리 컨트롤러를 HBM 베이스 다이에 통합한 NVHBM을 공개했다. HBM4E 대비 대역폭 30% 증가, 전력 15% 감소, XPU 다이 면적 25%를 확보한다. 커스텀 AI 칩 설계자는 메모리 컨트롤러 배치 변경에 따른 다이 면적 이

아마존 베드락 에이전트코어, 프레임워크 상관없이 AI 에이전트 평가 지원

아마존 베드락 에이전트코어, 프레임워크 상관없이 AI 에이전트 평가 지원

AI 에이전트 프레임워크 종류와 관계없이 통합 평가가 가능한 환경을 구축했다. OpenTelemetry 표준을 통해 LangGraph, LlamaIndex 등 서로 다른 SDK의 트레이스를 단일 기준으로 점수화한다. 실무자는 사용하는 프레임워크의 in

GoDaddy의 Amazon Quick 도입, 리포트 로딩 15분을 5초로 줄인 비결

GoDaddy의 Amazon Quick 도입, 리포트 로딩 15분을 5초로 줄인 비결

GoDaddy가 레거시 BI를 Amazon Quick으로 교체해 대시보드 렌더링 시간을 15분에서 5초 미만으로 단축했다. AWS 네이티브 통합과 서버리스 구조를 통해 연간 15,000시간의 업무 시간을 절감하고 대시보드 수를 50% 최적화했다. 대규