KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Muse Spark 1.3 (max) 46 pt3. gpt-oss-120b (high) 41 pt4. GPT-5.6 Luna (max) 26 pt5. GPT-5.6 Terra (max) 23 pt

AI 기술 블로그

엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

"수조 개 입자 추적" — 블랙홀 시뮬레이션 한계 뚫은 Codex 활용법

"수조 개 입자 추적" — 블랙홀 시뮬레이션 한계 뚫은 Codex 활용법

블랙홀 주변 플라즈마 시뮬레이션은 입자의 미세한 회전 경로를 모두 계산해야 하는 연산 부하가 컸다. 애리조나 대학의 치콴 찬 연구원은 Codex를 활용해 입자 궤적 추적 방식을 최적화하는 수학적 알고리즘 후보군을 빠르게 도출했다. AI가 제안한 수치

칩 설계 몰라도 Trainium 성능 끝까지 뽑아내는 AI 에이전트

칩 설계 몰라도 Trainium 성능 끝까지 뽑아내는 AI 에이전트

AI 모델이 커질수록 하드웨어 성능을 한계까지 쓰는 최적화 작업이 필수적이다. AWS가 Trainium과 Inferentia 전용 커널 개발을 돕는 'Neuron Agentic Development'를 공개했다. 코딩 에이전트가 NKI 커널 작성부터

"토큰 하나씩 안 쓴다" 구글이 공개한 4배 빠른 DiffusionGemma

"토큰 하나씩 안 쓴다" 구글이 공개한 4배 빠른 DiffusionGemma

LLM은 보통 단어를 하나씩 순차적으로 생성하며 속도 한계를 보입니다. 구글이 공개한 DiffusionGemma는 텍스트 블록 전체를 한 번에 찍어내 속도를 4배 높였습니다. 26B MoE 구조와 Apache 2.0 라이선스로 로컬 환경의 실시간 인터

개월 단위 로봇 학습을 시간 단위로, 엔비디아 Isaac Lab과 SageMaker AI의 결합

개월 단위 로봇 학습을 시간 단위로, 엔비디아 Isaac Lab과 SageMaker AI의 결합

물리 AI가 연구실을 넘어 실제 생산 현장으로 이동하며 고정밀 시뮬레이션의 중요성이 커졌다. 엔비디아 Isaac Lab과 아마존 SageMaker AI를 통해 Unitree H1 휴머노이드의 강화학습을 가속한다. 인프라 관리 부담을 없앤 하이퍼포드(H

토큰 1,000개/초 돌파, 엔비디아가 가속한 DiffusionGemma

토큰 1,000개/초 돌파, 엔비디아가 가속한 DiffusionGemma

대부분의 LLM은 한 단어씩 생성하는 순차적 방식으로 속도가 제한적이다. 구글 딥마인드의 DiffusionGemma는 텍스트 블록을 병렬로 생성해 지연 시간을 줄였다. 엔비디아 최적화 결과 H100 기준 초당 1,000토큰의 생성 속도를 구현했다.

"6개월 작업을 2주 만에" — LSEG, OpenAI로 금융 데이터 워크플로우 혁신

"6개월 작업을 2주 만에" — LSEG, OpenAI로 금융 데이터 워크플로우 혁신

글로벌 금융 인프라 기업 LSEG가 OpenAI 모델을 전사적으로 도입했다. 제품 출시 주기를 6개월에서 2주로 단축하며 리서치와 개발 속도를 높였다. Model Context Protocol을 통해 신뢰할 수 있는 금융 데이터와 AI를 결합했다.

코히어가 공개한 30B 코딩 모델 North Mini Code, 거대 모델 성능 추월

코히어가 공개한 30B 코딩 모델 North Mini Code, 거대 모델 성능 추월

코히어가 개발자 전용 첫 모델인 North Mini Code를 공개했다. 30B 파라미터 MoE 구조로 에이전트 기반 소프트웨어 엔지니어링에 최적화했다. 120B급 거대 모델을 제치고 코딩 벤치마크 상위권에 진입했다.

DeepKAIST, 영상 몇 개로 로봇 판단력 학습시키는 기술 개발

KAIST, 영상 몇 개로 로봇 판단력 학습시키는 기술 개발

KAIST 연구팀이 수천 건의 평가 데이터 없이 영상 몇 개만으로 AI가 인간의 선호를 학습하는 VOTP 기술을 공개했다. ICML 2026에서 상위 0.7% 구두 발표로 채택됐으며, 로봇·자율주행의 학습 비용을 획기적으로 줄일 수 있다. 피지컬 AI

Deep장애 대응 10분 단축, Amazon Quick으로 구현하는 자동 트리아지 에이전트

장애 대응 10분 단축, Amazon Quick으로 구현하는 자동 트리아지 에이전트

Amazon Quick과 New Relic을 연동해 장애 조사부터 보고서 작성까지 자동화합니다. 단 하나의 프롬프트로 근본 원인 분석(RCA)을 생성하고 Asana 티켓까지 생성합니다. 수동 데이터 수집 과정을 제거하여 온콜 엔지니어의 업무 부담을

구글, 톤·억양 유지하는 '제미나이 3.5 라이브 번역' 공개

구글, 톤·억양 유지하는 '제미나이 3.5 라이브 번역' 공개

실시간 음성 번역은 그동안 화자가 말을 끝낼 때까지 기다려야 하는 정적이 불가피했다. 구글이 70개 이상의 언어를 지원하며 화자의 톤과 속도를 그대로 유지하는 제미나이 3.5 라이브 번역을 출시했다. API 공개를 통해 외부 앱 구축이 가능하며 구글

개발 속도가 너무 빨라 전략이 병목이 된 Nextdoor의 Codex 활용법

개발 속도가 너무 빨라 전략이 병목이 된 Nextdoor의 Codex 활용법

AI 코딩 도구는 이제 단순한 코드 작성을 넘어 제품 전체를 설계하는 단계로 진입했다. Nextdoor는 Codex와 GPT-5.5를 도입해 3개 팀이 협업하던 기능을 엔지니어 한 명이 끝까지 구현한다. 기술적 구현보다 '무엇을 만들 것인가'라는 전략

젠슨 황이 주목한 피지컬 AI, 씨메스로보틱스가 구현한 풀스택 전략

젠슨 황이 주목한 피지컬 AI, 씨메스로보틱스가 구현한 풀스택 전략

AI가 화면 속 데이터를 넘어 실제 물리 세계에서 움직이는 '피지컬 AI' 시대가 열리고 있다. 씨메스로보틱스는 엔비디아의 B200, H100 GPU와 아이작 심(Isaac Sim)을 활용해 로봇 자동화 솔루션을 구축했다. 트리톤 인퍼런스 서버와 젯슨

Deep2개월 분량 코딩을 하루 만에—앤스로픽, 클로드 Fable 5 공개

2개월 분량 코딩을 하루 만에—앤스로픽, 클로드 Fable 5 공개

앤스로픽이 미토스급 성능을 일반 공개한 Claude Fable 5를 출시, SWE-bench Pro에서 GPT-5.5(58.6%)를 압도하는 80.3%를 기록했다. 스트라이프는 5,000만 줄 루비 코드 마이그레이션을 단 하루 만에 완료, 수작업 팀

DeepSDK 설치 없이 3D 갤러리 완성, 허깅페이스 'agents.md'가 바꾼 개발 문법

SDK 설치 없이 3D 갤러리 완성, 허깅페이스 'agents.md'가 바꾼 개발 문법

AI 에이전트가 이미지 생성부터 3D 복원, 웹 배포까지 전 과정을 스스로 수행했다. 허깅페이스 Spaces의 'agents.md'가 모델 호출 규격을 표준화해 에이전트의 조립 능력을 극대화했다. 별도 라이브러리 없이 모델들을 체이닝하여 복잡한 멀티미

"돌연변이보다 세포 상태" — MS가 암 치료 정밀도를 높이는 법

"돌연변이보다 세포 상태" — MS가 암 치료 정밀도를 높이는 법

암 치료는 그동안 세포 내 돌연변이 분석을 통해 약물을 매칭해 왔다. 마이크로소프트는 돌연변이가 같아도 반응이 다른 이유가 '세포 상태'에 있음을 밝혔다. Nature Methods에 발표된 이번 연구는 데이터 양보다 행동 다양성이 AI 성능을 결정함

제미나이 모델 입힌 유럽 로봇 15곳, 구글 딥마인드가 키운다

제미나이 모델 입힌 유럽 로봇 15곳, 구글 딥마인드가 키운다

AI가 디지털 세상을 넘어 물리적 세계로 확장되고 있다. 구글 딥마인드가 유럽의 초기 단계 로봇 스타트업 15곳을 선정해 3개월간 육성한다. 선정 기업은 제미나이(Gemini) 로봇 모델과 구글의 AI 스택을 활용해 상용화를 가속한다.

Deep자바스크립트 없이 웹을 완성하는 10가지 파이썬 프레임워크

자바스크립트 없이 웹을 완성하는 10가지 파이썬 프레임워크

파이썬은 데이터 분석을 넘어 웹 애플리케이션 개발의 핵심 도구로 자리 잡았다. 프론트엔드 지식 없이도 API부터 대시보드까지 구현 가능한 라이브러리가 늘고 있다. 실무 목적에 따라 최적화된 10가지 파이썬 기반 웹 프레임워크를 정리했다.

프롬프트 복붙 끝내는 앤스로픽의 '클로드 스킬' 공개

프롬프트 복붙 끝내는 앤스로픽의 '클로드 스킬' 공개

매번 새로운 채팅창에 스타일 가이드와 도메인 지식을 다시 입력해야 하는 번거로움이 있었다. 앤스로픽은 특정 작업 시 지침을 자동 로드하는 폴더 기반 시스템 '클로드 스킬'을 출시했다. 공식 저장소는 14만 개 이상의 별을 기록하며 AI 워크플로우 자산

"권한 오류 끝났다" — 아마존 퀵, ARN 체계로 마이그레이션 가속

"권한 오류 끝났다" — 아마존 퀵, ARN 체계로 마이그레이션 가속

AWS 계정 간 대시보드 이동 시 권한 설정이 초기화되는 고질적 문제가 있었다. 아마존 퀵은 ARN 구조 최적화와 에셋 번들 API로 리소스 참조를 자동 업데이트한다. 네임스페이스 기반 식별 체계를 통해 SaaS 기업의 멀티테넌트 격리 구현이 쉬워진다

데이터 복호화 없이 AI 추론 완료, AWS SageMaker의 동형암호(FHE) 적용

데이터 복호화 없이 AI 추론 완료, AWS SageMaker의 동형암호(FHE) 적용

클라우드 AI 추론 시 민감 데이터의 복호화 과정에서 발생하는 보안 리스크가 상존한다. Amazon Web Services(AWS)는 concrete-ml 라이브러리를 통해 데이터가 암호화된 상태로 연산되는 동형암호(FHE) 추론을 SageMaker

Deep규제는 지키고 속도는 높였다, AWS Bedrock '교차 리전 추론' 도입

규제는 지키고 속도는 높였다, AWS Bedrock '교차 리전 추론' 도입

AI 모델을 쓸 때 특정 지역 서버가 꽉 차면 응답이 느려지거나 끊깁니다. AWS Bedrock이 여러 지역의 자원을 자동 분배하는 '교차 리전 추론(CRIS)'을 제공합니다. 특히 EU 전용 프로필을 통해 데이터 규정을 준수하며 최적의 성능을 낼 수

"아마존 물류비 수천만 달러 절감" 예측 AI를 결정 AI로 바꾼 수학적 최적화

"아마존 물류비 수천만 달러 절감" 예측 AI를 결정 AI로 바꾼 수학적 최적화

기업의 복잡한 운영 결정은 직관이나 단순 규칙만으로 최적해를 찾기 어렵다. AWS는 확률적 예측을 넘어 수학적 확신을 주는 '연역적 AI'인 수학적 최적화를 제시한다. BMW 로봇 사이클 타임 10% 개선, 딜리버리히어로 물류비 24% 절감 등 실질적

2028년까지 AI가 연구하는 시대, OpenAI가 선언한 '개인용 AGI' 보급 계획

2028년까지 AI가 연구하는 시대, OpenAI가 선언한 '개인용 AGI' 보급 계획

AI를 전기와 같은 보편적 인프라로 전환해 모든 개인에게 보급한다. OpenAI는 연구-제품 단계를 넘어 AI의 풍요와 저렴한 보급을 뜻하는 '3단계'에 진입한다. 2028년 3월까지 내부 연구의 상당 부분을 AI 시스템이 직접 수행하는 체계를 구축한

마이크 없이 끝내는 음성 AI 검증 — 아마존 노바 소닉 테스트 하네스 공개

마이크 없이 끝내는 음성 AI 검증 — 아마존 노바 소닉 테스트 하네스 공개

음성 AI 에이전트의 성능을 확인하려면 사람이 직접 말하고 들어야 하는 수동 테스트의 한계가 있었다. 아마존이 노바 소닉(Nova Sonic)을 위해 마이크 없이 대화를 자동 수행하고 평가하는 오픈소스 프레임워크를 공개했다. LLM 판정 모델을 통해

OpenAI, AI 경제 영향 검증 위해 외부 연구 플랫폼 '리서치 익스체인지' 공개

OpenAI, AI 경제 영향 검증 위해 외부 연구 플랫폼 '리서치 익스체인지' 공개

AI가 노동 시장과 기업 운영 방식을 빠르게 바꾸고 있다. OpenAI가 외부 연구자와 협력해 AI의 경제적 효과를 분석하는 '리서치 익스체인지'를 출시했다. 선정된 연구자는 OpenAI의 도구와 데이터를 활용해 독립적인 실증 증거를 도출한다.

노트북 닫아도 멈추지 않는 코딩 에이전트, 아마존 베드락 에이전트코어 공개

노트북 닫아도 멈추지 않는 코딩 에이전트, 아마존 베드락 에이전트코어 공개

코딩 에이전트를 로컬 노트북에서 실행하며 겪던 전원 및 환경 제약 문제를 해결한다. 아마존 베드락 에이전트코어는 격리된 microVM과 영구 워크스페이스를 제공하는 전용 런타임이다. 모델에 상관없이 MCP 엔드포인트를 통해 도구 연결과 기업급 보안,

파편화된 AI 에이전트 환경 하나로 묶는 OpenEnv, 허깅페이스 중심 표준화 착수

파편화된 AI 에이전트 환경 하나로 묶는 OpenEnv, 허깅페이스 중심 표준화 착수

AI 에이전트가 터미널이나 브라우저 같은 환경에서 학습하고 작동하는 방식이 제각각이다. 허깅페이스와 엔비디아 등이 참여한 OpenEnv가 이를 표준화하는 인터페이스 계층으로 진화한다. 이제 모델과 환경을 따로 개발해도 공통 소켓처럼 연결해 효율적인 에

학습 너머의 엔지니어링 — AI 실무자를 위한 파이썬 표준 5가지

학습 너머의 엔지니어링 — AI 실무자를 위한 파이썬 표준 5가지

AI 엔지니어의 역할이 모델 학습 중심의 데이터 사이언스와 완전히 분리됐다. PyTorch의 Autograd부터 ONNX 직렬화까지 프로덕션 수준의 구현 능력이 필수다. 보안과 확장성을 확보하는 파이썬 설계 표준이 AI 서비스의 안정성을 결정한다.

영국, NVIDIA와 '소버린 AI' 가속... GH200 5,400개 기반 인프라 구축

영국, NVIDIA와 '소버린 AI' 가속... GH200 5,400개 기반 인프라 구축

영국 정부와 NVIDIA가 국가 주도의 '소버린 AI' 전략을 구체화했다. 5,400개의 GH200 칩을 탑재한 Isambard-AI를 중심으로 인프라를 확장한다. 추론 비용 90% 절감 및 학습 속도 3배 향상 등 실질적 성능 지표를 확보했다.

로봇부터 데이터센터까지, 엔비디아-LG가 구축하는 '물리적 AI' 공장

로봇부터 데이터센터까지, 엔비디아-LG가 구축하는 '물리적 AI' 공장

LG그룹과 엔비디아가 로봇, 자율주행, 인프라를 통합한 AI 팩토리를 건설한다. NVIDIA Isaac과 DRIVE 플랫폼을 통해 물리적 AI의 학습과 배포 워크플로우를 통합한다. 액체 냉각과 800V 전력 솔루션을 도입해 차세대 GPU 인프라 표준을