KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 66 pt3. Muse Spark 1.3 (max) 46 pt4. gpt-oss-120b (high) 42 pt5. GPT-5.6 Luna (max) 27 pt

AI 기술 블로그

엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

챗봇용 DPO를 OCR에 적용, 텍스트 반복 오류 최대 87.6% 제거

챗봇용 DPO를 OCR에 적용, 텍스트 반복 오류 최대 87.6% 제거

AI 모델이 특정 단어를 무한 반복하는 '텍스트 퇴행' 현상은 OCR 실무의 고질적 문제다. DharmaOCR은 챗봇 정렬에 쓰이던 DPO 기술을 객관적 정답 추출 작업에 도입했다. SFT로 해결 안 되던 반복 오류를 평균 59.4% 줄이며 상용 수준

끝났다 — 수개월 걸리던 정형 데이터 예측, NEXUS로 며칠 만에

끝났다 — 수개월 걸리던 정형 데이터 예측, NEXUS로 며칠 만에

기업 데이터의 대부분은 엑셀이나 DB 같은 표 형태의 정형 데이터로 존재한다. Fundamental의 대규모 표 모델(LTM) NEXUS가 아마존 세이지메이커 점프스타트에 출시됐다. 수십억 개의 예측 과제로 사전 학습되어 복잡한 피처 엔지니어링 없이

Reachy Mini, MCP 도입으로 '웹 검색·날씨' 원격 도구 확장

Reachy Mini, MCP 도입으로 '웹 검색·날씨' 원격 도구 확장

로봇 하드웨어 제어는 로컬에서, 외부 정보 획득은 원격으로 분리했다. MCP(Model Context Protocol)를 통해 Gradio Space의 도구를 즉시 추가한다. 신뢰 기반의 핵심 코어는 유지하며 외부 기능을 유연하게 교체하는 구조다.

앤스로픽, 1억 달러 투입해 '클로드 전문 파트너' 등급제 도입

앤스로픽, 1억 달러 투입해 '클로드 전문 파트너' 등급제 도입

기업들이 AI 파일럿을 넘어 실제 운영 단계로 진입하고 있다. 앤스로픽은 1억 달러를 투자해 클로드 파트너 네트워크의 서비스 트랙과 파트너 허브를 공개했다. 딜로이트, 액센추어 등 글로벌 컨설팅사와 협력해 대규모 인력 교육과 실전 배포를 가속화한다.

앞뒤 구분 없이 걷는다, 보스턴 다이내믹스 아틀라스의 '대칭형 발' 설계

앞뒤 구분 없이 걷는다, 보스턴 다이내믹스 아틀라스의 '대칭형 발' 설계

휴머노이드 로봇은 인간을 닮아야 하지만 실제 작업 현장에서는 다른 설계가 필요합니다. 보스턴 다이내믹스는 아틀라스의 발을 대칭형으로 만들고 무릎가 뒤로 꺾이게 설계했습니다. 덕분에 로봇이 몸을 돌리지 않고도 앞뒤로 자유롭게 이동하며 충격을 흡수합니다.

엔비디아가 공개한 산업용 AI 엔지니어 설계도 'NemoClaw'

엔비디아가 공개한 산업용 AI 엔지니어 설계도 'NemoClaw'

산업 설계와 시뮬레이션은 여전히 사람이 일일이 설정하고 보고서를 쓰는 수작업 비중이 높습니다. 엔비디아가 GTC 타이베이에서 자율 AI 에이전트 구축 설계도인 NemoClaw를 공개했습니다. 케이던스, 지멘스 등 글로벌 기업들이 이를 통해 수주 걸리던

Deep아마존 Nova 2 Lite, 학습 없는 '프롬프트 기반 객체 탐지' 공개

아마존 Nova 2 Lite, 학습 없는 '프롬프트 기반 객체 탐지' 공개

기존 컴퓨터 비전 솔루션은 데이터 파이프라인과 모델 학습에 막대한 초기 투자가 필요했다. 아마존 Nova 2 Lite는 자연어 프롬프트만으로 객체 좌표를 JSON 형태로 반환하는 제로샷 탐지를 지원한다. 서버리스 아키텍처를 통해 구축 기간을 수개월에서

"18세 미만은 더 엄격하게" OpenAI가 G7에 제안한 청소년 AI 안전망

"18세 미만은 더 엄격하게" OpenAI가 G7에 제안한 청소년 AI 안전망

AI가 교육과 학습의 필수 도구가 되면서 청소년의 안전한 사용 환경 조성이 시급해졌다. OpenAI는 G7 정상회의를 통해 글로벌 기준을 정립할 '국제 청소년 AI 안전 기구' 설립을 제안한다. 연령 예측 시스템과 강화된 가드레일을 통해 18세 미만

단순 저장소는 끝났다 — AI 시대의 데이터베이스 도구 10선

단순 저장소는 끝났다 — AI 시대의 데이터베이스 도구 10선

데이터베이스가 단순한 기록 저장소를 넘어 실시간 분석과 AI 메모리 역할로 진화하고 있다. ClickHouse부터 OpenViking까지, 목적별로 특화된 10가지 오픈소스 도구가 공개됐다. 서비스 규모와 목적에 맞는 DB 스택을 선택해 쿼리 속도와

전문성 키우다 바보 되는 AI 막는다, 아마존 노바 포지의 최적화 기술

전문성 키우다 바보 되는 AI 막는다, 아마존 노바 포지의 최적화 기술

기업 전용 데이터로 LLM을 학습시키면 기존의 추론 능력이 망가지는 경우가 많다. 아마존 노바 포지(Amazon Nova Forge)는 데이터 믹싱과 체크포인트 선택으로 이 문제를 해결한다. CPT, SFT, RFT로 이어지는 3단계 파이프라인을 통해

토큰 비용 10배 절감 — 엔비디아·MS, 윈도우부터 클라우드까지 에이전트 풀스택 공개

토큰 비용 10배 절감 — 엔비디아·MS, 윈도우부터 클라우드까지 에이전트 풀스택 공개

AI 에이전트의 실질적 구현은 모델 성능을 넘어 하드웨어와 런타임의 통합 최적화에 달려 있다. 엔비디아와 MS는 윈도우 PC, 애저 클라우드, 로컬 환경을 아우르는 에이전트 전용 통합 스택을 구축했다. 베라 루빈 플랫폼과 GB300 칩셋을 통해 추론

6.8초에서 3.3초로, 로컬 추론 최적화한 Holo3.1 공개

6.8초에서 3.3초로, 로컬 추론 최적화한 Holo3.1 공개

컴퓨터 사용 에이전트가 웹과 데스크톱을 넘어 모바일 환경으로 확장되고 있다. Holo3.1은 Qwen 기반 모델로 0.8B부터 35B-A3B까지 4가지 사이즈를 제공한다. NVFP4 양자화를 통해 로컬 추론 속도를 2배 높이고 모바일 작업 성공률을 최

코딩 도구의 경계를 허물다, 전 직군으로 확장하는 Codex

코딩 도구의 경계를 허물다, 전 직군으로 확장하는 Codex

Codex를 개발자 전용 코딩 보조 도구로 인식하는 경우가 많다. OpenAI는 역할별 플러그인과 인터랙티브 웹사이트 생성 기능인 '사이트'를 통해 전 직군으로 사용 범위를 넓혔다. 비개발자 사용자 층이 개발자보다 3배 빠르게 성장하며 단순 코드 작성

취약점 1만 건 찾아낸 Claude Mythos, 전 세계 핵심 인프라 보안으로 확장

취약점 1만 건 찾아낸 Claude Mythos, 전 세계 핵심 인프라 보안으로 확장

AI가 코드를 생성하는 속도만큼 보안 취약점 발견과 패치 속도를 높이는 경쟁이 시작됐다. 앤스로픽의 '클로드 미토스 프리뷰'가 초기 파트너사에서 1만 개 이상의 치명적 결함을 찾아냈다. 150개 기관으로 협력을 확대하고 650억 달러 투자 유치와 함께

정치후원금 0원, AI 거버넌스 주도권 내려놓은 OpenAI

정치후원금 0원, AI 거버넌스 주도권 내려놓은 OpenAI

AI 기술의 영향력이 커지면서 누가 이를 통제하고 규제할 것인지에 대한 논의가 치열합니다. OpenAI는 기업 차원의 정치활동위원회(PAC) 운영이나 후보자 기부를 하지 않는다는 원칙을 밝혔습니다. 특정 정치 집단이 회사를 대변하지 않으며, 투명한 규

기업용 AI 에이전트 보안의 핵심, Bedrock AgentCore Gateway의 MCP 인증 구현

기업용 AI 에이전트 보안의 핵심, Bedrock AgentCore Gateway의 MCP 인증 구현

AI 코딩 어시스턴트가 기업 내부 도구에 접근할 때 신원 검증을 위한 보안 체계가 필수적이다. Amazon Bedrock AgentCore Gateway가 OAuth 2.0 인증 코드를 통해 사용자 신원을 검증하는 중앙 관문 역할을 수행한다. IdP와

Deep마침내 뚫린 기업용 AI 장벽, OpenAI 모델 AWS 공식 상륙

마침내 뚫린 기업용 AI 장벽, OpenAI 모델 AWS 공식 상륙

기업들이 AI를 도입할 때 가장 고민하는 것은 보안과 관리 체계다. OpenAI의 최신 모델과 코딩 모델 Codex가 AWS의 Amazon Bedrock을 통해 정식 출시됐다. 기존 AWS 보안 및 결제 시스템을 그대로 쓰며 최신 AI를 바로 실무에

DeepAWS Bedrock에 상륙한 GPT-5.5와 코딩 에이전트 Codex

AWS Bedrock에 상륙한 GPT-5.5와 코딩 에이전트 Codex

OpenAI의 최신 모델들이 AWS의 AI 플랫폼인 Bedrock에서 정식 서비스된다. GPT-5.5와 5.4, 코딩 전문 에이전트 Codex를 기존 AWS 보안 환경 그대로 사용할 수 있다. OpenAI 직접 이용과 동일한 토큰 비용으로 고성능 추론

Deep엔비디아, 로봇 두뇌 '코스모스 3' 공개…피지컬 AI 판도 바꾼다

엔비디아, 로봇 두뇌 '코스모스 3' 공개…피지컬 AI 판도 바꾼다

엔비디아가 물리 세계를 이해하고 행동하는 AI 모델 '코스모스 3'를 발표했습니다. 텍스트부터 로봇의 동작까지 통합 처리해 학습 기간을 수개월에서 수일로 줄였습니다. 삼성, LG전자 등 국내 기업들도 이미 이 플랫폼을 활용해 산업용 AI 개발에 나

DeepNVIDIA, 엣지 AI의 물리적 구현을 위한 JetPack 7.2 공개

NVIDIA, 엣지 AI의 물리적 구현을 위한 JetPack 7.2 공개

NVIDIA가 엣지 디바이스용 AI 프레임워크인 JetPack 7.2와 NemoClaw를 발표했다. 서버 중심이던 에이전트 AI를 로봇과 산업 현장 등 물리적 영역으로 확장한다. 메모리 최적화와 실시간 추론 성능을 강화해 실제 생산 환경 도입을 앞

데이터 통합에만 몇 주? 아마존 퀵 리서치가 바꾼 연구 워크플로우

데이터 통합에만 몇 주? 아마존 퀵 리서치가 바꾼 연구 워크플로우

희귀 질환 연구는 파편화된 데이터 통합에만 수주가 소요되는 고질적인 문제가 있다. 아마존 퀵 리서치(AWS의 AI 기반 연구 자동화 도구)는 LLM 에이전트로 데이터 수집부터 보고서 작성까지 자동화한다. 최대 1만 개의 파일을 색인하는 '스페이스' 기

코드·텍스트 추론 속도 2배 높인 젯브레인즈의 Mellum2

코드·텍스트 추론 속도 2배 높인 젯브레인즈의 Mellum2

AI 시스템이 거대 모델 하나보다 여러 전문 모델의 조합으로 진화하고 있다. 젯브레인즈(JetBrains)가 저지연 코드·텍스트 작업에 최적화된 12B MoE 모델 Mellum2를 공개했다. 유사 규모 모델 대비 2배 빠른 추론 속도로 라우팅과 에이전

OpenAI, 미시간에 1GW급 데이터센터 'The Barn' 착공

OpenAI, 미시간에 1GW급 데이터센터 'The Barn' 착공

AI 모델 성능 고도화를 위해서는 막대한 컴퓨팅 자원과 전력 인프라 확보가 필수적이다. OpenAI가 미시간주 샐린에 1GW 규모의 데이터센터 캠퍼스 'The Barn'을 구축한다. 이는 'Stargate' 프로그램의 일환으로 인프라 수직 계열화를 통

"20분 로딩을 몇 초로"… AWS, LLM 콜드 스타트 잡는 CPU 바이패스 공개

"20분 로딩을 몇 초로"… AWS, LLM 콜드 스타트 잡는 CPU 바이패스 공개

거대 모델의 크기가 커지며 GPU 메모리에 가중치를 올리는 로딩 시간이 전체 추론 속도의 병목이 되고 있다. AWS(Amazon Web Services)는 FSx for Lustre와 NVIDIA GPUDirect Storage를 결합해 CPU를 거치

Mimesis, 수학적 모델 결합해 '현실적인' IoT 시계열 데이터 생성

Mimesis, 수학적 모델 결합해 '현실적인' IoT 시계열 데이터 생성

IoT 데이터 수집은 비용과 시간이 많이 들어 실험 환경 구축이 어렵다. 오픈소스 도구 Mimesis와 NumPy를 결합해 1년치 온도 데이터를 생성했다. 단순 무작위 값이 아닌 계절성 곡선과 네트워크 지연시간까지 재현했다.

AI 인프라 생산 공정에 AI를 심은 엔비디아와 대만 제조 연합

AI 인프라 생산 공정에 AI를 심은 엔비디아와 대만 제조 연합

전 세계 AI 데이터센터의 핵심인 하드웨어 공급망이 대만에 집중되어 있다. 엔비디아는 500개 이상의 대만 파트너사와 베라 루빈(Vera Rubin) 인프라 양산에 돌입했다. 제조사들은 AI 에이전트와 디지털 트윈을 도입해 AI 서버 생산 효율을 극대

엔비디아, 공장 전체를 관리하는 AI 뇌 'FOX 블루프린트' 공개

엔비디아, 공장 전체를 관리하는 AI 뇌 'FOX 블루프린트' 공개

제조 현장의 개별 자동화를 넘어 공장 전체를 조율하는 지능형 시스템이 필요해졌다. 엔비디아가 자율 공장 관리 에이전트 구축을 위한 레퍼런스 디자인인 'FOX 블루프린트'를 발표했다. 폭스콘과 페가트론 등 대만 주요 제조사가 이를 도입해 생산성과 에너지

Deep토큰 단가 낮추는 'AI 팩토리', 엔비디아 클라우드 생태계 6대륙 확장

토큰 단가 낮추는 'AI 팩토리', 엔비디아 클라우드 생태계 6대륙 확장

AI 모델 개발의 중심이 학습에서 고성능 추론과 에이전트 실행으로 이동하고 있다. 엔비디아가 인프라 설계부터 소프트웨어까지 통합한 AI 클라우드 생태계를 6대륙으로 넓혔다. 코어위브, 네이버클라우드 등 파트너사가 토큰당 비용 최적화와 액체 냉각 인프라

내 PC가 동료가 된다... 엔비디아, 1페타플롭 AI PC 'RTX Spark' 공개

내 PC가 동료가 된다... 엔비디아, 1페타플롭 AI PC 'RTX Spark' 공개

개인용 AI 에이전트가 클라우드를 벗어나 로컬 디바이스로 이동한다. 엔비디아가 1페타플롭 연산력과 128GB 통합 메모리를 갖춘 RTX Spark를 발표했다. 마이크로소프트와 보안 체계를 구축하고 어도비 앱의 AI 속도를 2배 높였다.

영상 생성과 로봇 제어를 하나로, 엔비디아 Cosmos 3 공개

영상 생성과 로봇 제어를 하나로, 엔비디아 Cosmos 3 공개

물리적 세계를 이해하고 행동하는 AI를 위한 통합 모델이 등장했다. 엔비디아 Cosmos 3는 영상 생성과 추론, 로봇 제어를 모델 하나로 처리한다. MoT 구조를 통해 텍스트, 영상, 행동 데이터를 동시에 다루는 것이 핵심이다.