KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Muse Spark 1.3 (max) 46 pt3. gpt-oss-120b (high) 41 pt4. GPT-5.6 Luna (max) 26 pt5. GPT-5.6 Terra (max) 23 pt

AI 기술 블로그

엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

로봇부터 전력망까지, 엔비디아-두산이 설계하는 '물리적 AI' 공장

로봇부터 전력망까지, 엔비디아-두산이 설계하는 '물리적 AI' 공장

AI의 영역이 화면 속 소프트웨어를 넘어 물리적 제조와 인프라로 확장되고 있다. 엔비디아와 두산그룹이 로봇, 건설기계, 에너지, 전자소재를 아우르는 물리적 AI 협력을 체결했다. 에이전틱 로봇 OS부터 SMR 전력 공급, AI 서버용 CCL 소재까지

AI 자동화 신화, 실체는 '분절된 저임금 인간 노동'

AI 자동화 신화, 실체는 '분절된 저임금 인간 노동'

AI가 인간의 일자리를 완전히 대체할 것이라는 공포가 확산하고 있다. 안토니오 카실리는 자동화가 노동의 소멸이 아닌 '가시성 제거'라고 분석한다. AI 시스템의 작동 기반은 데이터 라벨링과 마이크로 노동 같은 숨겨진 인간 노동이다.

3억 달러에 확보한 '달 배송망' — 보이저, 애스트로보틱 인수

3억 달러에 확보한 '달 배송망' — 보이저, 애스트로보틱 인수

민간 기업의 달 화물 운송과 인프라 구축 경쟁이 가속화되고 있다. 보이저 테크놀로지스가 애스트로보틱을 3억 달러에 인수하는 계약을 체결했다. 착륙선과 전력망을 통합해 2028년 미국 달 영구기지 건설을 지원한다.

"바다의 F-150" 태양광 자율보트로 데이터 장벽 허문 온라인 오션스

"바다의 F-150" 태양광 자율보트로 데이터 장벽 허문 온라인 오션스

지구 표면의 3분의 2가 바다지만 정작 수집 가능한 데이터는 턱없이 부족하다. 영국 온라인 오션스가 태양광 자율운항 선박 '스카우트'와 관제 소프트웨어 '테더'를 출시했다. 모듈형 설계를 통해 센서 교체가 가능하며, 현재 생산 능력이 수요를 못 따라가

마침내 인정받은 실전 AI, 중국 '차페크상' 휩쓴 한국 로봇 3사

마침내 인정받은 실전 AI, 중국 '차페크상' 휩쓴 한국 로봇 3사

로봇 분야의 권위 있는 '차페크상' 시상식이 중국 우후시에서 개최되었다. 브릴스, 뉴로메카, 티로보틱스가 SI, 휴머노이드, AMR 분야에서 각각 수상했다. 휴머노이드 별도 평가 도입과 VLA 기반 지능화 등 실전 AI 기술력이 핵심이었다.

Claude Code의 '블랙박스' 캔다 — 분석 도구 Her 공개

Claude Code의 '블랙박스' 캔다 — 분석 도구 Her 공개

Claude Code는 모든 작업 과정을 .jsonl 파일로 기록하지만 사람이 읽기엔 너무 방대하다. 분석 도구 Her는 이 로그를 읽어 위험 동작을 탐지하고 토큰 사용처를 요약 보고서로 제공한다. Nemotron-Mini-4B-Instruct 모델을

얇아진 폼팩터에 담은 AI 에이전트, 엔비디아 'RTX Spark' 공개

얇아진 폼팩터에 담은 AI 에이전트, 엔비디아 'RTX Spark' 공개

엔비디아가 개인용 AI 에이전트 시대를 위한 슈퍼칩 'RTX Spark'를 공개했다. 슬림 노트북과 소형 데스크톱에서도 1440p 해상도와 100 FPS 이상의 성능을 지원한다. DLSS 4.5와 NVIDIA ACE를 통해 고품질 렌더링과 지능형 AI

Deep모델 4종 섞어 만든 금융 시뮬레이션—소형 모델 멀티 에이전트의 실전 설계법

모델 4종 섞어 만든 금융 시뮬레이션—소형 모델 멀티 에이전트의 실전 설계법

멀티 에이전트 시스템은 보통 하나의 거대 모델에 여러 프롬프트를 입혀 구현한다. Thousand Token Wood v2는 OpenAI, NVIDIA 등 4개 랩의 소형 모델을 각 에이전트에 배치했다. JSON 복구 레이어와 데이터 흐름 기반 보안으로

DeepSeek V4 Pro의 추론력을 Qwen3-8B에 이식한 구직 AI 'Job Searcher'

DeepSeek V4 Pro의 추론력을 Qwen3-8B에 이식한 구직 AI 'Job Searcher'

이력서를 업로드하면 단순 목록이 아닌 구체적인 근거와 함께 최적의 직무를 추천한다. DeepSeek V4 Pro를 교사 모델로, Qwen3-8B를 학생 모델로 활용한 지식 증류 방식을 적용했다. 두 개의 LoRA 어댑터를 분리해 쿼리 생성과 적합성 평

Deep벤치마크 너머 '사고의 궤적'을 데이터화한 Persona Atlas

벤치마크 너머 '사고의 궤적'을 데이터화한 Persona Atlas

AI 모델의 지식 수준을 측정하는 기존 벤치마크의 한계를 넘어서는 시도가 나왔다. Persona Atlas는 웹 검색 기반의 페르소나 구축과 임베딩 분석으로 인물의 사고방식을 시각화한다. Hugging Face의 소형 모델들을 활용해 인물 간의 특성

DeepQwen2.5-3B, 30억 파라미터로 구현한 자율 경제 생태계

Qwen2.5-3B, 30억 파라미터로 구현한 자율 경제 생태계

소형 언어 모델(SLM)을 활용한 멀티에이전트 시스템 구축 시도가 늘고 있다. Qwen2.5-3B 모델 5개를 연결해 자원 희소성과 시장 변동성이 작동하는 가상 경제를 구현했다. 모델 크기보다 정교한 프롬프트와 시스템 설계가 에이전트의 추론 능력을 보

"90% 확신해도 틀린다" LLM 과신 잡는 캘리브레이션 3대 기법

"90% 확신해도 틀린다" LLM 과신 잡는 캘리브레이션 3대 기법

LLM이 출력하는 확신 점수와 실제 정답률이 일치하지 않는 미캘리브레이션 문제가 심각하다. 템퍼러처 스케일링, 플랫 스케일링, 아이소토닉 회귀가 주요 사후 교정 해결책으로 활용된다. RLHF 이후 심화된 과신 문제는 적응형 템퍼러처 스케일링(ATS)으

DeepspaCy 파이프라인 최적화: 텍스트 처리 속도 10배 높이는 3가지 실무 기법

spaCy 파이프라인 최적화: 텍스트 처리 속도 10배 높이는 3가지 실무 기법

기본 설정으로 spaCy를 사용하면 불필요한 연산으로 인해 대규모 데이터 처리 시 병목 현상이 발생한다. 파이프라인 선택적 로드와 병렬 배치 처리, 하이브리드 개체 인식 기법을 적용해 리소스 효율을 극대화한다. 단순 반복문을 파이프라인 스트림 방식

단순 답변 끝났다, 구글 Gemini 3.5가 여는 '실행형 에이전트' 시대

단순 답변 끝났다, 구글 Gemini 3.5가 여는 '실행형 에이전트' 시대

구글이 Gemini 3.5와 Omni 모델을 통해 단순 챗봇을 넘어선 에이전트 생태계를 공개했다. 24시간 백그라운드에서 작동하는 정보 에이전트와 코딩 능력을 검색과 안드로이드 OS에 통합했다. 전용 노트북 '구글북'과 헬스케어 앱, 웨어러블 기기로

보스턴 다이내믹스 아틀라스, '고스트 라보나' 킥으로 입증한 물리 지능

보스턴 다이내믹스 아틀라스, '고스트 라보나' 킥으로 입증한 물리 지능

휴머노이드 로봇의 물리적 한계를 시험하기 위해 축구 훈련을 도입했다. 모션 캡처와 강화학습을 결합해 고난도 '고스트 라보나' 킥을 구현했다. 시뮬레이션에서 24시간 만에 1년 치 학습량을 소화하며 전신 제어 능력을 입증했다.

Meta AI 고객지원 봇의 허점, 인스타그램 계정 탈취로 이어져

Meta AI 고객지원 봇의 허점, 인스타그램 계정 탈취로 이어져

AI 에이전트 도입이 가속화되며 보안 취약점이 실제 피해로 연결되고 있다. 메타의 AI 고객지원 봇이 단순 요청만으로 이메일 변경을 허용해 계정이 탈취됐다. 고도화된 해킹 기술보다 AI의 '과잉 충성'과 가드레일 부재가 핵심 원인으로 분석된다.

하드웨어 제약 없앤 클라우드 스트리밍, GeForce NOW 6월 신작 18종 투입

하드웨어 제약 없앤 클라우드 스트리밍, GeForce NOW 6월 신작 18종 투입

고사양 게임 구동을 위한 하드웨어 업그레이드 비용은 사용자에게 늘 부담이다. NVIDIA의 GeForce NOW(클라우드 게임 서비스)가 6월 한 달간 신작 18종을 추가한다. 다운로드 없이 클라우드 스트리밍만으로 최신 그래픽과 게임 플레이를 즉시 제

엑셀 버리고 앱 짰다 — 엔다바가 정의한 AI 네이티브 워크플로우

엑셀 버리고 앱 짰다 — 엔다바가 정의한 AI 네이티브 워크플로우

글로벌 테크 서비스 기업 엔다바가 전사 11,000명 규모에 AI 에이전트를 도입했다. OpenAI의 ChatGPT Enterprise와 Codex를 기반으로 AI 네이티브 방법론 'DavaFlow'를 구축했다. 코딩을 넘어 법무, 영업, 경영 관리까

기업 맞춤형 가드레일 구현하는 Nemotron 3.5, 멀티모달 안전망 공개

기업 맞춤형 가드레일 구현하는 Nemotron 3.5, 멀티모달 안전망 공개

AI 서비스 안전성 확보를 위해 텍스트와 이미지를 동시에 검사하는 가드레일 모델이 필수적이다. NVIDIA는 구글 Gemma 3 기반의 Nemotron 3.5 Content Safety를 통해 기업별 맞춤형 정책 적용 기능을 도입했다. 4B 파라미터의

나보다 나를 더 잘 아는 ChatGPT, '드림(Dreaming)' 메모리 아키텍처 공개

나보다 나를 더 잘 아는 ChatGPT, '드림(Dreaming)' 메모리 아키텍처 공개

AI와 대화할 때마다 매번 내 상황을 다시 설명해야 하는 번거로움이 사라집니다. OpenAI가 배경에서 스스로 기억을 정리하는 '드림(Dreaming)' 기반의 새 메모리 시스템을 도입했습니다. 단순 저장 방식을 넘어 대화 맥락을 스스로 합성해 더 정

"토큰 6배 절감" — 허깅페이스, 코딩 에이전트 전용 CLI 공개

"토큰 6배 절감" — 허깅페이스, 코딩 에이전트 전용 CLI 공개

코딩 에이전트가 허깅페이스 허브의 핵심 사용자로 부상했다. hf CLI는 에이전트를 자동 감지해 토큰 최적화된 TSV 형식을 제공한다. SDK 대비 토큰 소모를 최대 6배 줄이고 복잡한 작업의 성공률을 높였다.

추론 5배 빨라진 네모트론 3 울트라, 아마존 세이지메이커 상륙

추론 5배 빨라진 네모트론 3 울트라, 아마존 세이지메이커 상륙

AI 에이전트 구축 시 추론 속도와 비용 최적화가 핵심 과제로 부상했다. 엔비디아가 550B 파라미터 규모의 Nemotron 3 Ultra를 아마존 세이지메이커 점프스타트에 공개했다. 하이브리드 MoE 구조를 통해 추론 속도는 5배 높이고 비용은 최대

Deep법정으로 들어온 챗봇, 나홀로 소송의 풍경을 바꾸다

법정으로 들어온 챗봇, 나홀로 소송의 풍경을 바꾸다

변호사 없이 소송을 진행하는 나홀로 소송인이 급증하고 있습니다. AI가 작성한 서면은 가독성이 높지만, 여전히 승소 확률은 낮습니다. AI의 법률 조언에 대한 비밀 유지와 책임 소재를 두고 법적 논쟁이 치열합니다.

절차적 반복의 종말 — 데이터 사이언스를 재정의하는 '에이전틱 AI'

절차적 반복의 종말 — 데이터 사이언스를 재정의하는 '에이전틱 AI'

단순 응답을 넘어 스스로 계획하고 실행하는 에이전틱 AI 시대가 도래했다. 데이터 수집부터 모델 학습, 보고서 작성까지의 루틴한 파이프라인이 자동화된다. 실무자의 역할은 '어떻게 구현하는가'에서 '결과가 옳은가'를 판단하는 평가 중심으로 이동한다.

사진 한 장으로 가치 측정까지, 구글의 AI 빈티지 쇼핑 도구 공개

사진 한 장으로 가치 측정까지, 구글의 AI 빈티지 쇼핑 도구 공개

빈티지와 중고 쇼핑에 대한 검색 관심도가 역대 최고치를 기록하고 있다. 구글은 AI 모드, 렌즈, 서클 투 서치로 정교한 맞춤형 쇼핑 경험을 제공한다. 가상 시착부터 중고 가치 산정까지 AI가 쇼핑의 전 과정을 디지털화한다.

트랜스포머부터 RAG까지, LLM의 설계도를 그린 5가지 핵심 논문

트랜스포머부터 RAG까지, LLM의 설계도를 그린 5가지 핵심 논문

LLM의 복잡한 구조는 몇 가지 핵심 연구의 단계적 결합으로 이해할 수 있다. 트랜스포머의 셀프 어텐션부터 GPT-3의 인컨텍스트 러닝, RAG의 외부 지식 활용을 다룬다. 모델 규모 확대와 RLHF를 통한 정렬 과정이 상용 AI 서비스로 이어지는 경

르세라핌 MV로 본 제미나이, 모호한 가사 검색부터 서클 투 서치까지

르세라핌 MV로 본 제미나이, 모호한 가사 검색부터 서클 투 서치까지

K-POP 그룹 르세라핌이 안드로이드 및 제미나이와 협업한 캠페인을 공개했다. 가사 일부만으로 곡을 찾아 재생하는 제미나이의 AI 비서 기능이 강조됐다. 화면 속 의상을 바로 찾는 서클 투 서치 등 실생활 밀착형 AI 경험을 구현했다.

자율주행·로봇 개발 병목 뚫는 NVIDIA '물리 AI 에이전트 스킬' 공개

자율주행·로봇 개발 병목 뚫는 NVIDIA '물리 AI 에이전트 스킬' 공개

물리 AI 연구는 데이터 수집과 시뮬레이션, 학습 과정이 파편화되어 개발 속도가 느렸다. NVIDIA는 Cosmos 3 모델과 '에이전트 스킬'을 통해 전체 워크플로우 자동화를 구현했다. 320억 파라미터의 Alpamayo 2 Super 모델과 Isa

1년 분량 개발을 2주 만에, Wasmer가 Codex로 구현한 엣지 Node.js

1년 분량 개발을 2주 만에, Wasmer가 Codex로 구현한 엣지 Node.js

엣지 컴퓨팅 플랫폼 Wasmer가 Node.js 런타임을 엣지 계층에 구현했다. Codex와 GPT-5.5를 활용해 1년 예상 개발 기간을 2주로 단축했다. WebAssembly 샌드박스를 통해 도커 없이 JS 앱과 에이전트를 실행한다.

DeepOpenAI, 신약 개발·유전체 분석 특화한 GPT-Rosalind 업데이트 공개

OpenAI, 신약 개발·유전체 분석 특화한 GPT-Rosalind 업데이트 공개

생명과학 연구는 분자부터 생체 시스템까지 서로 다른 층위의 데이터를 합성하는 과정이 필수적이다. GPT-5.5의 에이전트 코딩 능력을 결합한 생명과학 전문 모델 GPT-Rosalind가 업데이트됐다. 전문가 판정 벤치마크 LifeSciBench를 통해