KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 66 pt3. Muse Spark 1.3 (max) 46 pt4. gpt-oss-120b (high) 42 pt5. GPT-5.6 Luna (max) 27 pt

AI 기술 블로그

엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

Deep로보터블, F&B 특화 양팔 휴머노이드 '제스트' 공개

로보터블, F&B 특화 양팔 휴머노이드 '제스트' 공개

로보터블이 2026 NRA 쇼에서 조리 특화 휴머노이드 플랫폼 '제스트'를 선보였다. VLA 모델과 멀티모달 센서를 결합해 실시간 환경 인식 기반의 조리 동작을 구현했다. 실제 주방 데이터 수집 루프를 통해 기존 시뮬레이션의 한계를 극복하는 전략을 취

±0.1mm 정밀 조립까지—엘리트로봇, 휠형 휴머노이드 '센토르 G1' 공개

±0.1mm 정밀 조립까지—엘리트로봇, 휠형 휴머노이드 '센토르 G1' 공개

엘리트로봇이 정밀 제조 특화 휠형 휴머노이드 '센토르 G1'을 발표했다. ±0.1mm 반복 정밀도와 6축 힘 센서로 광모듈 조립 등 초정밀 작업이 가능하다. 전용 임바디드 모델 '위안치 프리모'를 탑재해 자율 이동과 3D 맵핑을 수행한다.

AI 에이전트 보안의 핵심, MCP 인증 플랫폼 선택 가이드

AI 에이전트 보안의 핵심, MCP 인증 플랫폼 선택 가이드

MCP가 산업 표준으로 자리 잡으며 에이전트 보안이 필수 인프라로 부상했다. 워크OS, 스티치, 옥타 등 주요 인증 플랫폼의 MCP 지원 전략을 분석했다. 기업의 기존 환경과 에이전트 확장성에 따른 최적의 솔루션 선택 기준을 제시한다.

DeepWorkOS, 에이전트 등록 표준 'auth.md' 공개

WorkOS, 에이전트 등록 표준 'auth.md' 공개

WorkOS가 AI 에이전트 전용 등록 프로토콜인 auth.md를 발표했다. 마크다운 기반 표준 파일을 통해 에이전트가 스스로 서비스에 등록한다. API 키 공유 방식의 보안 취약점을 해결하고 ID-JAG 기반 검증을 제안한다.

DeepLangfuse, LLM 트레이싱부터 평가까지 통합 파이프라인 구현

Langfuse, LLM 트레이싱부터 평가까지 통합 파이프라인 구현

Langfuse(오픈소스 LLM 엔지니어링 플랫폼) 기반의 관측성 및 평가 파이프라인 구축법을 분석한다. 트레이싱, 프롬프트 관리, 스코어링, 데이터셋 실험을 아우르는 전체 워크플로우를 구현한다. OpenAI API 키 없이도 모의 LLM을 통해 파이

Deep음성 감정까지 읽어내는 엔드투엔드 모델, 스텝오디오 2.5 리얼타임 공개

음성 감정까지 읽어내는 엔드투엔드 모델, 스텝오디오 2.5 리얼타임 공개

상하이 AI 연구소 스텝펀이 실시간 음성 대화 모델인 스텝오디오 2.5 리얼타임을 발표했다. 기존 파이프라인 방식과 달리 음성 입출력을 단일 모델로 통합해 지연 시간을 획기적으로 줄였다. 특히 비언어적 음향 정보를 분석해 화자의 감정과 의도까지 파악하

좌표 찍기 대신 코딩한다, MS Webwright가 끌어올린 웹 에이전트 성능 60.1%

좌표 찍기 대신 코딩한다, MS Webwright가 끌어올린 웹 에이전트 성능 60.1%

마이크로소프트 리서치가 터미널 기반 웹 에이전트 프레임워크 Webwright를 공개했다. 브라우저를 직접 조작하는 대신 자동화 코드를 작성해 실행하는 방식으로 추론 효율을 높였다. Odysseys 벤치마크에서 기존 최고 기록을 35.1% 경신하며 60

NVIDIA, Gated DeltaNet-2 공개... 선형 어텐션의 '삭제-쓰기' 분리

NVIDIA, Gated DeltaNet-2 공개... 선형 어텐션의 '삭제-쓰기' 분리

NVIDIA가 선형 어텐션의 메모리 편집 병목을 해결한 Gated DeltaNet-2를 공개했다. 기존 스칼라 게이트를 채널별 삭제 및 쓰기 게이트로 분리해 정보 손실을 최소화했다. Mamba-3 등 경쟁 모델 대비 롱컨텍스트 리트리벌 성능에서 우위를

토큰 61% 줄이고 성능 높인 텐센트의 '4단계 메모리' 공개

토큰 61% 줄이고 성능 높인 텐센트의 '4단계 메모리' 공개

텐센트가 AI 에이전트의 컨텍스트 비대화 문제를 해결하는 4단계 메모리 시스템을 공개했다. 대화 내용을 피라미드 구조로 압축해 저장하며, 불필요한 로그를 외부 파일로 오프로딩한다. WideSearch 기준 토큰 사용량을 61% 줄이면서도 통과율을 33

Deep마크다운 기반 프롬프트 구조화 레이어 'SuperClaude' 프레임워크 공개

마크다운 기반 프롬프트 구조화 레이어 'SuperClaude' 프레임워크 공개

Anthropic API 위에 마크다운 기반의 커맨드와 에이전트를 결합한 SuperClaude 프레임워크가 공개되었다. 파이썬 브리지를 통해 시스템 프롬프트를 동적으로 구성하며 세션 저장 및 로드 기능을 지원한다. 단순 챗봇을 넘어 코딩, 보안 분석,

Deep모델 가중치 수정 없이 거부 반응 제어하는 CNA 기법 공개

모델 가중치 수정 없이 거부 반응 제어하는 CNA 기법 공개

Nous Research가 특정 MLP 뉴런을 식별해 모델의 거부 반응을 조절하는 CNA를 발표했다. SAE 학습이나 가중치 수정 없이 뉴런 활성화 차이만으로 모델의 행동을 정밀하게 제어한다. Llama와 Qwen 모델에서 거부율을 50% 이상 낮추면

Deep재난 현장 투입된 현대차 무인소방로봇, 붕괴 건물 진입 성공

재난 현장 투입된 현대차 무인소방로봇, 붕괴 건물 진입 성공

현대차그룹이 2026 안전한국훈련에서 무인소방로봇을 실전 투입했다. 지진으로 인한 건물 붕괴 상황에서 로봇이 진입해 화재 진압을 수행했다. 민관 협력을 통해 재난 대응 역량을 강화하겠다는 의지를 밝혔다.

Deep가리 탄, AI 에이전트 기억력 높이는 오픈소스 메모리 'GBrain' 공개

가리 탄, AI 에이전트 기억력 높이는 오픈소스 메모리 'GBrain' 공개

Y Combinator의 가리 탄이 지식 그래프 기반 메모리 레이어 GBrain을 공개했다. 마크다운과 PGLite를 결합해 검색 정밀도를 기존 대비 31.4%p 끌어올렸다. MCP를 통해 클로드 코드 등 주요 AI 에이전트 도구와 즉시 연동 가능하다

DeepPerplexity, 개발자 PC 공급망 스캐너 'Bumblebee' 오픈소스 공개

Perplexity, 개발자 PC 공급망 스캐너 'Bumblebee' 오픈소스 공개

Perplexity가 개발자 로컬 환경의 패키지와 AI 설정을 점검하는 Bumblebee를 공개했다. 빌드 결과물이 아닌 로컬 파일 시스템의 메타데이터를 읽어 취약점을 빠르게 찾아낸다. Go 언어로 작성되어 의존성이 없으며, 설치 스크립트를 실행하지

Deep구글, '특수 목적 AI' 넘어 '자율 연구 에이전트'로 전략 수정

구글, '특수 목적 AI' 넘어 '자율 연구 에이전트'로 전략 수정

구글이 특정 과학 문제 해결 도구에서 자율적으로 연구를 수행하는 에이전트 중심으로 전략을 수정했다. 제미나이 포 사이언스 패키지를 통해 가설 생성과 알고리즘 최적화를 통합하는 체계를 구축했다. 단순 도구를 넘어 인간 과학자와 협업하거나 독자적으로 성과

Deep20kg 미만 체급으로 8m/s 구현한 딥로보틱스 Lynx S10 출시

20kg 미만 체급으로 8m/s 구현한 딥로보틱스 Lynx S10 출시

딥로보틱스가 산업용 소형 휠-레그 로봇 Lynx S10을 공식 출시했다. 20kg 미만 무게에 16개 관절과 IP66 등급의 내구성을 갖춘 것이 특징이다. 전방위 인지 시스템과 고속 주행 능력을 통해 산업 현장 배치를 목표한다.

Deep제조·로봇 결합한 '피지컬 AI'로 한국 AI 3강 도약 추진

제조·로봇 결합한 '피지컬 AI'로 한국 AI 3강 도약 추진

류정혜 위원이 한국 AI 3강 도약을 위한 국가 전략과 미래 방향성을 발표했다. 단순 대화를 넘어 업무를 수행하는 에이전틱 AI와 피지컬 AI로의 전환을 강조했다. 한국의 강점인 제조업과 로봇 산업을 AI와 결합하는 생태계 전략이 핵심이다.

Deep30억 파라미터의 반란, 거대 모델 꺾은 DharmaOCR의 '특화 전략'

30억 파라미터의 반란, 거대 모델 꺾은 DharmaOCR의 '특화 전략'

Dharma가 구조화된 OCR 특화 소형 모델 DharmaOCR과 벤치마크를 공개했다. 30억 파라미터 모델이 GPT-5.4와 Claude Opus 4.6 등 프런티어 모델의 성능을 앞질렀다. 파라미터 규모보다 작업 중심의 '맥락적 특화'가 성능과 비

DeepGemma 4, 로컬 파일 탐색과 파이썬 실행으로 '에이전틱' 구현

Gemma 4, 로컬 파일 탐색과 파이썬 실행으로 '에이전틱' 구현

Gemma 4의 e2b 변체 모델을 활용해 로컬 시스템과 상호작용하는 툴 콜링 에이전트를 구현한다. 샌드박스형 파일 탐색기와 제한된 파이썬 인터프리터로 모델의 추론 한계를 보완한다. 단순 API 호출을 넘어 환경을 인식하고 결정하는 실무적 에이전트 설

DeepGoogle I/O 2026 'Dialogues' 공개 — 기술적 돌파구와 사회적 영향 논의

Google I/O 2026 'Dialogues' 공개 — 기술적 돌파구와 사회적 영향 논의

Google I/O 2026에서 기술적 돌파구를 논의한 Dialogues 스테이지가 운영되었다. 구글 리더와 과학자, 비전가들이 모여 기술이 사회와 미래에 미치는 영향을 분석했다. 해당 세션의 전체 내용은 유튜브를 통해 글로벌 개발자에게 공개되었다.

Deep마이크로소프트 Fara1.5 공개, OpenAI 오퍼레이터 제치고 브라우저 제어권 확보

마이크로소프트 Fara1.5 공개, OpenAI 오퍼레이터 제치고 브라우저 제어권 확보

MS가 브라우저 제어 AI 모델 Fara1.5 시리즈를 전격 공개했다. 벤치마크 결과 OpenAI와 구글의 최신 에이전트를 모두 앞섰다. 샌드박스 환경과 합성 데이터 파이프라인으로 안전성과 성능을 잡았다.

Deep환자 정보 다루는 AI 에이전트 허용, 아마존 노바 액트 HIPAA 적격성 확보

환자 정보 다루는 AI 에이전트 허용, 아마존 노바 액트 HIPAA 적격성 확보

아마존이 브라우저 기반 AI 에이전트 서비스인 노바 액트의 HIPAA 적격성을 확보했다. 이제 의료기관은 민감한 환자 건강 정보가 포함된 복잡한 행정 워크플로우를 자동화할 수 있다. 예약 관리부터 보험 청구까지, 사람이 수동으로 하던 브라우저 작업을

Deep추론 시간 42.47% 부풀린 '텍스트 퇴행'의 실체 — Qwen2.5-VL 분석

추론 시간 42.47% 부풀린 '텍스트 퇴행'의 실체 — Qwen2.5-VL 분석

소수 요청의 무한 루프가 전체 시스템 추론 효율을 급격히 저하시킨다. 최대우도 추정 학습 방식이 초래한 구조적 결함이 원인으로 분석된다. vLLM 등 동적 배칭 환경에서 정상 요청의 지연 시간까지 전이된다.

Deep단순 추론 넘어 에이전틱 AI로, Aetina가 재편하는 엣지 AI 지형

단순 추론 넘어 에이전틱 AI로, Aetina가 재편하는 엣지 AI 지형

Aetina가 COMPUTEX 2026에서 NVIDIA 기반 엣지 AI 솔루션 포트폴리오를 공개한다. 단일 추론 모델에서 물리적·시각적·에이전틱 AI가 통합된 컨텍스트 지능으로 진화한다. 로보틱스와 기업 자동화를 위한 4종의 엣지 제품군으로 실시간 처

Deep다운타임 줄이는 원격 관제, 빅웨이브로보틱스 '솔링크 인더스트리얼 허브' 앱 공개

다운타임 줄이는 원격 관제, 빅웨이브로보틱스 '솔링크 인더스트리얼 허브' 앱 공개

빅웨이브로보틱스가 산업 현장 통합 운영 서비스인 솔링크 인더스트리얼 허브 모바일 앱을 출시했다. 클라우드 기반으로 설비와 로봇 데이터를 통합 관제하며 실시간 알림과 원격 대응 기능을 제공한다. 보안 정책에 따른 데이터 분리 운영과 권한 관리를 통해 산

DeepRobot.com, 자율주행 로봇 기반 광고 플랫폼 'R-ads' 공개

Robot.com, 자율주행 로봇 기반 광고 플랫폼 'R-ads' 공개

Robot.com이 자율주행 로봇을 활용한 광고 플랫폼 R-ads를 출시했다. 전 세계 20개국 이상에서 100회 이상의 브랜드 활성화 사례를 확보했다. 물리적 옥외 광고를 디지털 광고처럼 측정 가능한 네트워크로 전환한다.

Deep토큰 비용 10배 낮춘 Vera Rubin NVL72, 컴퓨텍스 골든 어워드 석권

토큰 비용 10배 낮춘 Vera Rubin NVL72, 컴퓨텍스 골든 어워드 석권

NVIDIA가 COMPUTEX에서 Vera Rubin NVL72 등 AI 핵심 인프라 3종으로 주요 부문 상을 수상했다. Vera Rubin NVL72는 전성비 10배 향상과 토큰당 비용 10배 절감을 통해 추론 효율을 극대화했다. Jetson Tho

Deep인간의 검토마저 생략하는 자동화, 앤스로픽 'Claude Code'의 도발

인간의 검토마저 생략하는 자동화, 앤스로픽 'Claude Code'의 도발

앤스로픽이 런던 'Code with Claude' 행사를 통해 고도화된 코딩 자동화 비전을 공개했다. 스스로 프롬프트를 생성하고 메모를 통해 학습하는 '드림(Dreaming)' 기능이 핵심이다. 생산성 향상 이면에 코드 리뷰 부하와 보안 취약성이라는

Deep행정 10분 작업을 2분으로 줄인 AdventHealth의 OpenAI 도입 전략

행정 10분 작업을 2분으로 줄인 AdventHealth의 OpenAI 도입 전략

AdventHealth가 ChatGPT for Healthcare를 도입해 의료진의 행정 부담을 줄이고 환자 케어 시간을 확보했다. 단순 자동화가 아닌 '채택(Adoption)' 자체를 제품으로 정의하고 도메인별 피어 그룹을 통해 실무 확산을 이끌었다

Deep100만 토큰 창에 추론 엔진 얹은 알리바바 Qwen3.7-Max 공개

100만 토큰 창에 추론 엔진 얹은 알리바바 Qwen3.7-Max 공개

알리바바가 100만 토큰 컨텍스트와 추론 능력을 결합한 Qwen3.7-Max를 발표했다. 체인 오브 쏘트 기반의 사고 과정으로 복잡한 코딩과 장기 에이전트 태스크를 수행한다. 지능 지수는 상승했으나 사실 관계 회상 시 답변 거부율이 높아진 것이 특징이