KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 85 pt3. Muse Spark 1.3 (max) 47 pt4. gpt-oss-120b (high) 43 pt5. GPT-5.6 Luna (max) 28 pt

AI 기술 블로그

엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

OpenAI의 새로운 지능 GPT-5.5, 코딩과 복합 업무의 판도를 바꾸다

OpenAI의 새로운 지능 GPT-5.5, 코딩과 복합 업무의 판도를 바꾸다

OpenAI가 복합적인 업무 처리에 특화된 지능형 모델 GPT-5.5를 공개했다. 이 모델은 이전 버전과 동일한 속도를 유지하면서도 더 높은 지능을 제공한다. 코딩 및 에이전트 작업에서 효율성과 정확도를 대폭 개선했다.

Google TPU, 121 엑사플롭스 연산으로 AI 인프라 장악

Google TPU, 121 엑사플롭스 연산으로 AI 인프라 장악

Google이 자체 설계한 AI 전용 칩인 TPU의 최신 성능을 공개했다. 최신 세대 TPU는 121 엑사플롭스의 연산 처리 능력을 갖췄다. 이전 세대 대비 두 배 향상된 대역폭으로 대규모 AI 모델을 지원한다.

GeForce NOW, 구독 서비스 연동 라벨 도입으로 게임 탐색 효율 극대화

GeForce NOW, 구독 서비스 연동 라벨 도입으로 게임 탐색 효율 극대화

NVIDIA가 GeForce NOW 앱 내에 구독 서비스 연동 라벨을 도입했다. 사용자는 Xbox Game Pass와 Ubisoft+ 게임을 즉시 식별할 수 있다. 이번 업데이트로 클라우드 게임 라이브러리 접근성이 개선되었다.

Deep깃허브 에이전트 프로젝트 10선: 직접 포크해서 실행할 수 있는 저장소

깃허브 에이전트 프로젝트 10선: 직접 포크해서 실행할 수 있는 저장소

깃허브에서 가장 인기 있는 에이전트 프로젝트 10개를 선정했다. OpenClaw는 개인 비서, OpenHands는 코딩 에이전트에 특화되어 있다. 각 저장소는 포크 후 로컬 실행과 수정이 가능하도록 설계되었다.

OpenAI GPT-5.5가 Codex에 탑재, 엔비디아 직원 1만 명이 35배 저렴한 비용으로 사용

OpenAI GPT-5.5가 Codex에 탑재, 엔비디아 직원 1만 명이 35배 저렴한 비용으로 사용

OpenAI가 최신 모델 GPT-5.5를 Codex에 탑재했다. 엔비디아 GB200 NVL72 시스템에서 구동되며 추론 비용이 35배 낮아졌다. 엔비디아 직원 1만 명이 디버깅 시간을 며칠에서 몇 시간으로 단축했다.

Codex로 업무 자동화하기: 캘린더부터 보고서까지 10가지 활용법

Codex로 업무 자동화하기: 캘린더부터 보고서까지 10가지 활용법

Codex가 여러 도구의 데이터를 통합해 업무 브리핑을 자동 생성한다. 캘린더와 메신저 정보를 분석해 주간 보고서 초안을 작성할 수 있다. 문서와 지표를 바탕으로 프레젠테이션 슬라이드 초안을 제작한다.

OpenMythos, 추론 깊이 조절로 파라미터 증설 없이 성능 확장

OpenMythos, 추론 깊이 조절로 파라미터 증설 없이 성능 확장

OpenMythos는 반복 연산을 통해 모델의 추론 깊이를 확장하는 아키텍처다. MLA 어텐션을 도입해 기존 GQA 방식보다 메모리 효율성을 대폭 개선했다. 추론 시 루프 횟수를 늘리는 것만으로 재학습 없이 성능 향상이 가능하다.

DeepCodex 플러그인·스킬: $ 호출로 연결·프로세스 실행

Codex 플러그인·스킬: $ 호출로 연결·프로세스 실행

Codex가 플러그인으로 외부 도구와 정보를 연결함. Codex가 스킬로 팀의 작업 방식(플레이북)을 따르게 함. 스레드에서 $를 눌러 플러그인·스킬을 호출함.

Codex가 정해진 시간에 스스로 작업하는 법: 스케줄 자동화

Codex가 정해진 시간에 스스로 작업하는 법: 스케줄 자동화

OpenAI가 Codex에 스케줄 기반 자동 실행 기능을 추가했다. 사용자가 명령하지 않아도 정해진 시간에 작업을 수행하고 결과를 알려준다. 매일 아침 준비, 주간 보고서 작성 등 반복 업무를 자동화할 수 있다.

Codex 워크스페이스 구성과 프로젝트 관리 실무 가이드

Codex 워크스페이스 구성과 프로젝트 관리 실무 가이드

Codex는 스레드와 프로젝트 단위로 작업을 구조화한다. 사용자는 프로젝트를 로컬 폴더와 연결해 파일 접근 권한을 제어한다. 작업 도중 Steer 기능을 통해 실시간으로 명령을 수정할 수 있다.

OpenAI Codex 설정 가이드: 화면 절전부터 아바타까지 4가지 핵심 옵션

OpenAI Codex 설정 가이드: 화면 절전부터 아바타까지 4가지 핵심 옵션

OpenAI가 Codex 설정 메뉴를 공개했다. 개인화, 절전 방지, 상세 수준, 외형 4가지 항목이 핵심이다. 아바타 기능으로 백그라운드 작업 추적이 가능해졌다.

Apple, 70억 파라미터 RNN 학습 665배 가속한 ParaRNN 공개

Apple, 70억 파라미터 RNN 학습 665배 가속한 ParaRNN 공개

Apple 연구팀이 비선형 RNN을 병렬로 학습하는 ParaRNN 프레임워크를 발표했다. 기존 순차적 방식 대비 학습 속도를 665배 개선하여 70억 파라미터 모델을 구현했다. 뉴턴의 방법을 활용해 비선형 구조를 선형 시스템으로 근사하여 병렬 연산을

다중 모달 생물학 파운데이션 모델, 신약 개발 비용 50% 절감

다중 모달 생물학 파운데이션 모델, 신약 개발 비용 50% 절감

다중 모달 생물학 파운데이션 모델이 파편화된 의료 데이터를 통합한다. 신약 개발과 임상 진단 과정에서 최대 90%의 시간 단축 효과를 낸다. AWS는 모델 학습부터 배포까지 지원하는 통합 인프라 환경을 제공한다.

Amazon Quick 출시, 마케팅 데이터 파편화 해결하고 자동화 구현

Amazon Quick 출시, 마케팅 데이터 파편화 해결하고 자동화 구현

Amazon Quick이 마케팅 도구 간 데이터를 통합하는 지능형 비서로 출시되었다. 사용자는 흩어진 데이터를 연결해 실시간 성과 분석과 자동화된 보고서를 생성한다. 반복적인 마케팅 업무 시간을 획기적으로 단축해 전략 수립에 집중하게 돕는다.

Decoupled DiLoCo, 지리적 제약 없이 AI 모델 학습 속도 20배 높인다

Decoupled DiLoCo, 지리적 제약 없이 AI 모델 학습 속도 20배 높인다

Google이 지리적으로 분산된 환경에서 AI를 학습시키는 Decoupled DiLoCo 기술을 공개했다. 이 방식은 기존 동기화 방식보다 학습 속도를 20배 이상 개선했다. 서로 다른 세대의 하드웨어를 혼합해 학습 자원으로 활용할 수 있다.

DeepJWST 딥필드 데이터가 늘자, 계산 모델이 ‘관측 한계’를 넘는다

JWST 딥필드 데이터가 늘자, 계산 모델이 ‘관측 한계’를 넘는다

JWST가 2022년부터 초기 우주 관측 데이터를 대량으로 돌려줬다. 초기 은하가 한 번에 너무 많이 보여 분석이 ‘손작업’으로는 불가능해졌다. Robertson 연구팀은 대규모 계산 모델로 관측 한계를 풀었다.

LLM을 단순 검색기 대신 7가지 실전 도구로 활용하는 법

LLM을 단순 검색기 대신 7가지 실전 도구로 활용하는 법

대규모 언어 모델을 단순한 대화형 검색기 이상으로 활용할 수 있다. 논리 검증부터 복잡한 오류 분석까지 구체적인 역할 부여가 핵심이다. 사용자가 의도적으로 프롬프트를 설계하면 모델은 강력한 사고 파트너가 된다.

Google 오스트리아 크론스토르프에 첫 데이터 센터 구축

Google 오스트리아 크론스토르프에 첫 데이터 센터 구축

Google이 오스트리아 크론스토르프에 첫 데이터 센터를 건설한다. 이번 시설 구축으로 현지에서 100개의 직접 고용 일자리가 창출된다. 유럽 내 클라우드 인프라 확장을 통해 서비스 지연 시간을 단축한다.

CAMEL로 5개 에이전트 협업 파이프라인 구축, 계획-도구-비평 자동화

CAMEL로 5개 에이전트 협업 파이프라인 구축, 계획-도구-비평 자동화

CAMEL 프레임워크로 다중 에이전트 시스템을 설계했다. 계획, 연구, 작성, 비평, 재작성 5개 에이전트가 협업한다. Pydantic 스키마로 출력을 검증하고 자체 일관성 샘플링으로 신뢰도를 높였다.

Parakeet-TDT 0.6B 모델과 AWS Batch로 다국어 전사 비용 90% 낮춘다

Parakeet-TDT 0.6B 모델과 AWS Batch로 다국어 전사 비용 90% 낮춘다

NVIDIA가 25개 유럽 언어를 지원하는 Parakeet-TDT 모델을 공개했다. TDT 아키텍처로 침묵 구간을 건너뛰어 추론 속도를 획기적으로 높였다. AWS Batch와 스팟 인스턴스를 결합해 전사 비용을 최대 90% 절감했다.

DeepEquinox JAX 모듈: filter_jit·filter_grad·BatchNorm 학습까지

Equinox JAX 모듈: filter_jit·filter_grad·BatchNorm 학습까지

Equinox가 JAX PyTree로 모델 파라미터를 다루는 방식을 보여줬다. filter_jit과 filter_grad로 배열 파트만 컴파일·미분하도록 했다. BatchNorm 상태 저장과 직렬화 검증, 학습 루프까지 진행했다.

Amazon Bedrock AgentCore, 인프라 구축 없이 에이전트 개발 가능

Amazon Bedrock AgentCore, 인프라 구축 없이 에이전트 개발 가능

Amazon Bedrock AgentCore가 관리형 에이전트 하네스 기능을 공개했다. 개발자는 복잡한 인프라 설정 없이 API 호출만으로 에이전트를 실행한다. CLI를 통해 로컬 개발부터 프로덕션 배포까지 단일 워크플로우를 지원한다.

Amazon SageMaker AI, 생성형 AI 추론 최적화 추천 기능 도입

Amazon SageMaker AI, 생성형 AI 추론 최적화 추천 기능 도입

Amazon SageMaker AI가 생성형 AI 모델의 배포 최적화 추천 기능을 제공한다. NVIDIA AIPerf를 통합하여 수주가 걸리던 벤치마킹 과정을 자동화했다. 비용, 지연 시간, 처리량 등 목표에 맞는 최적의 인프라 구성을 제안한다.

DeepQwen3.6-27B 27B 밀집 모델과 preserve_thinking 옵션

Qwen3.6-27B 27B 밀집 모델과 preserve_thinking 옵션

Alibaba가 Qwen3.6-27B 밀집 오픈웨이트를 공개했다. Qwen3.6-27B가 Qwen3.5-397B-A17B MoE를 일부 벤치에서 앞섰다. API에서 preserve_thinking으로 대화 전 구간 사고를 유지할 수 있다.

ChatGPT 팀용 AI 에이전트 공개, Codex로 장기 작업 자동화

ChatGPT 팀용 AI 에이전트 공개, Codex로 장기 작업 자동화

OpenAI가 팀 공유형 워크스페이스 에이전트를 연구 프리뷰로 출시했다. Codex 기반 클라우드에서 실행되며 보고서 작성부터 코드 실행까지 처리한다. 관리자는 권한과 승인 절차를 설정해 데이터 통제를 유지할 수 있다.

Apple, 70억 파라미터 RNN 공개하며 트랜스포머 지형 흔든다

Apple, 70억 파라미터 RNN 공개하며 트랜스포머 지형 흔든다

Apple이 ICLR 2026에서 대규모 RNN 훈련 프레임워크 ParaRNN을 공개했다. 기존 트랜스포머 대비 효율적인 SSM의 한계를 외부 도구 결합으로 해결했다. 이미지 이해와 생성을 동시에 수행하는 통합 모델 MANZANO를 선보였다.

Responses API에서 WebSockets로 에이전트 루프 40% 가속

Responses API에서 WebSockets로 에이전트 루프 40% 가속

Responses API가 WebSockets로 에이전트 루프를 40% 더 빠르게 했다. GPT-5·GPT-5.2는 65 TPS였고 GPT-5.3-Codex-Spark는 1,000 TPS를 노렸다. WebSocket 연결에서 이전 응답 상태를 캐시해

JiuwenClaw가 20분 만에 200쪽 PPT를 만드는 다중 에이전트 팀을 구성했다

JiuwenClaw가 20분 만에 200쪽 PPT를 만드는 다중 에이전트 팀을 구성했다

JiuwenClaw가 다중 에이전트 협업 기능 AgentTeam을 공개했다. 리더 에이전트가 작업 분배와 조율을 자동으로 수행한다. 20분 만에 200쪽 분량의 기술 PPT를 생성하는 데 성공했다.

Gemma 4 VLA, 8GB 젯슨 오린 나노에서 자율 시각 판단 구현

Gemma 4 VLA, 8GB 젯슨 오린 나노에서 자율 시각 판단 구현

Google의 Gemma 4 모델을 8GB 젯슨 오린 나노에서 구동하는 VLA 데모가 공개됐다. 모델이 스스로 판단해 카메라를 켜고 상황을 분석하는 도구 호출 기능을 구현했다. llama.cpp 기반의 최적화와 양자화를 통해 저사양 엣지 기기에서도 실

Amazon Bedrock에 Neptune과 Mem0을 결합한 기업용 기억 장치 구현

Amazon Bedrock에 Neptune과 Mem0을 결합한 기업용 기억 장치 구현

Amazon Bedrock에 Neptune과 Mem0을 결합해 기업 맞춤형 기억을 구현한다. 지식 그래프와 벡터 검색을 병행하여 AI 챗봇의 응답 정확도를 높인다. 사용자가 직접 기억을 검증하는 인간 개입 루프를 통해 신뢰성을 확보한다.