KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 80 pt3. Muse Spark 1.3 (max) 44 pt4. gpt-oss-120b (high) 40 pt5. GPT-5.6 Luna (max) 27 pt

AI 기술 블로그

엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

NVIDIA, GPT-5.5 기반 Codex로 개발-연구 루프 자동화

NVIDIA, GPT-5.5 기반 Codex로 개발-연구 루프 자동화

OpenAI가 GPT-5.5 기반의 Codex를 NVIDIA 인프라에 적용했다. NVIDIA 엔지니어들은 이를 통해 MVP를 프로덕션 시스템으로 빠르게 전환했다. 연구팀은 논문 분석부터 원격 서버 실험 실행까지의 루프를 자동화했다.

NVIDIA와 SAP, 기업용 AI 에이전트 보안 플랫폼 OpenShell 공개

NVIDIA와 SAP, 기업용 AI 에이전트 보안 플랫폼 OpenShell 공개

NVIDIA와 SAP가 기업용 자율 AI 에이전트 보안을 위한 협력을 발표했다. SAP 비즈니스 AI 플랫폼에 오픈소스 런타임인 OpenShell이 통합된다. Joule Studio에서 NemoClaw를 활용해 안전한 에이전트 배포가 가능해진다.

Gemini Robotics-ER 1.5, Spot API 연결해 자연어 명령으로 물건 정리

Gemini Robotics-ER 1.5, Spot API 연결해 자연어 명령으로 물건 정리

Google의 Gemini Robotics-ER 1.5가 Spot 로봇의 제어 모델로 사용되었다. 기존의 상태 머신 프로그래밍 대신 자연어 프롬프트로 로봇을 조작했다. SDK와 API를 통해 도구 형태로 기능을 연결해 작업 수행 시간을 단축했다.

Orbit AIVI-Learning, Gemini Robotics ER 1.6 탑재로 게이지 인식 지원

Orbit AIVI-Learning, Gemini Robotics ER 1.6 탑재로 게이지 인식 지원

Boston Dynamics가 Gemini Robotics ER 1.6을 AIVI-Learning에 통합했다. 아날로그 게이지 읽기와 5S 준수 감사 등 고차원 추론 기능이 추가되었다. 클라우드 기반의 자동 업데이트와 투명한 추론 과정 확인이 가능해졌

Amazon Quick, 쿼리 정확도 48% 높이고 분석 시간 90분에서 5분으로 단축

Amazon Quick, 쿼리 정확도 48% 높이고 분석 시간 90분에서 5분으로 단축

Amazon Quick가 데이터 분석을 가속화하는 5가지 신규 기능을 공개했다. 자연어 질문을 SQL로 변환해 수백만 행의 데이터를 즉시 분석한다. AWS 기술 커뮤니티 적용 결과 쿼리 정확도가 48% 이상 향상되었다.

Amazon Nova Multimodal Embeddings, 도면과 텍스트를 1024차원 벡터로 통합

Amazon Nova Multimodal Embeddings, 도면과 텍스트를 1024차원 벡터로 통합

Amazon Nova Multimodal Embeddings가 텍스트와 이미지를 공유 벡터 공간에 매핑한다. 도면이나 차트 같은 시각적 정보를 OCR 없이 직접 검색할 수 있다. 텍스트 전용 파이프라인보다 제조 문서 검색 및 답변 생성 품질이 향상되었

OpenAI Daybreak 출시, GPT-5.5-Cyber로 취약점 패치 자동화

OpenAI Daybreak 출시, GPT-5.5-Cyber로 취약점 패치 자동화

OpenAI가 사이버 보안 이니셔티브 Daybreak를 공개했다. GPT-5.5-Cyber 모델을 통해 코드 취약점 탐지와 패치를 지원한다. 클라우드플레어와 크라우드스트라이크 등 21개 보안 기업이 파트너로 참여했다.

Claude Platform on AWS 출시: 계정 하나로 Anthropic 네이티브 API 쓴다

Claude Platform on AWS 출시: 계정 하나로 Anthropic 네이티브 API 쓴다

Anthropic이 AWS 계정으로 직접 이용 가능한 Claude Platform on AWS를 출시했다. 별도 계약 없이 AWS Marketplace를 통해 결제와 인증을 통합 관리한다. MCP 커넥터와 코드 실행 등 Anthropic의 최신 네이티

BLT-D, 토큰 없이 바이트 단위 추론 메모리 대역폭 92% 절감

BLT-D, 토큰 없이 바이트 단위 추론 메모리 대역폭 92% 절감

Meta와 스탠퍼드 연구진이 바이트 단위 언어 모델 BLT의 추론 속도를 높이는 세 가지 기법을 제안했다. 이산 확산 모델을 적용한 BLT-D는 메모리 대역폭 비용을 최대 92%까지 낮췄다. 추측적 디코딩을 활용한 BLT-S는 성능 저하 없이 대역폭을

OpenAI, 40억 달러 투입해 'DeployCo' 설립하고 Tomoro 인수

OpenAI, 40억 달러 투입해 'DeployCo' 설립하고 Tomoro 인수

OpenAI가 기업용 AI 배포 전문 기업인 OpenAI Deployment Company를 설립했다. 초기 투자금 40억 달러를 투입하고 AI 컨설팅 기업 Tomoro를 인수한다. 150명의 전문 엔지니어를 투입해 기업의 핵심 워크플로우에 AI를 직

TwELL CUDA 커널, LLM 추론 20.5% 및 학습 21.9% 가속화

TwELL CUDA 커널, LLM 추론 20.5% 및 학습 21.9% 가속화

Sakana AI와 NVIDIA가 LLM 가속을 위한 TwELL 포맷과 CUDA 커널을 공개했다. 추론 속도를 20.5%, 학습 속도를 21.9% 향상시키며 메모리 트래픽을 줄였다. 하드웨어 타일 구조에 맞춘 데이터 배치로 희소 연산의 오버헤드를 해결

Philips, Jetbrains 등 유럽 기업 6곳이 AI 확장 시 우선순위로 둔 5가지 조건

Philips, Jetbrains 등 유럽 기업 6곳이 AI 확장 시 우선순위로 둔 5가지 조건

유럽 주요 기업 6곳의 경영진이 AI 확장 실전 경험을 공유했다. 단순한 도구 배포보다 신뢰와 문화 구축이 우선되어야 한다고 강조했다. 워크플로우 재설계와 초기 거버넌스 참여가 성공의 핵심으로 꼽혔다.

Google Finance 유럽 확대 및 AI 기반 실시간 기업 실적 분석 도입

Google Finance 유럽 확대 및 AI 기반 실시간 기업 실적 분석 도입

Google이 AI 기능을 탑재한 Google Finance를 유럽 전역에 출시했다. 심층 검색과 기술적 지표 및 실시간 실적 발표 분석 기능을 제공한다. 현지 언어 지원을 통해 유럽 투자자의 금융 데이터 접근성을 높였다.

OpenAI 캠퍼스 네트워크 공개, 전 세계 대학 동아리 파트너십 체결

OpenAI 캠퍼스 네트워크 공개, 전 세계 대학 동아리 파트너십 체결

OpenAI가 전 세계 대학생 리더들을 위한 캠퍼스 네트워크를 구축한다. AI 네이티브 캠퍼스를 만들기 위해 학생 동아리와 파트너십을 맺는다. 이벤트 운영과 프로젝트 구축을 주도하는 학생 리더들의 참여를 기다린다.

NVIDIA CEO 젠슨 황이 카네기멜론 졸업생에게 전한 AI 시대의 기회

NVIDIA CEO 젠슨 황이 카네기멜론 졸업생에게 전한 AI 시대의 기회

젠슨 황 NVIDIA CEO가 카네기멜론 대학 졸업식에서 연설했다. 그는 AI가 단순한 컴퓨팅 산업을 넘어 새로운 산업 시대를 열고 있다고 강조했다. 기술을 두려워하기보다 책임감 있게 활용해 미래를 주도해야 한다고 당부했다.

192GB VRAM으로 구현한 온프레미스 CNC 제조 분석 시스템

192GB VRAM으로 구현한 온프레미스 CNC 제조 분석 시스템

AMD MI300X의 대용량 메모리를 활용해 제조 데이터를 외부 유출 없이 분석한다. CAD 파일을 직접 해석하여 제조 가능 여부를 30초 만에 판단한다. 추론과 데이터 조회를 분리하여 정확도와 보안을 동시에 확보했다.

NadirClaw로 Gemini Flash와 Pro를 자동 전환해 LLM 비용 줄이기

NadirClaw로 Gemini Flash와 Pro를 자동 전환해 LLM 비용 줄이기

NadirClaw가 프롬프트 복잡도에 따라 모델을 자동 선택하는 라우팅 시스템을 공개했다. 로컬 분류기를 통해 API 호출 전 단계에서 단순 작업과 복잡 작업을 구분한다. Gemini Flash와 Pro 모델을 적절히 배분해 운영 비용을 절감할 수 있

NVIDIA cuda-oxide 공개, Rust 코드로 GPU 커널 직접 컴파일한다

NVIDIA cuda-oxide 공개, Rust 코드로 GPU 커널 직접 컴파일한다

NVIDIA가 Rust를 PTX로 직접 컴파일하는 cuda-oxide를 공개했다. C++나 FFI 없이 Rust 언어로 GPU 커널을 작성할 수 있다. CUDA의 SIMT 모델을 Rust의 안전한 타입 시스템으로 구현했다.

NVIDIA, 단일 체크포인트로 3개 모델 구현하는 Star Elastic 공개

NVIDIA, 단일 체크포인트로 3개 모델 구현하는 Star Elastic 공개

NVIDIA가 단일 체크포인트에 30B, 23B, 12B 모델을 포함하는 Star Elastic 기술을 발표했다. 이 기술은 별도의 학습 없이 추론 단계별로 모델 크기를 동적으로 선택할 수 있게 한다. 기존 대비 메모리 사용량을 절반 이하로 줄이고 추

OncoAgent, 70개 암 가이드라인 학습한 온프레미스 의료 AI 공개

OncoAgent, 70개 암 가이드라인 학습한 온프레미스 의료 AI 공개

OncoAgent가 암 진단 및 치료 결정을 돕는 오픈소스 AI 프레임워크를 공개했다. 70개 이상의 전문 가이드라인을 학습하고 2단계 모델 구조로 효율성을 높였다. 온프레미스 배포를 통해 환자 데이터 유출 위험을 완전히 제거했다.

32 GB 메모리 효율의 비밀, BLIP 모델을 AWS Inferentia2로 이식하는 법

32 GB 메모리 효율의 비밀, BLIP 모델을 AWS Inferentia2로 이식하는 법

Tomofun이 Furbo 펫 카메라의 AI 추론 비용을 절감하기 위해 AWS Inferentia2를 도입했다. 기존 BLIP 모델 코드를 수정하지 않고 경량 래퍼를 사용해 추론 파이프라인을 최적화했다. 컴포넌트별 독립적인 컴파일 방식을 통해 GPU

학습 기반 이미지 압축, 기존 코덱 대비 40% 비트레이트 절감 달성

학습 기반 이미지 압축, 기존 코덱 대비 40% 비트레이트 절감 달성

학습 기반 이미지 코덱이 기존 표준 코덱보다 40% 높은 압축 효율을 기록했다. 아이폰 17 프로 맥스에서 230ms 만에 인코딩을 완료하는 실용성을 확보했다. 인간의 시각 시스템을 고려한 최적화로 압축 성능과 속도 간 균형을 맞췄다.

TC-JEPA, 캡션 데이터 결합해 이미지 예측 불확실성 해결

TC-JEPA, 캡션 데이터 결합해 이미지 예측 불확실성 해결

TC-JEPA가 이미지 캡션을 활용한 새로운 시각 표현 학습 방식을 제안했다. 텍스트 조건화 도구를 통해 마스킹된 영역의 예측 불확실성을 낮췄다. 기존 대조 학습 방식보다 세밀한 시각적 이해와 추론 성능이 향상됐다.

포르쉐 컵 브라질, 마이크로소프트 AI 에이전트로 레이스 운영 자동화

포르쉐 컵 브라질, 마이크로소프트 AI 에이전트로 레이스 운영 자동화

포르쉐 컵 브라질이 마이크로소프트 AI 에이전트를 도입해 레이스 운영을 디지털화했다. 실시간 텔레메트리와 AI 이미지 분석을 통해 차량 고장 감지와 사고 분석 시간을 단축했다. 향후 부품 주문 자동화와 예측 유지보수 시스템으로 AI 활용 범위를 확장할

HeadsUp, 1만 명 데이터로 3D 가우시안 헤드 복원 효율 극대화

HeadsUp, 1만 명 데이터로 3D 가우시안 헤드 복원 효율 극대화

HeadsUp은 다중 카메라 환경에서 고품질 3D 가우시안 헤드를 복원하는 기술이다. UV 파라미터 기반의 표현 방식을 도입하여 입력 이미지 해상도와 모델 복잡도를 분리했다. 1만 명 이상의 피험자 데이터를 학습하여 별도의 최적화 없이 새로운 인물을

12 GB 메모리로 구현하는 사이버 보안 특화 모델 CyberSecQwen-4B

12 GB 메모리로 구현하는 사이버 보안 특화 모델 CyberSecQwen-4B

사이버 보안 업무에 특화된 4B 파라미터 모델 CyberSecQwen-4B가 공개되었다. 기존 8B 모델 대비 성능은 유지하면서 메모리 점유율을 절반으로 줄였다. 보안 데이터 유출 없이 로컬 환경에서 즉시 배포 가능한 실용성에 집중했다.

1인 개발자 Y씨는 거대 모델의 메모리 부담을 덜어줄 EMO를 주목한다

1인 개발자 Y씨는 거대 모델의 메모리 부담을 덜어줄 EMO를 주목한다

EMO는 데이터로부터 모듈 구조가 스스로 형성되는 새로운 MoE 모델이다. 전체 전문가의 12.5%만 사용해도 전체 모델 성능에 근접한 결과를 낸다. 문서 단위로 전문가를 할당하여 도메인별 특화 모듈을 자동으로 구성한다.

OpenAI 1,340억 달러 소송과 AGI 통제권을 둘러싼 지배구조 갈등

OpenAI 1,340억 달러 소송과 AGI 통제권을 둘러싼 지배구조 갈등

일론 머스크가 OpenAI를 상대로 1,340억 달러 규모의 손해배상 소송을 제기했다. 그레그 브록먼은 머스크가 과거에 절대적 통제권을 가진 영리 법인 설립을 요구했다고 증언했다. 이번 재판 결과는 OpenAI의 기업 공개와 기업 가치 평가에 직접적인

OpenAI, 크롬 확장 프로그램 출시로 브라우저 제어권 확보

OpenAI, 크롬 확장 프로그램 출시로 브라우저 제어권 확보

OpenAI가 브라우저 기반 워크플로우를 자동화하는 크롬 확장 프로그램을 출시했다. 사용자가 로그인한 상태의 웹 서비스와 내부 툴을 AI 에이전트가 직접 조작할 수 있다. 보안을 위해 도메인별 권한 승인과 데이터 격리 기능을 함께 제공한다.

Simplex, Codex 도입으로 소프트웨어 개발 공정 전면 재설계

Simplex, Codex 도입으로 소프트웨어 개발 공정 전면 재설계

Simplex가 ChatGPT Enterprise와 Codex를 도입해 개발 생산성을 높였다. Codex는 단순 코드 생성을 넘어 설계, 테스트, 오류 수정까지 전 과정을 수행한다. 개발자는 구현보다 품질 관리와 최종 의사결정에 집중하는 구조로 전환되