KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Muse Spark 1.3 (max) 46 pt3. gpt-oss-120b (high) 41 pt4. GPT-5.6 Luna (max) 26 pt5. GPT-5.6 Terra (max) 23 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

Anthropic Opus 5 출시, Fable 5보다 낮은 비용과 완화된 제약으로 실무 활용도 높였다

Anthropic Opus 5 출시, Fable 5보다 낮은 비용과 완화된 제약으로 실무 활용도 높였다

Anthropic이 Fable 5보다 저렴하고 제약이 적은 고성능 모델 Opus 5를 출시했다. 일부 벤치마크에서 Fable 5를 앞서며, 데이터 보존 정책 제외 및 안전 분류기 작동 빈도를 85% 낮췄다. API 사용자는 비용 효율성과 데이터 프라이

미국 AI 오픈 웨이트 규제 논의, 엔비디아·MS가 '기술적 정당성'을 주장하는 이유

미국 AI 오픈 웨이트 규제 논의, 엔비디아·MS가 '기술적 정당성'을 주장하는 이유

Meta, Nvidia 등 주요 AI 기업들이 오픈 웨이트 모델에 대한 광범위한 규제 반대 서한을 발표했다. 지식 증류(Distillation)의 정당성과 보안 방어용 모델 확보의 필요성을 핵심 근거로 제시했다. 오픈 소스 모델 도입을 검토하는 기업은

ADHDev 1.0 공개, 로컬 코딩 에이전트 원격 제어 및 자동 병합 지원

ADHDev 1.0 공개, 로컬 코딩 에이전트 원격 제어 및 자동 병합 지원

로컬 코딩 에이전트를 웹과 모바일에서 제어하고 병렬 작업을 자동 병합하는 ADHDev 1.0이 공개됐다. 격리된 작업 환경에서 코드를 작성하고 검증 후 메인 저장소에 합치는 파이프라인을 제공한다.

로컬 LLM 에이전트용 오픈소스 아바타 프론트엔드 'Show GN' 공개

로컬 LLM 에이전트용 오픈소스 아바타 프론트엔드 'Show GN' 공개

로컬 LLM 에이전트의 텍스트 인터페이스를 영상통화형 아바타로 대체하는 Show GN이 공개됐다. 사전 렌더링 방식을 통해 GPU 부하를 줄이고 음성 양방향 소통을 지원한다.

기존 보안망 50% 무력화하는 AI 공격, AegisAI가 에이전트로 방어한다

기존 보안망 50% 무력화하는 AI 공격, AegisAI가 에이전트로 방어한다

AI가 개인 정보를 수집해 정교하게 짜인 스피어 피싱 공격을 수행하며 기존 보안망을 무너뜨리고 있다. 구글 보안 출신이 설립한 AegisAI는 AI 에이전트를 통해 인간처럼 메시지 이상 징후를 분석해 방어한다. AI 기반 공격의 성공률이 2배 높아진

Hetzner, OpenAI 호환 LLM 추론 API 실험적 공개

Hetzner, OpenAI 호환 LLM 추론 API 실험적 공개

Hetzner가 OpenAI 호환 인터페이스를 갖춘 LLM 추론 API를 실험적으로 공개했다. Qwen3.6-35B-A3B-FP8 모델을 통해 262K 컨텍스트 윈도우와 이미지 입력을 지원한다. 현재 과금 체계와 SLA가 없는 실험 단계로 Experi

엔비디아 젯슨, 루나 아웃포스트 달 탐사 로버에 탑재

엔비디아 젯슨, 루나 아웃포스트 달 탐사 로버에 탑재

엔비디아의 젯슨(Jetson) 칩이 달 표면 탐사 로버와 궤도 위성에 탑재된다. 루나 아웃포스트는 라이다(lidar) 제어에, 파이어플라이 에어로스페이스는 영상 처리에 젯슨 플랫폼을 사용한다. 올해 말까지 팰컨 9 로켓으로 발사될 예정이며, 극한의 방

Claude Code 비용 22% 절감하는 캐시 유지 도구 claude-thermos

Claude Code 비용 22% 절감하는 캐시 유지 도구 claude-thermos

Claude Code의 프롬프트 캐시 만료로 발생하는 불필요한 재인코딩 비용을 줄이는 claude-thermos가 공개됐다. 서브 에이전트 작업 중 5분이 지나 캐시가 만료되면 0.1배의 읽기 비용이 1.25배의 쓰기 비용으로 급증하는 문제를 자동 갱

Claude Managed Agents SDK가 정의하는 AI 에이전트 운영 및 비용 최적화 표준

Claude Managed Agents SDK가 정의하는 AI 에이전트 운영 및 비용 최적화 표준

Claude가 에이전트 SDK와 Managed Agents API를 통해 설계-배포-운영 전 과정을 표준화했다. 멀티 에이전트 패턴, MCP 기반 도구 확장, 배치 처리 통한 비용 50% 절감 방안을 구체적으로 제시한다. 실무자는 단순 챗봇을 넘어 세

OneCLI, AI 에이전트 API 키 노출 막는 오픈소스 인증 게이트웨이 공개

OneCLI, AI 에이전트 API 키 노출 막는 오픈소스 인증 게이트웨이 공개

AI 에이전트가 사용하는 API 키를 안전하게 관리하는 오픈소스 게이트웨이 OneCLI가 공개됐다. 에이전트에게는 가짜 키를 부여하고, 게이트웨이가 요청 시점에 실제 키로 교체해 주입하는 구조다. Docker를 통해 로컬 설치가 가능하며 대시보드(10

단발성 테스트는 놓쳤다, 멀티턴 공격에 무너진 AI 모델 88%

단발성 테스트는 놓쳤다, 멀티턴 공격에 무너진 AI 모델 88%

AI 모델 보안 취약점이 단발성 질문이 아닌 대화 흐름(멀티턴) 공격에서 최대 88.3%까지 치솟았다. 15개 플래그십 모델 대상 연구 결과, 대화 맥락을 이용한 공격이 단일 프롬프트 테스트보다 훨씬 치명적임이 드러났다. AI 에이전트를 도입하는 실무

320억 파라미터 성능을 40억 개로, MS Mage-Flow의 고해상도 효율

320억 파라미터 성능을 40억 개로, MS Mage-Flow의 고해상도 효율

마이크로소프트가 40억 개의 파라미터만으로 거대 모델 수준의 이미지 생성 능력을 갖춘 Mage-Flow를 공개했다. VAE 연산량을 최대 22배 줄여 1024px 이미지를 0.59초 만에 생성하며 메모리 점유율을 20GB 이하로 낮췄다. 제한된 GPU

가드레일이 막은 보안 연구, 실무자는 로컬 오픈소스 모델로 이동한다

가드레일이 막은 보안 연구, 실무자는 로컬 오픈소스 모델로 이동한다

AI 기업의 엄격한 가드레일이 정당한 보안 연구자의 취약점 분석과 방어 작업까지 차단하고 있다. Anthropic의 CVP 등 검증 프로그램이 존재하나 일관성 없는 거부 반응으로 인해 GLM 같은 오픈소스 모델 의존도가 높아진다. 보안 실무자는 작업

AMD, 2GW 규모 GPU 지원하는 AI 랙 시스템 '헬리오스' 공개

AMD, 2GW 규모 GPU 지원하는 AI 랙 시스템 '헬리오스' 공개

AMD가 대규모 AI 모델 학습과 추론을 위한 랙 스케일 시스템 '헬리오스(Helios)'를 공개했다. 마이크로소프트, 오픈AI, 메타 등이 도입 예정이며 앤스로픽과는 최대 2GW 규모의 GPU 배포를 위한 전략적 파트너십을 체결했다. 올해 말 출하를

"말 한마디로 PR 리뷰와 디버깅을 동시에", OpenAI Codex 음성 제어 공개

"말 한마디로 PR 리뷰와 디버깅을 동시에", OpenAI Codex 음성 제어 공개

OpenAI가 GPT-Live의 풀 듀플렉스 음성 제어를 Codex와 ChatGPT 데스크톱 앱에 통합했다. 음성 명령 하나로 여러 코딩 작업 스레드를 동시 실행하며 macOS Appshots로 화면 맥락을 실시간 분석한다. 유료 구독자는 빌드 26.

JJStatus, macOS 메뉴바용 AI 코딩 도구 사용량 확인 앱 공개

JJStatus, macOS 메뉴바용 AI 코딩 도구 사용량 확인 앱 공개

macOS 메뉴바에서 Claude, Codex, Gemini의 사용 한도를 실시간으로 확인하는 JJStatus가 공개됐다. 사용률과 리셋 시간을 시각화해 제공하며 API 사용자의 맞춤형 한도 설정 기능을 지원한다.

실리콘밸리 스타트업 200곳, 중국 AI 모델 금지 시 '비용 폭증' 경고

실리콘밸리 스타트업 200곳, 중국 AI 모델 금지 시 '비용 폭증' 경고

실리콘밸리 스타트업 200여 곳이 중국 오픈 웨이트 AI 모델의 미국 내 접근 금지에 반대하는 공동 서한을 보냈다. 저렴한 중국 모델 차단 시 Anthropic·OpenAI 등의 고비용 크레딧 부담이 커져 소수 대기업의 독점이 심화될 수 있다는 근거다

graphify, LLM 토큰 소모 없이 코드베이스를 지식 그래프로 변환하는 도구 공개

graphify, LLM 토큰 소모 없이 코드베이스를 지식 그래프로 변환하는 도구 공개

graphify가 코드와 문서를 지식 그래프로 매핑하는 도구를 공개했다. 로컬 파싱을 통해 토큰 비용 없이 오프라인 인덱싱이 가능하며, 경로 추적과 개념 설명 기능을 제공한다.

AI보다 50배 느린 177줄의 코딩이 더 큰 자부심을 주는 이유

AI보다 50배 느린 177줄의 코딩이 더 큰 자부심을 주는 이유

AI로 프로젝트를 빠르게 완성해도 제작 주체가 다르면 성취감을 얻기 어렵다. 직접 짠 177줄의 코드가 AI보다 50배 오래 걸렸지만 더 큰 심리적 충족감을 준다. 실무자는 결과물의 '완성'과 '제작' 중 어디에 가치를 둘지 판단 기준을 세워야 한다.

연 900억 계약 만료 앞둔 개발자 커뮤니티, Google AI 접근 차단 카드로 협상력 높인다

연 900억 계약 만료 앞둔 개발자 커뮤니티, Google AI 접근 차단 카드로 협상력 높인다

개발자 커뮤니티이 Google과 체결한 연 6천만 달러 규모의 데이터 라이선스 계약 만료를 앞두고 AI 접근 차단을 검토합니다. AI 요약 기능으로 인해 일반 검색 클릭률이 15%에서 8%로 급감하며 게시자의 수익 구조가 위협받고 있습니다. AI 실무

마이크로소프트, 자체 AI 모델 'MAI' 공개... GPU 비용 최대 89% 절감

마이크로소프트, 자체 AI 모델 'MAI' 공개... GPU 비용 최대 89% 절감

마이크로소프트가 자체 개발 AI 모델인 MAI-Image-2.5-Pro와 MAI-Voice-2-Flash를 공개했다. MAI-Voice-2-Flash는 이전 모델 대비 속도는 2배 빠르고 비용은 32% 낮췄으며, MAI-Image-2.5-Pro는 정밀

omp, Pi 기반 IDE 수준 기능 탑재한 터미널 AI 코딩 에이전트 공개

omp, Pi 기반 IDE 수준 기능 탑재한 터미널 AI 코딩 에이전트 공개

Mario Zechner의 오픈소스 에이전트 Pi를 확장한 터미널 코딩 에이전트 omp가 공개됐다. LSP와 DAP를 통합해 IDE 수준의 개발 기능을 터미널에서 제공하며, TUI를 통해 작업 상태를 시각화한다. macOS, Linux, Windows

Claude 보이스 모드, 모델 선택권 확대와 외부 앱 연동 기능 공개

Claude 보이스 모드, 모델 선택권 확대와 외부 앱 연동 기능 공개

Claude 보이스 모드에 Opus, Sonnet, Haiku 모델 선택 기능이 추가되었다. Gmail, Slack 등 외부 앱 연동을 통해 일정 수정 및 문서 작성이 가능하다. 무료 사용자는 Haiku 모델과 1개의 앱 연동으로 제한됨을 확인해야 한

macOS 26 전용 Palmier Pro, MCP 기반 AI 에이전트 편집 지원

macOS 26 전용 Palmier Pro, MCP 기반 AI 에이전트 편집 지원

AI 에이전트와 타임라인에서 협업하는 오픈소스 비디오 에디터 Palmier Pro가 공개됐다. MCP 서버를 통해 Cursor와 Claude를 연동하며 Apple Silicon 및 macOS 26 환경이 필수다. 무료 오픈소스 에디터 기능과 유료 생성

DARPA-미 공군, 표준 F-16에 AI 자율 비행 키트 적용해 시험 비행 실시

DARPA-미 공군, 표준 F-16에 AI 자율 비행 키트 적용해 시험 비행 실시

DARPA와 미 공군이 AI 에이전트로 자율 제어되는 F-16 전투기의 비행 시험을 진행했다. VENOM 프로그램의 자율 비행 키트(VAK)를 통해 표준 기체의 핵심 소프트웨어 변경 없이 AI 제어 기능을 구현했다. 향후 AIR 프로그램을 통해 다수

Runway, 생성 미디어 모델 자동 선택하는 '미디어 라우터' 공개

Runway, 생성 미디어 모델 자동 선택하는 '미디어 라우터' 공개

Runway가 개발자 플랫폼 Runway Dev를 통해 생성 미디어 모델 라우터를 출시했다. 이미지, 비디오, 오디오 모델 중 품질, 속도, 비용 기준에 따라 최적의 모델을 자동 선택해 API로 제공한다. 토큰 기반 과금 체계와 모델 제공 국가 설정

Black Forest Labs, 20초 영상·오디오 생성 가능한 멀티모달 모델 'FLUX 3' 공개

Black Forest Labs, 20초 영상·오디오 생성 가능한 멀티모달 모델 'FLUX 3' 공개

Black Forest Labs가 이미지, 영상, 오디오를 통합 생성하는 멀티모달 모델 FLUX 3를 공개했다. 단일 프롬프트로 최대 20초의 영상과 오디오를 생성하며, FLUX 3 Video와 Action 모델은 현재 승인 기반의 얼리 액세스로 제공

승인 버튼만 누르는 '보안 연극' 끝내라, 루브릭이 도입한 AI 에이전트 판사 SAGE

승인 버튼만 누르는 '보안 연극' 끝내라, 루브릭이 도입한 AI 에이전트 판사 SAGE

루브릭이 인간의 승인 절차를 AI가 실시간 감시하는 'AI-in-the-loop' 거버넌스 엔진 SAGE를 공개했다. 자연어 정책을 이해하는 소형언어모델(SLM)을 통해 비용과 지연시간을 낮추면서 에이전트의 실행 의도를 판별한다. 에이전트 자율성을 높

빅테크 5개사의 '장부 외 부채 1.65조 달러', AI 데이터센터 투자의 숨겨진 리스크

빅테크 5개사의 '장부 외 부채 1.65조 달러', AI 데이터센터 투자의 숨겨진 리스크

Alphabet, Microsoft 등 빅테크 5개사가 공식 장부에 기록되지 않은 약 1.65조 달러의 부채를 보유하고 있다. 특수목적법인(SPV) 등을 통해 부채를 은폐하며 AI 데이터센터 확장에 막대한 자금을 투입하는 구조다. AI 인프라 투자 규

아스트라제네카, AI-로봇 폐쇄 루프로 신약 개발 기간 50% 단축한다

아스트라제네카, AI-로봇 폐쇄 루프로 신약 개발 기간 50% 단축한다

AI 기반 설계와 로봇 자동화를 결합해 신약 후보 물질 발굴 기간을 최대 50% 단축한다. AI 예측-로봇 실험-데이터 피드백으로 이어지는 폐쇄 루프(Closed-loop) 시스템을 구축한다. R&D 실무자는 모델 성능보다 실험 데이터가 모델로 즉시