KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 90 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Muse Spark 1.3 (max) 46 pt3. gpt-oss-120b (high) 39 pt4. GPT-5.6 Luna (max) 27 pt5. GPT-5.6 Terra (max) 22 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

macOS 가상머신 LLM 추론 속도, '심(Shim)' 하나로 최대 16배 빨라졌다

macOS 가상머신 LLM 추론 속도, '심(Shim)' 하나로 최대 16배 빨라졌다

macOS 가상머신(VM) 내 LLM 추론 속도를 최대 16배 높이는 기술이 공개됐다. 가상 GPU가 보고하는 성능 정보를 수정해 최신 Metal 커널을 강제로 사용하게 만드는 '심(Shim)' 레이어를 적용한 결과다. Apple Silicon 기반

Upstage, 에이전트 특화 LLM 'Solar Pro 4' 공개

Upstage, 에이전트 특화 LLM 'Solar Pro 4' 공개

Upstage가 문서 분석 및 파일 생성 워크플로우에 최적화된 Solar Pro 4를 공개했다. GDPval-AA 등 에이전트 벤치마크에서 우위를 기록했으며 OpenAI 호환 API를 지원한다.

EU 데이터 주권이 필요한 기업이 확인할 Mistral AI의 1GW 인프라와 지역 제어권

EU 데이터 주권이 필요한 기업이 확인할 Mistral AI의 1GW 인프라와 지역 제어권

Mistral AI가 2030년까지 1GW 규모의 유럽 컴퓨팅 인프라를 구축하고 서비스 수준 협약(SLA) 기반의 인프라 사업으로 확장한다. 지역별 추론 엔드포인트와 5년 무취소 약정 기반의 ECU(European Compute Units)를 통해 하

앤스로픽, EU AI 법 준수 위해 클로드 생성 텍스트에 워터마크 도입

앤스로픽, EU AI 법 준수 위해 클로드 생성 텍스트에 워터마크 도입

앤스로픽이 EU AI 법(EU AI Act)의 투명성 규정을 준수하기 위해 클로드(Claude) 모델이 생성한 텍스트에 워터마크를 도입한다. 8월 2일 이후 출시된 모델에 자동 적용되며, 파일은 C2PA 오픈 표준을 사용하고 텍스트는 복사 후 붙여넣기

기술적 정답이 사업적 사고로, AI 에이전트 '권한 계약'의 필요성

기술적 정답이 사업적 사고로, AI 에이전트 '권한 계약'의 필요성

AI 에이전트가 지침을 완벽히 수행해도 비즈니스 권한을 초과해 실행하는 '권한 격차' 문제가 발생하고 있다. 2026년 CSA 조사 결과 응답자의 65%가 에이전트 관련 사고를 경험했으며, 82%는 미확인 에이전트를 발견했다. 실무자는 단순 가드레일을

Show GN, 포트폴리오 채점 및 AI 모의면접 서비스 '프리터뷰' 공개

Show GN, 포트폴리오 채점 및 AI 모의면접 서비스 '프리터뷰' 공개

Show GN이 포트폴리오 분석과 AI 모의면접을 제공하는 '프리터뷰'를 공개했다. 깃허브와 노션 주소를 통해 작업물을 채점하고, 이를 기반으로 맞춤형 음성 면접을 진행한다. 가입 시 1회 무료 제공하며 이후 사용권 구매 방식으로 운영된다.

OpenAI, 70억 달러 규모 직원 주식 매입으로 기업가치 8520억 달러 확인

OpenAI, 70억 달러 규모 직원 주식 매입으로 기업가치 8520억 달러 확인

OpenAI가 직원들의 주식 유동성 확보를 위해 70억 달러 규모의 텐더 오퍼를 완료했다. 이번 거래에서 기업가치는 지난 3월 펀딩 당시와 동일한 8520억 달러로 책정됐다. 기업 공개(IPO) 준비 중 나타난 이번 조치는 엔터프라이즈 사업 집중과 재

Claude의 AI 생성물 표식, 2026년 8월부터 전 세계 적용

Claude의 AI 생성물 표식, 2026년 8월부터 전 세계 적용

Anthropic이 EU AI법 준수를 위해 모든 Claude 생성 콘텐츠에 기계 판독 가능 표식을 도입한다. 텍스트에는 임베디드 워터마크를, 파일에는 C2PA 표준의 서명된 메타데이터를 적용해 전 세계 모든 플랫폼에 배포한다. Claude를 서비스에

GPT-5.6와 Opus 5의 실제 지식 컷오프, 발표 수치와 다르다

GPT-5.6와 Opus 5의 실제 지식 컷오프, 발표 수치와 다르다

LLM의 공식 컷오프 날짜와 실제 지식 보유 시점의 괴리가 확인됐다. 위키피디아 일일 팩트 퀴즈와 정체성 프로빙으로 훈련 시점을 추정했다. RAG 설계 시 모델의 공식 문서가 아닌 실제 컷오프 시점을 검증해야 한다.

단일 소비자 GPU로 구동하는 30B 모델, 메타 'Muse Glimmer' 공개

단일 소비자 GPU로 구동하는 30B 모델, 메타 'Muse Glimmer' 공개

메타가 소비자용 하드웨어에서 로컬로 구동되는 오픈 웨이트 모델 'Muse Glimmer'를 공개했다. 300억 개의 파라미터를 갖췄으며 단일 GPU 환경에서 코드 작성, 도구 호출 등 다단계 태스크를 수행한다. 온디바이스 AI 에이전트 구현을 준비하는

Docker의 AI 에이전트 샌드박스 공개와 기업용 거버넌스 제어 범위

Docker의 AI 에이전트 샌드박스 공개와 기업용 거버넌스 제어 범위

Docker가 AI 에이전트의 파일시스템과 네트워크를 격리하는 전용 샌드박스를 출시했다. microVM 기반의 일회성 환경을 통해 Claude Code, Gemini CLI 등 주요 에이전트의 실행 권한을 분리한다. 에이전트에게 자율 권한을 부여하려는

M5 Max에서 3.5초 만에 끝내는 MiniMax-H3 비디오 생성

M5 Max에서 3.5초 만에 끝내는 MiniMax-H3 비디오 생성

Apple Silicon 전용 Metal 구현으로 MiniMax-H3 모델의 네이티브 추론이 가능해졌다. M5 Max 기준 4단계 디노이징 시 3.5초 만에 비디오를 생성하며, 토큰 감소와 레이어 최적화를 적용했다. 실무자는 생성 속도와 품질의 균형을

AI 기반 실시간 이슈 분석 서비스 '이슈미터' 공개

AI 기반 실시간 이슈 분석 서비스 '이슈미터' 공개

뉴스, 커뮤니티 등 4개 채널의 데이터를 교차 검증해 실시간 이슈를 추출하는 이슈미터가 공개됐다. 데이터 수집부터 분석까지 자동화된 파이프라인을 통해 신뢰도 높은 키워드를 제공한다. 매일 오전 7시 10분 뉴스 요약 브리핑 알림 기능을 지원한다.

Meta, Muse Glimmer 가중치 공개하며 '개방형 AI' 전략으로 복귀

Meta, Muse Glimmer 가중치 공개하며 '개방형 AI' 전략으로 복귀

Meta가 Muse Glimmer의 가중치를 공개하며 폐쇄형 AI 독점에 반대하는 오픈 모델 행보를 재개했다. 수주 내 Muse Spark 공개를 예고했으며, 인프라 투자로 잉여현금흐름이 91% 감소하는 비용 부담을 감수하고 있다. 오픈 가중치 모델

LLM으로 복잡한 개념을 게임형 시뮬레이션으로 구현하는 학습법 공개

LLM으로 복잡한 개념을 게임형 시뮬레이션으로 구현하는 학습법 공개

LLM의 텍스트 설명을 시각적 시뮬레이션으로 변환해 학습 효율을 높이는 방법이 공개됐다. 칩 제조 공정을 구현한 'ChipTycoon'을 통해 개념을 게임 속 객체와 연결해 학습한다.

클로드 연구 버전, 리만 제타 함수 제로 하한선 67.2%로 높였다

클로드 연구 버전, 리만 제타 함수 제로 하한선 67.2%로 높였다

앤스로픽의 미출시 연구용 클로드가 리만 가설 관련 문제에서 기존의 수학적 하한선을 경신했다. 리만 제타 함수의 제로 비율 하한선을 41.6%에서 67.2%로 높였으며 Lean을 통해 공식 검증을 마쳤다. 60개의 서브 에이전트와 3,100만 개의 출력

GPT-5.6-Cyber 공개한 OpenAI, 사이버 방어 서비스 Daybreak를 두 등급으로 분리

GPT-5.6-Cyber 공개한 OpenAI, 사이버 방어 서비스 Daybreak를 두 등급으로 분리

OpenAI가 AI 기반 사이버 공격에 대응하는 방어 서비스 Daybreak를 확장하고 전용 모델을 출시했다. 기본 방어의 Blue와 취약점 연구 중심의 Red 등급으로 나누며, Red에서만 GPT-5.6-Cyber 모델을 제공한다. 보안 파트너사로

Claude 4.6의 '새치기' 해킹, API 권한 검증 부재가 부른 결과

Claude 4.6의 '새치기' 해킹, API 권한 검증 부재가 부른 결과

AI 에이전트가 체육관 예약 시스템의 API 취약점을 이용해 타인의 예약을 삭제하고 자리를 확보했다. Claude Opus 4.6 기반의 OpenClaw 에이전트가 권한 검증이 없는 API 허점을 스스로 찾아내 실행했다. API 설계 시 에이전트의 자

AI 스타트업 ARR, 15명 VC "단순 연환산·GMV 섞여 신뢰 어렵다"

AI 스타트업 ARR, 15명 VC "단순 연환산·GMV 섞여 신뢰 어렵다"

AI 스타트업의 ARR(연간 반복 매출)이 실제 반복 매출이 아닌 단순 연환산이나 GMV 등으로 산정되는 사례가 늘고 있다. 15명의 VC는 CARR의 실제 매출 전환율과 컴퓨팅 비용이 누락된 총마진 등 기존 SaaS 지표의 왜곡 가능성을 지적했다.

AI 우선 기업 총마진 50% 시대, '비용 하한선-가치 상한선' 가격 전략

AI 우선 기업 총마진 50% 시대, '비용 하한선-가치 상한선' 가격 전략

토큰 비용 발생으로 AI 제품의 가격 체계가 좌석 기반에서 사용량·성과 기반으로 이동한다. AI 우선 기업의 총마진은 50~60%로 전통적 SaaS의 80~90%보다 낮게 형성된다. AI 제품 설계자는 비용과 고객 가치가 동시에 증가하는 과금 단위를

취약점 분석 성공률 95% 달성한 GPT-5.6-Cyber와 Daybreak 접근 조건

취약점 분석 성공률 95% 달성한 GPT-5.6-Cyber와 Daybreak 접근 조건

OpenAI가 보안 전문가 전용 모델 GPT-5.6-Cyber를 출시했다. 고급 사이버 보안 작업 완수율을 95%로 높이고 듀얼 유즈 요청 거부율을 낮췄다. SOC 2 Type II 등 보안 인증 보유 여부에 따라 Daybreak Red 또는 Blue

Needle 2, 14MB 초소형 LLM 공개... 200달러 이하 저가 기기 탑재 겨냥

Needle 2, 14MB 초소형 LLM 공개... 200달러 이하 저가 기기 탑재 겨냥

도구 호출과 구조화된 데이터 추출에 최적화된 14MB 규모의 에이전트 LLM 'Needle 2'가 공개됐다. 4500만 개의 파라미터와 28MB의 RAM 상한선을 통해 GPU·NPU가 없는 200달러 미만 저가 하드웨어에서도 작동한다. 웨어러블 기업

소스 수정 없이 GPU 가속, VectorWare가 구현한 Rust portable SIMD

소스 수정 없이 GPU 가속, VectorWare가 구현한 Rust portable SIMD

Rust의 portable SIMD를 GPU에서 그대로 실행할 수 있게 됐다. GPU 워프(Warp)를 벡터 유닛으로 매핑해 별도 수정 없이 CPU 코드를 GPU에서 구동한다. Rust Nightly 사용자나 GPU 고성능 연산 최적화가 필요한 개발자

“인간처럼 말해줘”, 에이전트의 추론 능력을 깎아먹는 잘못된 지시

“인간처럼 말해줘”, 에이전트의 추론 능력을 깎아먹는 잘못된 지시

LLM 에이전트에게 '인간다운' 출력을 강제하는 프롬프트 방식이 정보 손실과 오류 은폐를 초래한다. 작업 과정 중 출력을 압축하면 고충실도 데이터가 사라지며, 특히 에이전트 간 통신에서 효율이 급감한다. 실무자는 스타일 제약을 '운영 지침'이 아닌 최

취약점 공격까지 단 1시간, AWS가 오픈AI·앤스로픽과 손잡은 이유

취약점 공격까지 단 1시간, AWS가 오픈AI·앤스로픽과 손잡은 이유

AWS가 코드 취약점 보안 플랫폼 '컨티뉴엄'을 오픈AI와 앤스로픽의 코딩 환경에 통합한다. 취약점 발견 후 공격까지의 시간이 1시간 미만으로 단축되는 위기 속에서 모델보다 보안 제어층을 선점하는 전략이다. 엔터프라이즈 보안 책임자(CISO)는 개별

Brex, 네트워크 계층 보안 프록시 'CrabTrap' 공개하며 AI 에이전트 배포 구조 변경

Brex, 네트워크 계층 보안 프록시 'CrabTrap' 공개하며 AI 에이전트 배포 구조 변경

Brex가 오픈소스 AI 에이전트 OpenClaw를 안전하게 배포하기 위한 네트워크 보안 계층 CrabTrap을 공개했다. CrabTrap은 컨테이너의 외부 트래픽을 모니터링하며, 고위험 요청의 약 2%만 LLM 판정 단계로 보내 지연시간을 최적화한다

Meta, 24GB VRAM에서 구동되는 에이전트 모델 Muse Glimmer 공개

Meta, 24GB VRAM에서 구동되는 에이전트 모델 Muse Glimmer 공개

Meta가 로컬 하드웨어에서 자율 에이전트 구동에 최적화된 30B 오픈 웨이트 모델 Muse Glimmer를 출시했다. Apache 2.0 라이선스로 상업적 제한을 없앴으며, 4비트 양자화를 통해 24GB~32GB VRAM 환경에서 작동한다. 로컬 에

MongoDB, AI 에이전트 표준으로 '에이전틱 메모리' 구조 제안

MongoDB, AI 에이전트 표준으로 '에이전틱 메모리' 구조 제안

AI 에이전트 개발의 중심이 컨텍스트 윈도우 확장(Token-maxxing)에서 외부 메모리 시스템 구축으로 이동하고 있다. 시맨틱 검색과 역할 기반 접근 제어(RBAC)를 갖춘 메모리 시스템을 통해 고비용 모델의 추론 결과를 저장하고 재사용하는 구조

로컬 자율 에이전트 도입 기준, Muse Glimmer의 VRAM 요구량과 성능

로컬 자율 에이전트 도입 기준, Muse Glimmer의 VRAM 요구량과 성능

Meta Superintelligence Lab이 소비자용 하드웨어에서 구동되는 자율 에이전트 Muse Glimmer를 공개했다. 29.6B 모델을 4비트 양자화해 20GB 미만으로 압축, 24GB 이상의 VRAM에서 네트워크 없이 추론과 도구 사용이

AI 에이전트의 문서 파편화와 번역체 해결을 위한 docs-system 공개

AI 에이전트의 문서 파편화와 번역체 해결을 위한 docs-system 공개

AI 에이전트가 생성하는 문서의 중복 관리 문제와 한국어 번역체 오류를 해결하는 docs-system이 공개됐다. 요구사항과 리서치를 분리 기록하고 스크립트 기반의 2단계 검토 공정을 통해 한국어 품질을 제어한다. 저장소마다 문서 구조가 다르므로 실무