KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 80 pt3. Muse Spark 1.3 (max) 44 pt4. gpt-oss-120b (high) 40 pt5. GPT-5.6 Luna (max) 27 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

"특정 모델에 묶이지 마라" — 리버티 뮤추얼의 모델 교체 가능 AI 아키텍처

"특정 모델에 묶이지 마라" — 리버티 뮤추얼의 모델 교체 가능 AI 아키텍처

AI 모델의 갑작스러운 서비스 중단이나 정책 변화는 기업의 운영 리스크가 된다. 리버티 뮤추얼은 50여 개의 독립 컴포넌트로 구성된 'AI 백본'을 통해 모델을 즉시 교체할 수 있는 구조를 만들었다. 6개의 전문 에이전트 협업 체계인 '소프트웨어 팩토

"목표 달성까지 반복하라" Claude Code가 제시한 4가지 에이전트 루프

"목표 달성까지 반복하라" Claude Code가 제시한 4가지 에이전트 루프

AI 코딩 도구를 사용할 때 매번 프롬프트를 입력해 지시하는 방식이 일반적이다. Claude Code 팀은 정지 조건이 충족될 때까지 작업을 반복하는 '루프' 운영 패턴을 공개했다. 작업 성격에 따라 Turn, Goal, Time, Proactive

AI가 엉망으로 짠 코드, 일주일 1만 달러에 지워주는 서비스 등장

AI가 엉망으로 짠 코드, 일주일 1만 달러에 지워주는 서비스 등장

AI 코딩 도구로 빠르게 만든 프로젝트가 규모가 커질수록 유지보수가 어려워지는 문제가 발생하고 있다. Odra는 AI가 중복 생성한 코드를 분석해 줄이고 유지보수 가능한 구조로 재설계하는 서비스를 제공한다. 시니어 엔지니어 3명이 일주일간 작업하며,

인스타그램·왓츠앱에 바로 심었다, Meta의 AI 이미지 생성기 'Muse' 공개

인스타그램·왓츠앱에 바로 심었다, Meta의 AI 이미지 생성기 'Muse' 공개

인스타그램 스토리나 왓츠앱에서 AI로 이미지를 만드는 기능이 추가됩니다. Meta가 공개한 'Muse'는 단순 생성부터 배경 삭제, QR 코드 제작까지 지원합니다. 기본 이용은 무료지만 사용량 제한을 넘기면 구독제로 전환되는 구조입니다.

Claude Desktop의 오픈소스 대안, 지식 그래프 기반 AI 동료 Rowboat 공개

Claude Desktop의 오픈소스 대안, 지식 그래프 기반 AI 동료 Rowboat 공개

AI와 협업할 때 매번 이전 맥락을 다시 설명하거나 문서를 업로드하는 번거로움이 있다. Rowboat는 로컬 데이터를 지식 그래프로 인덱싱해 누적된 기억을 가진 AI 워크스테이션을 제공한다. MCP 지원으로 외부 툴과 연결 가능하며 Mac, Windo

토큰 양은 DeepSeek, 매출은 Anthropic — AI 모델의 이층 구조

토큰 양은 DeepSeek, 매출은 Anthropic — AI 모델의 이층 구조

오픈소스 AI의 사용량이 급증하며 시장 점유율을 빠르게 높이고 있다. 하지만 실제 지출액은 여전히 고가의 프런티어 모델에 집중되어 있다. AI 도입 단계가 '발견'과 '생산'으로 분리되는 이층 경제 구조가 나타났다.

AI 에이전트가 데이터베이스 때문에 멈추지 않게 하는 법

AI 에이전트가 데이터베이스 때문에 멈추지 않게 하는 법

AI 에이전트 시대에는 기존의 딱딱한 데이터 관리 방식이 개발 속도를 늦추는 병목 현상을 일으킵니다. Huntr, Modelence, Tavily 등 AI 스타트업들은 데이터와 검색 기능을 하나로 합친 통합 플랫폼으로 이 문제를 해결했습니다. 유연한

Anthropic, Claude Cowork 모바일·웹 출시... 사용자의 절반은 '비코딩 업무'에 활용

Anthropic, Claude Cowork 모바일·웹 출시... 사용자의 절반은 '비코딩 업무'에 활용

Anthropic이 Claude Cowork를 모바일과 웹으로 확대 출시하며 서비스 접근성을 높였다. 사용 데이터 분석 결과 비즈니스 운영(33.4%)과 콘텐츠 제작(16.4%) 비중이 소프트웨어 개발(8.7%)을 크게 앞섰다. AI가 전문 영역의 대

77만 파운드 운송한 Forterra 자율주행차, 우크라이나 실전 배치

77만 파운드 운송한 Forterra 자율주행차, 우크라이나 실전 배치

드론이 지배하는 현대 전장에서 지상 자율주행 차량의 필요성이 커지고 있다. 미국 Forterra가 가솔린 기반 Lancer 차량 100여 대를 우크라이나에 배치했다. 9개월간 1,100회 이상의 임무를 수행하며 77만 파운드의 물자를 운송했다.

3초면 복제되는 목소리, AI 사기 막는 '실시간 리스너' Savi 출시

3초면 복제되는 목소리, AI 사기 막는 '실시간 리스너' Savi 출시

SNS에 올린 짧은 영상 하나로 내 목소리가 복제될 수 있는 시대다. Savi Security가 실시간 통화 모니터링으로 AI 사기를 감지하는 앱을 출시했다. Gemini 기반의 AI 게이트웨이 구조를 통해 텍스트와 음성 사기를 동시에 차단한다.

AI 프로젝트 60% 폐기 전망, 핵심은 모델 아닌 데이터 구조

AI 프로젝트 60% 폐기 전망, 핵심은 모델 아닌 데이터 구조

AI 모델을 도입해도 환각 현상과 데이터 파편화로 실무 적용에 한계를 느끼는 기업이 많다. 가트너는 AI 준비 데이터가 부족한 프로젝트의 60%가 2026년까지 중단될 것이라 전망했다. 성공의 핵심은 프롬프트를 넘어 정보 환경 전체를 설계하는 컨텍스트

말투와 감정까지 설계한다, iOS 27의 새로운 Siri

말투와 감정까지 설계한다, iOS 27의 새로운 Siri

AI 비서의 기계적인 말투나 고정된 말하기 속도에 불편함을 느끼는 사용자가 많다. 애플이 iOS 27 베타 3에서 Siri의 말하기 속도(Pace)와 표현력(Expressivity) 조절 기능을 공개했다. 슬라이더를 통해 감정의 깊이를 조절하며 생성형

AI 시대 비즈니스 해자, '도메인 지식'과 '체득형 취미'로 이동

AI 시대 비즈니스 해자, '도메인 지식'과 '체득형 취미'로 이동

LLM의 지식 노동 평준화로 비즈니스 방어선이 암묵지와 도메인 지식으로 옮겨간다. 여가 지출 비중이 13%로 상승하며 AI 대체재 전환 시점의 여가 비즈니스 기회가 확대된다.

Kapa, RAG 비용 34% 줄이는 '컨텍스트 가지치기' 공개

Kapa, RAG 비용 34% 줄이는 '컨텍스트 가지치기' 공개

RAG 시스템은 정확도를 높이려 너무 많은 문서를 LLM에 전달해 토큰 비용을 낭비한다. Kapa는 리랭커와 생성 모델 사이에 소형 LLM을 배치해 불필요한 청크를 68% 제거하는 Pruning 기법을 도입했다. 이를 통해 답변 재현율은 96% 유지하

OpenAI, 미국 국민에게 지분 배분하나... 샘 올트먼의 'AI 배당금' 제안

OpenAI, 미국 국민에게 지분 배분하나... 샘 올트먼의 'AI 배당금' 제안

AI가 인간의 데이터를 학습해 부를 쌓는 구조에 대한 비판이 거세다. 샘 올트먼은 미국 국민에게 OpenAI 지분을 나눠주는 방안을 정부에 제안했다. 기업가치 8,520억 달러 기준, 5% 지분 배분 시 가구당 약 320달러를 받게 된다.

1,450억 달러 투자에도 "기대보다 느린" 메타의 AI 에이전트 개발 속도

1,450억 달러 투자에도 "기대보다 느린" 메타의 AI 에이전트 개발 속도

내 업무를 완전히 대신해 줄 AI 에이전트의 시대가 생각보다 더디게 오고 있다. 마크 저커버그는 최근 AI 에이전트 개발 궤적이 지난 4개월간 예상만큼 가속화되지 않았음을 인정했다. 메타는 올해 최대 1,450억 달러를 인프라에 투자하고 7,000명을

Vercel, "모델과 에이전트 분리" 선언... AI 인프라의 AWS 지향

Vercel, "모델과 에이전트 분리" 선언... AI 인프라의 AWS 지향

많은 기업이 AI 프로토타이핑을 넘어 실제 서비스 상용화 단계에 진입했다. Vercel은 일일 600만 건의 배포와 1조 개의 토큰을 처리하며 에이전트 인프라 시장을 선점하고 있다. 자연어 기반 프레임워크 'Eve'와 데이터 통제용 'Sandbox'를

"믿지 말고 증명하라" AI 에이전트 기만을 잡아낼 감사 레이어 Mirror Stack

"믿지 말고 증명하라" AI 에이전트 기만을 잡아낼 감사 레이어 Mirror Stack

자율적으로 구동되는 AI 에이전트의 활용도가 급격히 높아지고 있다. AI가 인간 몰래 데이터를 조작하거나 제약을 우회하는 기만 행위가 우려된다. 오픈소스 Mirror Stack은 위조 불가능한 장부로 AI의 정직함을 사후 검증한다.

추론의 핵심 '침묵하는 작업공간' J-space 발견한 앤스로픽

추론의 핵심 '침묵하는 작업공간' J-space 발견한 앤스로픽

LLM은 겉으로 내뱉는 답변 외에도 내부적으로 복잡한 처리 과정을 거칩니다. 앤스로픽은 클로드 내부에서 여러 계산 과정이 공유하는 중심 작업공간 'J-space'를 발견했습니다. 이 공간을 제거하면 유창함은 유지되나 다단계 추론 성능은 거의 0으로 떨

메타, 1.3만 개 앱 검증된 디자인 시스템 'Astryx' 오픈소스 공개

메타, 1.3만 개 앱 검증된 디자인 시스템 'Astryx' 오픈소스 공개

UI 라이브러리를 도입해도 세부 스타일 수정 때문에 코드를 다시 짜는 일이 잦다. 메타가 8년간 13,000개 이상의 앱을 구동하며 다듬은 디자인 시스템 'Astryx'를 공개했다. 160개 이상의 컴포넌트와 AI 에이전트 전용 CLI를 통해 프로덕션

'제2의 엔비디아' 찾는 월가, SK하이닉스 미국 상장 나선다

'제2의 엔비디아' 찾는 월가, SK하이닉스 미국 상장 나선다

AI 붐으로 반도체 시장의 열기가 그 어느 때보다 뜨겁습니다. SK하이닉스가 미국 증시 상장을 통해 약 280억 달러의 자금을 조달할 계획입니다. HBM 등 고성능 메모리 수요 폭증과 '램마게돈' 상황이 이번 상장의 배경입니다.

Z.ai GLM 5.2 공개, 프런티어 모델 수준 성능으로 추론 비용 80% 이상 낮췄다

Z.ai GLM 5.2 공개, 프런티어 모델 수준 성능으로 추론 비용 80% 이상 낮췄다

Z.ai가 프런티어 모델 수준의 성능을 갖춘 오픈 웨이트 모델 GLM 5.2를 공개했다. 추론 비용이 1MTok당 약 4.40달러로 Opus의 20%, GPT-5.5의 15% 수준에 불과하다. API 호환성과 온프레미스 구축 가능성으로 인해 기업의 모

사라진 오피스 설치 제약 — AI 에이전트 전용 OfficeCLI 등장

사라진 오피스 설치 제약 — AI 에이전트 전용 OfficeCLI 등장

AI 에이전트로 오피스 문서를 자동화하려면 복잡한 라이브러리와 설치 환경이 필요했다. OfficeCLI는 별도 설치 없이 단일 바이너리로 Word, Excel, PPT를 읽고 편집하는 기능을 제공한다. HTML 렌더링 엔진과 MCP 서버를 탑재해 AI

Anthropic, Claude Code 내 중국 사용자 몰래 추적하던 코드 삭제

Anthropic, Claude Code 내 중국 사용자 몰래 추적하던 코드 삭제

Anthropic이 Claude Code 도구에 포함했던 사용자 추적 코드를 삭제했다. 해당 코드는 사용자의 시간대와 프록시 정보를 몰래 수집해 본사로 전송하고 있었다. 회사는 이를 계정 도용 방지 및 모델 무단 복제 차단을 위한 실험적 조치였다고

구글, 검색 서비스 미디어 데이터 AI 학습 활용 설정 변경 및 옵트아웃 제공

구글, 검색 서비스 미디어 데이터 AI 학습 활용 설정 변경 및 옵트아웃 제공

구글이 검색 서비스 내 이미지, 오디오, 비디오 등 미디어 데이터를 AI 모델 학습에 활용하는 설정을 업데이트했다. Search Services History와 Personalized Recommendations 설정을 통해 데이터 저장 여부와 삭제

엔지니어 연봉보다 비싼 컴퓨팅 비용, Anthropic의 2.3배 지출 구조

엔지니어 연봉보다 비싼 컴퓨팅 비용, Anthropic의 2.3배 지출 구조

AI 모델 개발 비용이 인건비를 압도하는 구조로 변하고 있다. Anthropic은 2026년 컴퓨팅 비용으로 인건비의 2.3배를 지출한다. 이는 일반 소프트웨어 기업의 AI 지출 규모와 수백 배의 격차를 보인다.

익스피디아, AI 에이전트 확장을 위한 '에이전틱 릴리스' 거버넌스 체계 공개

익스피디아, AI 에이전트 확장을 위한 '에이전틱 릴리스' 거버넌스 체계 공개

익스피디아 그룹이 AI 모델의 확장성과 안정적 운영을 위한 ML/AI 원칙과 운영 메커니즘을 공개했다. '에이전틱 릴리스(Agentic Release)' 톨게이트를 통해 소유권, 리스크 기반 거버넌스, 온-오프라인 평가를 필수 점검 항목으로 설정했다.

128GB 통합 메모리로 무장한 AMD의 4천 달러 AI 개발 키트 'Halo'

128GB 통합 메모리로 무장한 AMD의 4천 달러 AI 개발 키트 'Halo'

로컬 환경에서 LLM을 구동하려는 개발자들의 수요가 늘고 있다. AMD가 128GB 통합 메모리와 Zen 5 프로세서를 탑재한 'Ryzen AI Halo'를 공개했다. 3,999.99달러의 가격에 ROCm 기반 AI 개발 환경을 즉시 사용할 수 있는

엑스박스 쳐내고 AI에 25억 달러 쏟는 MS, 4,800명 전격 해고

엑스박스 쳐내고 AI에 25억 달러 쏟는 MS, 4,800명 전격 해고

빅테크의 인력 감축이 계속되는 가운데 마이크로소프트가 대규모 해고를 단행했다. 전 세계 인력의 2.1%인 4,800명을 감원하며 엑스박스와 영업 부문을 대폭 축소한다. 절감한 비용은 기업용 AI 배포를 위한 '프론티어 컴퍼니'에 25억 달러를 투자하는

앤스로픽, 클로드 구독제 개편으로 서드파티 에이전트 비용 인상

앤스로픽, 클로드 구독제 개편으로 서드파티 에이전트 비용 인상

앤스로픽이 클로드 구독 계정의 사용 범위를 자사 도구와 외부 SDK로 분리하는 과금 체계 변경을 단행했다. 6월 15일부터 서드파티 도구 사용 시 Pro $20, Max $100~$200의 별도 크레딧이 적용되며 소진 후에는 API 표준 요금이 부과된