KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 80 pt3. Muse Spark 1.3 (max) 44 pt4. gpt-oss-120b (high) 40 pt5. GPT-5.6 Luna (max) 27 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

아이폰보다 얇다, SpaceX가 준비하는 AI 전용 단말기

아이폰보다 얇다, SpaceX가 준비하는 AI 전용 단말기

스마트폰 이후의 새로운 AI 전용 기기에 대한 시장의 관심이 높다. SpaceX가 아이폰보다 얇은 형태의 AI 단말기 시제품을 투자자에게 공개했다. 자체 OS와 xAI 기술을 결합해 구글 안드로이드 같은 외부 플랫폼에서 독립한다.

작가 벤자민 홀런, AI 질문으로 인한 창작 정체와 'Writing Month' 시작

작가 벤자민 홀런, AI 질문으로 인한 창작 정체와 'Writing Month' 시작

작가 벤자민 홀런이 AI에 대한 반복적인 질문이 창작자의 동기를 저해하고 심리적 위축을 일으킨다고 밝혔다. 그는 지난 3년간 AI 관련 질문으로 인한 자기 의심으로 집필 정체를 겪었으며, 이에 대응해 'Writing Month'를 시작했다. 이는 AI

73조 토큰 쓴 메타, '토큰 낭비' 잡는 AI 게이트웨이 도입

73조 토큰 쓴 메타, '토큰 낭비' 잡는 AI 게이트웨이 도입

업무 효율을 위해 쓴 AI가 기업에는 감당하기 힘든 청구서로 돌아오고 있다. 메타 직원들이 한 달간 73.7조 개의 토큰을 소비하며 수십억 달러의 비용 발생 위기에 처했다. 이에 메타는 사용량 경쟁을 부추기던 리더보드를 없애고 중앙 통제 시스템인 'A

AI 도입 속도에 밀려난 통제권, 기업 85%가 겪는 '주도권 전쟁'

AI 도입 속도에 밀려난 통제권, 기업 85%가 겪는 '주도권 전쟁'

기업들이 AI 도입을 서두르면서 관리 체계가 무너지는 현상이 나타나고 있다. 85%의 기업이 여러 AI 플랫폼의 주도권 다툼을 겪으며 통제력을 잃고 있다. 특히 10%만이 자동 모니터링을 갖췄으며, 나머지는 수동 점검에 의존하는 실정이다.

수출통제 뚫고 복귀한 Claude Fable 5, 99% 탈옥 차단 장치 탑재

수출통제 뚫고 복귀한 Claude Fable 5, 99% 탈옥 차단 장치 탑재

글로벌 AI 모델의 출시와 중단이 기술력이 아닌 국가 규제 영역의 문제로 이동했다. Anthropic이 미 상무부의 수출통제 해제에 따라 Claude Fable 5를 전 세계에 재배포했다. 99% 이상의 탈옥을 차단하는 신규 안전 분류기를 탑재해 보안

뻔한 답변을 거부하는 Flint, 특정 구간만 랜덤하게 섞는 LLM 전략

뻔한 답변을 거부하는 Flint, 특정 구간만 랜덤하게 섞는 LLM 전략

LLM을 쓰다 보면 누구나 비슷하고 뻔한 '평균적인' 답변에 답답함을 느낀다. 스타트업 Springboards는 Qwen 3를 튜닝해 특정 지점에서만 무작위성을 높이는 모델 Flint를 공개했다. 전체 텍스트가 아닌 핵심 키워드 출력 직전에만 변동성을

Anthropic, 클로드 Fable 5 글로벌 출시 및 Mythos 5 수출 제한 해제

Anthropic, 클로드 Fable 5 글로벌 출시 및 Mythos 5 수출 제한 해제

미국 정부가 Anthropic의 최신 모델인 Fable 5와 Mythos 5에 대한 수출 제한을 해제했다. Fable 5는 전 세계에 출시되며, Mythos 5는 미국 내 조직의 접근 권한이 복구됐다.

"수수료 30% 대신 2.9%" Square, AI 비서 주문 시대 연다

"수수료 30% 대신 2.9%" Square, AI 비서 주문 시대 연다

배달 앱의 높은 중개 수수료 때문에 식당들이 적자를 보는 일이 흔해졌습니다. Square가 ChatGPT와 Claude에 직접 주문 기능을 통합해 중간 수수료를 없앴습니다. AI 비서가 메뉴 추천부터 결제까지 처리하며 식당의 수익 구조를 근본적으로 바

모바일에서 Claude Code 제어하는 오픈소스 허브 'NS Hub' 공개

모바일에서 Claude Code 제어하는 오픈소스 허브 'NS Hub' 공개

Claude Code를 모바일 브라우저에서 실행하고 작업 컨텍스트를 유지하는 NS Hub가 공개됐다. Stone 시스템을 통해 대화 단위로 태스크를 저장하며 AGPL v3 라이선스로 제공된다.

2개월 작업을 하루로 줄인 '클로드 페이블 5', 미국 규제 풀고 글로벌 복귀

2개월 작업을 하루로 줄인 '클로드 페이블 5', 미국 규제 풀고 글로벌 복귀

기업들이 AI 모델의 성능과 규제 리스크 사이에서 갈등하고 있다. 미국 상무부의 수출 통제 철회로 앤스로픽의 최상위 모델 '클로드 페이블 5'가 글로벌 시장에 복귀했다. 100만 토큰당 입력 10달러라는 최고가 정책과 함께 7월 7일까지 한시적 무료

구글 제미나이 스파크, 맥 OS 상륙... 파일 정리부터 예약까지 '대행'

구글 제미나이 스파크, 맥 OS 상륙... 파일 정리부터 예약까지 '대행'

PC에서 AI를 쓰려면 웹브라우저를 켜거나 단순 챗봇과 대화하는 게 일반적이었습니다. 구글이 내 컴퓨터의 파일을 직접 다루고 외부 앱과 연결되는 AI 에이전트 '제미나이 스파크'를 맥 OS용으로 출시했습니다. 구글 킵과 태스크는 물론 캔바, 드롭박스

클라우드 API 의존 끝낸다, 자율 코딩 모델 Ornith-1.0 공개

클라우드 API 의존 끝낸다, 자율 코딩 모델 Ornith-1.0 공개

ChatGPT가 짠 코드를 터미널에 복사해 직접 오류를 수정하던 시대가 끝난다. 스스로 터미널을 조작하고 성능을 개선하는 에이전틱 코딩 모델 Ornith-1.0이 공개됐다. 35B 모델 기준 터미널 조작 성능에서 Qwen 3.5와 Gemma 4를 크게

Claude·ChatGPT 대화 분기 경로 시각화하는 크롬 확장 'Show GN' 공개

Claude·ChatGPT 대화 분기 경로 시각화하는 크롬 확장 'Show GN' 공개

Claude와 ChatGPT의 대화 분기를 트리 그래프로 보여주는 크롬 확장 프로그램 Show GN이 공개됐다. 대화 경로를 한눈에 파악하고 이전 분기로 빠르게 이동하거나 그래프 형태로 내보낼 수 있다.

Anthropic, 과학 연구 특화 '클로드 사이언스' 공개

Anthropic, 과학 연구 특화 '클로드 사이언스' 공개

Anthropic이 과학적 연구와 데이터 분석에 최적화된 '클로드 사이언스(Claude Science)'를 발표했다. 복잡한 과학 논문과 방대한 데이터를 처리하는 데 특화된 기능을 제공한다.

자율성을 낮췄더니 업무 시간이 절반으로 — 모건스탠리의 AI 에이전트 실무법

자율성을 낮췄더니 업무 시간이 절반으로 — 모건스탠리의 AI 에이전트 실무법

기업용 AI 도입의 최대 난제는 모델의 판단을 어디까지 신뢰하고 통제할 것인가이다. 모건스탠리는 P&L 정산 업무에 AI 에이전트 'FIXR'를 도입해 작업 시간을 6시간에서 2~3시간으로 단축했다. 자율성을 높이는 대신 인간의 피드백을 고정 규칙으로

"책임 못 지는 AI 코드는 사절" — 게임 엔진 고도의 파격 선언

"책임 못 지는 AI 코드는 사절" — 게임 엔진 고도의 파격 선언

오픈소스 프로젝트는 전 세계 개발자들이 함께 코드를 짜며 성장한다. 최근 AI가 생성한 저품질 코드가 쏟아지며 검토자들의 피로도가 극에 달했다. 이에 고도 재단은 AI 작성 코드와 자동 제출된 PR을 전면 금지하기로 했다.

Deep엔비디아의 빈틈 노린 Etched — 기업가치 50억 달러와 10억 달러 수주

엔비디아의 빈틈 노린 Etched — 기업가치 50억 달러와 10억 달러 수주

AI 모델을 실제 서비스로 돌릴 때 가장 비용이 많이 드는 구간이 추론 단계다. 엔비디아의 대항마 Etched가 추론 전용 칩 시스템으로 10억 달러의 수주를 기록했다. 최근 5억 달러 투자를 유치하며 기업가치 50억 달러의 유니콘으로 급성장했다.

생성형 AI 검색 최적화(GEO) 적용 시 치과 추천 노출률 11%에서 27%로 상승

생성형 AI 검색 최적화(GEO) 적용 시 치과 추천 노출률 11%에서 27%로 상승

생성형 AI 검색 최적화(GEO)를 통해 특정 치과의 AI 추천 노출률이 2주 만에 11%에서 27%로 상승했다. 대조군과 비교 실험을 통해 구조화된 정보 제공과 콘텐츠 정비의 효과를 확인했다.

다시 풀린 족쇄, 앤스로픽 '미토스·페이블' 글로벌 공개

다시 풀린 족쇄, 앤스로픽 '미토스·페이블' 글로벌 공개

미국 정부가 앤스로픽의 최신 AI 모델에 걸었던 수출 제한 조치를 전격 해제했다. 가장 진보된 모델로 평가받는 미토스(Mythos)와 페이블(Fable)의 접근이 다시 허용된다. 아시아권 AI 모델의 급성장으로 인한 글로벌 경쟁력 약화 우려가 이번 결

웨이브, 기업가치 85억 달러 평가 기반으로 8,500만 달러 규모 직원 구주 매각 실시

웨이브, 기업가치 85억 달러 평가 기반으로 8,500만 달러 규모 직원 구주 매각 실시

영국 자율주행 스타트업 웨이브(Wayve)가 8,500만 달러 규모의 직원 구주 매각(Tender Offer)을 진행한다. 기업가치 85억 달러를 기준으로 기존 및 신규 투자자들이 참여하며, 이는 최근 12억 달러 규모의 시리즈 D 투자에 이은 조치다

클로드 코드 2.1.196, ANTHROPIC_BASE_URL 설정 시 시스템 프롬프트에 분류 신호 숨김

클로드 코드 2.1.196, ANTHROPIC_BASE_URL 설정 시 시스템 프롬프트에 분류 신호 숨김

앤스로픽의 개발 도구 클로드 코드(Claude Code) 2.1.196 버전에서 시스템 프롬프트 내 날짜 표기를 통해 API 경로 정보를 숨기는 스테가노그래피 기능이 발견됐다. ANTHROPIC_BASE_URL 설정 값과 시간대가 특정 조건(중국 AI

Tidal, AI 생성 음악 수익화 중단 및 7월 중순 식별 태그 도입

Tidal, AI 생성 음악 수익화 중단 및 7월 중순 식별 태그 도입

Tidal이 AI 생성 음악의 수익화를 금지하고 로열티 배분 우선순위를 인간 창작자에게 두는 정책을 발표했다. 7월 중순부터 100% AI 생성 콘텐츠에 식별 태그를 부착하며, 사기성 AI 음악은 차단 및 삭제한다. AI 생성물의 정의와 수익 권한에

Pi 코딩 에이전트용 서브에이전트 확장 기능 'pi-subagents' 공개

Pi 코딩 에이전트용 서브에이전트 확장 기능 'pi-subagents' 공개

Pi 코딩 에이전트가 작업을 자식 세션에 위임하는 확장 기능 pi-subagents가 공개됐다. 코드 리뷰, 구현, 병렬 감사 등 추가 시각이 필요한 작업을 자연어 요청만으로 처리한다. git worktree 격리와 재귀 깊이 제한을 통해 안정적인 병

AI가 만든 뻔한 UI '슬롭' 잡는다, Atlassian의 DESIGN.md 실험

AI가 만든 뻔한 UI '슬롭' 잡는다, Atlassian의 DESIGN.md 실험

AI로 UI를 만들면 브랜드 색깔 없이 다 비슷비슷하게 나오는 문제가 있습니다. Atlassian은 디자인 정체성을 담은 Markdown 파일인 DESIGN.md를 도입해 이를 해결하려 합니다. 프로토타입에서는 효과적이지만 실제 서비스 적용 시 토큰

모바일로 들어온 오픈소스 에이전트, OpenClaw 앱 출시

모바일로 들어온 오픈소스 에이전트, OpenClaw 앱 출시

스마트폰으로 AI와 대화하는 것을 넘어 AI가 직접 일을 처리하는 시대가 열리고 있다. 오픈소스 AI 에이전트 OpenClaw가 Android와 iOS 앱을 공식 출시했다. 전용 게이트웨이를 통해 모바일에서도 코딩과 식단 계획 등 에이전트 기능을 수행

개인 1명이 한 달 만에 모노레포 통합, AI 시대의 엔지니어링 리더십

개인 1명이 한 달 만에 모노레포 통합, AI 시대의 엔지니어링 리더십

AI 코딩 도구의 보급으로 개발 생산성의 임계점이 바뀌었다. 대규모 마이그레이션을 팀이 아닌 개인 1명이 기존 시간의 10%만으로 완수한다. 단순 코드 생성을 넘어 테스트와 CI/CD 등 '개발 하네스' 구축이 성패를 결정한다.

모델 성능보다 워크플로우에 베팅한 앤스로픽의 Claude Science

모델 성능보다 워크플로우에 베팅한 앤스로픽의 Claude Science

과학 연구의 파편화된 데이터베이스와 도구 전환 불편을 해결한다. 60개 이상의 DB와 멀티 에이전트 체계를 통합한 워크벤치 Claude Science를 공개했다. 특화 모델을 내세운 OpenAI, 독점 모델의 구글과 달리 범용 모델 기반의 넓은 접근성

데이터 분석부터 HPC 제어까지, 연구실 워크벤치를 통합한 'Claude Science'

데이터 분석부터 HPC 제어까지, 연구실 워크벤치를 통합한 'Claude Science'

AI가 단순 채팅을 넘어 실제 연구 파이프라인을 실행하는 단계로 진입했다. 앤스로픽이 공개한 'Claude Science'는 데이터 분석, DB 검색, HPC 클러스터 관리를 통합한 전용 앱이다. 모든 결과물에 실행 코드와 환경을 결합해 재현성을 확보

앤스로픽, 플래그십 성능 구현한 '클로드 소네트 5' 공개... API 가격 60% 낮췄다

앤스로픽, 플래그십 성능 구현한 '클로드 소네트 5' 공개... API 가격 60% 낮췄다

앤스로픽이 플래그십 모델에 근접한 성능을 갖춘 미드티어 모델 '클로드 소네트 5'를 출시했다. 표준 가격 기준 오퍼스 4.8보다 약 60% 저렴하며, 에이전트 코딩 및 추론 벤치마크에서 대폭적인 성능 향상을 보였다. 기업들이 AI 에이전트를 파일럿 단

오퍼스급 성능을 더 싸게, 앤스로픽이 던진 '에이전트 가성비' 소네트 5

오퍼스급 성능을 더 싸게, 앤스로픽이 던진 '에이전트 가성비' 소네트 5

AI가 대화를 넘어 스스로 계획하고 도구를 쓰는 '에이전트' 능력이 기본 사양이 되고 있다. 앤스로픽은 오퍼스 4.8에 근접한 성능을 내면서 비용은 대폭 낮춘 클로드 소네트 5를 공개했다. 입력 토큰당 2~3달러의 가격으로 고성능 에이전트의 실무 도입