KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 90 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Muse Spark 1.3 (max) 46 pt3. gpt-oss-120b (high) 39 pt4. GPT-5.6 Luna (max) 27 pt5. GPT-5.6 Terra (max) 22 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

AI 추론 크레딧 리셀 시장 등장, 하루 10만 달러 규모 비공식 거래 확인

AI 추론 크레딧 리셀 시장 등장, 하루 10만 달러 규모 비공식 거래 확인

스타트업의 미사용 AI 크레딧을 사고파는 '토큰 브로커'와 리셀 마켓플레이스가 등장했다. AI Credits, CheapCredits 등의 플랫폼과 텔레그램 채널을 통해 하루 10만 달러 규모의 크레딧 공급이 확인됐다. 프록시 서버를 통한 우회 접속

앤스로픽 다리오 아모데이 CEO, AI 반발 원인을 '신뢰의 위기'로 정의했다

앤스로픽 다리오 아모데이 CEO, AI 반발 원인을 '신뢰의 위기'로 정의했다

다리오 아모데이 앤스로픽 CEO가 AI 위험 경고가 산업 반발을 부추겼다는 주장에 반박했다. 그는 현재의 부정적 여론이 기업과 정부에 대한 근본적인 신뢰 위기이며 약속한 혜택을 실현하지 못한 결과라고 분석했다. 특히 프런티어 AI 기업의 속도를 늦추고

초등 데이터만 학습한 LittleLearner, 사전 학습 필터가 능력의 천장을 결정한다

초등 데이터만 학습한 LittleLearner, 사전 학습 필터가 능력의 천장을 결정한다

미국 초등 교육과정(K-5) 데이터만으로 학습시킨 LittleLearner 모델 3종이 공개됐다. 모델 크기 확장과 GRPO 후속 학습을 적용해도 사전 학습 범위를 벗어난 능력은 회복되지 않았다. 사전 학습 데이터의 경계가 모델의 최종 성능 한계를 결

에이전트 설계, 단일 루프에서 그래프 기반 오케스트레이션으로 확장

에이전트 설계, 단일 루프에서 그래프 기반 오케스트레이션으로 확장

에이전트 설계 방식이 단일 목표를 반복 수행하는 '루프'에서 여러 루프를 연결하는 '그래프' 구조로 확장되고 있다. 그래프 엔지니어링은 병렬 실행, 상태 전달, 거부 권한 등 오케스트레이션 설계를 통해 복잡한 작업 흐름을 관리한다. 실무자는 에이전트

LLM 평가 하네스, 모델이 가장 확신할 때 틀린다는 사실 발견했다

LLM 평가 하네스, 모델이 가장 확신할 때 틀린다는 사실 발견했다

LLM 기반 기업용 도구의 정확성을 검증하기 위해 정답 데이터(Ground Truth) 기반의 평가 하네스가 구축됐다. 합성 데이터셋과 랭킹 기반 스코어링 함수로 검증한 결과, 모델은 정답과 거리가 멀 때 오히려 높은 확신도를 보였다. 실무자는 단순

Cloudflare, 인프라 전문성 버리고 'AI 기능 나열'에 빠진 이유

Cloudflare, 인프라 전문성 버리고 'AI 기능 나열'에 빠진 이유

안정적인 인프라 기업이었던 Cloudflare가 기능 출시 속도만 쫓는 AI 제품 중심 회사로 변질되었다. 파편화된 저장소·컴퓨팅 도구와 베타 상태의 관측 도구들이 개발자 경험(DX)을 심각하게 해치고 있다. Cloudflare 생태계 도입 예정자는

AI의 수학적 성과, 추론 지능보다 '작업 기억' 확장 결과

AI의 수학적 성과, 추론 지능보다 '작업 기억' 확장 결과

AI가 어려운 수학 문제를 해결하는 핵심 동력이 지능 향상이 아닌 압도적인 작업 기억 용량에 있다는 분석이 나왔다. 방대한 컨텍스트 윈도우를 외부 작업 공간으로 활용해 수백 개의 중간 식과 제약 조건을 동시에 유지하는 방식이다. 실무자는 모델의 '생각

Anthropic, Claude에 SynthID-Text 기반 워터마크 도입

Anthropic, Claude에 SynthID-Text 기반 워터마크 도입

Anthropic이 챗봇 Claude의 생성 텍스트에 워터마크를 도입한다. 구글 딥마인드의 SynthID-Text 방식을 채택하며, 향후 워터마크 탐지 API를 공개할 계획이다. EU AI 법(EU AI Act)의 투명성 코드 준수를 위한 조치로, 코

AI 협업 패러다임 전환: 명령어 기반 코딩에서 의도 중심 리더십으로

AI 협업 패러다임 전환: 명령어 기반 코딩에서 의도 중심 리더십으로

AI와의 상호작용 방식이 결정론적 명령어 입력에서 의도 중심의 협업 형태로 변화하고 있다. 동일 입력에 대해 매번 다른 결과가 도출되는 확률적 특성으로 인해 맥락 공유와 결과 정의가 핵심으로 부상했다. 실무자는 단순 프롬프트 작성을 넘어 작업의 목적과

SpaceX, AI 코딩 스타트업 커서(Cursor) 공식 인수

SpaceX, AI 코딩 스타트업 커서(Cursor) 공식 인수

SpaceX가 AI 코딩 스타트업 커서를 공식 인수했다. 커서는 SpaceX의 대규모 GPU 인프라를 활용해 AI 코딩 기능을 확장한다.

Claude Code 플러그인 'ballast' 공개, 작업 절차 시스템화 지원

Claude Code 플러그인 'ballast' 공개, 작업 절차 시스템화 지원

Claude Code의 작업 절차를 시스템으로 만드는 플러그인 ballast가 공개됐다. 세션이 바뀌어도 학습 내용과 검증 절차를 유지하며 규칙 카탈로그를 통해 지침을 자동 주입한다.

MIDI 편집과 AI 채팅 결합한 Suno Studio 2.0, 단순 생성기에서 DAW로 확장

MIDI 편집과 AI 채팅 결합한 Suno Studio 2.0, 단순 생성기에서 DAW로 확장

Suno Studio 2.0이 MIDI 편집, 오디오 효과, 스템 분리 기능을 추가하며 DAW 형태로 확장했다. MIDI 데이터를 AI 생성 조건으로 활용하고, 자연어 채팅으로 프로젝트 전체의 믹싱과 커스텀 효과 생성을 수행한다. Premier 구독자

Claude Code, /goal과 /loop 기반의 루프 엔지니어링 공개

Claude Code, /goal과 /loop 기반의 루프 엔지니어링 공개

Claude Code가 에이전트의 자율적 반복 실행을 위한 루프 엔지니어링 도구를 공개했다. 측정 가능한 목표 달성까지 반복하는 /goal과 일정 주기마다 실행되는 /loop 기능을 제공한다. /loop는 세션 범위 내에서 작동하며 생성 후 7일이 지

hubble.md, 사람-에이전트 협업용 오픈소스 노트 앱 공개

hubble.md, 사람-에이전트 협업용 오픈소스 노트 앱 공개

Markdown과 HTML 기반의 무료 오픈소스 노트 앱 hubble.md가 공개됐다. 사람과 AI 에이전트가 동일한 노트 폴더에서 협업하며 실시간 편집 내용을 공유한다.

DeepSeek, V4-Pro 공개 및 API 시간대별 차등 요금제 도입

DeepSeek, V4-Pro 공개 및 API 시간대별 차등 요금제 도입

DeepSeek가 V4-Pro 모델을 출시하고 추론 강도 조절 기능을 추가했다. OpenAI Responses API를 네이티브로 지원하며 Codex 최적화 설정을 제공한다. 2026년 8월 16일부터 이용률에 따라 요금이 달라지는 차등 요금제를 적용

Z.ai, GLM-5.3 공개... 포스트 트레이닝 확장으로 사이버 보안 및 코딩 성능 강화

Z.ai, GLM-5.3 공개... 포스트 트레이닝 확장으로 사이버 보안 및 코딩 성능 강화

Z.ai가 포스트 트레이닝을 확장한 GLM-5.3 모델을 공개했다. 7430억 개 파라미터의 기존 베이스 모델을 유지하며 사이버 보안 및 롱호라이즌 코딩 능력을 높였다. API 접근과 가중치 공개는 안전성 평가 완료 후 약 2주 뒤에 진행될 예정이다.

Claude Code, 프롬프트 캐싱 기반 토큰 비용 구조와 컨텍스트 최적화 방식 공개

Claude Code, 프롬프트 캐싱 기반 토큰 비용 구조와 컨텍스트 최적화 방식 공개

앤스로픽이 에이전트 기반 코딩 도구인 Claude Code의 토큰 소비 구조와 비용 최적화 방법을 공개했다. 프롬프트 캐싱을 통해 읽기 비용을 입력가의 0.1배로 낮췄으며, 출력 토큰 비용은 입력보다 약 5배 높게 책정된다. 개발자는 /clear와 /

표준 GPU에서 3,000 TPS 구현한 Kog, LLM 30배 가속화 도전

표준 GPU에서 3,000 TPS 구현한 Kog, LLM 30배 가속화 도전

프랑스 스타트업 Kog가 표준 데이터센터 GPU의 소프트웨어 최적화로 추론 속도를 극대화하는 KIE를 공개했다. Laneformer 2B 모델 기준 3,000 TPS를 기록했으며, 저수준 리버스 엔지니어링으로 GPU 메모리 대역폭을 완전히 활용한다.

암호화된 데이터 그대로 AI 추론하는 구글 HEIR 공개

암호화된 데이터 그대로 AI 추론하는 구글 HEIR 공개

구글이 암호화된 상태의 데이터를 복호화 없이 처리하는 오픈소스 컴파일러 HEIR를 공개했다. 기존 AI 모델을 암호화 입력 기반으로 자동 변환해 암호학 전문가 없이도 프라이빗 AI 구현이 가능하다. 의료·금융 등 보안이 필수적인 도메인의 실무자는 Gi

"생각하고 답한다" Qwen 3.8-27B, 추론 제어와 26만 토큰 컨텍스트 공개

"생각하고 답한다" Qwen 3.8-27B, 추론 제어와 26만 토큰 컨텍스트 공개

Qwen 오픈 모델 시리즈의 최신 세대인 Qwen 3.8-27B가 공개되었다. 기본 추론 모드와 reasoning_effort 파라미터를 통해 사고 깊이와 비용을 조절할 수 있다. 추론 모델의 비용 효율성과 긴 문맥 처리 능력이 필요한 실무자는 파라미

아마존·구글·메타·MS, AI 전력용 천연가스 발전소 건설... 가격 3배 상승 가능성 제기

아마존·구글·메타·MS, AI 전력용 천연가스 발전소 건설... 가격 3배 상승 가능성 제기

빅테크 기업들이 AI 데이터센터 전력 확보를 위해 대규모 천연가스 발전소 건설에 나섰다. 메타(7.5GW)와 아마존(7.6GW)을 비롯해 구글과 마이크로소프트가 텍사스와 루이지애나에 기가와트급 발전소를 짓고 있다. 에너지 조사기관 노레바(Noreva)

Hexis, Git 저장소 기반 AI 에이전트 스킬 및 권한 제어 평면 공개

Hexis, Git 저장소 기반 AI 에이전트 스킬 및 권한 제어 평면 공개

Bevel이 AI 에이전트의 스킬, 도구, 권한을 중앙 관리하는 오픈소스 제어 평면 'Hexis'를 공개했다. MCP(Model Context Protocol)를 지원하며 모든 설정과 권한을 Git 저장소의 파일 형태로 관리해 변경 이력과 승인 절차를

레오폴드 아셴브레너의 헤지펀드 붕괴와 AI 랩의 '지적 오만' 리스크

레오폴드 아셴브레너의 헤지펀드 붕괴와 AI 랩의 '지적 오만' 리스크

전 OpenAI 멤버 레오폴드 아셴브레너가 설립한 헤지펀드 '시추에이셔널 어웨어니스'가 막대한 손실을 입었다. 약 4배의 레버리지를 활용해 AI 인프라에 투자하고 소프트웨어 기업에 숏 포지션을 잡은 전략이 실패하며 붕괴했다. AI 전문가들이 좁은 전문

Copilot 앱 통합하는 마이크로소프트, 8월 18일까지 저성과 기능 삭제

Copilot 앱 통합하는 마이크로소프트, 8월 18일까지 저성과 기능 삭제

마이크로소프트가 소비자용과 기업용 Copilot 앱을 하나로 통합한다. 2026년 8월 18일까지 그룹 채팅, AI 팟캐스트 등 저성과 기능을 삭제한다. 실무자는 사용 중인 실험적 기능의 삭제 여부와 OneDrive 파일 이전 상태를 확인해야 한다.

AI 코딩 서브에이전트 위임 시 발생하는 고정 비용과 효율적 판단 기준

AI 코딩 서브에이전트 위임 시 발생하는 고정 비용과 효율적 판단 기준

AI 코딩 서브에이전트 위임 시 프롬프트 캐시 미공유와 지시서 작성으로 인한 고정 비용이 발생한다. 작업 규모가 작으면 직접 실행이 경제적이며, 대량 작업이나 병렬 처리가 필요할 때 위임이 유리하다.

구글, 코딩·에이전트 특화 제미나이 3.7 플래시 공개... API 가격 50% 인하

구글, 코딩·에이전트 특화 제미나이 3.7 플래시 공개... API 가격 50% 인하

구글이 코딩과 에이전트 워크플로우에 최적화된 제미나이 3.7 플래시(Gemini 3.7 Flash)를 공개했다. 2026년 말까지 입력 토큰 100만 개당 0.75달러, 출력 토큰 100만 개당 3.75달러의 한시적 할인 가격을 적용한다. 개발자는 단

엔비디아, 5,000억 달러 AI 데이터센터 펀딩 및 GPU 잔존 가치 보장 계획 발표

엔비디아, 5,000억 달러 AI 데이터센터 펀딩 및 GPU 잔존 가치 보장 계획 발표

엔비디아가 블랙록, 골드만삭스 등 주요 금융사와 함께 최대 5,000억 달러 규모의 AI 데이터센터 구축 자금을 조달한다. 담보로 설정된 GPU의 가치가 하락할 경우 엔비디아가 그 차액의 최대 25%를 직접 보전하는 보증 체계를 도입한다. AI 실무자

DeepSeek-V4-Pro-0813 공개, DeepSeek 62.7점으로 실무 에이전트 성능 입증

DeepSeek-V4-Pro-0813 공개, DeepSeek 62.7점으로 실무 에이전트 성능 입증

DeepSeek-V4-Pro-0813이 정식 출시되며 에이전트 기능과 운영 안정성을 강화했다. DeepSeek 벤치마크 62.7점 달성 및 DSpark 예측 디코딩으로 추론 속도와 정확도를 높였다. 실무자는 reasoning_effort 설정과 vLL

캐피털원, 오픈웨이트 모델 커스텀해 멀티 에이전트 AI 플랫폼 구축

캐피털원, 오픈웨이트 모델 커스텀해 멀티 에이전트 AI 플랫폼 구축

캐피털원이 기성 파운데이션 모델 대신 오픈웨이트 모델을 커스텀한 멀티 에이전트 AI 플랫폼을 구축했다. Llama 모델에 독자 데이터를 학습시키고 MACAW라는 오케스트레이션 체계를 통해 사기 탐지 및 쇼핑 비서 서비스에 적용했다. 기업 실무자는 단일

구글·앤스로픽, LLM 텍스트 워터마킹 도입... 단어 선택 확률에 패턴 심는다

구글·앤스로픽, LLM 텍스트 워터마킹 도입... 단어 선택 확률에 패턴 심는다

구글과 앤스로픽이 AI 생성 텍스트를 식별하기 위한 워터마킹 기술을 도입했다. 구글은 2024년부터 제미나이에 적용했으며, 앤스로픽은 2026년 8월부터 신규 클로드 모델에 적용한다. 텍스트 길이에 따라 판별 정확도가 달라지며, 의미 기반의 전면 재작