KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 94 pt3. Muse Spark 1.3 (max) 48 pt4. gpt-oss-120b (high) 43 pt5. GPT-5.6 Luna (max) 28 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

에이전트로 Git을 Rust로 다시 쓴 Grit, 테스트 99% 통과

에이전트로 Git을 Rust로 다시 쓴 Grit, 테스트 99% 통과

Git은 20년간 명령 조합 방식으로 확장되어 실행 시마다 오버헤드가 발생하는 구조적 한계가 있다. Grit은 이를 해결하기 위해 Rust로 코어를 재구현하여 42,000개 테스트 중 99.3%를 통과했다. AI 에이전트를 활용해 36만 라인의 코드를

미국 성인 70%는 AI 안 쓴다... '전방위적 채택' 내러티브의 균열

미국 성인 70%는 AI 안 쓴다... '전방위적 채택' 내러티브의 균열

미국 내 AI 이용률이 활성 사용자, 간헐적 사용자, 비사용자로 약 3등분 된 것으로 나타났다. 마이크로소프트 데이터 기준 미국 노동 가능 인구의 30%만이 월 90분 이상 AI를 사용하고 있다. AI 기업들은 보편적 확산이라는 환상에서 벗어나 사용자

트릴리언에어 탄생시킨 스페이스X IPO, AI 랩 상장 경쟁의 신호탄

트릴리언에어 탄생시킨 스페이스X IPO, AI 랩 상장 경쟁의 신호탄

일론 머스크의 스페이스X가 역대 최대 규모의 기업공개(IPO)를 단행했다. 이번 상장으로 시장의 자본 흐름이 기존 소비자 서비스에서 AI 랩과 딥테크로 이동 중이다. OpenAI와 앤스로픽(Anthropic) 역시 기밀리에 상장 신청을 완료하며 경쟁에

금요일 오후 5시 21분, 미국 정부가 중단시킨 Fable 5 접근권

금요일 오후 5시 21분, 미국 정부가 중단시킨 Fable 5 접근권

고성능 AI 모델을 API나 채팅으로 이용하는 것은 이제 실무자의 일상적인 개발 환경이 됐다. 미국 정부가 국가안보를 이유로 Anthropic의 Fable 5와 Mythos 5에 대한 외국인 접근을 전격 차단했다. 단순 취약점 이슈를 넘어 정부의 일방

아마존의 '취약점 제보' 한 번에 해외 사용 막힌 앤스로픽 AI

아마존의 '취약점 제보' 한 번에 해외 사용 막힌 앤스로픽 AI

AI 모델이 해킹 도구로 악용될 수 있다는 보안 우려는 업계의 오랜 숙제입니다. 아마존의 제보를 받은 트럼프 행정부가 앤스로픽 최상위 모델의 해외 접근을 전격 차단했습니다. 정치적 갈등과 보안 이슈가 겹치며 앤스로픽의 IPO 계획과 글로벌 연구 환경에

구글·야후, 대량 발송자 DMARC 구성 요구하며 이메일 인증을 AI 인프라로 전환

구글·야후, 대량 발송자 DMARC 구성 요구하며 이메일 인증을 AI 인프라로 전환

구글과 야후가 2024년 초부터 대량 이메일 발송자에게 DMARC 구성을 필수 요구했다. SPF, DKIM, DMARC 기반의 인증 체계는 AI 필터와 AI 보조 도구가 발신자 신뢰도를 판단하는 핵심 입력값이 된다. AI가 사용자를 대신해 메일을 처리

murrdb, AI 추론용 RocksDB 기반 캐시 'Murr' 공개

murrdb, AI 추론용 RocksDB 기반 캐시 'Murr' 공개

AI 추론 워크로드 최적화를 위한 RocksDB 기반 NVMe/S3 캐시 Murr가 공개됐다. Redis 대비 읽기 성능을 높이고 S3 기반 영속성과 비용 효율성을 확보했다. Apache 2.0 라이선스로 제공된다.

악성코드 개발자, AI 보안 스캐너 무력화 위해 핵·생물무기 문구 삽입

악성코드 개발자, AI 보안 스캐너 무력화 위해 핵·생물무기 문구 삽입

악성코드 개발자들이 AI 보안 스캐너의 분석을 피하기 위해 스파이웨어에 핵·생물무기 관련 문구를 삽입했다. LLM의 안전 거부 기능을 악용해 보안 분석 파이프라인을 무력화하려는 시도다.

ChatGPT에 넣으면 끝? 전문 번역가가 밝힌 AI 도구의 한계와 실체

ChatGPT에 넣으면 끝? 전문 번역가가 밝힌 AI 도구의 한계와 실체

ChatGPT 등 AI 번역이 보편화되며 전문 작업의 가치가 단순 변환으로 오해받고 있다. 실제 번역은 현지화와 용어 일관성 확보가 핵심이며 AI는 오역과 누락 위험이 크다. AI를 스타일 가이드 점검과 용어 추출 도구로 활용하되 최종 판단은 전문가가

미 정부의 모델 차단 지시, Anthropic이 쏘아 올린 '소버린 AI' 경고장

미 정부의 모델 차단 지시, Anthropic이 쏘아 올린 '소버린 AI' 경고장

대부분의 AI 서비스는 OpenAI나 Anthropic 같은 미국 기업의 모델 API에 의존한다. Anthropic이 미 정부 지시로 최신 모델 Fable 5와 Mythos 5의 외국인 접근을 전격 차단했다. 이 사건은 특정 국가의 정책에 따라 서비스

20억 달러 쏟아부은 Meta의 결별, 중국 정부 압박에 Manus 인수 철회

20억 달러 쏟아부은 Meta의 결별, 중국 정부 압박에 Manus 인수 철회

글로벌 빅테크의 AI 인수가 기술 확보를 넘어 국가 간 정치적 갈등의 중심이 되고 있다. Meta가 중국계 AI 스타트업 Manus를 20억 달러에 인수했으나, 중국 정부의 안보 명령으로 운영 분리와 데이터 공유 중단을 시작했다. 이번 사례는 해외 법

AI 코딩 환경 구축의 세 가지 경로: 로컬 호스팅, API, 프런티어 구독 비용 분석

AI 코딩 환경 구축의 세 가지 경로: 로컬 호스팅, API, 프런티어 구독 비용 분석

AI 코딩 환경 구축을 위한 로컬 호스팅, API 렌탈, 프런티어 모델 구독의 세 가지 비용 효율적 경로를 분석했다. 월 400달러 수준의 구독 모델은 리스트 가격 기준 약 2,800달러의 API 사용량과 맞먹지만, 자동화 에이전트 구동 시에는 토큰

AI를 챗봇이 아닌 '정식 팀원'으로 쓰는 지라 대체제 Paca

AI를 챗봇이 아닌 '정식 팀원'으로 쓰는 지라 대체제 Paca

지라나 트렐로 같은 협업 도구에 티켓을 일일이 입력하는 건 늘 번거로운 일이다. AI가 단순 보조를 넘어 스프린트 계획과 태스크 수행에 직접 참여하는 오픈소스 도구 Paca가 공개됐다. MCP 서버와 클로드 코드 연동을 통해 AI 에이전트가 팀원처럼

상장 준비 중인 OpenAI, 미 주 법무장관들의 전방위 조사 직면

상장 준비 중인 OpenAI, 미 주 법무장관들의 전방위 조사 직면

ChatGPT로 익숙한 OpenAI가 미국 여러 주의 법무장관들로부터 조사를 받게 되었습니다. 뉴욕주 법무장관은 광고, 사용자 데이터 처리, 아동 및 노인 보호 관련 문서를 요구하는 소환장을 발송했습니다. 이번 조사는 플로리다주의 소송과 캐나다 총기

730만 달러 투자 후 돌연 아카이브된 LLMOps 플랫폼 TensorZero

730만 달러 투자 후 돌연 아카이브된 LLMOps 플랫폼 TensorZero

LLM 서비스 운영자는 모델 교체와 프롬프트 최적화라는 반복적인 관리 비용에 직면한다. TensorZero는 게이트웨이부터 관측, 평가, 최적화를 통합한 오픈소스 LLMOps 플랫폼이다. 포춘 10대 기업이 도입해 전 세계 LLM API 지출의 1%를

AI가 깎아먹은 임금, '생활비 인하' 모델로 메우는 앤드류 양의 실험

AI가 깎아먹은 임금, '생활비 인하' 모델로 메우는 앤드류 양의 실험

AI가 일자리를 대체하며 실질 소득이 감소하는 시대적 위기에 직면했다. 앤드류 양은 이익 추출 대신 비용을 낮춰 고객에게 돌려주는 '생활비 인하' 사업 모델을 제시한다. 최근 출시한 Noble Mobile은 수천 명의 고객과 수백만 달러의 매출을 기록

Deep앤스로픽, 클로드 마이토스·페이블 5 서비스 전격 중단

앤스로픽, 클로드 마이토스·페이블 5 서비스 전격 중단

앤스로픽이 최신 모델인 클로드 마이토스 5와 페이블 5의 접근을 중단했다. 예고 없는 서비스 중단으로 인해 해당 모델을 활용하던 실무자들의 혼란이 가중된다. 현재까지 구체적인 중단 사유나 서비스 재개 시점은 공개되지 않은 상태다.

"필요할 때 쓴다" OpenAI 코덱스의 토큰 리밋 리셋 도입

"필요할 때 쓴다" OpenAI 코덱스의 토큰 리밋 리셋 도입

AI 코딩 도구를 쓰다 보면 토큰 제한에 걸려 작업이 끊기는 경험을 한다. OpenAI가 코덱스 사용자에게 월 1회 토큰 리밋 리셋 기능을 기본 제공한다. 친구 추천을 통해 추가 리셋 권한을 얻는 획득 경로까지 마련했다.

텍스트도 이미지처럼 생성한다 — 구글 DiffusionGemma 공개

텍스트도 이미지처럼 생성한다 — 구글 DiffusionGemma 공개

LLM은 보통 다음 단어를 하나씩 예측해 문장을 이어 붙인다. 구글이 이미지 생성 방식인 확산 공정을 텍스트에 도입한 DiffusionGemma를 공개했다. 26B MoE 구조와 GGUF 양자화를 통해 24GB GPU 한 장으로 구동 가능하다.

잉크버드, AI 코치 기반 영어 일기 서비스 공개... 12만 라인 코드 AI 에이전트로 구현

잉크버드, AI 코치 기반 영어 일기 서비스 공개... 12만 라인 코드 AI 에이전트로 구현

AI 코치와 대화하며 영어 일기를 쓰고 복습하는 서비스 '잉크버드'가 공개됐다. 개인 메모리를 업데이트해 다음 질문에 반영하는 플라이휠 구조와 SRS 기반 복습 시스템을 갖췄다. 1인 개발자가 AI 에이전트를 활용해 12만 라인의 코드를 구현하며 개발

"가입 아니면 퇴사" — 메타 AI 학습에 동원된 6,500명 엔지니어의 반란

"가입 아니면 퇴사" — 메타 AI 학습에 동원된 6,500명 엔지니어의 반란

메타가 AI 패권을 잡기 위해 수조 원을 투자하며 조직을 급격하게 재편하고 있다. 최근 6,500명의 엔지니어를 '어플라이드 AI' 팀으로 강제 배치해 AI 학습 데이터 생성 업무에 투입했다. 단순 반복 작업에 지친 직원들이 청원과 항의를 쏟아내며 내

지능의 구독 경제화 경고, 오픈소스 AI가 생존 전략인 이유

지능의 구독 경제화 경고, 오픈소스 AI가 생존 전략인 이유

많은 기업이 OpenAI나 Google 같은 빅테크의 API를 빌려 AI 서비스를 구축하고 있다. 이러한 폐쇄적 구조는 단순한 비용 문제를 넘어 기업의 '운영 자유'를 심각하게 제한한다. 로컬 배포와 커뮤니티 거버넌스가 가능한 오픈소스 AI 체제로의

국가 안보 이유로 셧다운된 클로드 파블 5와 미토스 5

국가 안보 이유로 셧다운된 클로드 파블 5와 미토스 5

미국 정부가 국가 안보를 이유로 앤스로픽의 최상위 AI 모델 두 종의 접근을 전격 차단했다. 대상은 보안 취약점 탐지 능력이 탁월한 미토스 5와 최근 출시된 상용 모델 파블 5다. 앤스로픽은 타 모델에서도 가능한 수준의 취약점이라 반발했으나 전 세계

코드 리뷰 절차를 삭제하는 '대화 기반' 버전 관리 시스템 DeltaDB

코드 리뷰 절차를 삭제하는 '대화 기반' 버전 관리 시스템 DeltaDB

개발자는 코드를 수정하고 커밋한 뒤 풀 리퀘스트(PR)를 통해 리뷰를 받는다. Zed 팀은 대화와 코드 편집을 동시에 버전 관리하는 DeltaDB를 공개했다. 커밋 단위의 스냅샷 대신 모든 연산을 기록해 PR 없는 실시간 협업을 구현한다.

AI 에이전트의 무분별한 패키지 설치, JFrog가 '면역 체계'로 차단

AI 에이전트의 무분별한 패키지 설치, JFrog가 '면역 체계'로 차단

AI 에이전트가 스스로 기능을 확장하기 위해 배경에서 패키지를 설치하는 사례가 늘고 있다. NanoClaw와 JFrog가 협력해 검증된 레지스트리만 이용하게 하는 보안 통합 기능을 출시했다. 악성 코드가 포함된 라이브러리 요청을 차단하고 안전한 버전으

"코드 80%가 AI 작성" — 성과 아닌 '볼륨'에 갇힌 AI 코딩

"코드 80%가 AI 작성" — 성과 아닌 '볼륨'에 갇힌 AI 코딩

AI 코딩 도구 도입이 보편화되며 개발 환경이 빠르게 변하고 있다. 구글과 앤스로픽 등 주요 벤더들은 AI 작성 코드 비율이 75~80%에 달한다고 주장한다. 하지만 이는 결과 지표가 아닌 양적 수치이며, 실제 조직 단위 생산성 향상은 10% 수준에

"돈 모이면 AI가 짠다" FablePool의 공개 빌드 실험

"돈 모이면 AI가 짠다" FablePool의 공개 빌드 실험

킥스타터처럼 사람들이 돈을 모아 프로젝트를 만드는 방식은 익숙합니다. FablePool은 사람이 아닌 AI 에이전트가 빌더가 되어 거대 프롬프트를 수행합니다. 모든 자금 흐름과 토큰 지출 내역을 장부에 공개하며 결과물은 MIT 라이선스로 배포합니다.

탭 대신 무한 캔버스 펼치는 코딩 IDE 'Cate' 공개

탭 대신 무한 캔버스 펼치는 코딩 IDE 'Cate' 공개

수많은 창과 탭을 오가며 코딩하는 기존 IDE의 불편함에서 출발한다. 무한 캔버스 위에 에디터, 터미널, AI 에이전트를 자유롭게 배치하는 Cate가 공개됐다. Monaco 에디터와 Pi AI 에이전트를 탑재하고 MIT 라이선스로 제공된다.

Kimi K2.7-Code, 추론 토큰 30% 절감했으나 외부 검증은 미흡

Kimi K2.7-Code, 추론 토큰 30% 절감했으나 외부 검증은 미흡

코딩 모델의 추론 비용은 에이전트 워크플로우 운영의 핵심 변수다. Moonshot AI가 추론 토큰 사용량을 30% 줄인 Kimi K2.7-Code를 공개했다. 자체 벤치마크 성능은 상승했으나 독립 검증에서는 성능 저하가 관찰된다.

MiniMax-M3, 100만 토큰 처리 비용 20분의 1로 절감

MiniMax-M3, 100만 토큰 처리 비용 20분의 1로 절감

방대한 데이터를 한 번에 처리하는 초거대 컨텍스트 모델 경쟁이 치열하다. MiniMax가 100만 토큰을 지원하는 네이티브 멀티모달 모델 M3를 공개했다. MSA 기술을 통해 이전 모델 대비 추론 비용을 20분의 1 수준으로 낮췄다.