KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 85 pt3. Reve 2.1 74 pt4. grok-imagine-image-2.0 (low) 73 pt5. Nano Banana 2 (Gemini 3.1 Flash Image) 68 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 81 pt3. Muse Spark 1.3 (max) 65 pt4. gpt-oss-120b (high) 50 pt5. GPT-5.6 Luna (max) 30 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

AI를 정답지가 아닌 사고의 지렛대로 쓰는 법

AI를 정답지가 아닌 사고의 지렛대로 쓰는 법

AI가 확률 기반으로 작동하는 기술적 원리를 설명했다. 단순 대체가 아닌 사고 확장 도구로 활용하는 방법을 제시했다. 질문하는 능력이 미래의 핵심 경쟁력이 된다고 분석했다.

Eden AI, 단일 API로 수백 개 모델 통합 및 스마트 라우팅 구현

Eden AI, 단일 API로 수백 개 모델 통합 및 스마트 라우팅 구현

Eden AI가 여러 AI 모델을 단일 API로 통합하는 플랫폼을 제공한다. 스마트 라우팅 기능을 통해 모델 장애 시 자동으로 대체 모델로 전환한다. 비용, 지연 시간, 실행 지역에 따라 최적의 모델을 선택해 벤더 종속성을 방지한다.

DeepSeek-V4 출시, 100만 토큰 처리 시 메모리 점유율 10%로 절감

DeepSeek-V4 출시, 100만 토큰 처리 시 메모리 점유율 10%로 절감

DeepSeek-V4가 100만 토큰 컨텍스트를 지원하며 출시되었다. 전문가 혼합 방식과 하이브리드 어텐션을 통해 키-값 캐시를 10% 수준으로 낮췄다. 개발자는 HuggingFace를 통해 모델을 내려받아 온프레미스 환경에 배포할 수 있다.

ModMix, 두 게임을 조합해 기획안과 아트워크를 생성하는 AI 도구 출시

ModMix, 두 게임을 조합해 기획안과 아트워크를 생성하는 AI 도구 출시

ModMix이 두 게임과 태그를 조합해 게임 기획안을 생성한다. Anthropic Claude와 Flux schnell 모델을 활용해 비용을 최적화했다. 3주간의 스프린트를 거쳐 누적 비용 0.14달러로 서비스를 구현했다.

100줄 코드로 구현한 mini-swe-agent, AI 코딩 에이전트의 경량화

100줄 코드로 구현한 mini-swe-agent, AI 코딩 에이전트의 경량화

프린스턴과 스탠퍼드 연구팀이 100줄짜리 AI 코딩 에이전트를 공개했다. 별도의 복잡한 도구 호출 없이 bash 명령만으로 소프트웨어 이슈를 해결한다. SWE-bench 벤치마크에서 74% 이상의 성능을 기록하며 범용성을 입증했다.

PM 없는 스타트업, Slack과 Claude Code로 3배 빠른 실험

PM 없는 스타트업, Slack과 Claude Code로 3배 빠른 실험

샌프란시스코의 AI 네이티브 기업들이 전담 PM을 없애고 엔지니어 중심의 운영 모델로 전환하고 있다. Slack을 에이전트 오케스트레이션 허브로 활용하며 실험 비용을 획기적으로 낮추고 있다. AI 내재화 속도에 따라 기업 간의 생산성 격차가 매주 벌어

람다 대수 벤치마크, AI 논리 추론 능력 18% 향상 확인

람다 대수 벤치마크, AI 논리 추론 능력 18% 향상 확인

람다 대수 벤치마크가 AI 모델의 추론 능력을 측정하기 위해 공개되었다. 새로운 평가 체계는 기존 모델의 논리적 오류를 18% 더 정밀하게 포착한다. 복잡한 함수형 프로그래밍 구조를 통해 모델의 연산 정확도를 검증한다.

AI 산업을 향한 대중의 반감과 데이터 센터 갈등의 실체

AI 산업을 향한 대중의 반감과 데이터 센터 갈등의 실체

AI 산업에 대한 대중의 부정적 인식이 급격히 확산되고 있다. 기업의 생산성 향상 지표와 실제 현장의 체감 사이에는 큰 괴리가 존재한다. 데이터 센터 확충으로 인한 전기료 상승 등 실질적 피해가 반발을 키운다.

구글 Gemini Enterprise Agent Platform 출시, 200개 모델 통합 에이전트 인프라 공개

구글 Gemini Enterprise Agent Platform 출시, 200개 모델 통합 에이전트 인프라 공개

구글 클라우드가 Gemini Enterprise Agent Platform을 공식 출시했다. 200개 이상의 모델을 지원하며 에이전트의 전 생애주기를 단일 환경에서 관리한다. 보안 샌드박스와 장기 기억 기능을 통해 기업용 AI 에이전트 운영 인프라를

AI 에이전트용 오픈소스 메모리 레이어와 계층적 네임스페이스 도입

AI 에이전트용 오픈소스 메모리 레이어와 계층적 네임스페이스 도입

AI 에이전트의 기억을 체계적으로 관리하는 오픈소스 메모리 레이어가 공개되었다. 폴더 구조와 유사한 계층적 네임스페이스 방식을 통해 정보를 논리적으로 분리한다. 상위 경로를 읽으면 하위 경로의 데이터가 자동으로 포함되는 구조를 갖췄다.

8개 질문으로 3D 바디 생성하는 MLP 모델, 오차 0.3cm 달성

8개 질문으로 3D 바디 생성하는 MLP 모델, 오차 0.3cm 달성

8개 질문으로 3D 신체 모델을 생성하는 MLP 모델이 공개됐다. 사진이나 GPU 없이 CPU만으로 밀리초 단위의 빠른 연산이 가능하다. 신장 오차 0.3cm, 체중 오차 0.3kg의 높은 정확도를 기록했다.

WUPHF, Git 기반 공유 위키로 AI 에이전트 토큰 소모 7배 줄이다

WUPHF, Git 기반 공유 위키로 AI 에이전트 토큰 소모 7배 줄이다

AI 에이전트들이 공유 위키를 통해 협업하는 WUPHF가 공개되었다. Git 기반 마크다운 저장소를 공유 메모리로 사용하여 토큰 소모를 줄였다. Claude Code 등 기존 CLI 도구와 연동해 실제 업무 수행이 가능하다.

오픈소스 이슈 1만 3천 개 정리하는 AI 봇 ClawSweeper

오픈소스 이슈 1만 3천 개 정리하는 AI 봇 ClawSweeper

ClawSweeper가 1만 3천 개의 미처리 이슈를 AI로 자동 분류한다. 보수적인 5가지 기준을 적용해 확실한 항목만 닫기 제안을 한다. 사람이 최종 결정을 내리는 구조로 오류율을 0.1% 미만으로 유지한다.

Tolaria, 마크다운 노트를 Git 저장소로 관리하는 오픈소스 앱 출시

Tolaria, 마크다운 노트를 Git 저장소로 관리하는 오픈소스 앱 출시

Tolaria가 마크다운 지식 베이스를 관리하는 데스크톱 앱을 공개했다. 노트를 일반 파일과 Git 저장소로 다루며 데이터 이식성을 유지한다. 계정과 구독 없이 완전 오프라인 동작이 가능하다.

SSH 세션에 로컬 클립보드 이미지를 바로 붙여넣는 imgssh 공개

SSH 세션에 로컬 클립보드 이미지를 바로 붙여넣는 imgssh 공개

SSH 접속 시 로컬 클립보드 이미지를 원격 서버에 자동 업로드하는 도구 imgssh가 공개됐다. 설치나 데몬 없이 ssh를 감싸는 방식으로 동작하며, Ctrl+] 단축키 하나로 이미지 경로를 세션에 삽입한다. Claude Code 등 터미널 AI 도

DESIGN.md: AI 코딩 도구가 읽는 디자인 시스템 단일 파일 포맷

DESIGN.md: AI 코딩 도구가 읽는 디자인 시스템 단일 파일 포맷

Google Labs가 제안한 DESIGN.md 포맷이 주목받고 있다. 디자인 시스템을 YAML과 마크다운 이중 구조로 단일 파일에 담는다. AI 코딩 에이전트가 디자인 규칙을 참조하는 기준점으로 설계되었다.

딥러닝을 과학 이론으로 정립하려는 움직임이 시작됐다

딥러닝을 과학 이론으로 정립하려는 움직임이 시작됐다

arXivLabs가 딥러닝 과학 이론화 프로젝트를 시작했다. 개방성과 커뮤니티 기여를 핵심 가치로 삼았다. 이 프로젝트는 학계와 산업계 모두에 영향을 줄 것이다.

오픈소스 투자 에이전트, 증권사 수수료 없이 스스로 구축

오픈소스 투자 에이전트, 증권사 수수료 없이 스스로 구축

오픈소스 투자 에이전트가 깃허브에 공개됐다. 단일 에이전트가 20개 도구와 3단계 기억 시스템으로 판단한다. 사용자는 모든 프롬프트와 도구를 커스텀해 수수료 없이 운영할 수 있다.

구글, Anthropic에 최대 400억 달러 투자 계획

구글, Anthropic에 최대 400억 달러 투자 계획

구글이 AI 스타트업 Anthropic에 최대 400억 달러를 투자할 계획이다. 이번 투자는 구글의 AI 경쟁력 강화를 위한 전략적 결정으로 분석된다. Anthropic은 이 자금을 클라우드 인프라와 모델 개발에 사용할 예정이다.

OpenAI macOS 앱 보안 인증서 교체 및 업데이트 강제화

OpenAI macOS 앱 보안 인증서 교체 및 업데이트 강제화

OpenAI가 macOS 앱 서명 과정에서 보안 이슈를 확인했다. 공급망 공격으로 노출된 인증서를 폐기하고 신규로 교체한다. 사용자는 2026년 5월 8일까지 최신 버전으로 업데이트해야 한다.

GPT-5.5 공개, 코딩 벤치마크서 클로드 제치고 선두 탈환

GPT-5.5 공개, 코딩 벤치마크서 클로드 제치고 선두 탈환

OpenAI가 GPT-5.5를 공개했다. 터미널 벤치마크에서 82.7%로 클로드 미토스 프리뷰를 근소하게 앞질렀다. API는 아직 제공되지 않으며 유료 구독자부터 순차적으로 사용 가능하다.

Anthropic 클로드 코드 구독 해지, 토큰 소모와 품질 저하가 이유

Anthropic 클로드 코드 구독 해지, 토큰 소모와 품질 저하가 이유

한 개발자가 Anthropic의 클로드 코드 구독을 해지했다. 갑작스러운 토큰 소모와 고객 지원 부실이 주요 원인이다. 코드 품질 저하와 불투명한 사용량 제한 문제도 지적됐다.

DeepSeek V4 등장, GPT-5.5 대비 1/6 가격으로 성능 근접

DeepSeek V4 등장, GPT-5.5 대비 1/6 가격으로 성능 근접

DeepSeek이 1.6조 파라미터 V4 모델을 MIT 라이선스로 공개했다. API 가격이 GPT-5.5 대비 약 1/7, Claude Opus 4.7 대비 1/6 수준이다. BrowseComp 벤치마크에서 GPT-5.5에 1%p 차이로 근접했다.

AI 크롤러 분석, 서버 로그가 유일한 창구다

AI 크롤러 분석, 서버 로그가 유일한 창구다

AI 검색 시스템이 사이트를 수집하는 공식 도구가 없다. 서버 로그 파일로 GPTBot, PerplexityBot의 행동을 추적할 수 있다. 장기 로그 보관과 CDN 레벨 로깅이 분석의 정확도를 높인다.

Zed, 같은 창에서 여러 AI 에이전트를 병렬 실행한다

Zed, 같은 창에서 여러 AI 에이전트를 병렬 실행한다

Zed가 같은 창 안에서 여러 AI 에이전트 스레드를 동시에 실행하고 조율하는 기능을 추가했다. 각 스레드마다 접근할 폴더와 저장소 범위를 따로 지정할 수 있으며, 서로 다른 에이전트를 조합해 쓸 수 있다. 새로운 Threads Sidebar가 기본

AI 생성 늑대 사진 한 장이 수색 작전을 뒤흔들었다

AI 생성 늑대 사진 한 장이 수색 작전을 뒤흔들었다

한국 경찰이 AI로 생성한 늑대 사진을 유포한 40대 남성을 체포했다. 허위 사진은 동물원을 탈출한 늑대 뉴크구의 수색 작전을 엉뚱한 방향으로 돌렸다. 용의자는 재미로 사진을 만들었다고 진술했으며 최대 5년 징역형에 처해질 수 있다.

K-Gongyak, GPT-4o와 Tavily API로 2026년 지방선거 공약 자동화

K-Gongyak, GPT-4o와 Tavily API로 2026년 지방선거 공약 자동화

GPT-4o와 Tavily API를 결합한 지방선거 공약 생성기가 공개됐다. 전국 243개 자치단체의 실시간 현안을 반영해 맞춤형 공약을 도출한다. 예산 추정과 KPI를 포함해 공약의 실행 가능성을 수치로 제시한다.

Nothing이 AI 받아쓰기 도구를 내놨다, 폰(3)부터 쓸 수 있다

Nothing이 AI 받아쓰기 도구를 내놨다, 폰(3)부터 쓸 수 있다

Nothing이 AI 음성 받아쓰기 도구 Essential Voice를 출시했다. 이 도구는 어떤 앱에서도 음성을 텍스트로 바꾸고 군더더기를 제거한다. 폰(3)에서 먼저 쓸 수 있고 폰(4a) 프로는 이달 말 지원 예정이다.

기업 85%가 AI 에이전트 시험 중, 실제 도입은 5%에 불과

기업 85%가 AI 에이전트 시험 중, 실제 도입은 5%에 불과

시스코 조사에서 기업 85%가 AI 에이전트 시범 운영 중이다. 실제 운영 환경에 투입한 기업은 5%에 그친다. 시스코는 신뢰 부족을 해결하기 위해 오픈소스 보안 프레임워크를 공개했다.

메타, AWS ARM CPU 수백만 개 도입…AI 칩 지형 또 바뀐다

메타, AWS ARM CPU 수백만 개 도입…AI 칩 지형 또 바뀐다

메타가 AWS의 자체 개발 ARM CPU 그라비톤 수백만 개를 AI 추론용으로 도입하는 계약을 체결했다. GPU 대신 CPU를 AI 에이전트 워크로드에 활용하는 전환점이 되며, AWS는 자체 칩 경쟁력을 입증했다. 이 계약으로 메타의 클라우드 지출이