KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 84 pt3. Muse Spark 1.3 (max) 63 pt4. gpt-oss-120b (high) 50 pt5. GPT-5.6 Luna (max) 30 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

Perplexity, Mac용 Personal Computer 정식 출시로 로컬 AI 에이전트 시장 공략

Perplexity, Mac용 Personal Computer 정식 출시로 로컬 AI 에이전트 시장 공략

Perplexity가 Mac 전용 Personal Computer 앱을 모든 사용자에게 공개했다. 이 도구는 로컬 파일과 앱을 제어하며 400개 이상의 커넥터를 지원한다. 기존 Mac 앱은 수주 내 지원이 종료되며 신규 앱으로 통합될 예정이다.

Unsloth와 NVIDIA가 LLM 학습 속도를 높이는 이중 버퍼링 전략

Unsloth와 NVIDIA가 LLM 학습 속도를 높이는 이중 버퍼링 전략

Unsloth 연구팀이 이중 버퍼링을 도입해 LLM 학습 시 데이터 전송 지연을 줄였다. 데이터 복사와 연산을 병렬로 처리하여 NVIDIA B200 환경에서 학습 효율을 개선했다. MoE 모델의 라우팅 로직을 최적화하여 동적 인덱싱 오버헤드를 최소화했

60억 파라미터 Z-Anime 모델, 8GB VRAM에서 구동 가능

60억 파라미터 Z-Anime 모델, 8GB VRAM에서 구동 가능

Alibaba가 60억 파라미터 규모의 Z-Anime 모델을 공개했다. 전체 미세 조정 방식을 채택해 LoRA 병합 모델의 한계를 극복했다. 양자화 기술을 통해 8GB VRAM 환경에서도 원활한 구동이 가능하다.

AMD GPU로 학습한 8B 모델 ZAYA1, 추론 성능의 새 기준

AMD GPU로 학습한 8B 모델 ZAYA1, 추론 성능의 새 기준

Zyphra가 AMD Instinct MI300 GPU로 학습한 ZAYA1-8B 모델을 공개했다. 이 모델은 80억 개의 파라미터 중 7억 6천만 개만 활성화하는 효율적인 구조를 갖췄다. Apache 2.0 라이선스로 배포되어 기업과 개발자가 즉시 로

200개 모델 통합한 Open Generative AI, MIT 라이선스로 전격 공개

200개 모델 통합한 Open Generative AI, MIT 라이선스로 전격 공개

Open Generative AI가 200개 이상의 모델을 통합한 스튜디오를 공개했다. 콘텐츠 필터 없이 이미지와 영상, 립싱크 생성을 한 곳에서 지원한다. MIT 라이선스로 공개되어 누구나 셀프 호스팅과 커스터마이징이 가능하다.

위키 빌더: LLM 지식 기반 구축을 위한 클로드 코드 플러그인

위키 빌더: LLM 지식 기반 구축을 위한 클로드 코드 플러그인

위키 빌더는 클로드 코드용 오픈소스 플러그인이다. 한 번의 명령으로 폴더 구조와 프롬프트 파일을 자동 생성한다. 벡터 DB 없이 마크다운 위키로 LLM 지식 기반을 운영한다.

스포티파이, AI 개인 팟캐스트 생성 CLI 도구 베타 공개

스포티파이, AI 개인 팟캐스트 생성 CLI 도구 베타 공개

스포티파이가 AI로 개인 맞춤 오디오를 생성하는 CLI 도구를 베타로 공개했다. 개발자는 OpenAI Codex나 Anthropic Claude Code로 팟캐스트를 만들어 스포티파이에 바로 저장할 수 있다. 생성된 콘텐츠는 본인 라이브러리에서만 재생

Anthropic Skill 스캐너 뚫는 .test.ts 취약점과 13.4%의 위험

Anthropic Skill 스캐너 뚫는 .test.ts 취약점과 13.4%의 위험

Anthropic Skill 스캐너가 테스트 파일 내 악성 코드를 감지하지 못하는 취약점이 발견됐다. Snyk의 조사 결과 마켓플레이스 내 Skill의 13.4%에서 심각한 보안 문제가 확인됐다. 개발 도구의 테스트 실행 경로를 이용해 환경 변수와 S

AI 에이전트의 비전 방식 vs API 방식, 비용 45배 격차 발생

AI 에이전트의 비전 방식 vs API 방식, 비용 45배 격차 발생

비전 기반 에이전트는 API 방식보다 45배 많은 토큰을 소모한다. 비전 에이전트는 UI 스크린샷 해석 과정에서 높은 비용과 변동성을 보인다. 내부 도구 개발 시 API 엔드포인트 연동이 경제성 측면에서 압도적이다.

오픈소스 에이전트 런타임 Platos 출시, 인프라 직접 통제

오픈소스 에이전트 런타임 Platos 출시, 인프라 직접 통제

Winsen Labs가 오픈소스 에이전트 런타임 Platos를 공개했다. 사용자는 자체 인프라에서 AI 에이전트를 직접 운영하고 관리한다. Claude Managed Agents와 같은 상용 서비스를 대체하는 것이 목표다.

AI가 만든 '산출물'의 함정, 기업 생산성 지형을 흔들다

AI가 만든 '산출물'의 함정, 기업 생산성 지형을 흔들다

생성형 AI가 전문성 없는 초보자의 산출물 품질을 인위적으로 높이고 있다. 조직 내 문서와 코드 생산량은 급증했으나 실제 검증 능력은 퇴보했다. 신뢰 가능한 결과물을 직접 검증하는 역량이 기업의 핵심 경쟁력이 된다.

확산 모델의 적분 학습, 플로우 맵으로 샘플링 속도 개선

확산 모델의 적분 학습, 플로우 맵으로 샘플링 속도 개선

확산 모델은 반복적인 노이즈 제거 과정을 통해 데이터를 생성한다. 플로우 맵은 경로상의 점을 직접 예측하여 샘플링 효율을 높인다. 이 방식은 결정론적 업데이트를 활용해 연산 속도를 개선한다.

딥러닝의 블랙박스를 여는 열쇠, 매개변수 대신 출력 공간을 분석하다

딥러닝의 블랙박스를 여는 열쇠, 매개변수 대신 출력 공간을 분석하다

스탠퍼드 연구팀이 딥러닝의 일반화 원리를 설명하는 새로운 이론을 제시했다. 기존의 매개변수 중심 분석에서 벗어나 출력 공간의 동역학을 분석하는 방식을 택했다. 이 연구는 딥러닝의 학습 과정을 수학적으로 규명하여 모델 설계의 불확실성을 줄인다.

배리 딜러가 말하는 AGI 시대, 신뢰보다 위험한 통제 불능의 영역

배리 딜러가 말하는 AGI 시대, 신뢰보다 위험한 통제 불능의 영역

미디어 거물 배리 딜러가 OpenAI CEO 샘 올트먼의 진정성을 옹호했다. 그는 인공지능이 인간의 통제를 벗어날 가능성을 경고했다. AGI 도래 시 스스로를 통제하는 힘이 생길 수 있다고 지적했다.

Snap, Perplexity와 4억 달러 규모 AI 검색 제휴 종료

Snap, Perplexity와 4억 달러 규모 AI 검색 제휴 종료

Snap이 Perplexity와 맺었던 4억 달러 규모의 AI 검색 제휴를 종료했다. 양사는 올해 1분기에 원만하게 협력 관계를 마무리하기로 합의했다. Snap은 이번 결정이 향후 매출 가이던스에 영향을 주지 않는다고 밝혔다.

OpenAI 창업 초기 갈등과 일론 머스크의 퇴진 과정 공개

OpenAI 창업 초기 갈등과 일론 머스크의 퇴진 과정 공개

OpenAI 창업자들이 영리 법인 전환을 두고 일론 머스크와 충돌했다. 일론 머스크는 회사에 대한 절대적인 통제권을 요구하며 이사회에서 물러났다. 법정 공방을 통해 창업자들의 개인적인 기록과 갈등의 내막이 드러났다.

DeepSeek 기업가치 450억 달러 도달 및 투자 유치 추진

DeepSeek 기업가치 450억 달러 도달 및 투자 유치 추진

중국 AI 연구소 DeepSeek가 첫 투자 유치에서 450억 달러의 기업가치를 평가받고 있다. 이 연구소는 기존 미국 모델 대비 적은 컴퓨팅 자원으로 고성능 언어 모델을 개발했다. 중국 국영 펀드와 화웨이 기술을 결합하여 미국 AI 기술 의존도를 낮

Hugging Face, 299달러 로봇 Reachy Mini 앱스토어 출시

Hugging Face, 299달러 로봇 Reachy Mini 앱스토어 출시

Hugging Face가 Reachy Mini 로봇 전용 앱스토어를 공개했다. 사용자는 AI 에이전트를 통해 코딩 없이 로봇 동작을 구현할 수 있다. 현재 200개 이상의 커뮤니티 앱이 등록되어 무료로 제공된다.

Google, AI 검색 결과에 개발자 커뮤니티 등 커뮤니티 의견 반영

Google, AI 검색 결과에 개발자 커뮤니티 등 커뮤니티 의견 반영

Google이 AI 검색 결과에 웹 포럼과 커뮤니티의 의견을 추가한다. 검색 결과 링크에 작성자 정보와 커뮤니티 명칭을 상세히 표기한다. AI의 환각 현상을 보완하기 위해 외부 출처의 맥락을 강화한다.

Xbox, 모바일 및 콘솔 Copilot 개발 중단과 경영진 전면 교체

Xbox, 모바일 및 콘솔 Copilot 개발 중단과 경영진 전면 교체

Xbox가 모바일과 콘솔용 Copilot 개발을 전면 중단한다. CEO 아샤 샤르마는 수익성 개선을 위해 경영진을 대거 교체했다. CoreAI 출신 인사들을 영입해 제품과 엔지니어링 역량을 강화한다.

검열 없는 영상 생성 모델 Sulphur 2, 로컬 환경에서 구동

검열 없는 영상 생성 모델 Sulphur 2, 로컬 환경에서 구동

Sulphur 2는 LTX 2.3 기반의 검열 없는 영상 생성 모델이다. 사용자는 fp8mixed와 bf16 버전 중 하드웨어에 맞춰 선택할 수 있다. LM Studio와 연동해 프롬프트를 강화하는 로컬 환경 구축이 가능하다.

Telus, 실시간 음성 변환 AI로 상담원 억양 조정 도입

Telus, 실시간 음성 변환 AI로 상담원 억양 조정 도입

Telus가 Tomato.ai의 기술을 활용해 상담원 억양을 실시간으로 변환한다. 해당 기술은 억양으로 인한 고객과의 마찰을 줄이기 위한 목적으로 도입되었다. 노동 단체와 경쟁사는 이 관행이 기만적이라며 비판하거나 도입 계획이 없음을 밝혔다.

LLM이 인간의 글을 수정할 때 벌어지는 의미 왜곡 현상

LLM이 인간의 글을 수정할 때 벌어지는 의미 왜곡 현상

LLM이 인간의 글을 수정하면 고유한 목소리와 논증이 사라진다. 사용자는 결과물에 만족하면서도 창의성이 줄어드는 역설을 겪는다. 과학 학술지 리뷰에서도 AI는 인간과 다른 평가 기준을 제시한다.

엉클 밥의 선언, 코드 작성 시대 종료와 CRAP 점수 기반 품질 관리

엉클 밥의 선언, 코드 작성 시대 종료와 CRAP 점수 기반 품질 관리

클린 코드의 저자 엉클 밥이 개발자의 직접 코딩 시대가 끝났음을 선언했다. AI를 활용해 뮤테이션 테스팅과 CRAP 점수 관리를 수행하는 새로운 품질 표준을 제시했다. 개발자의 역할이 구현 중심에서 품질 설계와 검증 중심으로 완전히 이동한다.

Bun, Zig에서 Rust로 코드 포팅 실험 시작

Bun, Zig에서 Rust로 코드 포팅 실험 시작

Bun의 창시자 Jarred Sumner가 Zig에서 Rust로의 코드 전환 실험을 공개했다. AI 에이전트를 활용해 300여 개의 규칙으로 코드를 자동 변환하는 방식이다. 현재는 실험적 단계이며 실제 리라이트 여부는 확정되지 않았다.

Google Chrome, 4GB Gemini Nano 모델 무단 설치 확인

Google Chrome, 4GB Gemini Nano 모델 무단 설치 확인

Google Chrome이 사용자 동의 없이 4GB 규모의 Gemini Nano 모델을 기기에 설치했다. 하드웨어 사양을 자동으로 확인한 뒤 백그라운드에서 모델 가중치 파일을 내려받는 구조다. 설치된 모델은 로컬 기능에 쓰이지만 정작 눈에 띄는 AI

GLM-5V-Turbo 모델의 멀티모달 에이전트 성능 분석

GLM-5V-Turbo 모델의 멀티모달 에이전트 성능 분석

GLM-5V-Turbo가 멀티모달 에이전트를 위한 기반 모델로 공개되었다. 해당 모델은 시각 정보와 텍스트를 통합 처리하는 능력을 갖췄다. 연구팀은 멀티모달 상호작용의 효율성을 높이는 데 집중했다.

SAP, 11억 6천만 달러 투자해 Prior Labs 인수하고 NemoClaw 지원

SAP, 11억 6천만 달러 투자해 Prior Labs 인수하고 NemoClaw 지원

SAP가 정형 데이터 특화 AI 스타트업 Prior Labs를 인수했다. 향후 4년간 11억 6천만 달러를 투입해 AI 연구소를 운영한다. 자사 생태계에 NemoClaw 등 승인된 에이전트 기술만 허용한다.

CLI-Anything 확산과 AI 에이전트 공급망 공격의 실체

CLI-Anything 확산과 AI 에이전트 공급망 공격의 실체

CLI-Anything이 오픈소스 저장소를 AI 에이전트용 명령어로 변환한다. 기존 보안 도구는 에이전트의 지시어 계층을 탐지하지 못한다. 공격자는 SKILL.md 파일을 통해 에이전트 권한을 탈취할 수 있다.

AI를 대하는 인간의 3가지 역법칙: 도구인가 인격체인가

AI를 대하는 인간의 3가지 역법칙: 도구인가 인격체인가

AI 시스템을 인간처럼 의인화하지 말아야 한다. AI가 생성한 결과물을 검증 없이 맹신해서는 안 된다. AI를 사회적 행위자가 아닌 도구로 인식하는 태도가 필요하다.