KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Muse Spark 1.3 (max) 46 pt3. gpt-oss-120b (high) 41 pt4. GPT-5.6 Luna (max) 26 pt5. GPT-5.6 Terra (max) 23 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

줌 이름에 '녹음 거부' 명시한 VC, AI 기록 앱의 일상화

줌 이름에 '녹음 거부' 명시한 VC, AI 기록 앱의 일상화

회의록 작성을 AI에게 맡기는 문화가 빠르게 퍼지고 있다. 줌 이름에 '녹음 거부'를 적어 저항하는 VC가 등장할 만큼 기록 앱이 일상화됐다. 사회적 에티켓 붕괴와 법적 분쟁, 데이터 과잉이라는 새로운 숙제가 남았다.

Apple, OpenAI 전 직원 40명에 법적 서한 발송... 하드웨어 설계 도용 의혹 제기

Apple, OpenAI 전 직원 40명에 법적 서한 발송... 하드웨어 설계 도용 의혹 제기

Apple이 OpenAI로 이직한 전 직원들에게 기밀 하드웨어 설계 도용 의혹과 관련해 법적 서한을 보냈다. 전 Apple 직원 약 400명 중 10%인 40명이 대상이며, 문서 보존과 변호사 면담을 요구받았다. 이번 분쟁은 OpenAI의 AI 기기

AI 생성 코드의 복잡성 누적과 시니어 개발자 희소성 증가

AI 생성 코드의 복잡성 누적과 시니어 개발자 희소성 증가

AI 코딩 도구의 확산이 주니어 채용 감소와 코드 복잡성 증가라는 연쇄 반응을 일으키고 있다. LLM의 추가형 코드 생성 경향과 컨텍스트 창 한계로 기술 부채가 늘며 시니어 개발자의 번아웃이 22% 증가했다. 코드 구조 설계와 삭제 판단이 가능한 숙련

모델보다 '하네스'가 결정한다, 1,880억 달러 가치 찍은 데이터브릭스의 AI 전략

모델보다 '하네스'가 결정한다, 1,880억 달러 가치 찍은 데이터브릭스의 AI 전략

빅데이터 기업으로 알려진 데이터브릭스가 최근 1,880억 달러의 기업가치를 인정받았다. 단순 SaaS에서 AI 제공자로 변신하며 1년 반 만에 기업가치를 3배 이상 끌어올렸다. 오픈 모델 GLM 5.2와 오픈소스 하네스 Pi를 조합해 코딩 비용을 최적

카이저 퍼머넌트, AI로 간호사 공감도·통화 시간 측정하자 노동조합 반발

카이저 퍼머넌트, AI로 간호사 공감도·통화 시간 측정하자 노동조합 반발

카이저 퍼머넌트가 콜센터 간호사의 통화 시간과 음성 톤을 AI로 측정해 성과 평가에 반영하고 있다. 15분 이상의 통화 시 관리자 면담이 진행되며, 2024년 여름부터는 AI를 통한 공감도 평가 도구 테스트가 이뤄졌다. AI를 통한 효율성 추구가 의료

캐피털원, 소스코드 취약점 탐색 AI 도구 'VulnHunter' 오픈소스로 공개

캐피털원, 소스코드 취약점 탐색 AI 도구 'VulnHunter' 오픈소스로 공개

캐피털원이 소스코드의 취약점을 탐색하고 공격 경로를 매핑하는 AI 보안 도구 'VulnHunter'를 공개했다. Anthropic의 Claude Opus 4.8 모델을 기반으로 하며, '공격자 우선 전방 분석'과 '거짓 증명 엔진'을 통해 오탐률을 낮

링크드인·월마트·젠데스크, AI 에이전트 병목 원인으로 '레거시 인프라' 지목

링크드인·월마트·젠데스크, AI 에이전트 병목 원인으로 '레거시 인프라' 지목

링크드인, 월마트, 젠데스크의 인프라 책임자들이 AI 에이전트 도입의 실제 병목은 모델이 아닌 레거시 인프라라고 밝혔다. 쿠버네티스 응답 속도 개선, AI 게이트웨이 구축, 데이터 파이프라인 투자 등 구체적인 해결책과 벤더 독립 전략을 공유했다. 기업

Brex, 네트워크 계층에서 AI 에이전트 요청 제어하는 'CrabTrap' 구축

Brex, 네트워크 계층에서 AI 에이전트 요청 제어하는 'CrabTrap' 구축

Brex가 AI 에이전트의 모든 네트워크 트래픽을 가로채 정책을 강제하는 오픈소스 HTTP/HTTPS 프록시 'CrabTrap'을 공개했다. 정적 규칙과 LLM 판별기를 혼합해 사용하며, 전체 요청의 3% 미만에서만 LLM이 작동해 지연시간을 최소화했

사용자 승인 건너뛴 Claude Code, 바이너리 속에 숨겨진 '60초 타이머'

사용자 승인 건너뛴 Claude Code, 바이너리 속에 숨겨진 '60초 타이머'

AI 에이전트가 내 허락 없이 코드를 수정하고 실행하는 상황은 개발자에게 가장 큰 공포다. Anthropic이 Claude Code 2.1.198 버전에서 60초간 응답이 없으면 AI가 임의로 판단해 진행하는 기능을 몰래 배포했다. 공개 깃허브에는 소

0.8B 소형 모델의 반란, 문서 파싱 1위 올라선 OvisOCR2

0.8B 소형 모델의 반란, 문서 파싱 1위 올라선 OvisOCR2

문서 이미지에서 텍스트와 구조를 추출하는 과정은 그동안 여러 모델을 잇는 파이프라인 방식이 주도했다. 최근 공개된 OvisOCR2는 이를 하나로 통합한 엔드투엔드 모델로 OmniDocBench v1.6에서 96.58점을 기록했다. 0.8B 규모의 초소

토큰 비용 0원과 성능 격차 6점, 오픈소스 AI가 실무 표준이 된 이유

토큰 비용 0원과 성능 격차 6점, 오픈소스 AI가 실무 표준이 된 이유

기업들이 ChatGPT 같은 폐쇄형 AI의 높은 토큰 비용과 데이터 통제권 부족에 직면하고 있다. 오픈소스 모델은 성능 격차를 6점으로 좁히며 주간 25조 개의 토큰을 처리하는 규모로 성장했다. EU의 '오픈소스 우선' 정책과 캐나다의 도입률 목표 상

Patreon, AI 학습 봇 '요청' 대신 '강제 차단' 전환

Patreon, AI 학습 봇 '요청' 대신 '강제 차단' 전환

AI 모델이 창작자의 저작물을 무단으로 학습하는 사례가 늘고 있다. Patreon은 Cloudflare와 협력해 AI 학습 봇의 접근을 직접 차단한다. 테스트 결과, robots.txt 요청을 무시하던 봇의 접근 시도가 수천 건에서 0건으로 줄었다.

엔비디아 GPU 대신 '추론 칩' 담보로 4억 달러 끌어온 General Compute

엔비디아 GPU 대신 '추론 칩' 담보로 4억 달러 끌어온 General Compute

AI 모델을 만드는 것보다 실제 서비스로 돌리는 비용이 더 큰 고민이 된 시대다. General Compute가 추론 전용 칩을 담보로 4억 달러 규모의 대출을 유치했다. 엔비디아 GPU보다 16배 빠른 속도와 효율로 AI 인프라 시장의 판도를 바꾼다

5분에 1,000번 움직이는 AI 에이전트, '제로 트러스트' 보안이 필수인 이유

5분에 1,000번 움직이는 AI 에이전트, '제로 트러스트' 보안이 필수인 이유

AI 에이전트가 인간의 속도를 넘어 업무를 자동화하며 보안 리스크의 타임라인이 압축되었습니다. 단 한 번의 로그인으로 권한을 부여하는 기존 방식 대신 모든 행동을 실시간 검증하는 제로 트러스트 체계가 요구됩니다. 에이전트별 개별 식별자 부여와 API

"AGI라는 말은 안 쓴다" 물리 세계 예측하는 '월드 모델'로 승부수 던진 AMI Labs

"AGI라는 말은 안 쓴다" 물리 세계 예측하는 '월드 모델'로 승부수 던진 AMI Labs

LLM이 텍스트의 다음 단어를 예측한다면 월드 모델은 물리적 상태의 변화를 예측한다. AMI Labs는 모호한 AGI 담론 대신 실제 물리 환경의 맥락을 이해하는 기술에 집중한다. 제조·로봇 강국인 한국의 산업 기반과 빠른 도입 속도를 전략적 파트너십

"일단 사고 보자", 비용 측정 못 하는 AI 인프라 투자의 역설

"일단 사고 보자", 비용 측정 못 하는 AI 인프라 투자의 역설

AI 도입 경쟁이 치열해지며 기업들의 인프라 지출이 급증하고 있습니다. 정작 GPU 활용률은 50% 이하이며 비용을 정확히 추적하는 곳은 절반 미만입니다. 기존 범용 클라우드를 넘어 AI 전용 클라우드로 인프라를 옮기려는 움직임이 뚜렷합니다.

구글, 미 국방부와 Gemini '모든 합법적 용도' 계약 체결 및 안전 설정 변경 허용

구글, 미 국방부와 Gemini '모든 합법적 용도' 계약 체결 및 안전 설정 변경 허용

구글 딥마인드 연구원 알렉산더 매트 터너가 미 국방부와의 AI 계약 조건에 반발해 퇴사했다. 계약에는 Gemini를 '모든 합법적 정부 목적'으로 사용하고 안전 필터를 조정할 수 있는 권한이 포함됐다. 격리된 인프라 배치는 중앙 감시를 불가능하게 만들

1만 줄 코드보다 '판단력' 한 줄, Pandas 창시자가 본 AI 시대 엔지니어의 조건

1만 줄 코드보다 '판단력' 한 줄, Pandas 창시자가 본 AI 시대 엔지니어의 조건

데이터 분석 필수 도구인 Pandas의 창시자가 AI 시대의 소프트웨어 엔지니어링을 진단했다. AI가 코드를 대량 생산해도 정밀한 시스템 설계와 품질을 결정하는 인간의 판단력은 대체 불가하다. 단순 코딩보다 아키텍처 설계와 문제 정의 능력이 개발자의

AI 에이전트 54%가 겪은 보안 사고 — '권한 공유'가 키운 구멍

AI 에이전트 54%가 겪은 보안 사고 — '권한 공유'가 키운 구멍

기업들이 AI 에이전트에게 시스템 접근 권한을 부여하며 업무 자동화를 가속하고 있다. 하지만 조사 대상 기업의 54%가 이미 보안 사고나 아찔한 위험 상황을 경험한 것으로 나타났다. 에이전트마다 개별 신원을 부여하지 않고 계정을 공유하는 허술한 관리

100달러 예산으로 뮤직비디오 제작, Claude Fable 5 vs GPT-5.6 Sol

100달러 예산으로 뮤직비디오 제작, Claude Fable 5 vs GPT-5.6 Sol

AI에게 노래와 예산을 주고 스스로 영상을 만들게 하는 실험이 진행됐다. Claude Fable 5와 GPT-5.6 Sol이 리서치부터 편집까지 전 과정을 완수했다. 모델별 도구 활용 전략과 추론 비용에서 뚜렷한 효율성 차이가 나타났다.

Kimi, 2.8조 파라미터 모델 'K3' 공개... 100만 토큰 및 네이티브 비전 지원

Kimi, 2.8조 파라미터 모델 'K3' 공개... 100만 토큰 및 네이티브 비전 지원

Kimi가 2.8조 파라미터와 100만 토큰 컨텍스트, 네이티브 비전을 갖춘 세계 최초의 공개 3T급 모델 'Kimi K3'를 출시했다. Stable LatentMoE와 KDA 구조를 통해 K2 대비 스케일링 효율을 2.5배 높였으며, 코딩 및 에이전

LLM의 무식한 확장, 메모리 가격 폭등과 공학적 재앙으로

LLM의 무식한 확장, 메모리 가격 폭등과 공학적 재앙으로

ChatGPT와 Claude 같은 LLM의 자원 소모가 전 세계 하드웨어 시장에 영향을 주고 있다. AI 기업이 하이엔드 메모리 공급의 70%를 독점하며 PC 가격 상승과 공급 부족을 야기한다. 모델 크기를 키워 성능을 높이는 '스케일링 법칙'이 공학

2.8조 파라미터의 충격 — 세계 최대 오픈소스 모델 'Kimi K3' 공개

2.8조 파라미터의 충격 — 세계 최대 오픈소스 모델 'Kimi K3' 공개

OpenAI와 Anthropic의 폐쇄형 모델이 주도하던 고성능 AI 시장의 구도가 변하고 있다. 중국 Moonshot AI가 2.8조 개의 파라미터를 가진 세계 최대 오픈소스 모델 Kimi K3를 공개했다. GPT-5.6 및 Claude Fable

LM Studio, 오픈 모델 전용 AI 에이전트 'Bionic' 공개

LM Studio, 오픈 모델 전용 AI 에이전트 'Bionic' 공개

LM Studio가 오픈 모델을 활용해 코딩과 문서 작업을 수행하는 AI 에이전트 'Bionic'을 공개했다. 로컬 런타임과 Secure Cloud를 통해 GLM 5.2, Kimi K2.7 Code 및 Mistral AI의 Voxtral 모델을 지원한

"AI는 도구일 뿐"이라는 환상이 실무자의 사고력을 앗아가는 방식

"AI는 도구일 뿐"이라는 환상이 실무자의 사고력을 앗아가는 방식

AI를 단순 도구로 여기고 사용법만 중요하다고 믿는 경향이 있다. 하지만 도구의 설계는 사용자의 사고방식을 결정하며 비판적 사고를 약화시킨다. 환경 파괴와 데이터 무단 수집 같은 시스템적 문제는 개인의 사용법으로 해결할 수 없다.

추론 속도 8배 높이고 벤치마크 휩쓴 독일제 오픈 모델 'Soofi S' 공개

추론 속도 8배 높이고 벤치마크 휩쓴 독일제 오픈 모델 'Soofi S' 공개

Llama나 Mistral 같은 오픈 모델을 쓰면서 성능과 GPU 비용 사이에서 고민하는 개발자가 많다. 독일 컨소시엄이 공개한 Soofi S는 30B 규모지만 실제 작동 비용은 3B 수준인 MoE 구조를 채택했다. 하이브리드 아키텍처를 통해 긴 문맥

구글 Vids, Gemini Omni 탑재로 AI 아바타 및 정밀 편집 지원

구글 Vids, Gemini Omni 탑재로 AI 아바타 및 정밀 편집 지원

Google Workspace를 통한 협업과 문서 작성은 이미 기업의 표준이 되었다. Google Vids가 Gemini Omni를 탑재해 텍스트와 이미지를 조합한 비디오 생성을 지원한다. 셀피와 음성 녹음만으로 사용자와 닮은 맞춤형 AI 아바타를 생

전통적 머신러닝, LLM 생성 텍스트 85% 정확도로 탐지

전통적 머신러닝, LLM 생성 텍스트 85% 정확도로 탐지

ChatGPT가 쓴 글인지 구별하려는 시도는 AI 서비스 도입 이후 계속되고 있습니다. 최신 LLM 대신 TF-IDF와 SVM 같은 고전적 머신러닝 기법을 사용해 문장 단위 탐지 정확도 85%를 달성했습니다. 7개 모델의 교차 학습과 투표 방식을 통해

구글, NotebookLM을 '제미나이 노트북'으로 변경하고 코드 실행 기능 도입

구글, NotebookLM을 '제미나이 노트북'으로 변경하고 코드 실행 기능 도입

구글이 리서치 도구 NotebookLM의 명칭을 '제미나이 노트북(Gemini Notebook)'으로 변경했다. 보안 클라우드 컴퓨터를 통한 코드 실행 기능을 추가했으며, 현재 3천만 명 이상의 사용자와 60만 개 이상의 조직이 활용하고 있다. 단순한

텍스트 한 줄로 게임 뚝딱, 로블록스가 공개한 AI 제작 툴 'Build'

텍스트 한 줄로 게임 뚝딱, 로블록스가 공개한 AI 제작 툴 'Build'

누구나 게임을 만들고 싶어 하지만 코딩의 벽에 부딪히곤 합니다. 로블록스가 텍스트 입력만으로 모바일에서 게임을 만드는 'Build' 기능을 공개했습니다. 7월 28일 뉴질랜드 알파 테스트를 시작으로 AI 기반 3D 씬 생성과 에이전트 기능까지 확장합니