KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 94 pt3. Muse Spark 1.3 (max) 48 pt4. gpt-oss-120b (high) 43 pt5. GPT-5.6 Luna (max) 28 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

MFA도 소용없었다, 메타 AI 봇이 열어준 '계정 복구' 뒷문

MFA도 소용없었다, 메타 AI 봇이 열어준 '계정 복구' 뒷문

누구나 계정 복구 메일을 바꿀 수 있는 보안 구멍이 메타 AI 봇에서 발견됐다. 공격자가 봇에게 요청해 복구 이메일을 변경하고 비밀번호를 초기화해 계정을 탈취했다. 로그인 단계의 MFA는 작동했지만, AI 봇이 관리하는 복구 경로에는 검증 장치가 없었

Quilty, 시나리오 기반 영화 흥행 예측 도구 공개했으나 실효성 논란

Quilty, 시나리오 기반 영화 흥행 예측 도구 공개했으나 실효성 논란

AI 스타트업 Quilty가 시나리오 분석을 통해 영화의 성공 여부를 예측하는 도구를 선보였습니다. 하지만 실제 사용자들 사이에서는 예측 정확도에 대한 회의적인 반응이 나오고 있습니다.

3,700만 단어 학습한 AI, 90년대 마이크로소프트 기술문서 완벽 재현

3,700만 단어 학습한 AI, 90년대 마이크로소프트 기술문서 완벽 재현

LLM에게 특정 시대의 글쓰기 스타일을 입히는 파인튜닝 실험이 진행됐다. 90년대 MS 매뉴얼 3,700만 단어를 학습시킨 결과, 7B 소형 모델이 당시 특유의 문서 구조를 정확히 흉내 냈다. RAG와 달리 스타일 전이에 집중한 이번 실험은 약 50달

iMessage로 채팅하듯 쓰는 AI 에이전트, 애플이 처음 허락한 'Poke'

iMessage로 채팅하듯 쓰는 AI 에이전트, 애플이 처음 허락한 'Poke'

AI 에이전트를 텍스트 메시지처럼 쉽게 사용하는 서비스가 늘고 있다. 스타트업 Poke가 애플 '메시지 포 비즈니스' 플랫폼에 첫 승인된 AI 에이전트가 됐다. 사용자당 과금 모델과 엄격한 UI 가이드라인 준수가 승인의 핵심 조건이었다.

GPU 훔쳐 쓰고 스스로 코드 수정하는 '자율형 AI 웜' PoC 성공

GPU 훔쳐 쓰고 스스로 코드 수정하는 '자율형 AI 웜' PoC 성공

고정된 취약점 목록 없이 스스로 타깃을 분석해 전파되는 자율형 AI 웜이 개발됐다. 오픈웨이트 sLLM을 감염 기기의 GPU에서 로컬로 구동하며 실시간 공격 전략을 수립한다. 테스트 결과 33개 호스트 중 약 62%를 감염시켰으며 학습 데이터 컷오프

수백만 건의 결함을 잡아낸 알리바바의 AI 코드 리뷰어

수백만 건의 결함을 잡아낸 알리바바의 AI 코드 리뷰어

코드 리뷰 자동화는 개발 생산성을 결정짓는 핵심 요소다. 알리바바가 2년간 수만 명의 개발자에게 검증한 Open Code Review를 오픈소스로 공개했다. 결정론적 설계와 LLM을 결합해 라인 단위의 정밀 리뷰와 보안 취약점 탐지를 수행한다.

200ms 단위 실시간 소통, 미라 무라티가 제시한 '인터랙션 모델'

200ms 단위 실시간 소통, 미라 무라티가 제시한 '인터랙션 모델'

OpenAI CTO 출신 미라 무라티가 설립한 Thinking Machines Lab이 공개됐다. 오픈소스 모델 파인튜닝 API 'Tinker'와 200ms 간격의 실시간 인터랙션 모델을 개발 중이다. 기존의 턴제 방식을 벗어나 인간의 대화 패턴을 실

한국 온라인 커뮤니티, AI 검열 도구로 모든 이미지 전수 조사한다

한국 온라인 커뮤니티, AI 검열 도구로 모든 이미지 전수 조사한다

한국 내 온라인 포럼들이 업로드되는 모든 이미지를 AI 검열 도구로 스캔해야 합니다. 불법 콘텐츠 유통을 차단하기 위한 강제 조치입니다.

일론 머스크, SpaceX와 X 통해 세계 최초 조 단위 달러 자산가 노린다

일론 머스크, SpaceX와 X 통해 세계 최초 조 단위 달러 자산가 노린다

뉴욕타임스 기자 라이언 맥이 저서 '캐릭터 리밋'을 통해 일론 머스크의 행보를 분석했습니다. SpaceX의 성장과 트위터 인수 이후의 변화가 머스크를 조 단위 달러 자산가로 이끄는 경로를 다룹니다.

코드 80%를 AI가 짜는 시대, Anthropic이 예고한 '재귀적 개선'

코드 80%를 AI가 짜는 시대, Anthropic이 예고한 '재귀적 개선'

AI가 단순 코딩 보조를 넘어 스스로를 설계하고 개선하는 단계로 진입하고 있습니다. Anthropic은 이미 내부 코드의 80% 이상을 Claude가 작성하며 개발 속도를 8배 높였습니다. 단순 구현을 넘어 연구 판단 영역까지 AI가 수행하며 'AI가

모델 상향평준화 시대, 스타트업의 진짜 해자는 '운영 체계'와 'Eval'

모델 상향평준화 시대, 스타트업의 진짜 해자는 '운영 체계'와 'Eval'

LLM 모델들이 서로 비슷해지며 기술적 차별화가 어려워진 환경이다. 이제는 모델 자체가 아니라 컨텍스트와 Eval 중심의 운영 체계가 핵심 경쟁력이다. 업무 매핑부터 피드백 루프까지 6단계의 AI-네이티브 전환 경로를 제시한다.

공사 기간 절반으로 단축 — Meta, 텐트형 데이터센터 전격 도입

공사 기간 절반으로 단축 — Meta, 텐트형 데이터센터 전격 도입

AI 인프라 경쟁이 가속화되며 데이터센터 구축 방식이 파격적으로 변하고 있다. Meta가 오하이오주에 12.5만 평방피트 규모의 텐트형 구조물 5동을 빠르게 구축했다. 공기 단축과 비용 절감을 위해 오프그리드 가스 터빈과 임시 구조물을 결합한 전략이다

메모리 붕괴 막는 '티켓 시스템', 에이전트 아키텍처 Show GN 공개

메모리 붕괴 막는 '티켓 시스템', 에이전트 아키텍처 Show GN 공개

LLM 에이전트의 고질적인 문제인 메모리 노이즈와 세션 휘발성을 해결하려는 시도가 계속되고 있다. 오픈소스 Show GN은 에이전트를 프롬프트가 아닌 파일 기반 레포지토리 구조로 설계해 런타임 독립성을 확보했다. 티켓 기반 메모리 승격 시스템과 PM

AI 수요가 삼킨 메모리 공급망, DDR5 32GB 최저가 375달러 돌파

AI 수요가 삼킨 메모리 공급망, DDR5 32GB 최저가 375달러 돌파

고성능 PC 조립의 필수 규격인 DDR5 32GB 메모리 가격이 급등하고 있다. AI 수요로 인한 제조 역량 부족으로 1년 전 100달러 미만이던 가격이 최저 374.97달러까지 올랐다. SSD 가격 역시 최대 5배 이상 상승하며 PC 하드웨어 전반의

환각부터 모델 붕괴까지, 6년 전 구글이 지운 경고장

환각부터 모델 붕괴까지, 6년 전 구글이 지운 경고장

LLM의 환각과 편향성은 이제 업계의 고질적인 문제로 자리 잡았다. 2020년 구글에서 해고된 팀닛 게브루의 '확률적 앵무새' 논문이 예견한 5가지 경고가 모두 현실화됐다. 데이터 오염으로 인한 모델 붕괴와 탄소 배출 급증 등 구조적 한계가 수치로 증

Huawei, KV-캐시 용량 5배 늘린 vLLM 백엔드 KVarN 공개

Huawei, KV-캐시 용량 5배 늘린 vLLM 백엔드 KVarN 공개

LLM의 긴 문맥 처리 시 발생하는 KV-캐시 메모리 부족은 추론 효율의 핵심 병목이다. 화웨이가 공개한 KVarN은 FP16 수준의 정확도를 유지하며 캐시 용량을 3~5배 확대한다. 별도 캘리브레이션 없이 플래그 설정만으로 vLLM에 즉시 적용 가능

케빈 오리어리, 유타주 데이터센터 부지 4만 에이커에서 절반으로 축소

케빈 오리어리, 유타주 데이터센터 부지 4만 에이커에서 절반으로 축소

투자자 케빈 오리어리가 유타주에 계획한 데이터센터 규모를 절반 수준으로 줄이기로 했습니다. 지역 주민과 환경 운동가들의 반대 압력이 거세지자 19,430에이커를 제외하기로 결정했습니다.

C/C++ 메모리 버그, 스스로 찾고 고치는 Anthropic의 취약점 탐지 프레임워크

C/C++ 메모리 버그, 스스로 찾고 고치는 Anthropic의 취약점 탐지 프레임워크

소프트웨어 취약점 분석은 전문가의 수작업과 많은 시간이 소요되는 영역이다. Anthropic이 Claude를 활용해 탐지부터 패치까지 자동화하는 오픈소스 레퍼런스를 공개했다. gVisor 샌드박스 기반의 7단계 파이프라인으로 C/C++ 메모리 취약점을

메타, 페이스북에 AI 크리에이터 비서 도입... 틱톡·유튜브와 '창작자 쟁탈전'

메타, 페이스북에 AI 크리에이터 비서 도입... 틱톡·유튜브와 '창작자 쟁탈전'

크리에이터들은 매번 복잡한 데이터 차트를 분석하며 업로드 시점을 고민합니다. 메타가 콘텐츠 스타일과 성과를 분석해 맞춤형 전략을 제안하는 AI 비서를 출시했습니다. AI 번역과 립싱크 기술을 결합해 주간 5억 명 이상의 글로벌 시청자를 확보합니다.

AI 에이전트가 직접 빌드하고 수정하는 Angular v22 공개

AI 에이전트가 직접 빌드하고 수정하는 Angular v22 공개

Angular가 v22 업데이트를 통해 AI 에이전트 중심의 개발 환경을 구축했다. Signal Forms와 Angular Aria 등 핵심 기능이 프로덕션 준비 상태로 승격됐다. OnPush를 기본 변경 감지 전략으로 채택하고 Webpack 지원을

에이전트 중단·복구 자동화, 구글 'Agent Executor' 오픈소스 공개

에이전트 중단·복구 자동화, 구글 'Agent Executor' 오픈소스 공개

LLM 에이전트의 실무 도입 시 가장 큰 걸림돌은 실행의 불안정성과 상태 관리다. 구글이 분산 에이전트 런타임 'Agent Executor(AX)'를 Apache 2.0 라이선스로 공개했다. 격리된 액터 구조와 이벤트 로그 기반의 자동 복구 기능을 통

구글 직원들, 사내에서 자사 AI 성능 비판하는 '밈' 공유했다

구글 직원들, 사내에서 자사 AI 성능 비판하는 '밈' 공유했다

구글 직원들이 내부 커뮤니티에서 자사 AI의 낮은 성능을 희화화하는 밈을 공유하고 있습니다. 세계 최고의 AI 기술력을 보유하고 있음에도 실제 제품의 완성도에 대한 내부 불만이 드러난 사례입니다.

Deep제미나이 탑재한 시리, 챗봇 시장 정조준하는 애플의 승부수

제미나이 탑재한 시리, 챗봇 시장 정조준하는 애플의 승부수

애플이 WWDC 2026에서 시리의 대대적인 AI 업그레이드를 공개한다. 구글 제미나이를 활용해 문맥 이해와 멀티스텝 작업 수행 능력을 강화한다. 독립형 시리 앱과 앱스토어 AI 에이전트 통합으로 서비스 생태계를 확장한다.

아마존, 언어로 소통하는 자율 주행 창고 로봇 '프로테우스' 신버전 공개

아마존, 언어로 소통하는 자율 주행 창고 로봇 '프로테우스' 신버전 공개

아마존이 코딩 없이 언어로 상호작용하는 자율 주행 창고 로봇 '프로테우스'의 새 버전을 공개했습니다. AI 기반 업그레이드를 통해 현장 작업자가 말로 직접 업무를 지시할 수 있게 되었습니다.

Deep권한 줬더니 AWS 키 탈취... Anthropic이 밝힌 에이전트 격리 전략

권한 줬더니 AWS 키 탈취... Anthropic이 밝힌 에이전트 격리 전략

AI 에이전트의 권한이 커질수록 사고 발생 시 피해 범위인 '폭발 반경'도 함께 넓어진다. Anthropic은 단순 승인 절차의 한계를 깨닫고 gVisor와 OS 샌드박스를 통한 물리적 격리를 도입했다. 설정 파일 자동 실행과 프롬프트 인젝션을 통한

변환기 없이 오디오·비디오 직접 읽는 구글 Gemma 4 공개

변환기 없이 오디오·비디오 직접 읽는 구글 Gemma 4 공개

내 노트북이나 스마트폰에서 AI를 돌리려면 모델 크기와 처리 속도가 가장 중요하다. 구글이 별도의 데이터 변환 과정 없이 오디오와 비디오를 직접 처리하는 Gemma 4를 공개했다. 12B 모델 기준 인코더 프리 구조를 채택해 배포 크기를 줄이고 온디바

가짜 이미지로 진짜 상품 찾기, 아마존의 검색 AI 실험

가짜 이미지로 진짜 상품 찾기, 아마존의 검색 AI 실험

아마존이 쇼핑 앱 검색창에 AI 생성 이미지를 도입한다. 사용자가 적절한 검색어를 모를 때 AI 이미지를 선택해 원하는 스타일의 상품으로 연결한다. 리뷰 요약, 알렉사 쇼핑 등 기존 AI 기능에 이어 시각적 탐색 영역까지 확장한 조치다.

Deep우버의 AI 비용 통제, 엔지니어 1인당 월 1,500달러 제한

우버의 AI 비용 통제, 엔지니어 1인당 월 1,500달러 제한

우버가 올해 AI 예산을 4개월 만에 소진하며 코딩 에이전트 비용 관리에 나섰다. 직원 1인당 특정 AI 도구 사용액을 월 1,500달러로 제한하는 정책을 도입했다. 이는 엔지니어 평균 연봉의 약 11%에 해당하는 금액으로 실질적인 비용 가치를 보

UC 버클리 CS 수업, AI 활용 증가에 낙제율 급증하고 수학 능력 저하

UC 버클리 CS 수업, AI 활용 증가에 낙제율 급증하고 수학 능력 저하

UC 버클리 컴퓨터공학 수업에서 AI 도구 활용이 늘면서 학생들의 낙제율이 크게 올랐습니다. 기초 수학 역량 저하가 원인으로 지목되며 교육 현장의 AI 도입 전략에 제동이 걸렸습니다.

포춘 500 절반이 쓰는 '바이브 코딩' Lovable, 구글 클라우드 사용량 5배 확대

포춘 500 절반이 쓰는 '바이브 코딩' Lovable, 구글 클라우드 사용량 5배 확대

코딩 진입장벽을 낮추는 '바이브 코딩'이 기업 시장의 핵심 도구로 부상하고 있다. 스톡홀름 스타트업 Lovable이 구글 클라우드와 다년 계약을 맺고 AI 인프라 사용량을 5배 늘린다. Gemini와 Claude 모델을 동시에 활용하며 Wiz 보안 솔