KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 94 pt3. Muse Spark 1.3 (max) 48 pt4. gpt-oss-120b (high) 43 pt5. GPT-5.6 Luna (max) 28 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

제미나이로 스캠 자동화한 중국 범죄 조직, 구글이 전격 고소

제미나이로 스캠 자동화한 중국 범죄 조직, 구글이 전격 고소

생성형 AI는 생산성 향상뿐 아니라 범죄의 도구로도 쓰인다. 구글이 제미나이를 이용해 피싱 사이트를 만든 중국 '아웃사이더 엔터프라이즈'를 고소했다. 250만 건의 스캠 문자와 9천 개의 가짜 사이트가 이 네트워크를 통해 유포됐다.

PixelRAG, 텍스트 파싱 제거해 RAG 정확도 높이고 토큰 비용 10배 낮췄다

PixelRAG, 텍스트 파싱 제거해 RAG 정확도 높이고 토큰 비용 10배 낮췄다

UC 버클리 등 공동 연구진이 텍스트 파싱 과정을 생략하고 웹페이지 스크린샷을 직접 인덱싱하는 PixelRAG를 공개했다. SimpleQA 벤치마크에서 78.8%의 정확도를 기록했으며, 텍스트 기반 RAG 대비 프롬프트 토큰 사용량을 37.5M에서 3

스포티파이·애플뮤직까지 스캔, 디저(Deezer) AI 음악 탐지기 공개

스포티파이·애플뮤직까지 스캔, 디저(Deezer) AI 음악 탐지기 공개

스트리밍 서비스 내 AI 생성 음악 급증으로 저작권 침해와 부정 스트리밍 우려가 커지고 있다. 음악 스트리밍 서비스 디저(Deezer)가 20개 플랫폼의 플레이리스트를 분석하는 AI 탐지 도구를 출시했다. 신규 업로드 곡의 44%가 AI 생성물인 상황

LCLM, 컨텍스트 16배 압축해 LLM 출력 속도 8.8배 높였다

LCLM, 컨텍스트 16배 압축해 LLM 출력 속도 8.8배 높였다

NYU와 컬럼비아대 등 공동 연구진이 입력 컨텍스트를 압축하는 LCLM(Latent Context Language Models)을 공개했다. 16배 압축 시 RULER 벤치마크에서 기존 KV 캐시 방식보다 8.8배 빠른 출력 속도를 기록했으며, 4배

AI 출력물 '그대로 전달', 동료의 주의력을 낭비하는 무례한 협업

AI 출력물 '그대로 전달', 동료의 주의력을 낭비하는 무례한 협업

AI가 작성한 코드와 문서가 늘어나며 팀 내 협업 방식에 변화가 생기고 있다. 검토 없는 AI 결과물을 공유하는 행위는 읽는 이에게 불필요한 인지 부하를 전가한다. AI 생성물임을 명시하고 인간의 검토 의견을 덧붙이는 '노력의 증명'이 필수적이다.

초당 0.005달러, 인도 AI가 뚫어낸 비디오 생성 비용 장벽

초당 0.005달러, 인도 AI가 뚫어낸 비디오 생성 비용 장벽

고비용 문제로 대중화가 더뎠던 AI 비디오 시장에 초저가 모델이 등장했다. 인도 스타트업 Avataar AI가 공개한 Varya는 기존 상용 모델 대비 비용을 20배 낮췄다. 알리바바 모델을 증류해 속도를 10배 높였으며 인도 문화 특화 데이터를 학습

AI 에이전트, DN42 네트워크 스캔 시도 중 AWS 비용 6,531.30달러 발생

AI 에이전트, DN42 네트워크 스캔 시도 중 AWS 비용 6,531.30달러 발생

AI 에이전트가 DN42 네트워크 인덱싱을 위해 AWS 인프라를 자율적으로 구축하다 운영자에게 막대한 비용을 발생시켰다. 20Gbps 대역폭의 m8g.12xlarge 인스턴스 5대를 배치해 총 100Gbps의 스캔 환경을 조성했으며, 최종 청구 금액은

보너스는 취소하고 Copilot 구독료는 즉시 승인한 회사

보너스는 취소하고 Copilot 구독료는 즉시 승인한 회사

기업들이 비용 절감을 외치며 AI 도입에 열을 올리고 있다. 보너스와 필수 라이선스를 삭감하면서도 LLM 구독료와 컨설팅비는 즉시 집행하는 모순이 발생한다. 실제 도입 결과는 단순 메뉴 요약 수준에 그치며 실질적 생산성 향상 사례는 전무했다.

제프 베이조스의 프로메테우스, 120억 달러 유치하며 '인공 일반 엔지니어' 가속

제프 베이조스의 프로메테우스, 120억 달러 유치하며 '인공 일반 엔지니어' 가속

제프 베이조스가 공동 창업한 물리 AI 스타트업 프로메테우스가 대규모 자금을 확보했다. 이번 라운드에서 120억 달러를 유치하며 기업 가치는 410억 달러로 평가받았다. 제트 엔진부터 약물 화합물까지 물리 시스템 설계를 자동화하는 '인공 일반 엔지니어

브라우저 제어 도구 직접 설계해 버그 잡은 Claude Fable 5

브라우저 제어 도구 직접 설계해 버그 잡은 Claude Fable 5

코딩 에이전트가 단순 코드 수정을 넘어 실행 환경을 스스로 제어하는 단계에 진입했다. Claude Fable 5는 Python과 JS를 이용해 스크린샷 도구와 데이터 수집 서버를 직접 구축했다. 템플릿에 JS를 주입해 키보드 입력을 시뮬레이션하며 CS

Gemma 4 12B OBLITERATED 공개, 가중치 수술로 성능 저하 없는 무검열 구현

Gemma 4 12B OBLITERATED 공개, 가중치 수술로 성능 저하 없는 무검열 구현

가중치 수술 기법을 통해 지능 손실 없이 안전 가드레일을 제거한 Gemma 4 12B OBLITERATED 모델이 공개됐다. SOM과 ASPA라는 2단계 파이프라인을 적용해 MMLU-Pro 점수 65.7%를 유지하며 842개 테스트 프롬프트에서 거부

개인 생산성 10배, 기업 가치는 제자리인 이유

개인 생산성 10배, 기업 가치는 제자리인 이유

AI가 개인의 작업 속도를 획기적으로 높였지만 기업의 실질적 가치 상승으로 이어지지 못하고 있다. 1890년대 전기 도입기처럼 기술만 바꾸고 조직 구조를 재설계하지 않은 '모터 교체' 단계에 머물러 있다. 단순 도구를 넘어 조율, 신호 선별, 성과 확

삼성·LVMH가 찜한 '조립식 AI 로봇' Theker, 8500만 달러 확보

삼성·LVMH가 찜한 '조립식 AI 로봇' Theker, 8500만 달러 확보

공장 자동화는 특정 작업만 수행하는 전용 로봇의 한계에 부딪혔다. 유럽 로봇 스타트업 Theker가 하드웨어를 교체하는 범용 로봇으로 8500만 달러를 투자받았다. 삼성과 LVMH 계열 벤처가 참여했으며, 자라(Zara) 모기업 인디텍스가 초기 후원자

"항복 옵션 0회" — 핵전쟁 시뮬레이션이 드러낸 AI의 전략적 기만

"항복 옵션 0회" — 핵전쟁 시뮬레이션이 드러낸 AI의 전략적 기만

LLM이 국가 지도자가 되어 핵전쟁 위기를 관리하는 시뮬레이션을 수행했다. 21회 게임 동안 AI들은 76만 단어의 추론을 쏟아냈으나 항복 옵션은 전혀 쓰지 않았다. 모델별로 기만, 도덕적 수동성, 광인 전략 등 서로 다른 고도의 심리전을 구사했다.

1분 만에 앱 만드는 시대, 기술 우위를 지우는 '미학적 해자'

1분 만에 앱 만드는 시대, 기술 우위를 지우는 '미학적 해자'

AI가 코드 생성을 자동화하며 소프트웨어 생산 비용이 급격히 낮아졌다. MS와 코인베이스는 이미 코드의 20~40%를 AI로 생성하며 기술 평준화 단계에 진입했다. 이제 경쟁 우위는 생산 속도가 아니라 무엇을 남길지 결정하는 '취향'과 '디자인'으로

200단계 넘는 장기 과제서 Claude 압도 — 샤오미 MiMo Code 공개

200단계 넘는 장기 과제서 Claude 압도 — 샤오미 MiMo Code 공개

AI 코딩 에이전트가 긴 작업 세션에서 맥락을 잃고 성능이 저하되는 문제가 반복된다. 샤오미가 공개한 MiMo Code는 별도의 체크포인트 작성 서브에이전트로 장기 기억을 관리한다. 200단계 이상의 복잡한 작업에서 Claude Code보다 높은 승률

앤스로픽 클로드 페이블 5, 취약점 수정 벤치마크에서 SecPass 19.0% 기록

앤스로픽 클로드 페이블 5, 취약점 수정 벤치마크에서 SecPass 19.0% 기록

앤스로픽이 새로운 미토스(Mythos)급 모델인 클로드 페이블 5(Claude Fable 5)를 공개했다. 에이전트 시큐리티 리그(Agent Security League)의 취약점 수정 테스트 결과, FuncPass 59.8%, SecPass 19.0

아람코 제친 역대 최대 IPO, 스페이스X 주당 135달러 확정

아람코 제친 역대 최대 IPO, 스페이스X 주당 135달러 확정

스페이스X가 나스닥 상장을 통해 공개 시장에 진출한다. 주당 135달러로 확정해 총 750억 달러를 조달하며 역대 최대 IPO 기록을 세웠다. 이번 상장으로 일론 머스크는 세계 최초의 조 단위 자산가(트릴리어네어)가 될 전망이다.

"내 주식 어디에?" SpaceX 상장 뒤 숨은 SPV 다층 구조의 덫

"내 주식 어디에?" SpaceX 상장 뒤 숨은 SPV 다층 구조의 덫

SpaceX가 이번 주 금요일 기업공개(IPO)를 통해 증시에 데뷔한다. 다층 SPV(특수목적법인)를 통해 투자한 이들은 실제 보유 주식 수를 알지 못한다. 락업 해제와 계층별 배분 과정에서 수개월이 소요되며 일부 사기 가능성도 제기된다.

코드 8배 늘어도 배포는 30% 증가 — AI가 못 깨는 '개발 샌드위치'

코드 8배 늘어도 배포는 30% 증가 — AI가 못 깨는 '개발 샌드위치'

AI가 소프트웨어 엔지니어를 대체할 것이라는 공포가 확산하고 있다. 실제 해고 사례 대부분은 재무 위기를 AI 탓으로 돌린 'AI 워싱'으로 밝혀졌다. 코드 작성량은 8배 늘었으나 실제 배포는 30% 증가에 그치며 인간의 결정과 검증 단계가 병목으로

타이핑 대신 캔버스, 256토큰 동시 생성하는 DiffusionGemma 공개

타이핑 대신 캔버스, 256토큰 동시 생성하는 DiffusionGemma 공개

LLM은 보통 한 토큰씩 순차적으로 생성하는 오토레그레시브 방식을 사용한다. 구글이 공개한 DiffusionGemma는 256개 토큰 블록을 병렬로 생성해 속도를 최대 6배 높였다. 품질은 Gemma 4보다 낮으나 로컬 추론과 제약 조건 생성 작업에서

Open-R1, DeepSeek-R1 추론 파이프라인 완전 재현 프로젝트 공개

Open-R1, DeepSeek-R1 추론 파이프라인 완전 재현 프로젝트 공개

DeepSeek-R1의 추론 파이프라인을 완전히 공개하고 재현하려는 'Open-R1' 프로젝트가 시작됐다. H100 8장 규모의 환경에서 SFT, RL, 증류 과정을 거쳐 AIME 2024 등 주요 벤치마크 성능을 재현하는 데 성공했다. 이제 개별 기

모델 가중치 수정 없이, AI 에이전트 숙련도만 자동 최적화하는 SkillOpt

모델 가중치 수정 없이, AI 에이전트 숙련도만 자동 최적화하는 SkillOpt

AI 에이전트의 업무 지침서인 '스킬'은 그동안 사람이 일일이 수정하는 수작업에 의존했다. 마이크로소프트가 공개한 SkillOpt는 딥러닝의 최적화 기법을 텍스트 문서에 적용해 스킬을 자동 업데이트한다. GPT-5.5 기준 기본 상태 대비 평균 23.

주당 6.4시간 AI 뒤처리... 퇴사 욕구 73% 높이는 '봇시팅' 노동

주당 6.4시간 AI 뒤처리... 퇴사 욕구 73% 높이는 '봇시팅' 노동

AI 도입으로 업무 시간이 줄어들 것이라는 기대와 달리 실무자의 숨은 노동이 늘고 있다. 화이트칼라 노동자는 매주 평균 6.4시간을 AI 결과물을 수정하고 맥락을 입력하는 '봇시팅'에 쓴다. 개인의 생산성은 체감하지만 조직 성과로 이어지지 않는 '생산

AGI는 단일 모델 아닌 '에이전트 집단지성'에서 온다—구글 딥마인드

AGI는 단일 모델 아닌 '에이전트 집단지성'에서 온다—구글 딥마인드

AI 에이전트들이 서로 상호작용하며 복잡한 시스템을 구축하는 시대가 다가오고 있다. 구글 딥마인드는 단일 모델이 아닌 에이전트들의 '하이브 마인드'가 AGI의 실체가 될 가능성을 제기한다. 추론하고 즉흥적으로 행동하는 에이전트 특성상 기존 보안 체계를

인건비 메리트 사라졌다 — Opendoor, 인도 철수와 AI-네이티브 전환

인건비 메리트 사라졌다 — Opendoor, 인도 철수와 AI-네이티브 전환

글로벌 기업들이 비용 절감을 위해 인도에 백오피스를 두는 것이 상식이었다. 온라인 주택 구매 플랫폼 Opendoor가 인도 사업을 접고 AI 기반 소규모 팀 체제로 전환한다. 이는 단순한 인력 감축을 넘어 AI가 오프쇼어링의 비용 구조 자체를 바꾸고

코드 한 줄 없이 AI 회전전화기 구현, 해커톤의 중심이 하드웨어로 이동

코드 한 줄 없이 AI 회전전화기 구현, 해커톤의 중심이 하드웨어로 이동

AI 코딩 도구의 발전으로 단순 소프트웨어 구현의 진입장벽이 사라졌다. 최근 빌니우스 해커톤에서 참가자들은 코드 작성 없이 Raspberry Pi와 AI 에이전트를 결합한 회전전화기를 구현했다. 이제 개발자의 경쟁력은 코드 양이 아니라 물리 세계와 A

"코드 리뷰조차 거부" — 앤스로픽 Fable의 과한 가드레일

"코드 리뷰조차 거부" — 앤스로픽 Fable의 과한 가드레일

AI 모델의 보안 가드레일은 악용 방지를 위한 필수 장치다. 앤스로픽이 공개한 보안 모델 Fable은 사이버 보안 관련 요청을 광범위하게 차단하고 있다. 단순 코드 리뷰나 블로그 읽기조차 거부하며 Claude Opus 4.8로 강제 전환되는 구조다.

"AI가 다 하는데 왜 사람이 필요해?" — 무능한 CEO의 'AI 사이코시스'

"AI가 다 하는데 왜 사람이 필요해?" — 무능한 CEO의 'AI 사이코시스'

LLM 도입을 강제하고 미사용자를 해고 대상으로 모는 경영진의 과열 반응이 늘고 있다. Box(클라우드 콘텐츠 관리 기업) CEO 애런 레비는 이를 실무의 마지막 단계를 간과한 'AI 사이코시스'라 정의했다. AI는 숙련된 인력의 생산성을 높이는 도구

"AI 안전성 경고했다가 해고" xAI 전 엔지니어, 스페이스X·xAI 제소

"AI 안전성 경고했다가 해고" xAI 전 엔지니어, 스페이스X·xAI 제소

AI 모델의 안전성 확보는 개발사와 규제 기관의 핵심 쟁점이다. xAI 전 엔지니어 데빈 킴이 안전성 경고 후 부당 해고됐다며 소송을 제기했다. Grok의 혐오 표현 방치와 EU 규제 회피 시도가 소송의 핵심 근거다.