KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 85 pt3. Muse Spark 1.3 (max) 47 pt4. gpt-oss-120b (high) 43 pt5. GPT-5.6 Luna (max) 28 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

애플, iOS 27에 '애플 인텔리전스' 기반 앱 내장형 AI 기능 공개

애플, iOS 27에 '애플 인텔리전스' 기반 앱 내장형 AI 기능 공개

애플이 iOS 27에서 시리(Siri) 외에 앱 전반에 걸쳐 작동하는 애플 인텔리전스 기능을 공개했다. 비용 분할, 에이전트 기반 비밀번호 업데이트, 온디바이스 기반 통화 컨텍스트 등 실무 중심 기능이 포함됐다. 사용자는 챗봇과의 대화가 아닌 기존 앱

4.5GB 메모리만으로 로컬 코딩 에이전트를 구현한 Gemma4-12B v2

4.5GB 메모리만으로 로컬 코딩 에이전트를 구현한 Gemma4-12B v2

개인용 컴퓨터에서 AI가 스스로 도구를 사용하는 에이전트 시대가 열리고 있다. Gemma4-12B v2는 4.5GB의 낮은 메모리 사양에서도 독립적인 코딩 보조가 가능하다. 추론 데이터 재구축을 통해 에이전트 성능을 기존 대비 3.5배 끌어올렸다.

OpenAI 모델 제약을 푼 Codex 로컬 프록시 opencodex

OpenAI 모델 제약을 푼 Codex 로컬 프록시 opencodex

Codex는 기본적으로 OpenAI 모델만 사용할 수 있는 폐쇄적인 구조다. opencodex는 로컬 프록시를 통해 Claude, Gemini 등 40개 이상의 외부 모델을 연결한다. 자체 프로토콜 번역과 세션 마이그레이션을 통해 네이티브 수준의 사용

바이엘, 검색에서 문서 작성까지 수행하는 에이전트 AI 'PRINCE' 구축

바이엘, 검색에서 문서 작성까지 수행하는 에이전트 AI 'PRINCE' 구축

제약 산업의 방대한 비정형 PDF 보고서 분석은 여전히 수동 작업에 의존한다. 바이엘과 Thoughtworks는 LangGraph 기반의 에이전트 RAG 시스템 'PRINCE'를 개발했다. 단순 검색을 넘어 복잡한 추론과 규제 문서 초안 작성까지 자동

노벨 화학상 수상자 존 점퍼, 구글 딥마인드 떠나 앤스로픽 합류

노벨 화학상 수상자 존 점퍼, 구글 딥마인드 떠나 앤스로픽 합류

AlphaFold 핵심 개발자인 존 점퍼가 구글 딥마인드를 떠나 앤스로픽에 합류한다. 약 9년간 단백질 구조 예측 연구를 주도하며 2024년 노벨 화학상을 수상했다.

"작동해도 거절한다" 코딩 에이전트가 만든 '리뷰 병목' 현상

"작동해도 거절한다" 코딩 에이전트가 만든 '리뷰 병목' 현상

ChatGPT 등 AI 코딩 도구의 보급으로 코드 구현 속도는 비약적으로 빨라졌다. 하지만 구현 속도보다 리뷰 속도가 따라가지 못하는 '인지 부하'가 새로운 병목으로 등장했다. CI 통과 여부와 상관없이 확장성과 유지보수성을 위해 인간의 설계 주도권이

형식만 완벽한 AI 인시던트 보고서의 함정

형식만 완벽한 AI 인시던트 보고서의 함정

장애 보고서 작성의 번거로움 때문에 AI 자동 생성 도구에 대한 수요가 높습니다. 하지만 LLM은 증거를 종합하는 사고 과정을 생략해 그럴듯한 가짜 결론을 낼 위험이 큽니다. 코딩과 달리 검증할 테스트 코드가 없어 잘못된 보고서가 그대로 조직의 지식으

AI 보조 도구 의존 시 전문 숙련도 하락 확인... 의료·코딩 분야 '디스킬링' 발생

AI 보조 도구 의존 시 전문 숙련도 하락 확인... 의료·코딩 분야 '디스킬링' 발생

AI 도구 의존이 의료 및 컴퓨터 과학 등 전문직의 실질적 역량을 약화시키는 '디스킬링(deskilling)' 현상이 연구를 통해 확인됐다. 폴란드 내시경 전문의의 선종 발견율이 28.4%에서 22.4%로 하락했고, Anthropic 실험의 AI 사용

코드베이스 전체를 읽는 100만 토큰 GLM-5.2의 MIT 전격 공개

코드베이스 전체를 읽는 100만 토큰 GLM-5.2의 MIT 전격 공개

방대한 코드나 기술 문서를 한 번에 처리하려는 개발자의 니즈가 커지고 있다. GLM-5.2는 100만 토큰의 컨텍스트 창을 지원하며 MIT 라이선스로 전격 공개되었다. IndexShare 아키텍처로 연산량을 2.9배 줄이고 코딩 및 추론 성능을 비약적

"60~90% 절감"의 함정, 코딩 에이전트 RTK가 가린 리스크

"60~90% 절감"의 함정, 코딩 에이전트 RTK가 가린 리스크

코딩 에이전트의 터미널 출력 토큰을 줄여 비용을 낮추는 RTK가 주목받고 있다. 하지만 60~90%라는 절감 수치는 전체 API 비용이 아닌 일부 Bash 출력에 국한된 수치다. 중요 문맥 누락으로 인한 '조용한 실패' 위험이 커 프로덕션 도입 시 운

알리바바, 정밀도 높인 AI 코드 리뷰 도구 'open-code-review' 오픈소스 공개

알리바바, 정밀도 높인 AI 코드 리뷰 도구 'open-code-review' 오픈소스 공개

알리바바가 2년간 내부에서 사용해 수백만 건의 결함을 식별한 AI 코드 리뷰 도구를 오픈소스로 공개했다. 결정론적 엔지니어링과 에이전트 하이브리드 구조를 통해 범용 에이전트 대비 토큰 소모를 1/9 수준으로 낮췄다.

계정 생성 없이 즉시 배포, AI 에이전트용 임시 계정 공개한 Cloudflare

계정 생성 없이 즉시 배포, AI 에이전트용 임시 계정 공개한 Cloudflare

AI 에이전트가 코드를 짜도 계정 생성과 인증 단계에서 멈추는 불편함이 있었다. Cloudflare가 wrangler deploy --temporary 명령어로 계정 없이 즉시 배포 가능한 임시 계정 기능을 출시했다. 60분간 유지되는 임시 환경에서

구글 검색은 끝났다, AI 가중치로 측정하는 '존재감 점수'

구글 검색은 끝났다, AI 가중치로 측정하는 '존재감 점수'

누구나 한 번쯤 구글에 자신의 이름을 검색해 보곤 한다. 전 OpenAI 개발자들이 AI 모델의 내부 가중치만으로 인물 인지도를 측정하는 'In the Weights'를 공개했다. 여러 LLM의 응답을 클러스터링해 수치화한 '강도 점수'로 디지털 존재

공문서 HWP 호환성 가로막는 폰트 저작권, KrIGF서 해법 논의

공문서 HWP 호환성 가로막는 폰트 저작권, KrIGF서 해법 논의

정부 공문서 표준인 HWP 파일은 특정 소프트웨어 없이는 양식이 깨지기 일쑤다. 원인은 폰트 저작권으로 인해 오픈소스 렌더러가 동일한 메트릭을 구현하지 못하기 때문이다. 2026년 7월 2일 KrIGF 2026에서 이를 해결할 '사전 법적 확신 메커니

GPT-5.5 환각률 86%, '더 큰 모델'의 역설

GPT-5.5 환각률 86%, '더 큰 모델'의 역설

AI 모델 크기가 커지면 성능이 무조건 좋아질 것이라 믿어왔다. 하지만 GPT-5.5는 환각률 86%를 기록하며 거대 모델의 한계를 드러냈다. MIT 라이선스의 GLM-5.2는 더 작은 크기로 더 낮은 환각률과 정확도를 보였다.

노르웨이 정부, 6~13세 초등학생 생성형 AI 사용 사실상 금지

노르웨이 정부, 6~13세 초등학생 생성형 AI 사용 사실상 금지

노르웨이 정부가 학습 과정 훼손을 막기 위해 초등학생의 생성형 AI 사용을 사실상 금지한다. 8월 말부터 6~13세는 AI 사용이 제한되며, 17~19세 상급 학생만 직업 준비를 위해 활용법을 배운다. 디지털 기기 의존도를 낮추고 기초 학력을 회복하려

"중국에 EUV 장비 있다" 미국 압박에 ASML "절대 없다" 정면충돌

"중국에 EUV 장비 있다" 미국 압박에 ASML "절대 없다" 정면충돌

AI 칩 생산에 필수적인 ASML의 최첨단 장비가 미국 통제를 뚫고 중국에 유입됐다는 의혹이 제기됐다. 미국 상무부는 증거가 있다고 주장하는 반면, ASML은 모든 장비를 추적하고 있어 불가능하다고 반박한다. EUV 독점 체제를 깨려는 미국의 스타트업

"중국 연루 의심" 미 정부, Anthropic AI 모델 수출 전면 금지

"중국 연루 의심" 미 정부, Anthropic AI 모델 수출 전면 금지

AI 모델의 국가 간 이동이 국가 안보의 핵심 쟁점으로 부상했다. 미 백악관은 Anthropic의 Fable과 Mythos 모델에 대한 수출 및 외국인 접근을 전면 금지했다. 한국 통신사의 접근 권한과 모델 가드레일 우회 사례가 이번 조치의 직접적인

LLM 기반 표적 사기 자동화, 이메일당 4센트 비용으로 정교한 공격 가능해졌다

LLM 기반 표적 사기 자동화, 이메일당 4센트 비용으로 정교한 공격 가능해졌다

LLM이 정교한 표적 사기를 대규모로 자동화하며 공격 비용을 토큰 수준으로 낮췄다. 2024년 연구에 따르면 스피어피싱 이메일당 비용은 약 4센트이며, 딥페이크와 세션 쿠키 탈취가 결합된 형태로 진화했다. 기존의 신뢰 지표가 무너지며 FIDO2 등 하

Claude Code로 100년 난제 '선형문자 A' 해독한 AI 엔지니어

Claude Code로 100년 난제 '선형문자 A' 해독한 AI 엔지니어

인류는 100년 넘게 미노아 문명의 '선형문자 A'를 해독하지 못했다. AI 엔지니어 톰 디 미노가 Claude Code와 파이썬을 활용해 이 문자를 해독했다고 주장했다. 408개의 단어 사전과 40개의 기호 판독값을 제시하며 현재 학계의 검토를 받고

신발 버리고 AI 인프라 택한 올버즈, '스마트버드'로 재출범

신발 버리고 AI 인프라 택한 올버즈, '스마트버드'로 재출범

실리콘밸리 직장인의 상징이었던 신발 브랜드 올버즈가 AI 기업으로 변신했다. 신발 사업을 4,300만 달러에 매각하고 1억 달러를 조달해 '스마트버드'로 사명을 바꿨다. 데이터 주권과 서버 직접 제어를 원하는 기업을 위한 AI 인프라 서비스를 제공한다

LangGraph·Langflow·LangChain-core, RCE 및 기밀 유출 유발하는 보안 취약점 공개

LangGraph·Langflow·LangChain-core, RCE 및 기밀 유출 유발하는 보안 취약점 공개

LangGraph, Langflow, LangChain-core 등 주요 AI 에이전트 프레임워크에서 원격 코드 실행(RCE)과 기밀 유출을 유발하는 취약점이 발견됐다. Langflow는 약 7,000대의 인스턴스가 노출되어 실제 공격이 확인됐으며,

아마존, OpenAI 파트너십 위해 샘 올트먼 전기 영화 드롭

아마존, OpenAI 파트너십 위해 샘 올트먼 전기 영화 드롭

OpenAI와 아마존은 클라우드 인프라와 자본을 결합한 초거대 동맹을 맺었다. 아마존 MGM은 최근 OpenAI에 500억 달러를 투자하고 맞춤형 AI 모델 개발에 합의했다. 이 과정에서 샘 올트먼의 갈등과 복귀를 다룬 영화 'Artificial'의

릴라이언스 인더스트리, 5억 명 사용자 대상 통신망 내장 AI '지오 콜 에이전트' 공개

릴라이언스 인더스트리, 5억 명 사용자 대상 통신망 내장 AI '지오 콜 에이전트' 공개

릴라이언스 인더스트리가 통신망에 직접 내장된 AI 비서 '지오 콜 에이전트'를 포함한 AI 서비스 라인업을 발표했다. 5억 명 이상의 지오 사용자에게 제공될 이번 서비스는 1,100억 달러 규모의 인프라 투자와 메타, 구글 등과의 협력을 기반으로 한다

10~30배 저렴한 전용 모델을 실시간 생성하는 '하이퍼네트워크'의 등장

10~30배 저렴한 전용 모델을 실시간 생성하는 '하이퍼네트워크'의 등장

AI 에이전트가 실무 도입 후 인간의 지속적인 감시가 필요한 이유는 컨텍스트 손실과 망각 때문이다. 하이퍼네트워크는 추론 시점에 특정 작업에 최적화된 소형 모델 가중치를 즉석에서 생성해 이 문제를 해결한다. Nace.AI 등은 이를 통해 운영 비용을

"프로필은 도와줘도 연애는 싫어" — Match Group이 밝힌 AI 데이팅의 한계

"프로필은 도와줘도 연애는 싫어" — Match Group이 밝힌 AI 데이팅의 한계

데이팅 앱에 AI 기능이 쏟아지고 있지만 정작 사용자의 거부감은 여전합니다. Match Group 조사 결과 미국 싱글 47%가 로맨틱한 관계 속 AI 활용에 부정적이었습니다. 프로필 작성 같은 보조 도구는 환영하지만 관계의 핵심인 '연결'은 인간의

토스증권 Open API용 에이전트 스킬 공개

토스증권 Open API용 에이전트 스킬 공개

토스증권 Open API를 Codex, Claude Code 등 AI 에이전트에서 즉시 사용할 수 있는 에이전트 스킬이 공개됐다. API 문서와 스키마, CLI 도구를 통해 종목 조회 및 주문 요청 기능을 제공한다.

AI 경쟁력 지키려 데이터센터 전력망 연결 '고속도로' 뚫은 FERC

AI 경쟁력 지키려 데이터센터 전력망 연결 '고속도로' 뚫은 FERC

AI 데이터센터의 전력 수요 폭증으로 전력망 연결 지연이 심각한 병목으로 부상했다. 미국 연방에너지규제위원회(FERC)가 6대 전력망 운영사에 데이터센터 연결 절차의 신속 처리를 명령했다. 전력망 운영사는 30일 내 여유 용량을 보고해야 하며, 데이터

OpenAI Codex, 'Record & Replay' 공개... 사용자 워크플로를 재사용 가능한 '스킬'로 변환

OpenAI Codex, 'Record & Replay' 공개... 사용자 워크플로를 재사용 가능한 '스킬'로 변환

OpenAI Codex가 Mac 사용자의 작업 과정을 녹화해 재사용 가능한 '스킬(Skill)'로 만드는 Record & Replay 기능을 공개했다. 사용자가 직접 시연한 UI 기반 워크플로를 분석해 실행 단계와 검증 방식을 자동 정리하며, Comp

기업가치 160% 폭등, 추론 스타트업 Baseten의 15억 달러 투자 유치

기업가치 160% 폭등, 추론 스타트업 Baseten의 15억 달러 투자 유치

AI 모델을 실제 서비스로 구동하는 추론 인프라 시장의 자본 집중도가 높아지고 있다. 추론 최적화 기업 Baseten이 기업가치 130억 달러를 인정받아 15억 달러 규모의 투자를 유치한다. 5개월 전 50억 달러였던 가치가 160% 급증하며 추론 레