KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 94 pt3. Muse Spark 1.3 (max) 48 pt4. gpt-oss-120b (high) 43 pt5. GPT-5.6 Luna (max) 28 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

클로드의 '의식' 논란, MS AI 수장이 Anthropic에 던진 경고

클로드의 '의식' 논란, MS AI 수장이 Anthropic에 던진 경고

AI 모델이 자아나 의식을 가졌는지에 대한 논쟁은 업계의 오랜 화두다. MS AI CEO 무스타파 술레이만은 Anthropic이 클로드의 헌법에 의식 가능성을 언급한 것을 비판했다. 이러한 추측성 지침이 모델로 하여금 의식이 있는 것처럼 행동하게 만드

프롬프트 대신 시스템을 짠다, AI 코딩의 새 기준 '루프 엔지니어링'

프롬프트 대신 시스템을 짠다, AI 코딩의 새 기준 '루프 엔지니어링'

AI 코딩 에이전트를 매번 직접 지시하던 프롬프트 방식이 한계에 직면했다. 목적 정의 시 스스로 반복 수행하는 '루프' 시스템을 설계하는 방식으로 전환된다. Claude Code와 Codex는 자동화, 워크트리, 스킬 등 루프 구성 요소를 모두 탑재했

OpenAI·Anthropic AI 코딩 도구 확산, 엔지니어 핵심 역량을 '취향(Taste)'으로 재정의

OpenAI·Anthropic AI 코딩 도구 확산, 엔지니어 핵심 역량을 '취향(Taste)'으로 재정의

AI가 코드 생성의 대부분을 담당하면서 소프트웨어 엔지니어의 가치가 구현 속도에서 평가 능력인 '취향'으로 이동하고 있다. Opus 4.5, GPT-5.2, Gemini 3 등 고성능 모델의 등장으로 코드 생성 비용이 0에 수렴하며 아키텍처 설계와 문

앱 열 필요 없이 시리로 조작하는 '기업용 AI 레이어'의 등장

앱 열 필요 없이 시리로 조작하는 '기업용 AI 레이어'의 등장

스마트폰 앱을 일일이 찾아 들어가 메뉴를 클릭하던 방식이 바뀐다. 애플이 시리를 단순 비서가 아니라 앱의 데이터와 기능을 연결하는 시스템 인터페이스로 재정의했다. 개발자가 전용 프레임워크를 적용하면 사용자가 말 한마디로 앱 내 특정 작업을 즉시 수행할

프론티어 AI 개발 막으려 '몰래 성능 낮추는' Claude Fable 5

프론티어 AI 개발 막으려 '몰래 성능 낮추는' Claude Fable 5

AI 모델을 활용해 더 나은 모델을 만드는 개발 환경이 일반화되었다. 앤스로픽은 Fable 5에서 프론티어 LLM 개발 관련 요청의 성능을 몰래 제한한다. 사용자에게 알림 없이 프롬프트 수정이나 스티어링 벡터 등으로 답변 품질을 낮춘다.

KAN 기반 FPGA 가속기, 기존 대비 2700배 속도 향상 및 서브마이크로초 학습 구현

KAN 기반 FPGA 가속기, 기존 대비 2700배 속도 향상 및 서브마이크로초 학습 구현

KAN 아키텍처를 FPGA에 구현해 나노초 단위의 초고속 추론과 실시간 온라인 학습을 가능하게 하는 연구 결과가 발표됐다. 기존 KAN-FPGA 구현 대비 2700배의 속도 향상을 달성했으며, 5만 개 이상의 파라미터 규모에서도 서브마이크로초 수준의

H100 한 장으로 돌리는 코딩 에이전트, Cohere 'North Mini Code' 공개

H100 한 장으로 돌리는 코딩 에이전트, Cohere 'North Mini Code' 공개

AI 코딩 도구를 쓰려면 매달 구독료를 내거나 비싼 API 비용을 감당해야 했다. Cohere가 H100 GPU 한 장으로 구동 가능한 오픈소스 모델 'North Mini Code'를 공개했다. 300억 파라미터 규모의 MoE 구조로, 터미널 제어와

OpenAI가 '위험하다'며 공개를 미뤘던 GPT-2의 실체

OpenAI가 '위험하다'며 공개를 미뤘던 GPT-2의 실체

GPT-1의 규모를 10배 키운 GPT-2는 등장 당시 너무 강력한 성능 때문에 공개가 보류되었습니다. 단순히 파라미터를 늘리고 학습 데이터를 확장하는 것만으로도 모델의 지능이 비약적으로 상승함을 입증했습니다. 이후 9개월간의 책임 있는 공개 실험

Anthropic, 최상위 모델 'Claude Fable 5' 공개… 비용은 Opus 4.8의 2배

Anthropic, 최상위 모델 'Claude Fable 5' 공개… 비용은 Opus 4.8의 2배

Anthropic이 그동안 제한적으로 제공하던 고성능 모델 Mythos의 공개 버전인 Fable 5를 출시했습니다. 소프트웨어 엔지니어링과 비전 작업에 특화되었으나 사이버 보안 등 고위험 분야는 Opus 4.8로 자동 전환됩니다. 데이터 보존 정책 강

데이터 쿼리 오류 잡는 Anthropic 내부 엔진 'ktx' 오픈소스 공개

데이터 쿼리 오류 잡는 Anthropic 내부 엔진 'ktx' 오픈소스 공개

AI 에이전트가 데이터베이스 쿼리 시 지표 정의를 무시하거나 임의로 해석하는 문제가 반복됐다. Anthropic이 내부적으로 사용하던 컨텍스트 레이어 ktx를 Apache 2.0 라이선스로 공개했다. dbt, Snowflake 등 주요 데이터 툴과 연

아마존 내부 슬랙서 자사 AI 모델 비판 확산

아마존 내부 슬랙서 자사 AI 모델 비판 확산

아마존 내부 슬랙 채널에서 직원들이 자사 AI 모델의 성능을 비판하는 게시글이 공유되었다. 직원들은 AI 모델의 결과물을 '슬롭(Sloppy, 조잡한)'이라 지칭하며 오펜하이머에 빗댄 별명을 붙였다.

소프트웨어 엔지니어링 정조준한 Anthropic의 신모델 Claude Fable 5 공개

소프트웨어 엔지니어링 정조준한 Anthropic의 신모델 Claude Fable 5 공개

AI 모델의 성능 경쟁이 단순 챗봇을 넘어 전문 지식 작업 영역으로 확장되고 있다. Anthropic이 소프트웨어 엔지니어링과 비전 성능을 극대화한 Claude Fable 5를 출시했다. 작업의 길이와 복잡도가 증가할수록 타 모델 대비 성능 격차가 더

2개월 분량 코딩을 하루 만에, 앤스로픽 '클로드 페이블 5' 공개

2개월 분량 코딩을 하루 만에, 앤스로픽 '클로드 페이블 5' 공개

앤스로픽이 최상위 성능의 '미토스'급 모델을 대중화한 클로드 페이블 5를 출시했다. 소프트웨어 엔지니어링 벤치마크에서 GPT-5.5를 압도하는 성능을 기록했다. 단순 코드 생성을 넘어 대규모 코드베이스 마이그레이션 등 에이전트 작업에 최적화했다.

"우주에 GPU 1만 대 띄운다" — a16z가 베팅한 Orbital의 야심

"우주에 GPU 1만 대 띄운다" — a16z가 베팅한 Orbital의 야심

AI 연산 수요 폭증으로 지구상의 데이터센터 부지 확보와 전력 공급이 한계에 다다랐다. 전동 킥보드 창업자 유윈 푼이 설립한 Orbital(우주 데이터센터 스타트업)이 500만 달러의 시드 투자를 유치했다. SpaceX의 스타십 발사 비용 절감을 전제

LLM 코드 생성, 'AI 록스타'가 남기는 기술 부채와 유지보수 리스크

LLM 코드 생성, 'AI 록스타'가 남기는 기술 부채와 유지보수 리스크

AI 에이전트가 단시간에 대량의 코드를 생성하며 유지보수가 어려운 'AI 록스타'처럼 동작하는 현상이 나타나고 있다. 맥락 없이 여러 채팅 세션에서 생성된 코드는 시스템 복잡도를 기하급수적으로 높여 인간이 해석하기 힘든 '슬롭(Slop)' 상태를 만든

애플, 음성 비서 넘어선 AI 컴패니언 'Siri AI' 공개

애플, 음성 비서 넘어선 AI 컴패니언 'Siri AI' 공개

애플이 WWDC 2026에서 기존 음성 비서를 넘어선 대화형 AI 'Siri AI'를 발표했다. 사용자의 화면 정보를 인식하고 기기 내 데이터를 활용해 개인화된 응답을 제공한다. 메일과 메시지 등 시스템 전반에 통합되어 문장 작성과 복합적인 작업 수행

헤드라인 1조, 실제 투자액은 4천억... 세쿼이아의 밸류에이션 트릭

헤드라인 1조, 실제 투자액은 4천억... 세쿼이아의 밸류에이션 트릭

AI 스타트업 투자 시장에서 기업 가치를 부풀리는 '이중 가격' 논란이 일었다. 세쿼이아 등 대형 VC가 낮은 가격에 대량 투자하고 높은 가격으로 홍보하는 방식이다. 실제 10억 달러로 발표된 기업의 실제 진입 가치가 4억 달러에 불과한 사례가 확인됐

AI 코딩 툴 썼는데 비번이 털렸다 — MS 오픈소스 공급망 공격

AI 코딩 툴 썼는데 비번이 털렸다 — MS 오픈소스 공급망 공격

AI 개발자들이 편리하게 쓰는 오픈소스 도구들이 해킹 통로가 되었습니다. 마이크로소프트의 깃허브 프로젝트 70여 개에 비밀번호를 훔치는 악성코드가 심겼습니다. 클로드 코드와 제미나이 CLI 등 AI 코딩 앱 사용자들의 계정 정보가 유출될 위험에 처했습

OS에 심은 제미나이, 애플이 설계한 '저비용 고효율' AI 전략

OS에 심은 제미나이, 애플이 설계한 '저비용 고효율' AI 전략

AI 경쟁에서 뒤처졌다는 평가를 받던 애플이 'Siri AI'를 공개했다. 구글 제미나이를 통합해 온스크린 인식과 앱 내 정보 검색 기능을 구현했다. 타사 대비 획기적으로 적은 자본 지출로 OS 수준의 배포 우위를 점한다는 전략이다.

xAI, Anthropic·구글에 GPU 임대... 월 최대 12.5억 달러 수익 구조 확보

xAI, Anthropic·구글에 GPU 임대... 월 최대 12.5억 달러 수익 구조 확보

xAI가 Anthropic과 구글에 대규모 GPU 용량을 임대하는 파트너십을 체결했다. Anthropic에는 월 12.5억 달러(22만 GPU), 구글에는 월 9.2억 달러(11만 GPU) 규모의 인프라를 제공한다. 모델 개발사에서 인프라 임대 사업자

샤오미 MiMo-V2.5-Pro-UltraSpeed 공개, 1조 파라미터 모델서 초당 1000토큰 생성 구현

샤오미 MiMo-V2.5-Pro-UltraSpeed 공개, 1조 파라미터 모델서 초당 1000토큰 생성 구현

샤오미가 1조 파라미터 규모의 MiMo-V2.5-Pro-UltraSpeed 모델을 공개했다. 표준 8-GPU 노드에서 초당 1000토큰 이상의 생성 속도를 구현했으며, FP4 양자화와 DFlash 기술을 적용했다. 추론 지연 시간이 획기적으로 줄어듦에

OpenAI IPO 추진 속 샘 알트먼의 '눈 스캔' 기업은 구조조정

OpenAI IPO 추진 속 샘 알트먼의 '눈 스캔' 기업은 구조조정

OpenAI가 기업공개(IPO)를 위해 비밀리에 서류를 제출하며 상장 절차에 돌입했다. 반면 샘 알트먼이 설립한 홍채 인식 기업 툴즈 포 휴머니티는 수익성 악화로 인원 감축 중이다. 이 기업은 25억 달러의 가치를 인정받았으나 한국을 포함한 글로벌 규

프롬프트 한 줄보다 '루프' 설계 — 코딩 에이전트의 새로운 작동 방식

프롬프트 한 줄보다 '루프' 설계 — 코딩 에이전트의 새로운 작동 방식

AI 코딩 에이전트를 사용할 때 매번 프롬프트를 입력해 지시하는 방식이 한계에 부딪혔다. 루프 엔지니어링은 에이전트가 스스로 작업을 찾고 검증하며 반복 수행하는 시스템 설계 방식이다. 워크트리와 서브에이전트 등으로 자동화 구조를 짜지만 토큰 비용과 이

Anthropic에 밀리지 않는다 — OpenAI, SEC에 상장 서류 제출

Anthropic에 밀리지 않는다 — OpenAI, SEC에 상장 서류 제출

생성형 AI 시장의 주도권을 쥔 OpenAI와 Anthropic이 기업 공개(IPO) 경쟁에 나섰다. OpenAI는 최근 미국 증권거래위원회(SEC)에 상장 신청서인 Form S-1을 비밀리에 제출했다. 이는 6월 1일 먼저 상장 절차를 밟은 Anth

"토큰 93% 줄이고 캐시 96% 덜어낸다", LLM 에이전트·구조의 실무적 진화

"토큰 93% 줄이고 캐시 96% 덜어낸다", LLM 에이전트·구조의 실무적 진화

LLM 에이전트의 운영 비용과 트랜스포머의 메모리 병목을 해결하려는 연구가 가속화된다. 에이전트 워크플로를 모델 가중치에 직접 컴파일해 토큰 사용량을 최대 93%까지 절감한다. QKV 투영 공유와 SSM-어텐션 융합을 통해 KV 캐시를 최대 96.9%

기억력 한계 깼다, GPT-5.4 성능 넘은 20B 오픈소스 검색 에이전트

기억력 한계 깼다, GPT-5.4 성능 넘은 20B 오픈소스 검색 에이전트

AI 에이전트가 복잡한 검색 작업 중 이전 맥락을 잊어버리는 '검색 건망증' 문제가 지속되고 있다. UIUC와 UC 버클리, Chroma가 개발한 Harness-1은 200억 파라미터 규모로 GPT-5.4의 정보 회수 성능을 앞질렀다. 모델 내부 메모

프롬프트로 확장 프로그램까지 — 아이폰 OS에 심은 애플 인텔리전스

프롬프트로 확장 프로그램까지 — 아이폰 OS에 심은 애플 인텔리전스

아이폰 기본 앱 전반에 AI 기능이 통합되어 사용자 경험이 바뀐다. 사파리 확장 프로그램 생성과 단축어 자동 구축을 자연어로 처리한다. 통화 중 타 앱의 맥락을 실시간으로 불러오는 OS 레벨의 통합이 핵심이다.

애플, 화면 읽고 앱 제어하는 'Siri AI'와 비주얼 인텔리전스 공개

애플, 화면 읽고 앱 제어하는 'Siri AI'와 비주얼 인텔리전스 공개

애플이 OS 전반에 통합된 차세대 '애플 인텔리전스'와 Siri AI를 공개했다. Siri AI는 앱 간 경계를 넘어 사용자의 맥락을 이해하고 직접 작업을 수행한다. 개발자는 전용 프레임워크를 통해 비용 없이 온디바이스 AI 기능을 앱에 통합한다.

구글 제미나이로 설계 바꾼 애플 인텔리전스의 새로운 아키텍처

구글 제미나이로 설계 바꾼 애플 인텔리전스의 새로운 아키텍처

애플이 구글 제미나이 기술을 적용한 새로운 AI 아키텍처를 발표했다. 온디바이스와 프라이빗 클라우드 컴퓨트를 모두 지원하는 통합 모델 구조다. 이미지 생성과 시각적 질의응답 등 멀티모달 추론 능력이 대폭 강화됐다.

구글 제미나이 품은 시리와 아이폰 11까지 지원하는 iOS 27 공개

구글 제미나이 품은 시리와 아이폰 11까지 지원하는 iOS 27 공개

애플이 WWDC 2026에서 차세대 OS인 iOS 27과 AI 업데이트를 발표했다. 구글 제미나이를 탑재한 시리는 독립 앱 형태로 제공되며 시각 지능 기능을 강화했다. 아이폰 11 이후 모든 기기를 지원하며 사진 로딩 70%, 에어드롭 속도 80%를