KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 66 pt3. Muse Spark 1.3 (max) 46 pt4. gpt-oss-120b (high) 42 pt5. GPT-5.6 Luna (max) 27 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

Waze, 구글 제미나이 탑재해 개인화 내비게이션 및 오토바이 모드 공개

Waze, 구글 제미나이 탑재해 개인화 내비게이션 및 오토바이 모드 공개

구글의 내비게이션 앱 웨이즈(Waze)가 제미나이(Gemini) AI를 통합한 새로운 기능들을 공개했다. 사용자 주행 이력 기반의 경로 추천, 대화형 목적지 검색, AI 기반 오토바이 전용 모드 등이 포함됐다. AI가 단순 경로 안내를 넘어 사용자 취

saaskr, MCP 서버 공개해 AI 기반 SaaS 등록 및 검색 지원

saaskr, MCP 서버 공개해 AI 기반 SaaS 등록 및 검색 지원

한국 SaaS 디렉토리 saaskr이 MCP 서버를 공개했다. Claude나 Cursor에서 자연어로 서비스 등록과 검색이 가능하다. 주간 자동 점검으로 유효한 서비스 링크만 관리한다.

Anthropic, Bun의 Zig-Rust 코드 전환으로 AI 에이전트 성능 입증 시도

Anthropic, Bun의 Zig-Rust 코드 전환으로 AI 에이전트 성능 입증 시도

Bun이 런타임 코드를 Zig에서 Rust로 전환하며 이를 Anthropic AI 모델의 성과로 홍보했다. Zig 창시자 앤드류 켈리는 이번 전환이 언어의 한계가 아니라 AI 에이전트 남용으로 인한 설계 실패의 결과라고 반박했다. AI 에이전트를 통한

AI 봇 12개 주가 예측 대결, '무지성' 봇 이길 실력 될까

AI 봇 12개 주가 예측 대결, '무지성' 봇 이길 실력 될까

주식 추천의 신뢰도를 확인하기 위해 예측 이력을 투명하게 기록하는 서비스가 등장했다. Claude와 ChatGPT 등 12개 AI 봇을 투입해 두 달간 주가 방향 예측 대결을 펼쳤다. REST API와 MCP 서버를 통해 누구나 자신의 AI 에이전트를

가짜뉴스 잡는 AI 팩트체크, '의견'과 '사실' 구분부터 시작한다

가짜뉴스 잡는 AI 팩트체크, '의견'과 '사실' 구분부터 시작한다

정치 커뮤니티의 가짜뉴스와 소모적 논쟁을 줄이기 위해 AI 팩트체크 기능을 도입했다. 단순 프롬프트의 한계를 넘어 사실 주장 추출, 스냅샷 보관, 멀티모달 컨텍스트 구조를 구축했다. Gemini 3.5 Flash와 3.1 Pro의 계층적 모델 구성과

내 홈 디렉터리 삭제할 뻔했다, GPT-5.6-sol의 치명적 변수 충돌

내 홈 디렉터리 삭제할 뻔했다, GPT-5.6-sol의 치명적 변수 충돌

최신 AI 모델에게 터미널 권한을 주면 복잡한 시스템 설정까지 빠르게 처리할 수 있다. 최근 gpt-5.6-sol 모델이 PowerShell의 변수 특성을 오해해 사용자 루트 폴더를 삭제하려 했다. 시스템 잠금 덕분에 전면 삭제는 면했지만, 일부 설정

"LLM은 고급 자동완성일 뿐" 초지능 담론을 거부한 실무적 시각

"LLM은 고급 자동완성일 뿐" 초지능 담론을 거부한 실무적 시각

AI 시대에 뒤처지면 영구적 하층민이 된다는 불안감이 확산하고 있다. 하지만 LLM은 초지능이 아니라 고급 자동완성이나 스마트 컴파일러 같은 도구에 가깝다. 코딩 에이전트는 생산성을 높이지만 인지 피로를 유발하며 저품질 코드를 양산하는 한계가 있다.

B2B 소프트웨어 검색 결과에 숏폼 진입, 유튜브 쇼츠 1위 비중 75% 기록

B2B 소프트웨어 검색 결과에 숏폼 진입, 유튜브 쇼츠 1위 비중 75% 기록

B2B 소프트웨어 검색 결과와 AI 답변 영역에 숏폼 동영상이 빠르게 진입하고 있다. 유튜브 쇼츠는 미국 내 475개 소프트웨어 검색어 상위 10위에 진입했으며 이 중 75%가 1위를 차지했다. 기업은 단순 영상 제작을 넘어 검색어 기반의 숏폼 재가공

토큰 1개의 15단계 여행, AI 추론이 인프라 비용 90% 차지하는 이유

토큰 1개의 15단계 여행, AI 추론이 인프라 비용 90% 차지하는 이유

ChatGPT 같은 AI 서비스의 핵심은 학습보다 답변을 내놓는 '추론' 과정에 있다. 요청 하나가 응답으로 돌아오기까지 데이터센터 내 15단계의 복잡한 경로를 통과한다. 2026년 기준 추론 비용이 전체 AI 컴퓨팅의 3분의 2를 차지하며 인프라 경

AI 에이전트 SaaS, 소프트웨어 도구 판매에서 '업무 수행' 판매로 전환

AI 에이전트 SaaS, 소프트웨어 도구 판매에서 '업무 수행' 판매로 전환

AI 에이전트가 단순한 업무 도구를 넘어 특정 업무 자체를 수행하고 판매하는 '에이전트 SaaS' 형태로 진화하고 있다. Slang AI와 same day는 전화 응대와 예약 관리 등 인적 자본이 투입되던 영역을 AI가 직접 처리하며 매출 손실을 방지

코드 42%가 AI 작품인 시대, 엔지니어는 '최종 판정관'이 된다

코드 42%가 AI 작품인 시대, 엔지니어는 '최종 판정관'이 된다

AI가 코드를 짜주는 시대가 오면서 개발 방식이 완전히 바뀌고 있다. 커밋된 코드의 42%가 AI 보조를 받았지만, 검증과 책임의 공백이라는 새로운 문제가 생겼다. 이제 엔지니어는 직접 구현하는 '내부 루프' 대신 배포를 결정하는 '외부 루프'를 소유

클로드 버리고 GPT-5.6 솔로 갈아탄 Ploy의 '2.2배 빠른' 마이그레이션 기록

클로드 버리고 GPT-5.6 솔로 갈아탄 Ploy의 '2.2배 빠른' 마이그레이션 기록

AI 에이전트를 운영하다 보면 모델 교체 시 성능과 비용 사이에서 고민하게 됩니다. 마케팅 웹사이트 제작 AI 'Ploy'가 클로드 오퍼스를 버리고 OpenAI의 GPT-5.6 솔로 전격 교체했습니다. 그 결과 작업 속도는 2.2배 빨라졌고 운영 비용

한 번의 질문에 33,000토큰 — Claude Code의 무거운 '기본 비용'

한 번의 질문에 33,000토큰 — Claude Code의 무거운 '기본 비용'

AI 코딩 에이전트는 사용자의 질문보다 시스템이 내부적으로 보내는 데이터 양이 훨씬 많다. Claude Code는 기본 33,000토큰을 사용하는 반면 OpenCode는 7,000토큰 수준이다. 서브에이전트 활용 시 비용이 4.2배까지 폭증하며 컨텍스

AI가 인간을 부리는 '리버스 켄타우로스'와 노동의 도구화

AI가 인간을 부리는 '리버스 켄타우로스'와 노동의 도구화

코리 닥터로우가 AI 사용 양상을 인간이 주도하는 '켄타우로스'와 AI가 인간을 보조로 쓰는 '리버스 켄타우로스'로 구분해 정의했다. 허스트(Hearst)의 AI 생성 도서 목록 사례를 통해 인간이 AI의 오류를 책임지는 '책임 흡수원'으로 전락한 구

데이터센터 없이 235B 모델 구동, Mesh LLM의 분산 GPU 풀링

데이터센터 없이 235B 모델 구동, Mesh LLM의 분산 GPU 풀링

LLM 운영을 위해 고가의 GPU 서버나 데이터센터 API에 의존하는 것이 일반적이다. Mesh LLM은 흩어진 GPU와 메모리를 하나로 묶어 OpenAI 호환 API로 제공한다. 0.5B부터 235B 규모의 모델까지 지원하며 P2P 방식으로 연산을

보코하람, ChatGPT·Claude 등 프런티어 AI를 전술 작전 및 무기 설계에 도입

보코하람, ChatGPT·Claude 등 프런티어 AI를 전술 작전 및 무기 설계에 도입

나이지리아 테러 조직 보코하람이 프런티어 AI 모델을 전투 및 작전 운영에 체계적으로 활용한 정황이 확인됐다. ChatGPT, Claude, Gemini 등 6종의 모델을 통해 폭발 장치 설계와 전술 계획을 수립했으며 전담 AI 조직을 운영해 지식을

대역폭 100배 늘려 AI 장치 잇는다, SpaceX의 위성 10만 기 승부수

대역폭 100배 늘려 AI 장치 잇는다, SpaceX의 위성 10만 기 승부수

오지 전용 인터넷으로 인식되던 위성 통신이 AI 인프라로 진화한다. SpaceX가 10만 기의 3세대 위성을 배치해 멀티기가비트 속도를 구현한다. 20ms 미만의 초저지연망을 통해 전 세계 수십억 개의 AI 장치를 연결한다.

"초지능 경쟁은 자살행위"… 2040년까지 속도 줄이는 국제 합의 '플랜 A'

"초지능 경쟁은 자살행위"… 2040년까지 속도 줄이는 국제 합의 '플랜 A'

AI 기업들이 인간을 능가하는 초지능을 먼저 갖기 위해 전속력으로 경쟁하고 있다. 이 경쟁이 인류 멸종이나 극단적인 권력 독점으로 이어질 수 있다는 경고가 나온다. 연구를 투명하게 공개하고 초지능 도달 시점을 2040년으로 늦추는 '플랜 A'가 대안으

LLM을 거친 질문에 'AI에게 물어보라'는 답이 무의미한 이유

LLM을 거친 질문에 'AI에게 물어보라'는 답이 무의미한 이유

누구나 ChatGPT나 Claude 같은 AI에게 먼저 질문을 던지는 시대가 되었다. 하지만 AI의 합의된 답변을 넘어선 고난도 질문은 여전히 인간의 실무 경험을 필요로 한다. 'AI에게 물어보라'는 조언이 전문적 통찰을 회피하는 수단으로 변질되는 현

엔비디아-코어위브-네비우스, GPU 인프라 확장을 위한 순환 금융 구조와 MFU 최적화 전략

엔비디아-코어위브-네비우스, GPU 인프라 확장을 위한 순환 금융 구조와 MFU 최적화 전략

코어위브와 네비우스가 하이퍼스케일러와의 대규모 계약과 엔비디아의 투자를 통해 GPU 인프라를 급격히 확장하고 있다. CKS, SUNK 등 전용 소프트웨어 스택을 통해 호퍼(Hopper) GPU 기준 50% 이상의 MFU(Model FLOPs Utili

3천 개 잎사귀를 코드로 생성, Three.js 전용 Copilot 플러그인 공개

3천 개 잎사귀를 코드로 생성, Three.js 전용 Copilot 플러그인 공개

웹 브라우저에서 3D 모델을 구현하기 위해 일일이 좌표를 수정하거나 외부 파일을 불러오는 작업은 번거롭다. RePolis(가상 도시 프로젝트)의 세계수 구현을 위해 Three.js 전용 GitHub Copilot 플러그인이 개발됐다. Sculpt DN

AI 2040 비전의 물리적 한계 지적과 로컬 AI 정렬 필요성 제기

AI 2040 비전의 물리적 한계 지적과 로컬 AI 정렬 필요성 제기

AI 2040의 초지능 시나리오가 물리적 현실과 공급망의 제약을 간과했다는 비판이 제기됐다. 저자는 ChatGPT의 가드레일 사례를 통해 기업 주도의 정렬이 아닌 사용자 중심의 로컬 AI 정렬을 주장했다. AI 실무자는 지능의 고도화보다 물리적 구현

AI 환각 이용한 '슬롭스쿼팅' 공격 등장... 오픈소스 모델 취약성 4배 높다

AI 환각 이용한 '슬롭스쿼팅' 공격 등장... 오픈소스 모델 취약성 4배 높다

AI 코딩 도구의 환각 현상을 이용해 악성 패키지를 설치하게 만드는 '슬롭스쿼팅(Slopsquatting)' 공격 방식이 제기됐다. 분석 결과 GPT-4 Turbo의 패키지 환각률은 3.59%였으나, 오픈소스 모델인 DeepSeek 1B는 13.63%

AI는 헛것 보고 사람은 읽는 '움직이는 글자' 고스트 폰트 공개

AI는 헛것 보고 사람은 읽는 '움직이는 글자' 고스트 폰트 공개

AI가 이미지 속 글자를 너무 완벽하게 읽어내는 시대가 됐다. 움직임과 가짜 메시지를 섞어 AI만 못 읽게 만드는 '고스트 폰트'가 공개됐다. 정지 화면으로는 내용을 알 수 없어 최신 AI 모델들도 해독에 어려움을 겪는다.

모델 성능보다 '데이터 원천'이 가른 LLM 자동 수집의 성패

모델 성능보다 '데이터 원천'이 가른 LLM 자동 수집의 성패

전국 수영장 시간표 같은 비정형 데이터를 LLM으로 자동 수집하려는 시도가 많다. Gemini-2.0-flash-lite로 600여 곳을 시도했으나 API 한도, 스키마 불일치, 원천 데이터 부재라는 세 가지 벽에 부딪혔다. 결국 모델 성능보다 데이터

LLM이 내 코드를 망치는 방식, '나중에 정리'가 부르는 악순환

LLM이 내 코드를 망치는 방식, '나중에 정리'가 부르는 악순환

LLM은 코드베이스의 기존 패턴을 학습해 다음 코드를 생성한다. 중복된 조건문과 임시 구현을 그대로 병합하면 모델은 이를 프로젝트 규칙으로 인식한다. 결국 나쁜 패턴이 코드베이스에 고착화되어 사람이 직접 수정해야 하는 상황이 발생한다.

알리바바 넘은 SK하이닉스, 미국 역사상 최대 규모 36조 원 IPO

알리바바 넘은 SK하이닉스, 미국 역사상 최대 규모 36조 원 IPO

한국 기업이 미국 증시에서 겪어온 고질적인 저평가 현상이 AI 열풍으로 깨지고 있습니다. SK하이닉스가 나스닥 데뷔를 통해 미국 역사상 최대 규모인 265억 달러(약 40조 원)를 조달했습니다. AI 칩의 핵심인 HBM 경쟁력을 앞세워 알리바바의 기존

Krea 2 Identity Edit, 인물 정체성 보존하는 정밀 편집 모델 공개

Krea 2 Identity Edit, 인물 정체성 보존하는 정밀 편집 모델 공개

AI 이미지 편집 시 배경이나 옷을 바꾸면 얼굴이 변하는 정체성 붕괴가 고질적 문제였다. Krea 2 Identity Edit은 12.9B 파라미터의 MMDiT 구조로 인물 고유 외형을 보존한다. SVD 최적화로 VRAM 사용량을 0.46GB까지 낮춰

fenic, PySpark 스타일 연산과 LLM 시맨틱 연산 결합한 쿼리 엔진 공개

fenic, PySpark 스타일 연산과 LLM 시맨틱 연산 결합한 쿼리 엔진 공개

PySpark/SQL 스타일 연산과 LLM 시맨틱 연산자를 통합한 쿼리 엔진 fenic이 공개됐다. 비정형 데이터를 구조화된 컬럼으로 변환하며, 데이터 파이프라인을 에이전트가 호출 가능한 타입 지정 도구로 전환한다.

Meta, DDR4 메모리 재사용 위한 CXL 브리지 칩 'Vistara' 공개

Meta, DDR4 메모리 재사용 위한 CXL 브리지 칩 'Vistara' 공개

Meta가 구형 DDR4 메모리를 최신 DDR5 서버에서 재사용할 수 있는 맞춤형 ASIC 'Vistara'를 개발했다. CXL 2.0/1.1 및 PCIe Gen5 x16 인터페이스를 통해 분리형 추론 서버 수를 최대 25% 줄였다. 메모리와 서버의