KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 94 pt3. Muse Spark 1.3 (max) 48 pt4. gpt-oss-120b (high) 43 pt5. GPT-5.6 Luna (max) 28 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

코딩 테스트의 종말 — AI 시대, 기업이 다시 '기초 역량'에 집착하는 이유

코딩 테스트의 종말 — AI 시대, 기업이 다시 '기초 역량'에 집착하는 이유

AI 코딩 도구의 보급으로 기존의 기술 면접 방식이 무력화되고 있다. 앤스로픽 등 주요 기업은 면접 내 AI 사용을 제한하며 기초 역량 검증으로 회귀 중이다. 도구적 숙련도보다 추론 능력과 설계 역량 중심의 라이브 테스트 비중이 확대된다.

10년 전 제온 서버, 최적화만으로 Gemma 4 '읽기 속도' 구현

10년 전 제온 서버, 최적화만으로 Gemma 4 '읽기 속도' 구현

LLM 추론의 핵심 병목은 연산 속도가 아니라 메모리 대역폭이다. 2016년형 제온 서버에서 ik_llama.cpp 최적화를 통해 Gemma 4 26B-A4B를 실행했다. 추측 디코딩과 MoE 캐시 최적화로 GPU 없이도 읽기 가능한 속도를 확보했다.

DeepGoogle SRE의 진화, AI 자율 운영 시대의 '안전 삼각축'

Google SRE의 진화, AI 자율 운영 시대의 '안전 삼각축'

AI 코딩 도구로 배포 속도가 4배 빨라지며 기존 수동 SRE 관행이 한계에 봉착했다. Google은 AI 에이전트의 자율성을 4단계로 구분하고 안전 가드레일을 구축했다. 운영자는 이제 코드 리뷰어가 아닌, AI의 안전 경계를 설계하는 아키텍트로

그래미 어워즈 CEO 하비 메이슨 주니어, 생성형 AI의 음악 산업 파급력과 시상식 대응 논의

그래미 어워즈 CEO 하비 메이슨 주니어, 생성형 AI의 음악 산업 파급력과 시상식 대응 논의

그래미 어워즈를 주관하는 레코딩 아카데미의 하비 메이슨 주니어 CEO가 생성형 AI가 음악 산업에 미치는 영향과 대응 방안을 논의했습니다. 기술이 창작의 영역을 빠르게 잠식하는 가운데, 시상식의 공정성과 인간 예술가의 가치를 지키기 위한 고민이 깊어

알파벳, AI 인프라 및 컴퓨팅 확장 위해 800억 달러 자본 조달 발표

알파벳, AI 인프라 및 컴퓨팅 확장 위해 800억 달러 자본 조달 발표

알파벳이 AI 인프라와 컴퓨팅 능력을 강화하기 위해 800억 달러 규모의 자본을 조달합니다. 거대 AI 모델 구동에 필수적인 하드웨어 투자를 대폭 확대할 계획입니다.

UltraCat, 팬 조절부터 잠자기 제어까지 맥북 유틸리티 통합 무료 앱 공개

UltraCat, 팬 조절부터 잠자기 제어까지 맥북 유틸리티 통합 무료 앱 공개

맥북의 상태 모니터링, 팬 속도 조절, 잠자기 제어 기능을 하나로 통합한 무료 앱 UltraCat이 공개되었습니다. TG Pro, 암페타민 등 개별적으로 사용하던 유료 유틸리티의 핵심 기능을 한 곳에서 사용할 수 있습니다.

1200억 파라미터 모델을 로컬로, 엔비디아 품은 서피스 랩탑 울트라

1200억 파라미터 모델을 로컬로, 엔비디아 품은 서피스 랩탑 울트라

고성능 노트북 시장은 그동안 애플의 맥북 프로가 독주해 왔다. 마이크로소프트가 엔비디아와 협력해 128GB 통합 메모리를 갖춘 '서피스 랩탑 울트라'를 공개했다. 1200억 개의 파라미터를 가진 AI 모델을 클라우드 없이 로컬에서 돌리는 압도적 성능을

2000억 달러 CPU 시장 정조준한 엔비디아의 'RTX Spark' 공개

2000억 달러 CPU 시장 정조준한 엔비디아의 'RTX Spark' 공개

AI PC 시장이 단순 챗봇 실행을 넘어 자율적인 에이전트 구동 단계로 진입한다. 엔비디아가 1페타플롭 성능의 'RTX Spark' CPU를 공개하며 2000억 달러 규모의 CPU 시장에 도전한다. 마이크로소프트, 델, HP 등 주요 제조사가 올가을부

코드 생성 금지, 스탠퍼드가 정의한 '가르치는 AI'의 기준

코드 생성 금지, 스탠퍼드가 정의한 '가르치는 AI'의 기준

AI 코딩 어시스턴트가 정답을 즉시 제공하며 학습자의 사고 과정을 대체하는 문제가 늘고 있다. 스탠퍼드 대학교 CS336 과정은 AI가 구현 대신 설명과 피드백만 제공하는 엄격한 가이드라인을 설정했다. 구체적인 디버깅 유도 질문과 프로파일링 데이터 요

"5일 뒤 날씨가 내일처럼 정확" — 윈드본의 AI 기상 예보

"5일 뒤 날씨가 내일처럼 정확" — 윈드본의 AI 기상 예보

기상 예보는 슈퍼컴퓨터와 물리 모델이 지배하는 영역이었다. 스타트업 윈드본이 공개한 '웨더메시 6'는 유럽 중기예보센터(ECMWF)보다 더 잦고 정확한 예측을 제공한다. 자체 기상 풍선 400개에서 수집한 데이터를 모델에 직접 입력해 예측 정밀도를 높

추론부터 행동까지 하나로, 물리 AI 통합 모델 코스모스 3 공개한 엔비디아

추론부터 행동까지 하나로, 물리 AI 통합 모델 코스모스 3 공개한 엔비디아

물리 AI는 현실 세계를 이해하고 다음 상황을 예측해 행동을 생성해야 한다. 엔비디아가 추론, 세계 생성, 행동 생성을 하나로 통합한 코스모스 3를 오픈소스로 공개했다. MoT 아키텍처 기반의 8B, 32B 모델과 학습 레시피, 6종의 합성 데이터셋을

GPT-5.5 성능 잡고 비용은 10%로 낮춘 MiniMax-M3 공개

GPT-5.5 성능 잡고 비용은 10%로 낮춘 MiniMax-M3 공개

중국 AI 스타트업 MiniMax가 100만 토큰 컨텍스트를 지원하는 M3 모델을 출시했다. GPT-5.5와 Gemini 3.1 Pro의 성능을 일부 추월하며 운영 비용을 8~20% 수준으로 절감했다. 10일 이내에 가중치 공개(Open Weights

구글 AI 검색의 역설, 'No-AI' 기본 설정 내놓은 DuckDuckGo

구글 AI 검색의 역설, 'No-AI' 기본 설정 내놓은 DuckDuckGo

구글이 검색 결과 상단에 AI 생성 개요를 배치하는 AI 우선 체제로 전환했다. DuckDuckGo는 AI 답변과 채팅 프롬프트를 제거한 'noai' 전용 페이지를 기본 검색엔진으로 설정하는 확장 프로그램을 출시했다. 출시 후 No-AI 페이지 방문자

AI가 생성한 Matplotlib 코드 오류, 개발 환경의 신뢰성 문제 제기

AI가 생성한 Matplotlib 코드 오류, 개발 환경의 신뢰성 문제 제기

AI가 데이터 시각화 라이브러리인 Matplotlib의 잘못된 코드를 생성하며 개발 효율성에 혼선을 빚었습니다. 모델의 환각 현상이 실무 코드 작성에 미치는 영향과 검증의 중요성이 다시금 강조됩니다.

엔비디아, 노트북 및 데스크톱 PC용 범용 칩 공개

엔비디아, 노트북 및 데스크톱 PC용 범용 칩 공개

엔비디아가 노트북과 데스크톱 PC를 위한 범용 칩을 공개했습니다. 기존 GPU 중심의 하드웨어 구성을 넘어 PC 시스템의 핵심 연산 영역으로 진출합니다.

OpenAI 청구서 공포 끝낼 LLM 관측 플랫폼 Spanlens

OpenAI 청구서 공포 끝낼 LLM 관측 플랫폼 Spanlens

LLM 서비스 운영 시 가장 큰 고민은 예상치 못한 비용과 복잡한 디버깅이다. 오픈소스 플랫폼 Spanlens는 baseURL 변경만으로 비용 추적과 에이전트 경로 시각화를 제공한다. LangGraph 토폴로지 뷰와 Critical Path 분석으로

코드 재작성 비용 0원 시대, 모델링이 개발자의 유일한 무기

코드 재작성 비용 0원 시대, 모델링이 개발자의 유일한 무기

LLM의 생산성 폭발로 인간의 소비 속도가 개발의 새로운 병목이 됐다. 무분별한 AI 생성물인 '슬롭(Slop)'의 악순환을 막기 위해 자동 방어층 구축이 필수적이다. 이제 개발자의 핵심 역량은 단순 구현이 아니라 시스템 아키텍처 설계와 컨텍스트 관리

OpenAI가 못 먹는 AI 앱 시장, '시스템 오브 워크'가 해자다

OpenAI가 못 먹는 AI 앱 시장, '시스템 오브 워크'가 해자다

AI 모델 성능이 올라가며 단순한 앱 서비스들이 거대 랩에 흡수되고 있다. 하지만 복잡한 산업별 워크플로와 규제를 해결하는 버티컬 영역은 여전히 기회다. 모델은 교체 가능하지만 실제 업무가 돌아가는 시스템을 소유한 기업이 살아남는다.

The Website Specification 공개, AI 에이전트 대응 포함한 10개 영역 표준 제시

The Website Specification 공개, AI 에이전트 대응 포함한 10개 영역 표준 제시

플랫폼과 무관하게 적용 가능한 웹사이트 기술 표준인 'The Website Specification'이 공개되었습니다. SEO, 보안, 성능 등 10개 영역을 다루며 MCP 서버를 통해 AI 에이전트의 접근성을 높였습니다.

AI 구독 서비스, 이제는 '해지'가 해결책이 될 수 있을까?

AI 구독 서비스, 이제는 '해지'가 해결책이 될 수 있을까?

AI 구독 비용에 대한 부담과 효용성 고민이 제기되었습니다. 구독 해지를 통해 최적의 도구 조합을 찾는 움직임이 나타나고 있습니다.

Odysseus, ChatGPT UI를 내 서버에 구현하는 셀프 호스팅 AI 워크스페이스 공개

Odysseus, ChatGPT UI를 내 서버에 구현하는 셀프 호스팅 AI 워크스페이스 공개

ChatGPT와 Claude의 UI 경험을 개인 서버에서 구현하는 셀프 호스팅 워크스페이스 Odysseus 1.0이 공개됐다. ChromaDB, SearXNG, ntfy를 통합해 로컬 데이터 기반의 프라이버시 중심 환경을 제공한다. 셸 접근, 모델 다

초당 400토큰 쏟아내는 Step 3.7 Flash, AI 에이전트 '실행' 속도 잡았다

초당 400토큰 쏟아내는 Step 3.7 Flash, AI 에이전트 '실행' 속도 잡았다

AI 에이전트가 단순 대화를 넘어 실제 업무를 수행하는 실행 단계로 진입했다. StepFun이 공개한 Step 3.7 Flash는 초당 최대 400토큰의 처리량을 구현했다. 256k 컨텍스트 윈도우와 3단계 추론 설정을 통해 비용과 성능의 균형을 맞췄

서버 없이 아이폰에서 9초 만에 그림 그리는 Bonsai Image 4B

서버 없이 아이폰에서 9초 만에 그림 그리는 Bonsai Image 4B

이미지 생성 AI를 쓰려면 비싼 서버 비용과 대기 시간이 필수였다. PrismML이 모델 크기를 획기적으로 줄인 Bonsai Image 4B를 공개했다. 아이폰 17 프로 맥스에서 512px 이미지를 9.4초 만에 생성한다.

200파운드로 VRAM 32GB 확보 — Tesla V100 중고 조합의 실효성

200파운드로 VRAM 32GB 확보 — Tesla V100 중고 조합의 실효성

최신 GPU의 VRAM 부족 문제를 중고 데이터센터 GPU 조합으로 해결했다. Tesla V100 SXM2와 어댑터를 사용하여 총 32GB VRAM 환경을 구축했다. Qwen3.6-27B 모델을 초당 최대 60토큰 속도로 로컬에서 구동했다.

제로데이 스스로 찾는 Claude Mythos, 무너진 패치 골든타임

제로데이 스스로 찾는 Claude Mythos, 무너진 패치 골든타임

AI가 알려진 취약점 공격을 넘어 스스로 제로데이 취약점을 발견하는 단계에 진입했다. Claude Mythos는 CyberGym 83.1%를 기록하며 취약점 발견의 '안전 마진'을 제거했다. 기존 CVSS 중심의 패치 우선순위 체계는 AI의 공격 속도

"인간은 소중하다" — AI 능력 격차 논리를 대체할 명제

"인간은 소중하다" — AI 능력 격차 논리를 대체할 명제

AI와 인간의 능력 격차가 좁아지며 기존의 인간 가치 옹호 논리가 흔들리고 있다. 창작물의 질을 결정하는 '의도'와 '형식' 중 AI는 의도 없는 형식만 빠르게 생성한다. 결과물의 품질이라는 가변적 수치 대신 인간 존재 자체의 가치를 선언하는 논리가

토큰 65배 더 쓰는 MCP, 다시 CLI로 돌아가는 이유

토큰 65배 더 쓰는 MCP, 다시 CLI로 돌아가는 이유

LLM 외부 도구 연결 표준인 MCP가 과도한 토큰 소비와 성능 저하 문제를 드러냈다. 4개 서버 연결 시 컨텍스트의 최대 16.5%가 도구 정의로 낭비되며 호출 속도는 API 대비 3배 느리다. CLI 우선 전략과 필요할 때만 로드하는 '스킬(Ski

50개 쌓인 세션 속에서 정답 찾기 — pi 전용 관리 도구 pisesh

50개 쌓인 세션 속에서 정답 찾기 — pi 전용 관리 도구 pisesh

코딩 에이전트 사용 시 급증하는 세션 관리의 불편함이 실무적 병목이 된다. pisesh는 즐겨찾기와 검색 기능을 통해 pi의 세션 복구 과정을 효율화한다. npm 설치 후 pi 내부에서 /sesh 명령어로 즉시 호출해 사용할 수 있다.

월급보다 무서운 정체성 상실, 'AI 대체 장애(AIRD)'의 등장

월급보다 무서운 정체성 상실, 'AI 대체 장애(AIRD)'의 등장

AI로 인한 일자리 상실이 단순한 경제적 불안을 넘어 심리적 '애도' 단계로 진입했다. 2025년 플로리다대 연구진은 이를 'AI 대체 장애(AIRD)'라는 새로운 임상 개념으로 정의했다. 인지 노동자의 전문성이 곧 정체성인 특성상, 과거 산업혁명보다

AI 에이전트의 'DROP TABLE' 막는 보안 방화벽 Claw Patrol 공개

AI 에이전트의 'DROP TABLE' 막는 보안 방화벽 Claw Patrol 공개

AI 에이전트에게 프로덕션 권한을 줬을 때 발생하는 통제 불능 위험을 해결한다. 자격 증명을 분리 보관하고 SQL·k8s 등 와이어 레벨 트래픽을 파싱해 액션을 게이팅한다. LLM 판사와 사람의 승인 절차를 결합해 위험 호출을 실시간으로 차단하는 구조