KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 84 pt3. Muse Spark 1.3 (max) 63 pt4. gpt-oss-120b (high) 50 pt5. GPT-5.6 Luna (max) 30 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

M4 24GB 맥북에서 Qwen 3.5 9B 로컬 실행하기

M4 24GB 맥북에서 Qwen 3.5 9B 로컬 실행하기

M4 24GB 메모리 환경에서 로컬 LLM을 구동하는 최적의 설정을 확인했다. Qwen 3.5-9B 모델이 40 토큰/초 속도로 코딩 보조 역할을 수행한다. 로컬 모델은 인터넷 없이 작동하며 구독료 없는 지속 가능한 대안이다.

애플 실리콘 맥 전용 Rapid-MLX, Ollama 대비 4.2배 빠른 추론

애플 실리콘 맥 전용 Rapid-MLX, Ollama 대비 4.2배 빠른 추론

애플 실리콘 맥에서 작동하는 고성능 로컬 AI 엔진 Rapid-MLX가 공개되었다. 기존 도구 대비 최대 4.2배 빠른 속도와 0.1초대 응답 시간을 구현했다. OpenAI API와 호환되어 기존 개발 도구에 즉시 연결해 사용할 수 있다.

AI로 8시간 만에 만든 수면 방해 분석 도구와 Raspberry Pi 활용법

AI로 8시간 만에 만든 수면 방해 분석 도구와 Raspberry Pi 활용법

개발자가 AI 코딩 도구를 활용해 8시간 만에 수면 방해 요인을 찾는 분석 툴을 구축했다. Raspberry Pi와 Home Assistant를 연동해 소음 발생 시점과 수면 데이터를 시각화했다. AI가 문제 해결 자체가 아니라 도구 제작 비용을 낮춰

Google, AI 기반 소프트웨어 취약점 탐색 해킹 시도 저지

Google, AI 기반 소프트웨어 취약점 탐색 해킹 시도 저지

Google이 AI를 이용한 해커의 소프트웨어 공격 시도를 저지했다. AI가 코드 분석과 취약점 탐색 시간을 획기적으로 단축시켰다. 보안 패치 속도보다 공격 속도가 빨라지는 새로운 위협이 관찰된다.

MiniCPM-V 4.6, 토큰 비용 43배 줄이고 처리 속도 1.5배 높였다

MiniCPM-V 4.6, 토큰 비용 43배 줄이고 처리 속도 1.5배 높였다

MiniCPM-V 4.6가 초경량 멀티모달 모델로 공개되었다. 토큰 비용을 43배 줄이고 처리 속도를 1.5배 높였다. 모바일 플랫폼 배포와 다양한 양자화 형식을 지원한다.

TypeScript 7.0 10x 속도 개선과 AI의 Rust·Go 코딩 전환

TypeScript 7.0 10x 속도 개선과 AI의 Rust·Go 코딩 전환

AI가 Rust와 Go 같은 시스템 언어를 능숙하게 작성하기 시작했다. TypeScript 7.0은 Go로 재작성되어 속도가 10배 향상되었다. 코드 작성보다 테스트와 문서의 중요성이 커지는 패러다임 전환이 일어났다.

결정론적 아키텍처로 구현한 설정 붕괴 0%의 연속성

결정론적 아키텍처로 구현한 설정 붕괴 0%의 연속성

AI가 AI를 검수하는 자율 교정 방식의 구조적 한계를 지적했다. DAG 기반의 결정론적 아키텍처를 통해 AI의 자율성을 제한했다. 상업용 웹소설 30화 분량에서 설정 붕괴 0%를 달성했다.

할리우드 작가들, 시간당 52달러 AI 데이터 라벨러로 전향

할리우드 작가들, 시간당 52달러 AI 데이터 라벨러로 전향

할리우드 작가들이 생계를 위해 AI 학습 데이터 구축 작업에 투입되고 있다. Mercor(AI 인력 매칭 플랫폼) 등에서 시간당 52달러를 받으며 데이터 라벨링을 수행한다. 창의적 역량보다 가이드라인의 기계적 준수가 강조되는 단순 반복 작업으로 변질되

"AI는 다음 산업혁명" 발언에 야유 보낸 UCF 인문대 졸업생들

"AI는 다음 산업혁명" 발언에 야유 보낸 UCF 인문대 졸업생들

센트럴 플로리다 대학교 졸업식에서 AI를 산업혁명에 비유한 강연자가 야유를 받았다. 인문학 전공 졸업생들은 AI의 확산에 대해 강한 거부감을 드러냈다. 기술적 효율성과 인간적 가치 사이의 갈등이 실제 현장에서 표출된 사례다.

Swift로 구현한 LLM 학습, 행렬 곱셈 속도를 Tflop/s까지 끌어올리기

Swift로 구현한 LLM 학습, 행렬 곱셈 속도를 Tflop/s까지 끌어올리기

개발자가 Swift(애플의 프로그래밍 언어)로 LLM 학습 코드를 직접 구현했다. llm.c(C언어로 짠 GPT-2 모델)를 기준으로 행렬 곱셈 최적화를 진행했다. 프레임워크 없이 순수 코드로 연산 속도를 높이는 과정을 다룬다.

EstreGenesis, AGENTS.md 하나로 7종 AI 코딩 에이전트 규칙 통합한다

EstreGenesis, AGENTS.md 하나로 7종 AI 코딩 에이전트 규칙 통합한다

EstreGenesis가 여러 AI 코딩 에이전트의 규칙을 통합하는 라이브러리를 공개했다. AGENTS.md를 중심으로 도구별 브릿지 파일을 생성해 설정 충돌을 방지한다. AI와 인간의 작업 시간을 분리해 추정하는 새로운 정책이 추가되었다.

Claude가 IP 스택 역할을 수행하며 핑에 응답하는 속도 측정

Claude가 IP 스택 역할을 수행하며 핑에 응답하는 속도 측정

Anthropic의 Claude를 네트워크 통신 스택으로 활용하는 실험이 진행되었다. 패킷을 텍스트로 변환해 모델에 입력하고 응답을 다시 패킷으로 바꾸는 방식이다. 응답 속도가 수 초 단위로 측정되며 실용성보다 LLM의 추론 능력을 검증했다.

45억 파라미터 Gemma 4, 추론 속도 3배 높여 온디바이스 AI 정조준

45억 파라미터 Gemma 4, 추론 속도 3배 높여 온디바이스 AI 정조준

Google DeepMind가 추론 속도를 3배 개선한 Gemma 4를 공개했다. 다중 토큰 예측 기술을 적용해 온디바이스 환경 효율을 극대화했다. 텍스트와 이미지, 오디오를 처리하는 멀티모달 기능을 기본 탑재했다.

129개 디자인 시스템 탑재한 로컬 퍼스트 도구 Open Design

129개 디자인 시스템 탑재한 로컬 퍼스트 도구 Open Design

Open Design이 129개 브랜드 디자인 시스템을 갖춘 오픈소스 도구로 등장했다. 사용자의 로컬 환경에 있는 코딩 에이전트와 연동해 디자인 엔진으로 작동한다. 결정론적 팔레트와 자기 비평 메커니즘을 통해 AI 특유의 무분별한 생성을 방지한다.

Bifrost, 50배 빠른 속도로 AI API 게이트웨이 시장 공략

Bifrost, 50배 빠른 속도로 AI API 게이트웨이 시장 공략

Bifrost가 기존 LiteLLM 대비 50배 빠른 처리 속도를 구현했다. 15개 이상의 AI 프로바이더를 단일 API로 통합해 관리 효율을 높였다. 드롭인 교체 방식으로 기존 코드 수정 없이 즉시 도입이 가능하다.

Google Cloud DORA 보고서: AI 도입 ROI 39% 달성 조건

Google Cloud DORA 보고서: AI 도입 ROI 39% 달성 조건

Google Cloud와 DORA가 AI 보조 개발의 ROI 분석 보고서를 발표했다. AI 도입 초기에는 생산성이 일시적으로 하락하는 J-커브 현상이 발생한다. 조직의 시스템 품질과 자동화된 가드레일 구축 여부가 실제 수익률을 결정한다.

AI 코딩 에이전트의 함정: 코드 생산량 2배 시 유지보수 비용 50% 절감 필요

AI 코딩 에이전트의 함정: 코드 생산량 2배 시 유지보수 비용 50% 절감 필요

AI 코딩 에이전트가 코드 생산량을 늘려도 유지보수 비용이 늘면 생산성은 결국 하락한다. 유지보수 비용이 코드 생산량의 증가분과 정확히 역비례하게 감소해야 실질적인 이득이 발생한다. 단순한 속도 향상은 장기적으로 개발자를 유지보수의 굴레에 가두는 결과

PS3 에뮬레이터 개발팀, AI 생성 코드 PR 중단 요청

PS3 에뮬레이터 개발팀, AI 생성 코드 PR 중단 요청

PS3 에뮬레이터 개발팀이 AI로 작성된 코드 제출을 중단해달라고 요청했다. 무분별한 AI PR이 코드 리뷰 부담을 늘리고 프로젝트 품질을 저하시키고 있다. AI 도구의 확산이 오픈소스 생태계의 유지보수 비용을 높이는 부작용을 낳았다.

메릴랜드주, AI 데이터센터 전력망 비용 20억 달러 청구에 반발

메릴랜드주, AI 데이터센터 전력망 비용 20억 달러 청구에 반발

메릴랜드주가 PJM 인터커넥션의 전력망 업그레이드 비용 청구에 반발했다. AI 데이터센터 수요로 인한 20억 달러의 비용을 주민이 부담하는 구조다. 전력망 비용을 기업이 직접 부담해야 한다는 주장이 거세지고 있다.

Apple 로컬 모델 API를 활용한 온디바이스 데이터 변환 구현

Apple 로컬 모델 API를 활용한 온디바이스 데이터 변환 구현

클라우드 AI API 의존도를 낮추고 온디바이스 AI 활용을 제안한다. Apple의 로컬 모델 API를 통해 텍스트 요약과 구조화된 데이터 추출이 가능하다. 데이터 프라이버시를 강화하고 시스템 복잡도를 낮추는 실무적 이점을 제공한다.

Anthropic 클로드 코드가 깨운 실행력과 100유로의 도파민 루프

Anthropic 클로드 코드가 깨운 실행력과 100유로의 도파민 루프

Anthropic이 코딩 에이전트인 클로드 코드를 통해 개발 생산성을 높였다. 아이디어에서 결과까지의 시간이 단축되며 강력한 도파민 루프가 형성됐다. 사용자는 실행 마비를 극복하기 위해 유료 토큰과 API 크레딧을 소비한다.

확률적 엔지니어링 시대, 24시간 일하는 에이전트 함대

확률적 엔지니어링 시대, 24시간 일하는 에이전트 함대

소프트웨어 개발이 결정론적 시스템에서 확률적 시스템으로 전환되고 있다. AI 에이전트가 코드를 생성하고 리뷰하는 24/7 운영 체제가 구축되는 중이다. 생산량은 폭증하지만 검증 비용은 줄지 않는 비대칭성이 핵심 과제로 떠올랐다.

Mojo 1.0 베타 출시, Python 문법으로 GPU 연산까지

Mojo 1.0 베타 출시, Python 문법으로 GPU 연산까지

Mojo가 1.0 베타 버전을 공개하며 정적 타입 언어로서의 기반을 다졌다. Python과 네이티브로 상호운용되어 기존 코드의 성능 병목을 해결한다. CPU와 GPU를 아우르는 고성능 커널 작성을 단일 언어로 지원한다.

CodeBurn으로 18개 AI 코딩 도구의 토큰 비용과 효율을 실시간 추적하기

CodeBurn으로 18개 AI 코딩 도구의 토큰 비용과 효율을 실시간 추적하기

CodeBurn이 18개 AI 코딩 도구의 토큰 사용량과 비용을 추적한다. 로컬 세션 데이터를 직접 분석해 낭비 패턴을 탐지하고 수정안을 제시한다. 터미널과 메뉴 바를 통해 실시간으로 생산성과 지출을 관리할 수 있다.

Claude Code, Markdown 버리고 HTML 도입... 생성 시간 4배 늘려도 시각화 강화

Claude Code, Markdown 버리고 HTML 도입... 생성 시간 4배 늘려도 시각화 강화

Anthropic의 Claude Code가 출력 형식을 Markdown에서 HTML로 전환했다. 시각화와 상호작용 기능을 강화해 복잡한 설계와 코드 리뷰 효율을 높였다. 생성 시간은 2~4배 늘었으나 정보 전달력과 공유 가능성을 우선했다.

HiDream-O1-Image 80억 파라미터로 2048x 고해상도 구현

HiDream-O1-Image 80억 파라미터로 2048x 고해상도 구현

HiDream-O1-Image가 80억 파라미터 규모로 공개되었다. 압축 과정 없이 픽셀을 직접 다뤄 2048x 고해상도를 구현했다. 추론 에이전트를 탑재해 복잡한 지시사항과 텍스트 렌더링 능력을 높였다.

Meta의 AI 전환, 내부 조직 문화와 생산성 사이의 균열

Meta의 AI 전환, 내부 조직 문화와 생산성 사이의 균열

Meta가 전사적 AI 전환을 가속화하며 내부 구성원들의 피로도가 급증하고 있다. 잦은 우선순위 변경과 과도한 업무 강도가 조직의 효율성을 저해하는 요인으로 지목된다. 기술 도입 속도와 조직의 적응력 사이에서 발생하는 마찰이 기업 전략의 변수로 떠올랐

DeepSeek-V4, KV 캐시 10% 사용해 100만 토큰 처리한다

DeepSeek-V4, KV 캐시 10% 사용해 100만 토큰 처리한다

DeepSeek-V4 시리즈가 100만 토큰의 문맥 길이를 지원하며 공개됐다. 하이브리드 어텐션 기술로 KV 캐시 사용량을 10%까지 낮췄다. MMLU 벤치마크에서 90.1%의 정확도를 기록하며 성능을 높였다.

LociTerm, AI 코딩 워크플로우를 위한 영구적 웹 터미널

LociTerm, AI 코딩 워크플로우를 위한 영구적 웹 터미널

LociTerm은 브라우저 기반의 영구적 터미널 환경을 제공한다. tmux 세션을 활용해 AI 코딩 작업 중에도 세션이 유지된다. 단일 바이너리 구조로 홈랩이나 원격 서버에 쉽게 설치 가능하다.

AI 챗봇 도입, 도구가 아닌 '사회적 신호'의 포석

AI 챗봇 도입, 도구가 아닌 '사회적 신호'의 포석

기업들이 실용성보다 경쟁사 추종을 위해 AI 챗봇을 도입하고 있다. 과거의 캐러셀이나 쿠키 배너처럼 챗봇이 웹사이트의 필수 장식품으로 전락했다. 사용자 경험보다 기업의 현대적 이미지를 과시하는 사회적 신호의 성격이 강하다.