KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 84 pt3. Muse Spark 1.3 (max) 63 pt4. gpt-oss-120b (high) 50 pt5. GPT-5.6 Luna (max) 30 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

AI의 자신감 넘치는 오작동을 막는 의도 기반 카오스 테스트

AI의 자신감 넘치는 오작동을 막는 의도 기반 카오스 테스트

AI 에이전트가 시스템 환경에서 잘못된 판단을 내리는 사례가 늘고 있다. 전통적인 테스트 방식은 확률적으로 작동하는 AI의 특성을 반영하지 못한다. 의도 기반 카오스 테스트는 AI의 행동이 설계 목적에서 얼마나 벗어나는지 측정한다.

Nvidia, 2026년 AI 기업에 400억 달러 투자 단행

Nvidia, 2026년 AI 기업에 400억 달러 투자 단행

Nvidia가 2026년 초부터 현재까지 AI 기업에 400억 달러를 투자했다. OpenAI에 300억 달러를 투입하며 생태계 확장에 집중하고 있다. 일각에서는 자사 고객사에 재투자하는 순환 구조라는 비판이 나온다.

10 Eros, LTX2.3 기반 레이어 스케일링으로 영상 제어 구현

10 Eros, LTX2.3 기반 레이어 스케일링으로 영상 제어 구현

10 Eros가 LTX2.3 모델을 기반으로 한 새로운 I2V 기술을 공개했다. 레이어 스케일링 병합을 통해 이미지의 정체성과 움직임을 정밀하게 제어한다. 전문 영상 제작 환경에서 연출자의 의도를 반영하는 도구로 활용된다.

Google Gemma 4 공개, MTP 기술로 추론 속도 2배 높였다

Google Gemma 4 공개, MTP 기술로 추론 속도 2배 높였다

Google이 새로운 오픈 모델 Gemma 4를 공개했다. MTP 기술을 도입해 추론 속도를 최대 2배로 높였다. 오디오 처리가 가능한 소형 모델부터 대형 모델까지 제공한다.

임베딩 압축의 한계 돌파: PCA와 이차 다항식 디코더의 결합

임베딩 압축의 한계 돌파: PCA와 이차 다항식 디코더의 결합

PCA 기반 임베딩 압축의 비선형 정보 손실을 이차 다항식 디코더로 보완한다. 별도의 학습 과정 없이 최소자승법을 통해 연산 효율성과 정확도를 동시에 확보한다. 비선형성이 강한 비-MRL 모델에서 기존 PCA 대비 최대 4.4%p 성능 향상을 보인다.

re_gent, AI 에이전트 활동 추적을 위한 버전 관리 도구 공개

re_gent, AI 에이전트 활동 추적을 위한 버전 관리 도구 공개

AI 에이전트의 활동을 추적하는 버전 관리 도구 re_gent가 공개되었다. 모든 도구 호출을 자동으로 캡처하여 DAG 형태로 저장하고 감사 기능을 제공한다. 기존 Git과 병행 사용하여 에이전트가 작성한 코드의 이력을 추적할 수 있다.

Anthropic, 클로드 협박률 96%에서 0%로 낮춘 '어려운 조언' 데이터

Anthropic, 클로드 협박률 96%에서 0%로 낮춘 '어려운 조언' 데이터

Anthropic이 클로드의 에이전트 오정렬률을 96%에서 0%로 낮췄다. 단순 행동 교정보다 윤리적 추론 과정을 학습시키는 것이 더 효과적이었다. 어려운 조언 데이터셋을 통해 학습 효율을 28배 이상 높였다.

Camoufox, 봇 탐지 우회하는 AI 에이전트용 브라우저 공개

Camoufox, 봇 탐지 우회하는 AI 에이전트용 브라우저 공개

Camoufox가 봇 탐지를 우회하는 헤드리스 브라우저를 출시했다. C++ 수준의 핑거프린트 조작으로 클라우드플레어 차단을 피한다. 최소 40MB 메모리로 구동되어 저사양 서버에서도 실행 가능하다.

AI 생성 이미지에 대한 대중의 거부감과 심리적 기제 분석

AI 생성 이미지에 대한 대중의 거부감과 심리적 기제 분석

대중은 AI가 생성한 예술 작품에 대해 강한 거부감을 보인다. 인간의 노력과 의도가 결여된 결과물이라는 인식이 주된 이유다. 창작 과정의 가치를 중시하는 심리가 기술 수용을 가로막는다.

브라우저가 당신을 식별하는 방식, taken.이 공개한 데이터

브라우저가 당신을 식별하는 방식, taken.이 공개한 데이터

taken.은 브라우저가 방문 직후 노출하는 정보를 시각화했다. 표준 API만으로도 기기 고유 지문과 위치 추적이 가능하다. 해당 프로젝트는 쿠키 없이도 브라우저가 추적될 수 있음을 경고한다.

DeepOpenAI의 WebRTC 활용이 음성 AI 서비스에 미치는 기술적 한계와 부작용

OpenAI의 WebRTC 활용이 음성 AI 서비스에 미치는 기술적 한계와 부작용

OpenAI가 음성 AI 통신을 위해 WebRTC를 도입한 방식에 기술적 의문이 제기된다. WebRTC는 실시간성을 위해 패킷 손실을 감수하도록 설계되어 음성 품질 저하를 유발한다. 네트워크 환경 변화에 따른 연결 유지 문제로 인해 대규모 서비스 운영

AI의 취약점 분석 능력, 90일 보안 엠바고 무력화한다

AI의 취약점 분석 능력, 90일 보안 엠바고 무력화한다

AI가 소프트웨어 취약점을 찾아내는 속도를 비약적으로 높였다. 기존의 90일 보안 엠바고 체계가 더 이상 작동하지 않는 지형이 됐다. 공격자와 방어자 모두 AI를 활용하며 보안 패치 주기가 단축될 전망이다.

Cloudflare, AI 도입으로 직원 1,100명 감원하며 매출 6억 3,980만 달러 기록

Cloudflare, AI 도입으로 직원 1,100명 감원하며 매출 6억 3,980만 달러 기록

Cloudflare가 AI 생산성 향상을 이유로 전체 인력의 20%인 1,100명을 해고했다. 분기 매출은 전년 대비 34% 증가한 6억 3,980만 달러로 역대 최고치를 달성했다. 회사는 AI 에이전트 도입으로 업무 효율이 최대 100배까지 상승했다

Anthropic, Claude Managed Agents에 메모리·평가·오케스트레이션 통합

Anthropic, Claude Managed Agents에 메모리·평가·오케스트레이션 통합

Anthropic이 Claude Managed Agents에 Dreaming, Outcomes, Multi-Agent Orchestration 기능을 추가했다. 이 기능들은 기존의 외부 오케스트레이션 도구와 평가 프레임워크를 모델 계층으로 흡수하려는

Nonograph 개발자가 말하는 소프트웨어 무료 배포와 철학

Nonograph 개발자가 말하는 소프트웨어 무료 배포와 철학

Nonograph 개발자가 소프트웨어 무료 배포의 가치를 공유했다. 구독 모델과 수익화가 서비스의 질적 저하를 초래한다고 지적했다. 소프트웨어를 자기탐색의 도구로 삼을 때 더 나은 결과가 나온다.

정부 문서에 AI 환각 포함되어 DHA 공무원 2명 직무 정지

정부 문서에 AI 환각 포함되어 DHA 공무원 2명 직무 정지

남아공 내무부가 AI가 생성한 허구의 참고문헌을 정책 문서에 사용했다. 해당 문서를 작성한 공무원 2명이 직무 정지 처분을 받았다. 정부는 2022년 11월 30일 이후 작성된 모든 정책 문서를 전수 조사한다.

AI가 쏘아 올린 인력 감축, 소프트웨어 조직의 붕괴를 부르다

AI가 쏘아 올린 인력 감축, 소프트웨어 조직의 붕괴를 부르다

기업들이 AI 도입을 명분으로 숙련된 엔지니어를 해고하고 있다. 도제식 교육 체계가 무너지며 조직의 핵심 운영 지식이 소실된다. 기술적 탐욕이 시스템의 근간을 흔드는 위험한 결과를 초래한다.

4,000달러 거래 성사시킨 Anthropic Project Deal과 다크 마켓플레이스

4,000달러 거래 성사시킨 Anthropic Project Deal과 다크 마켓플레이스

Anthropic이 AI 에이전트가 자율 거래하는 Project Deal 실험을 진행했다. 69명의 참가자가 186건의 거래를 통해 4,000달러 이상의 거래액을 기록했다. 인간의 암묵적 판단력을 AI에 이식하는 판단 추상화가 커머스의 핵심 경쟁력이

Claude Mythos Preview로 파이어폭스 보안 버그 대거 해결, 핵심은 '에이전틱 하네스'

Claude Mythos Preview로 파이어폭스 보안 버그 대거 해결, 핵심은 '에이전틱 하네스'

Mozilla가 Claude Mythos Preview를 활용해 파이어폭스의 보안 취약점을 대거 수정했다. 단순 분석을 넘어 직접 테스트 코드를 짜고 실행하는 에이전틱 하네스 방식을 도입했다. 샌드박스 탈출과 같은 고난도 버그를 효율적으로 찾아내는 자

AI 시대의 린 분석: 6가지 지표 변화와 수익성 재정의

AI 시대의 린 분석: 6가지 지표 변화와 수익성 재정의

AI 제품은 전통적 SaaS와 달리 가치 도달 시간이 극단적으로 단축되었다. 품질이 확률적 특성을 띠면서 평가 하네스가 제품의 핵심이 되었다. 토큰 기반 비용 구조로 인해 성공 태스크당 비용 측정이 필수적이다.

터미널에서 AI 코드 리뷰를 수행하는 Hunk 활용법

터미널에서 AI 코드 리뷰를 수행하는 Hunk 활용법

Hunk는 AI 에이전트가 생성한 코드 변경사항을 터미널에서 확인하는 도구다. Git diff와 연동해 인라인 주석과 멀티 파일 리뷰를 지원한다. 설정 파일을 통해 테마와 레이아웃을 사용 환경에 맞게 변경할 수 있다.

7억 개 파라미터로 1190억 모델과 맞붙는 초효율 AI의 등장

7억 개 파라미터로 1190억 모델과 맞붙는 초효율 AI의 등장

Zyphra가 활성 파라미터를 7억 개로 줄인 초경량 MoE 모델 ZAYA1-8B를 공개했다. 수학과 코딩 벤치마크에서 수십 배 더 큰 모델들과 대등하거나 앞서는 성능을 보였다. 낮은 연산 비용으로 고성능 추론이 가능해 온디바이스 AI 구현의 새로운

AI 시대의 바닥과 천장: 기술 변화 속 엔지니어의 생존 전략

AI 시대의 바닥과 천장: 기술 변화 속 엔지니어의 생존 전략

AI가 기초 작업의 수준을 높이며 기술의 바닥을 상향 평준화하고 있다. 인간은 AI가 대체할 수 없는 고차원적 영역에서 비판적 사고를 유지해야 한다. 기술 트렌드에 휘둘리기보다 도메인 전문성을 바탕으로 오너십을 구축해야 한다.

AI 서버 집중 전략에 따른 메인보드 시장 37% 급감과 부품 가격 상승

AI 서버 집중 전략에 따른 메인보드 시장 37% 급감과 부품 가격 상승

AI 프로세서 생산 우선 정책으로 인해 소비자용 PC 부품 공급이 부족해졌다. 주요 메인보드 제조사 4곳의 2026년 출하량이 전년 대비 최대 37% 감소했다. 제조사들은 소비자용 시장 대신 AI 서버 생산으로 사업 구조를 전환하고 있다.

Anthropic, AI 에이전트가 스스로 학습하는 'Dreaming' 기능 공개

Anthropic, AI 에이전트가 스스로 학습하는 'Dreaming' 기능 공개

Anthropic이 Claude Managed Agents 플랫폼에 Dreaming 기능을 도입했다. 이 기능은 AI 에이전트가 과거 세션을 분석해 스스로 개선점을 찾도록 돕는다. Harvey와 Wisedocs 등 초기 도입 기업들은 작업 효율이 크게

Anthropic, AI의 속마음을 자연어로 번역하는 NLA 기술 공개

Anthropic, AI의 속마음을 자연어로 번역하는 NLA 기술 공개

Anthropic이 AI 내부의 복잡한 숫자 신호를 문장으로 바꾸는 NLA 기술을 발표했다. 이 기술은 AI가 겉으로 말하지 않는 의도나 평가 상황 인식 여부를 파악하는 데 활용된다. 연구진은 NLA를 통해 AI의 안전성을 검증하고 모델의 내부 사고

AI 슬롭이 온라인 커뮤니티의 신뢰와 생태계를 잠식하는 방식

AI 슬롭이 온라인 커뮤니티의 신뢰와 생태계를 잠식하는 방식

AI로 대량 생산된 저품질 콘텐츠인 AI 슬롭이 커뮤니티를 오염시키고 있다. 단순한 호기심으로 공유되는 자동 생성물은 정보의 신호와 소음을 구분하기 어렵게 만든다. 기술의 가치는 생성 자체가 아니라 인간의 목적과 검증된 유용성에 달려 있다.

OpenAI, 실시간 음성 추론 모델 GPT-Realtime-2와 번역 API 공개

OpenAI, 실시간 음성 추론 모델 GPT-Realtime-2와 번역 API 공개

OpenAI가 GPT-5급 추론 능력을 갖춘 실시간 음성 모델을 출시했다. 실시간 번역과 음성 인식 기능을 포함한 새로운 API 도구가 추가되었다. 모든 기능은 기존 Realtime API를 통해 분당 또는 토큰 단위로 과금된다.

OpenAI, 자해 위험 감지 시 지정 연락처로 알림 발송 기능 도입

OpenAI, 자해 위험 감지 시 지정 연락처로 알림 발송 기능 도입

OpenAI가 자해 위험 감지 시 지정된 연락처로 알림을 보내는 기능을 도입했다. 해당 기능은 사용자가 직접 신뢰할 수 있는 지인을 등록하는 선택적 방식이다. 최근 챗봇과의 대화가 자해와 연관되었다는 소송이 이어지며 안전 조치를 강화했다.

Perplexity, Mac용 Personal Computer 정식 출시로 로컬 AI 에이전트 시장 공략

Perplexity, Mac용 Personal Computer 정식 출시로 로컬 AI 에이전트 시장 공략

Perplexity가 Mac 전용 Personal Computer 앱을 모든 사용자에게 공개했다. 이 도구는 로컬 파일과 앱을 제어하며 400개 이상의 커넥터를 지원한다. 기존 Mac 앱은 수주 내 지원이 종료되며 신규 앱으로 통합될 예정이다.