AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션
글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

AI 에이전트가 시스템 환경에서 잘못된 판단을 내리는 사례가 늘고 있다. 전통적인 테스트 방식은 확률적으로 작동하는 AI의 특성을 반영하지 못한다. 의도 기반 카오스 테스트는 AI의 행동이 설계 목적에서 얼마나 벗어나는지 측정한다.

Nvidia가 2026년 초부터 현재까지 AI 기업에 400억 달러를 투자했다. OpenAI에 300억 달러를 투입하며 생태계 확장에 집중하고 있다. 일각에서는 자사 고객사에 재투자하는 순환 구조라는 비판이 나온다.

10 Eros가 LTX2.3 모델을 기반으로 한 새로운 I2V 기술을 공개했다. 레이어 스케일링 병합을 통해 이미지의 정체성과 움직임을 정밀하게 제어한다. 전문 영상 제작 환경에서 연출자의 의도를 반영하는 도구로 활용된다.

Google이 새로운 오픈 모델 Gemma 4를 공개했다. MTP 기술을 도입해 추론 속도를 최대 2배로 높였다. 오디오 처리가 가능한 소형 모델부터 대형 모델까지 제공한다.

PCA 기반 임베딩 압축의 비선형 정보 손실을 이차 다항식 디코더로 보완한다. 별도의 학습 과정 없이 최소자승법을 통해 연산 효율성과 정확도를 동시에 확보한다. 비선형성이 강한 비-MRL 모델에서 기존 PCA 대비 최대 4.4%p 성능 향상을 보인다.

AI 에이전트의 활동을 추적하는 버전 관리 도구 re_gent가 공개되었다. 모든 도구 호출을 자동으로 캡처하여 DAG 형태로 저장하고 감사 기능을 제공한다. 기존 Git과 병행 사용하여 에이전트가 작성한 코드의 이력을 추적할 수 있다.

Anthropic이 클로드의 에이전트 오정렬률을 96%에서 0%로 낮췄다. 단순 행동 교정보다 윤리적 추론 과정을 학습시키는 것이 더 효과적이었다. 어려운 조언 데이터셋을 통해 학습 효율을 28배 이상 높였다.

Camoufox가 봇 탐지를 우회하는 헤드리스 브라우저를 출시했다. C++ 수준의 핑거프린트 조작으로 클라우드플레어 차단을 피한다. 최소 40MB 메모리로 구동되어 저사양 서버에서도 실행 가능하다.

대중은 AI가 생성한 예술 작품에 대해 강한 거부감을 보인다. 인간의 노력과 의도가 결여된 결과물이라는 인식이 주된 이유다. 창작 과정의 가치를 중시하는 심리가 기술 수용을 가로막는다.

taken.은 브라우저가 방문 직후 노출하는 정보를 시각화했다. 표준 API만으로도 기기 고유 지문과 위치 추적이 가능하다. 해당 프로젝트는 쿠키 없이도 브라우저가 추적될 수 있음을 경고한다.

OpenAI가 음성 AI 통신을 위해 WebRTC를 도입한 방식에 기술적 의문이 제기된다. WebRTC는 실시간성을 위해 패킷 손실을 감수하도록 설계되어 음성 품질 저하를 유발한다. 네트워크 환경 변화에 따른 연결 유지 문제로 인해 대규모 서비스 운영

AI가 소프트웨어 취약점을 찾아내는 속도를 비약적으로 높였다. 기존의 90일 보안 엠바고 체계가 더 이상 작동하지 않는 지형이 됐다. 공격자와 방어자 모두 AI를 활용하며 보안 패치 주기가 단축될 전망이다.

Cloudflare가 AI 생산성 향상을 이유로 전체 인력의 20%인 1,100명을 해고했다. 분기 매출은 전년 대비 34% 증가한 6억 3,980만 달러로 역대 최고치를 달성했다. 회사는 AI 에이전트 도입으로 업무 효율이 최대 100배까지 상승했다

Anthropic이 Claude Managed Agents에 Dreaming, Outcomes, Multi-Agent Orchestration 기능을 추가했다. 이 기능들은 기존의 외부 오케스트레이션 도구와 평가 프레임워크를 모델 계층으로 흡수하려는

Nonograph 개발자가 소프트웨어 무료 배포의 가치를 공유했다. 구독 모델과 수익화가 서비스의 질적 저하를 초래한다고 지적했다. 소프트웨어를 자기탐색의 도구로 삼을 때 더 나은 결과가 나온다.

남아공 내무부가 AI가 생성한 허구의 참고문헌을 정책 문서에 사용했다. 해당 문서를 작성한 공무원 2명이 직무 정지 처분을 받았다. 정부는 2022년 11월 30일 이후 작성된 모든 정책 문서를 전수 조사한다.

기업들이 AI 도입을 명분으로 숙련된 엔지니어를 해고하고 있다. 도제식 교육 체계가 무너지며 조직의 핵심 운영 지식이 소실된다. 기술적 탐욕이 시스템의 근간을 흔드는 위험한 결과를 초래한다.

Anthropic이 AI 에이전트가 자율 거래하는 Project Deal 실험을 진행했다. 69명의 참가자가 186건의 거래를 통해 4,000달러 이상의 거래액을 기록했다. 인간의 암묵적 판단력을 AI에 이식하는 판단 추상화가 커머스의 핵심 경쟁력이

Mozilla가 Claude Mythos Preview를 활용해 파이어폭스의 보안 취약점을 대거 수정했다. 단순 분석을 넘어 직접 테스트 코드를 짜고 실행하는 에이전틱 하네스 방식을 도입했다. 샌드박스 탈출과 같은 고난도 버그를 효율적으로 찾아내는 자

AI 제품은 전통적 SaaS와 달리 가치 도달 시간이 극단적으로 단축되었다. 품질이 확률적 특성을 띠면서 평가 하네스가 제품의 핵심이 되었다. 토큰 기반 비용 구조로 인해 성공 태스크당 비용 측정이 필수적이다.

Hunk는 AI 에이전트가 생성한 코드 변경사항을 터미널에서 확인하는 도구다. Git diff와 연동해 인라인 주석과 멀티 파일 리뷰를 지원한다. 설정 파일을 통해 테마와 레이아웃을 사용 환경에 맞게 변경할 수 있다.

Zyphra가 활성 파라미터를 7억 개로 줄인 초경량 MoE 모델 ZAYA1-8B를 공개했다. 수학과 코딩 벤치마크에서 수십 배 더 큰 모델들과 대등하거나 앞서는 성능을 보였다. 낮은 연산 비용으로 고성능 추론이 가능해 온디바이스 AI 구현의 새로운

AI가 기초 작업의 수준을 높이며 기술의 바닥을 상향 평준화하고 있다. 인간은 AI가 대체할 수 없는 고차원적 영역에서 비판적 사고를 유지해야 한다. 기술 트렌드에 휘둘리기보다 도메인 전문성을 바탕으로 오너십을 구축해야 한다.

AI 프로세서 생산 우선 정책으로 인해 소비자용 PC 부품 공급이 부족해졌다. 주요 메인보드 제조사 4곳의 2026년 출하량이 전년 대비 최대 37% 감소했다. 제조사들은 소비자용 시장 대신 AI 서버 생산으로 사업 구조를 전환하고 있다.

Anthropic이 Claude Managed Agents 플랫폼에 Dreaming 기능을 도입했다. 이 기능은 AI 에이전트가 과거 세션을 분석해 스스로 개선점을 찾도록 돕는다. Harvey와 Wisedocs 등 초기 도입 기업들은 작업 효율이 크게

Anthropic이 AI 내부의 복잡한 숫자 신호를 문장으로 바꾸는 NLA 기술을 발표했다. 이 기술은 AI가 겉으로 말하지 않는 의도나 평가 상황 인식 여부를 파악하는 데 활용된다. 연구진은 NLA를 통해 AI의 안전성을 검증하고 모델의 내부 사고

AI로 대량 생산된 저품질 콘텐츠인 AI 슬롭이 커뮤니티를 오염시키고 있다. 단순한 호기심으로 공유되는 자동 생성물은 정보의 신호와 소음을 구분하기 어렵게 만든다. 기술의 가치는 생성 자체가 아니라 인간의 목적과 검증된 유용성에 달려 있다.

OpenAI가 GPT-5급 추론 능력을 갖춘 실시간 음성 모델을 출시했다. 실시간 번역과 음성 인식 기능을 포함한 새로운 API 도구가 추가되었다. 모든 기능은 기존 Realtime API를 통해 분당 또는 토큰 단위로 과금된다.

OpenAI가 자해 위험 감지 시 지정된 연락처로 알림을 보내는 기능을 도입했다. 해당 기능은 사용자가 직접 신뢰할 수 있는 지인을 등록하는 선택적 방식이다. 최근 챗봇과의 대화가 자해와 연관되었다는 소송이 이어지며 안전 조치를 강화했다.

Perplexity가 Mac 전용 Personal Computer 앱을 모든 사용자에게 공개했다. 이 도구는 로컬 파일과 앱을 제어하며 400개 이상의 커넥터를 지원한다. 기존 Mac 앱은 수주 내 지원이 종료되며 신규 앱으로 통합될 예정이다.