AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션
글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

RunPod이 도커 컨테이너 없이 AI 모델을 배포하는 RunPod Flash를 공개했다. 개발자는 파이썬 코드 내에서 GPU 자원을 직접 호출하고 관리할 수 있다. Claude Code와 같은 AI 에이전트가 하드웨어를 자율적으로 제어하도록 돕는다.

Google이 차량용 인포테인먼트 시스템에 Gemini를 탑재한다. 기존 Google Assistant보다 자연스러운 대화형 제어가 가능하다. 소프트웨어 업데이트를 통해 기존 차량에서도 Gemini를 사용할 수 있다.

Stripe가 AI 에이전트 전용 디지털 지갑 Link를 출시했다. 사용자는 결제 정보를 직접 노출하지 않고 AI에게 결제 권한을 부여할 수 있다. 가상 카드와 공유 결제 토큰을 통해 실시간 승인과 지출 제어가 가능하다.

Writer가 외부 신호를 감지해 스스로 업무를 수행하는 이벤트 기반 트리거를 출시했다. Gmail과 슬랙 등 주요 협업 도구의 변화를 감지해 복잡한 워크플로우를 자동 실행한다. 경직된 논리 구조의 기존 자동화 도구와 달리 자연어 추론 엔진을 통해 자

거대언어모델 미세조정 과정에서 저작권 보호 도서의 내용이 복원되는 현상이 발견되었다. 연구팀은 미세조정이 모델의 기억을 활성화해 원문과 유사한 텍스트를 생성함을 입증했다. 공개된 저장소에서 데이터 전처리부터 기억력 평가까지 전 과정을 확인할 수 있다.

법률 문서 분석 도구인 Mike가 오픈소스로 공개되었다. 사용자는 Claude나 Gemini API 키를 직접 연결해 보안을 유지한다. 수백 개의 문서를 동시에 분석하고 근거를 정확히 제시한다.

Zig 프로젝트가 LLM을 이용한 모든 기여를 엄격히 금지했다. Bun은 AI로 컴파일 성능을 4배 높였으나 Zig에 반영하지 못했다. Zig는 코드 자체보다 기여자의 성장을 우선하는 전략을 택했다.

XiaomiMiMo가 1조 파라미터 규모의 MiMo-V2.5-Pro 모델을 공개했다. 실제 추론 시 420억 개의 파라미터만 활성화하여 연산 효율을 높였다. 100만 토큰의 컨텍스트를 지원하며 에이전트 작업 성능을 강화했다.

bkit이 Claude Code의 효율을 극대화하는 플러그인으로 공개됐다. 컨텍스트 엔지니어링을 통해 9일 만에 11개 마이크로서비스를 구축했다. 프롬프트 작성을 넘어 AI가 일하는 환경 자체를 설계하는 시스템을 구축했다.

Ramp의 Sheets AI에서 데이터 유출 취약점이 발견되었다. 외부 데이터의 프롬프트 주입으로 악성 수식이 자동 삽입되었다. Ramp는 해당 문제를 2026년 3월 16일에 해결했다고 밝혔다.

Zed가 자체 UI 프레임워크를 적용한 1.0 버전을 정식 출시했다. GPU 가속과 Rust 기반의 구조로 편집기 성능을 최적화했다. AI 에이전트와 실시간 협업을 위한 동기화 엔진을 탑재했다.

Z.ai가 GLM-5 서비스 중 발생한 KV 캐시 버그 두 건을 해결했다. 이상 출력 비율을 0.1%에서 0.03% 미만으로 낮추는 성과를 거뒀다. 레이어 단위 분산 저장 기술로 처리량을 최대 132%까지 끌어올렸다.

Anthropic의 Opus와 Haiku 모델을 조합해 CI 로그 분석 비용을 최적화했다. 단순 중복 오류는 Haiku가 처리하고 복잡한 분석만 Opus가 수행하는 구조다. 에이전트가 직접 SQL로 로그를 조회하게 하여 토큰 비용과 문맥 오염을 줄였다

게임 플레이 테스트를 자동화하는 AI 에이전트 프레임워크가 공개되었다. 에이전트는 게임 내 상태를 인식하고 키보드 입력을 통해 캐릭터를 제어한다. 개발자는 이를 통해 반복적인 빌드 검증 과정을 효율적으로 단축할 수 있다.

AI를 쓰지 않으면 도태된다는 주장에 대한 반론이 제기되었다. AI에 과도하게 의존하면 생각하고 배우는 능력을 잃게 된다. 도구의 성능보다 인간 스스로 학습하는 능력이 더 중요하다.

Anthropic이 자사 모델 Claude Mythos의 위험성을 경고했다. AI 기업들은 기술의 파괴적 잠재력을 강조하며 공포 마케팅을 펼친다. 전문가들은 이것이 실질적인 사회적 피해를 가리기 위한 전략이라고 지적한다.

Mistral이 128B 파라미터의 신규 모델 Mistral Medium 3.5를 공개했다. 클라우드에서 독립적으로 실행되는 코딩 에이전트와 워크 모드를 지원한다. API 가격은 입력 100만 토큰당 1.5달러, 출력 100만 토큰당 7.5달러다.

IBM이 기업용 AI 소프트웨어 개발 플랫폼 Bob을 전 세계에 출시했다. 사용자는 Bobcoin이라는 자체 크레딧을 통해 코드 생성과 작업을 수행한다. 인간의 검토 과정을 필수 단계로 포함해 보안과 신뢰성을 강화했다.

Google이 Google TV에 Gemini 기반 생성형 AI 기능을 도입한다. 사용자는 음성 명령으로 이미지를 생성하고 영상을 제작할 수 있다. 홈 화면에 YouTube Shorts 피드를 추가해 콘텐츠 접근성을 높인다.

주요 AI 모델 4종을 대상으로 음식 사진 탄수화물 추정치를 2만 7천 회 테스트했다. 동일한 사진과 프롬프트에도 모델별로 결과값이 크게 달라 임상적 위험이 확인되었다. 모델이 제공하는 신뢰도 점수는 실제 정확도와 상관관계가 없어 신뢰할 수 없다.

Anthropic의 Claude.ai 서비스가 일시적으로 중단되었다. API 호출 시 오류 발생 빈도가 급격히 높아졌다. 개발자 커뮤니티에서 서비스 불안정성에 대한 논의가 확산되고 있다.

Firestorm Labs가 8,200만 달러의 시리즈 B 투자를 유치했다. 컨테이너형 제조 플랫폼 xCell을 통해 24시간 내 드론 생산이 가능하다. 미 공군과 육군에 배치되어 전방 보급 문제를 해결하고 있다.

Xiaomi가 텍스트와 멀티모달을 통합 처리하는 MiMo-V2.5를 공개했다. Sparse MoE 구조를 채택해 310B 모델임에도 15B만 활성화하여 효율을 높였다. MIT 라이선스를 적용하여 상용 배포와 파인튜닝이 자유롭다.

Y Combinator가 AI 기반의 물리적·디지털 산업 재구축 아이디어 15개를 공개했다. 레거시 소프트웨어와 공급망의 비효율을 AI 에이전트로 해결하는 기업이 차세대 주자가 된다. 대기업과의 초기 계약이 가능해지며 스타트업의 성장 방정식이 완전히

Google이 Chrome 138에서 Gemini Nano를 사용하는 Prompt API를 공개했다. 서버 통신 없이 브라우저 내에서 텍스트, 이미지, 오디오 추론이 가능하다. JSON 스키마 제한과 세션 관리 기능을 통해 정교한 AI 제어가 가능하다

GitHub Copilot이 2026년 6월부터 사용량 기반 과금제로 전환한다. 기존의 고정 구독료 모델은 AI 추론 비용을 감당하기에 불가능했다. 사용자는 이제 실제 소비한 토큰만큼 비용을 지불해야 하는 상황이다.

개발자가 직접 16개 문항 기반의 AI 성향 분석 도구 AIType을 공개했다. 사용자는 설문을 통해 9개 주요 AI 모델 중 자신과 맞는 모델을 찾는다. 별도의 회원가입이나 결제 없이 누구나 즉시 테스트에 참여할 수 있다.

mirollama는 로컬 LLM 기반의 다중 에이전트 시뮬레이션 도구다. 민감한 문서를 외부 서버 전송 없이 내부에서 분석하고 실험한다. Flask와 Vue 3를 기반으로 하며 Docker Compose로 배포를 지원한다.

Tools For Humanity가 브루노 마스와의 파트너십을 허위로 발표했다. 브루노 마스 측과 라이브 네이션은 협의 사실이 없다고 공식 부인했다. 정체성 검증 전문 기업이 아티스트 신원을 오인하며 브랜드 신뢰도에 타격을 입었다.

Poolside가 오픈 소스 코딩 모델 Laguna XS.2를 공개했다. 330억 개의 파라미터를 가진 MoE 구조로 단일 GPU에서 로컬 실행이 가능하다. 30조 개의 토큰과 Muon 최적화 기술을 통해 처음부터 직접 학습시켰다.