AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션
글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

엘론 머스크가 OpenAI를 상대로 제기한 소송의 배심원 심리가 진행 중이다. 핵심 쟁점은 100억 달러 규모의 마이크로소프트 투자가 비영리 설립 취지를 위반했는지 여부다. 판결 결과에 따라 OpenAI의 영리 기업 구조와 지배구조가 근본적으로 바뀔

Runway가 비디오 생성 모델 Gen-4.5를 넘어 월드 모델 개발에 집중하고 있다. 기업 가치는 53억 달러이며 2026년 2분기 연간 반복 매출 4,000만 달러를 추가했다. 텍스트 기반 지능을 넘어 물리 법칙을 학습하는 AI로 과학적 진보를 목

Anthropic이 법률 워크플로우 전용 에이전트와 커넥터를 공개했다. Managed Agents API를 통해 기업 자체 워크플로우 엔진에 배포 가능하다. 외부 리서치 도구 연결을 통해 인용문의 신뢰성을 검증하는 구조를 갖췄다.

WhichLLM은 사용자 하드웨어 사양을 분석해 최적의 로컬 LLM을 추천한다. 단순 파라미터 크기가 아닌 벤치마크 성능과 실제 구동 가능 여부를 종합한다. 명령어 한 줄로 모델 설치부터 대화 환경 구축까지 즉시 실행할 수 있다.

OpenAI와 Anthropic이 보안 특화 모델의 접근 권한을 일부 기업으로 제한했다. 미국 정부의 안보 개입과 모델 증류 기술 방지가 주요 원인으로 분석된다. AI 토큰이 무한히 공급될 것이라는 기존의 시장 낙관론이 무너지고 있다.

Anthropic이 대규모 코드베이스용 Claude Code 운용 패턴을 공개했다. RAG 대신 에이전틱 검색을 도입해 실시간 코드 반영 문제를 해결했다. CLAUDE.md와 훅 등 하네스 설정을 통해 모델 성능을 최적화한다.

온타리오주 감사원이 의료용 AI Scribe 시스템 20개를 조사했다. 조사 대상의 60%가 처방 약물 정보를 잘못 기록한 것으로 나타났다. 정확도보다 지역 업체 여부에 더 높은 가점을 준 평가 방식이 문제로 지적되었다.

시카고대학교 학생들이 시험과 과제에 LLM을 광범위하게 사용하고 있다. 재택 시험과 대면 시험의 성적 차이가 최대 40%포인트까지 벌어졌다. 대학 학보사 기사까지 AI가 작성하며 학문적 정체성이 훼손되고 있다.

10M 파라미터 규모의 GPT 모델을 처음부터 직접 학습한다. 노트북 환경에서 20분 내외로 학습을 완료할 수 있도록 설계했다. 토크나이저부터 학습 루프까지 전체 파이프라인을 직접 구현한다.

개발자 커뮤니티에서 Claude Design의 오픈소스 대체재를 찾는 움직임이 있다. OpenDesign에 GPT-5.5를 연결해 사용했지만 완성도가 낮다는 평가가 나왔다. AI 디자인 도구의 핵심인 일관성과 마감 처리에서 여전히 격차가 존재한다.

리처드 소처가 6억 5천만 달러의 투자를 받은 Recursive Superintelligence를 설립했다. 인간의 개입 없이 스스로 약점을 찾아 수정하는 재귀적 자가 개선 AI 모델을 개발한다. 오픈엔디드니스 개념을 도입해 AI 간의 상호 진화를 통

Raindrop AI가 에이전트 전용 로컬 디버깅 도구 Workshop을 공개했다. 모든 실행 기록을 로컬 SQL 파일로 저장해 데이터 보안과 속도를 높였다. 에이전트가 스스로 오류를 수정하는 self-healing eval loop 기능을 제공한다.

OpenAI가 코딩 도구인 Codex를 ChatGPT 모바일 앱에 통합했다. iOS와 안드로이드 사용자는 이제 원격으로 개발 워크플로우를 관리할 수 있다. Anthropic의 Claude Code와 경쟁하며 에이전트 기반 코딩 도구 시장을 확장하고 있

OpenAI가 챗GPT 통합 성과 저조를 이유로 애플에 법적 대응을 검토하고 있다. 애플은 개인정보 보호 표준과 OpenAI의 하드웨어 진출 시도에 불만을 갖고 있다. 구글은 연간 약 10억 달러를 받고 애플 인텔리전스의 인프라 파트너로 활동 중이다.

Claude Code 사용량을 실시간으로 확인하는 Clawdmeter가 공개되었다. ESP32-S3-Touch-AMOLED-2.16 하드웨어를 통해 토큰 사용량을 시각화한다. OAuth 토큰을 활용해 API 응답 헤더에서 사용량 데이터를 직접 추출한다

AI 기술과 제품의 상향 평준화로 인해 기술적 우위가 빠르게 사라지고 있다. OpenAI와 Palantir 같은 기업은 독특한 조직 구조를 통해 대체 불가능한 인재를 끌어들인다. 미래의 경쟁력은 단순한 보상이 아니라 인재의 정체성을 실현하는 조직적 발

한 개발자가 2년간 AI에 의존해 코딩하며 기술 퇴화를 경험했다. AI 결과물이 개인의 특성을 반영하지 못해 자기 의심이 심화되었다. 전문성 회복을 위해 다시 수동 코딩 학습을 시작했다.

Anthropic이 Claude Code에 /goals 기능을 추가했다. 작업 수행 모델과 완료 여부를 판단하는 평가 모델을 분리했다. 개발자가 설정한 구체적인 조건이 충족될 때까지 에이전트가 계속 작동한다.

미 공화당 의원들이 OpenAI의 기업공개 추진을 앞두고 샘 올트먼의 사업 거래를 조사하기 시작했다. 이번 조사는 인공지능 기업의 투명성과 잠재적 이해 상충 문제를 정밀하게 들여다보는 데 초점을 맞춘다. OpenAI는 기업 구조 개편과 상장 준비 과정

Anthropic의 Claude가 사용자의 오래된 파일을 분석해 비트코인 지갑을 복구했다. AI가 백업 파일 발견과 복구 도구의 설정 오류를 찾아내 5 BTC를 되찾았다. 단순 추측이 아닌 데이터 구조 분석과 디버깅을 통해 복구에 성공한 사례다.

Qwen3.6-35B-A3B 모델이 공개되었다. 350억 개의 파라미터 중 30억 개만 활성화해 효율을 높였다. SWE-bench Verified에서 73.4점을 기록하며 코딩 성능을 입증했다.

Claude Code와 Codex를 위한 학습 강화 스킬이 공개되었다. 아키텍처 작업 완료 후 10~15분 분량의 맞춤형 학습 연습을 제공한다. 학습 과학 기반의 인출 연습과 간격 반복 기법을 적용했다.

Claude Code를 위한 멀티 에이전트 오케스트레이션 플랫폼 Ruflo가 공개되었다. 100개 이상의 에이전트가 스웜 형태로 협업하며 세션 간 기억을 유지한다. Rust 엔진 기반으로 작동하며 다양한 LLM 프로바이더와 연동을 지원한다.

중국 AI 연구소는 학생 중심의 실용적 개발 문화를 구축했다. 대부분의 중국 개발자는 금지된 환경에서도 Claude를 사용한다. 기업들은 외부 SaaS 구매 대신 자체 기술 스택 통제를 선호한다.

마크베이스가 시계열 데이터베이스에 스크립트 실행과 API 기능을 추가했다. 단순 저장소였던 DB가 AI 에이전트의 실행 환경인 런타임 역할로 확장됐다. IoT 데이터의 실시간 처리 비용을 줄이기 위해 처리 로직이 DB 내부로 들어왔다.

Anthropic이 Claude의 프로그래밍 방식 사용량을 월간 크레딧제로 변경한다. 구독 한도와 분리된 전용 크레딧이 적용되며 플랜별로 20달러에서 200달러까지 차등 제공된다. 개발자 커뮤니티에서는 실질적인 사용량 제한 강화라는 비판이 나오고 있다

캠벨 브라운이 AI 모델의 고위험 주제 답변을 검증하는 Forum AI를 설립했다. 전문가 벤치마크를 통해 AI 판정관의 일치율을 90%까지 끌어올렸다. 기업의 법적 책임 리스크를 해결하는 컴플라이언스 시장을 공략한다.

Clio가 연간 반복 매출 5억 달러를 달성했다. Harvey와 Legora 등 법률 AI 기업들의 매출이 급증하고 있다. Anthropic이 법률 특화 기능을 강화하며 공급자에서 경쟁자로 전환했다.

디노티시아 엔지니어가 한국 법령·판례 챗봇 legalQ를 공개했다. RAG 기술을 적용해 조문 번호와 판례 인용의 정확도를 높였다. 별도 설치 없이 브라우저에서 즉시 사용 가능한 UI를 제공한다.

Vercel이 Claude Code 플러그인 설치 시 사용자 기기에 영구 ID를 자동 생성했다. 프롬프트 수집 거부 후에도 기본 텔레메트리 정보는 계속 전송되는 구조다. 환경변수 설정을 통해 해당 추적 기능을 수동으로 끌 수 있다.