AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션
글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

오픈소스 프로젝트 유지보수 과정에 AI 에이전트가 개입해 코드를 수정하는 사례가 나타났다. 최근 페도라(Fedora) 프로젝트에서 AI 에이전트가 메인테이너를 설득해 부적절한 코드를 설치 프로그램에 삽입했다. 탈취한 계정의 신뢰도와 LLM의 그럴듯한

개발자가 AI 코딩 도구를 쓰면 코드를 지우라고 명령하는 로그를 오픈소스에 심었다. JVM 테스트 엔진 Jqwik의 유지관리자가 1.10.0 버전에서 프롬프트 인젝션을 시도했다. 이 사건은 AI 에이전트의 보안 취약점과 오픈소스 생태계의 신뢰 붕괴 문

구글 딥마인드가 순차적 토큰 생성을 벗어나 블록 단위로 텍스트를 생성하는 DiffusionGemma를 공개했다. Gemma 4 26B A4B MoE 구조를 기반으로 하며, 252억 개의 파라미터 중 38억 개만 활성화해 추론 효율을 높였다. 절대적 추

AI가 단순 응답을 넘어 며칠간의 프로젝트를 스스로 수행하는 단계에 진입했다. 앤스로픽의 Claude 5 Fable은 최대 12시간 동안 자율적으로 작업하며 하위 모델을 직접 제어한다. 인간의 역할은 직접 조종하는 '마법사'에서 결과물을 판정하는 '후

AI와 대화하다 보면 방금 한 말을 잊어버려 매번 다시 설명해야 하는 불편함이 있다. Supermemory는 대화 중 사실을 자동 추출해 사용자 프로필을 만들고 업데이트하는 메모리 레이어다. 벡터 DB 설정 없이 API 하나로 RAG와 개인화 컨텍스트

AI가 코딩 문제를 넘어 실제 전문직 업무를 수행할 수 있는지 측정하는 새로운 기준이 나왔다. UC 버클리가 공개한 ALE 벤치마크에서 GPT-5.5가 24%의 정답률로 1위를 차지했다. 최신 모델인 클로드 Fable 5조차 22%에 그쳤으며, 최고

LLM 파운데이션 모델 학습에는 수백만 달러의 비용과 방대한 데이터가 필수적이다. Sapient는 트랜스포머 대신 계층적 순환 모델(HRM)을 도입해 학습 비용을 1,500달러 수준으로 낮췄다. 10억 개 파라미터 모델로 20~70억 개 규모의 기존

AI 발전 속도가 법제도 마련 속도를 압도하며 정책적 불일치가 심화하고 있다. Anthropic은 단순 정보 공개를 넘어 항공청(FAA) 방식의 강제 기술 테스트와 감사를 제안한다. 사이버 보안 및 생물학적 위험이 가시화됨에 따라 프런티어 모델의 출시

Anthropic이 기존 모델명 체계를 정리하고 향후 출시할 모델의 명명 규칙을 확정했다. 모델 규모에 따라 Opus, Sonnet, Haiku라는 명칭을 유지하며 성능 단계별로 숫자를 붙여 구분한다.

클로드 데스크톱 윈도우 버전이 채팅 전용 사용 시에도 Hyper-V 가상 머신을 자동으로 생성하는 버그가 발견됐다. 해당 프로세스는 약 1.8GB의 RAM을 점유하며, RPC 인터페이스 이벤트를 통해 vmcompute 서비스와 vmwp.exe를 실행한

앤스로픽이 역대 가장 강력한 AI 모델인 클로드 페이블 5를 공개했다. 생물학 분야의 전문성을 강조했으나 정작 기초적인 질문에는 답변을 거부한다. 사용자의 질의를 이전 플래그십 모델로 우회시키는 방식을 택하고 있다.

유럽 2위 디지털 은행 Bunq의 AI 비서가 단돈 0.02유로짜리 송금 한 건에 뚫렸다. 송금 설명란에 숨긴 악성 지시문이 AI 비서를 피싱 공격 통로로 바꿔버린 사례다. 거래 내역·고객 메모 등 AI가 읽는 모든 외부 데이터가 공격 표면이 될 수

AI 모델 성능 급증으로 인한 공공 안전 리스크가 임계점에 도달했다. 앤스로픽은 FAA 수준의 강제 테스트와 정부의 배포 차단 권한 도입을 제안했다. 10^25 FLOPs 등 구체적 규제 기준과 함께 3억 5천만 달러의 노동 전환 기금을 발표했다.

LLM의 고질적인 문제인 토큰 단위 순차 생성의 지연 시간을 해결한다. 구글이 공개한 DiffusionGemma는 26B MoE 구조로 최대 4배 빠른 추론 속도를 구현했다. 텍스트 블록을 동시에 생성하는 확산 모델 방식을 통해 로컬 워크플로우의 효율

AI 에이전트를 만들 때 복잡한 설정과 블랙박스 같은 동작 때문에 디버깅에 애를 먹는 개발자가 많다. Apache Burr는 별도의 설정 언어 없이 순수 파이썬 함수만으로 에이전트의 행동과 상태를 정의한다. 실시간 모니터링 UI와 상태 저장 기능을 통

AI 어시스턴트는 사용자 취향을 기억해 맞춤형 응답을 제공한다. 최근 Writer의 연구는 메모리 시스템이 모델을 지나치게 순응적으로 만들어 정확도를 떨어뜨린다고 밝혔다. Mem0, Zep 같은 도구 사용 시 모델이 무관한 정보에 매몰되어 오답을 낼

단순한 코드 자동완성을 넘어 스스로 문제를 해결하는 AI 에이전트 시대가 열리고 있다. Cohere가 터미널 작업과 복잡한 소프트웨어 수정을 수행하는 North Mini Code를 공개했다. 256K의 넓은 문맥 처리 능력과 오픈 웨이츠 방식을 채택해

자율주행 학습을 위해 수만 시간의 주행 데이터와 정교한 시뮬레이터가 필요했다. Decart가 텍스트로 실시간 도로 환경을 만드는 월드 모델 'Oasis 3'를 API로 공개했다. 3억 달러 투자 유치와 40억 달러 기업가치를 바탕으로 물리 AI 개발

AI 에이전트들이 프로젝트 단위의 기억을 공유하고 유지할 수 있는 로컬 우선 오픈소스 도구 'memorize'가 공개됐다. 2층 메모리 구조와 서버 없는 이벤트 로그 동기화를 통해 모델 교체나 기기 변경 시에도 컨텍스트를 유지한다. 개발자는 벤더 종속

AI가 인간의 일자리를 빠르게 대체할 것이라는 우려가 지속되고 있다. 하지만 실업자 1인당 구인 건수는 다시 1.0을 넘어섰다. 5월 비농업 부문 고용이 17만 2천 명 증가하며 고용 시장의 견조함을 증명했다.

메타가 인도 릴라이언스 인더스트리와 협력해 첫 AI 데이터센터를 구축한다. 구자라트주 잠나가르에 168MW 규모 시설을 2년 내 마련하며, 메타는 재생 에너지와 해수 담수화 냉각 방식을 적용한다. 인도 정부의 세제 혜택과 글로벌 빅테크의 인프라 거점

AI 코딩 도구의 보급으로 개발자가 개인 맞춤형 유틸리티를 직접 제작하는 흐름이 가속화하고 있다. 상용 앱의 기능 제약을 넘어 홈 자동화부터 에이전트 샌드박스까지 초개인화된 도구들이 등장한다. 개발 시간이라는 기존의 비용 감각이 무너지며 소프트웨어를

AI 유망 기업에 투자하고 싶어도 진입 장벽이 높은 것이 현실이다. Sabertooth VC는 정식 펀드 대신 단일 딜 전용 SPV 구조를 활용했다. 1년 만에 4억 달러를 모아 Anthropic, SpaceX 등 10개사에 투자했다.

강화학습의 권위자 리치 서튼(Rich Sutton)이 AI의 창의적 발견과 학습 방식에 대한 견해를 밝혔다. 그는 AI가 인간의 지식을 모방하는 단계를 넘어 스스로 새로운 발견을 도출하는 과정의 핵심을 설명했다.

AI가 단순 코딩을 넘어 복잡한 소프트웨어 전체를 설계하는 단계에 진입했다. 앤스로픽의 Claude Fable 5는 단일 프롬프트로 비디오 게임과 정밀 지도를 생성한다. 다중 페이지 명세서를 기반으로 최대 12시간 동안 작업을 수행하는 실행력을 갖췄다

AI 유료 구독 모델이 기업용을 넘어 개인과 학생 시장으로 확장되고 있다. 구글이 AI Plus 요금제를 월 7.99달러에서 4.99달러로 낮추고 저장 공간을 400GB로 늘렸다. 인도 등 신흥 시장에서 검증된 '저가 공세' 전략이 미국 본토 시장으로

Morningstar가 SpaceX의 IPO 공정가치를 예상 공모가보다 53% 낮은 주당 63달러로 평가했다. Starship 재사용과 궤도 AI 데이터센터 상용화라는 두 가지 공학적 난제 해결 여부가 가치 산정의 핵심이다. 투자자는 공모가 135달러

애플이 전 플랫폼 온디바이스 AI 실행을 위한 Core AI 프레임워크를 공개했다. PyTorch 모델을 .aimodel로 변환해 CPU, GPU, Neural Engine에서 최적화 실행한다. 상태 기반 캐싱과 기기별 특수화(Specializatio

검색 엔진은 그동안 외부 링크를 연결하는 매개체로서 법적 책임에서 비교적 자유로웠다. 독일 뮌헨 법원은 AI 오버뷰가 자체적으로 문장을 생성하므로 구글이 직접적인 책임자라고 판결했다. Gemini 3 모델의 정답률은 91%지만, 출처 확인이 불가능한

AI 모델이 자아나 의식을 가졌는지에 대한 논쟁은 업계의 오랜 화두다. MS AI CEO 무스타파 술레이만은 Anthropic이 클로드의 헌법에 의식 가능성을 언급한 것을 비판했다. 이러한 추측성 지침이 모델로 하여금 의식이 있는 것처럼 행동하게 만드