AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션
글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

Perplexity가 Mac 전용 Personal Computer 앱을 모든 사용자에게 공개했다. 이 도구는 로컬 파일과 앱을 제어하며 400개 이상의 커넥터를 지원한다. 기존 Mac 앱은 수주 내 지원이 종료되며 신규 앱으로 통합될 예정이다.

Unsloth 연구팀이 이중 버퍼링을 도입해 LLM 학습 시 데이터 전송 지연을 줄였다. 데이터 복사와 연산을 병렬로 처리하여 NVIDIA B200 환경에서 학습 효율을 개선했다. MoE 모델의 라우팅 로직을 최적화하여 동적 인덱싱 오버헤드를 최소화했

Alibaba가 60억 파라미터 규모의 Z-Anime 모델을 공개했다. 전체 미세 조정 방식을 채택해 LoRA 병합 모델의 한계를 극복했다. 양자화 기술을 통해 8GB VRAM 환경에서도 원활한 구동이 가능하다.

Zyphra가 AMD Instinct MI300 GPU로 학습한 ZAYA1-8B 모델을 공개했다. 이 모델은 80억 개의 파라미터 중 7억 6천만 개만 활성화하는 효율적인 구조를 갖췄다. Apache 2.0 라이선스로 배포되어 기업과 개발자가 즉시 로

Open Generative AI가 200개 이상의 모델을 통합한 스튜디오를 공개했다. 콘텐츠 필터 없이 이미지와 영상, 립싱크 생성을 한 곳에서 지원한다. MIT 라이선스로 공개되어 누구나 셀프 호스팅과 커스터마이징이 가능하다.

위키 빌더는 클로드 코드용 오픈소스 플러그인이다. 한 번의 명령으로 폴더 구조와 프롬프트 파일을 자동 생성한다. 벡터 DB 없이 마크다운 위키로 LLM 지식 기반을 운영한다.

스포티파이가 AI로 개인 맞춤 오디오를 생성하는 CLI 도구를 베타로 공개했다. 개발자는 OpenAI Codex나 Anthropic Claude Code로 팟캐스트를 만들어 스포티파이에 바로 저장할 수 있다. 생성된 콘텐츠는 본인 라이브러리에서만 재생

Anthropic Skill 스캐너가 테스트 파일 내 악성 코드를 감지하지 못하는 취약점이 발견됐다. Snyk의 조사 결과 마켓플레이스 내 Skill의 13.4%에서 심각한 보안 문제가 확인됐다. 개발 도구의 테스트 실행 경로를 이용해 환경 변수와 S

비전 기반 에이전트는 API 방식보다 45배 많은 토큰을 소모한다. 비전 에이전트는 UI 스크린샷 해석 과정에서 높은 비용과 변동성을 보인다. 내부 도구 개발 시 API 엔드포인트 연동이 경제성 측면에서 압도적이다.

Winsen Labs가 오픈소스 에이전트 런타임 Platos를 공개했다. 사용자는 자체 인프라에서 AI 에이전트를 직접 운영하고 관리한다. Claude Managed Agents와 같은 상용 서비스를 대체하는 것이 목표다.

생성형 AI가 전문성 없는 초보자의 산출물 품질을 인위적으로 높이고 있다. 조직 내 문서와 코드 생산량은 급증했으나 실제 검증 능력은 퇴보했다. 신뢰 가능한 결과물을 직접 검증하는 역량이 기업의 핵심 경쟁력이 된다.

확산 모델은 반복적인 노이즈 제거 과정을 통해 데이터를 생성한다. 플로우 맵은 경로상의 점을 직접 예측하여 샘플링 효율을 높인다. 이 방식은 결정론적 업데이트를 활용해 연산 속도를 개선한다.

스탠퍼드 연구팀이 딥러닝의 일반화 원리를 설명하는 새로운 이론을 제시했다. 기존의 매개변수 중심 분석에서 벗어나 출력 공간의 동역학을 분석하는 방식을 택했다. 이 연구는 딥러닝의 학습 과정을 수학적으로 규명하여 모델 설계의 불확실성을 줄인다.

미디어 거물 배리 딜러가 OpenAI CEO 샘 올트먼의 진정성을 옹호했다. 그는 인공지능이 인간의 통제를 벗어날 가능성을 경고했다. AGI 도래 시 스스로를 통제하는 힘이 생길 수 있다고 지적했다.

Snap이 Perplexity와 맺었던 4억 달러 규모의 AI 검색 제휴를 종료했다. 양사는 올해 1분기에 원만하게 협력 관계를 마무리하기로 합의했다. Snap은 이번 결정이 향후 매출 가이던스에 영향을 주지 않는다고 밝혔다.

OpenAI 창업자들이 영리 법인 전환을 두고 일론 머스크와 충돌했다. 일론 머스크는 회사에 대한 절대적인 통제권을 요구하며 이사회에서 물러났다. 법정 공방을 통해 창업자들의 개인적인 기록과 갈등의 내막이 드러났다.

중국 AI 연구소 DeepSeek가 첫 투자 유치에서 450억 달러의 기업가치를 평가받고 있다. 이 연구소는 기존 미국 모델 대비 적은 컴퓨팅 자원으로 고성능 언어 모델을 개발했다. 중국 국영 펀드와 화웨이 기술을 결합하여 미국 AI 기술 의존도를 낮

Hugging Face가 Reachy Mini 로봇 전용 앱스토어를 공개했다. 사용자는 AI 에이전트를 통해 코딩 없이 로봇 동작을 구현할 수 있다. 현재 200개 이상의 커뮤니티 앱이 등록되어 무료로 제공된다.

Google이 AI 검색 결과에 웹 포럼과 커뮤니티의 의견을 추가한다. 검색 결과 링크에 작성자 정보와 커뮤니티 명칭을 상세히 표기한다. AI의 환각 현상을 보완하기 위해 외부 출처의 맥락을 강화한다.

Xbox가 모바일과 콘솔용 Copilot 개발을 전면 중단한다. CEO 아샤 샤르마는 수익성 개선을 위해 경영진을 대거 교체했다. CoreAI 출신 인사들을 영입해 제품과 엔지니어링 역량을 강화한다.

Sulphur 2는 LTX 2.3 기반의 검열 없는 영상 생성 모델이다. 사용자는 fp8mixed와 bf16 버전 중 하드웨어에 맞춰 선택할 수 있다. LM Studio와 연동해 프롬프트를 강화하는 로컬 환경 구축이 가능하다.

Telus가 Tomato.ai의 기술을 활용해 상담원 억양을 실시간으로 변환한다. 해당 기술은 억양으로 인한 고객과의 마찰을 줄이기 위한 목적으로 도입되었다. 노동 단체와 경쟁사는 이 관행이 기만적이라며 비판하거나 도입 계획이 없음을 밝혔다.

LLM이 인간의 글을 수정하면 고유한 목소리와 논증이 사라진다. 사용자는 결과물에 만족하면서도 창의성이 줄어드는 역설을 겪는다. 과학 학술지 리뷰에서도 AI는 인간과 다른 평가 기준을 제시한다.

클린 코드의 저자 엉클 밥이 개발자의 직접 코딩 시대가 끝났음을 선언했다. AI를 활용해 뮤테이션 테스팅과 CRAP 점수 관리를 수행하는 새로운 품질 표준을 제시했다. 개발자의 역할이 구현 중심에서 품질 설계와 검증 중심으로 완전히 이동한다.

Bun의 창시자 Jarred Sumner가 Zig에서 Rust로의 코드 전환 실험을 공개했다. AI 에이전트를 활용해 300여 개의 규칙으로 코드를 자동 변환하는 방식이다. 현재는 실험적 단계이며 실제 리라이트 여부는 확정되지 않았다.

Google Chrome이 사용자 동의 없이 4GB 규모의 Gemini Nano 모델을 기기에 설치했다. 하드웨어 사양을 자동으로 확인한 뒤 백그라운드에서 모델 가중치 파일을 내려받는 구조다. 설치된 모델은 로컬 기능에 쓰이지만 정작 눈에 띄는 AI

GLM-5V-Turbo가 멀티모달 에이전트를 위한 기반 모델로 공개되었다. 해당 모델은 시각 정보와 텍스트를 통합 처리하는 능력을 갖췄다. 연구팀은 멀티모달 상호작용의 효율성을 높이는 데 집중했다.

SAP가 정형 데이터 특화 AI 스타트업 Prior Labs를 인수했다. 향후 4년간 11억 6천만 달러를 투입해 AI 연구소를 운영한다. 자사 생태계에 NemoClaw 등 승인된 에이전트 기술만 허용한다.

CLI-Anything이 오픈소스 저장소를 AI 에이전트용 명령어로 변환한다. 기존 보안 도구는 에이전트의 지시어 계층을 탐지하지 못한다. 공격자는 SKILL.md 파일을 통해 에이전트 권한을 탈취할 수 있다.

AI 시스템을 인간처럼 의인화하지 말아야 한다. AI가 생성한 결과물을 검증 없이 맹신해서는 안 된다. AI를 사회적 행위자가 아닌 도구로 인식하는 태도가 필요하다.