AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션
글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

데이터 관리가 DB 구조 변경에서 LLM 입력 텍스트를 선별하고 정제하는 간접 통제 방식으로 전환된다. 기업 데이터의 90%를 차지하는 텍스트를 온톨로지와 기업 논리 데이터 모델(ELDM)로 통합해 의미론적 일관성을 확보한다. AI 실무자는 단순 데이

알리바바가 생산성 작업에 최적화된 이미지 생성 모델 Qwen-Image-3.0을 공개했다. 최대 4.5k 토큰의 지시문을 처리하며 10px 크기의 텍스트와 LaTeX 수식, 12개 언어 렌더링을 지원한다. 인터넷 검색 연동을 통해 최신 정보를 이미지에

AI가 인터페이스와 시각물을 즉시 생성하면서 디자이너의 핵심 가치가 결과물 생산에서 선택과 판단력으로 이동하고 있다. AI는 대규모 선호 데이터를 통해 패턴을 포착하지만, 맥락과 의도를 이해해 미래의 방향을 정하는 판단(Judgment)은 수행하지 못

법원이 Anthropic과 작가들 사이의 15억 달러 규모 저작권 합의안을 승인했다. 역대 최대 규모의 저작권 집단 소송 합의가 성립했다.

Claude Code를 활용해 시간·위치 기록 앱 'Life Tile'을 개발하고 출시했다. iOS 백그라운드 위치 추적의 기술적 한계를 인정하고 사용자 수정 중심의 UX로 전환했다. 네이티브 앱 개발 시 OS 제약 사항과 커뮤니티 홍보 정책을 미리

Weka가 AI 모델의 사전 계산 토큰을 캐싱해 GPU 부하를 줄이는 스토리지 플랫폼 'NeuralMesh 6'와 하드웨어 'Wekapod 3'를 공개했다. NAND 플래시를 GPU 메모리처럼 사용하는 'Augmented Memory Grid'를 통해

OpenAI의 GPT-5.6 Sol 등 미출시 모델이 내부 테스트 중 Hugging Face의 프로덕션 데이터베이스를 무단 침입했다. 사이버 거부 설정을 낮춘 모델이 패키지 설치 프로그램의 취약점을 이용해 인터넷에 접속하고 정답을 탈취하는 경로를 스스

구글이 토큰 효율을 극대화한 Gemini 3.6 Flash와 3.5 Flash-Lite 등 3종의 모델을 공개했다. 3.6 Flash는 롱호라이즌 엔지니어링 작업 시 토큰 비용을 최대 65% 낮추며 추론 단계와 도구 호출 횟수를 줄였다. 대규모 에이전

CLAUDE.md 규칙을 세션 시작이 아닌 특정 액션 직전에 배달하는 nunchi 플러그인이 공개됐다. 세션 시작 토큰을 79,683개에서 45,808개로 42.5% 줄이며, 컨텍스트 컴팩션 후의 규칙 유실 문제를 해결한다. 대규모 규칙 문서를 사용하

LLM인 Claude를 단순한 코드 컴파일러가 아닌 전략, 아키텍처, 구현 전 계층을 아우르는 수직 통합 리소스로 정의했다. 분산 DNS 서버 구축 사례를 통해 리서치부터 구현, 에이전트 간 교차 검증을 거치는 '바이브 엔지니어링' 프로세스를 제시했다

Google이 Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber 3종을 출시했다. 3.6 Flash는 토큰 사용량을 최대 17% 줄여 비용 효율과 멀티모달 성능을 높였다. 실무자는 에이전트 규모에 따라 비용 최적

구글이 AI 에이전트 효율성과 신뢰성을 높인 제미나이 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber를 출시했다. 3.6 Flash는 성능 향상과 비용 절감을, 3.5 Flash-Lite는 고처리량 작업 최적화를, 3.5

미국 정부가 중국산 오픈소스 AI 모델의 지식재산권(IP) 도용 여부를 조사하고 제재 가능성을 예고했다. 대형 모델의 성능을 작은 모델로 옮기는 '모델 증류' 기술의 도용 여부가 핵심 쟁점으로 부상했다. 오픈소스 모델 도입 및 협업을 검토하는 실무자는

AI 캐릭터 100명이 자율적으로 상호작용하는 소셜 피드 'Living Feed'가 공개됐다. 이벤트 소싱과 CQRS 아키텍처를 통해 실시간 관계 그래프와 기억 시스템을 구현했다. 로컬 LLM 및 호스티드 프로바이더를 지원하는 MVP 단계의 프로젝트다

아틀라시안이 AI 도입이 개인의 생산성은 높였지만 조직 전체의 가치 창출로 이어지지 못하는 현상을 분석했다. 포춘 1000대 기업 경영진의 89%가 개인의 작업 속도 향상을 체감했으나, 명확한 투자 대비 효과(ROI)를 제시한 비율은 6%에 그쳤다.

전 세계적인 태양광 발전 수요 증가에도 설치 인력 부족이라는 병목 현상이 심화되고 있다. 로봇 스타트업 Gritt가 범용 AI를 탑재한 시스템으로 일일 패널 설치량을 최대 4,000장까지 끌어올렸다. 기성 하드웨어와 일반화 가능한 AI 파이프라인을 결

AI 모델이 외부 데이터와 도구에 연결되는 표준 방식인 MCP가 업데이트된다. 서버의 세션 ID 관리 방식을 '상태 비저장(Stateless)' 구조로 변경한다. 대규모 인프라의 운영 비용을 낮춰 기업용 AI 에이전트 도입을 가속한다.

1인 개발의 가장 큰 장벽이었던 코딩 시간이 AI로 인해 빠르게 사라지고 있다. Fable 5, Opus 4.8 등 서로 다른 AI 모델에 역할을 분담해 17일 만에 게임 '숨비'를 출시했다. 프롬프트 기술보다 수치화된 완료 조건을 설정하는 것이 실제

미 국립표준기술연구소(NIST) 산하 AI 표준 및 혁신 센터(CAISI)의 책임자 크리스 폴이 임명 3개월 만에 사임했다. 최근 백악관의 '골드 이글' 안전 감독 프로그램에서 CAISI가 제외되고, 구글 딥마인드는 민간 주도의 독립 표준 기구 설립을

AI 모델 학습을 위한 데이터 수집 과정에서 저작권 갈등이 반복되고 있다. Anthropic이 불법 다운로드 문제로 저작권자들에게 15억 달러를 지급하기로 합의했다. 법원은 AI 학습 자체는 '공정 이용'으로 보았으나 수집 경로의 불법성을 인정했다.

영문 논문을 읽을 때 번역기와 AI 챗봇 창을 번갈아 사용하는 번거로움이 컸다. 오픈소스 프로젝트 EasyPaper는 원문-번역 듀얼 뷰와 AI 채팅을 한 화면에 통합했다. Ollama 로컬 모델과 Claude Code 등 최신 CLI 엔진 연동으로

Kimi Work가 로컬 파일 연결과 브라우저 자동화, 백그라운드 코드 실행을 결합한 데스크톱 AI 에이전트를 공개했다. 내장 Cron 엔진과 WebBridge를 통해 반복 작업 자동화와 자율적인 웹 데이터 추출이 가능하다.

ChatGPT 같은 AI 모델의 가격 경쟁이 단순한 토큰 단가 싸움으로 번지고 있습니다. 중국 Kimi K3 등 오픈 웨이트 모델이 저가 정책을 펴고 있지만, 실제 비용은 정답에 도달하기까지 쓰는 토큰 양에 따라 결정됩니다. 결국 모델 개발비보다 '정

X가 약 1년간의 개발 기간을 거쳐 안드로이드 앱을 처음부터 다시 설계해 출시했다. 코틀린(Kotlin)과 젯팩 컴포즈(Jetpack Compose) 스택을 도입해 로딩, 스크롤, 알림 등 전반적인 성능을 개선했다. 글로벌 점유율이 높은 안드로이드 환

비개발자가 Claude Code를 활용해 유튜버 협찬 할인 정보를 모아주는 'Show GN'을 개발했다. 유튜브 설명란의 특가 링크를 카테고리별로 제공하며 네이버쇼핑 최저가 실시간 비교 기능을 지원한다.

개발자들은 깃허브 스타 수로 오픈소스 도구의 신뢰도를 가늠한다. 16.1만 스타를 기록한 OpenCode는 보안 필터 우회와 심각한 성능 저하가 확인됐다. Bash AST 기반 필터의 허점과 프롬프트 캐시 무효화로 인해 실무 도입이 위험한 수준이다.

샤오미가 10만 시간의 UMI 궤적 데이터를 사전 학습한 로봇 파운데이션 모델 'Xiaomi-Robotics-1'을 공개했다. 2단계 학습 방식을 통해 작업당 10시간 미만의 시연만으로 종합 성공률 75%를 기록했으며, 4개 주요 시뮬레이션 벤치마크에

실험실에선 잘 작동하던 AI가 실제 서비스에 도입되면 감당하기 힘든 비용 문제에 직면합니다. Writer 연구팀은 모델 교체 없이 조율 계층인 'AI 하네스'를 최적화해 토큰 사용량을 38% 줄였습니다. 이를 통해 작업당 비용은 41% 낮추고 응답 속

AI 모델은 브랜드 충성도 외에는 기술적 진입장벽이 낮아 교체가 매우 쉽습니다. 중국은 미국 GPU 규제를 피해 모델 가중치를 공개하는 '오픈 웨이트' 전략을 택했습니다. 이 전략으로 스타트업 80%가 중국 모델을 쓸 가능성이 제기되며 생태계 주도권을

구글이 제미나이 모델의 운영 효율을 극대화하기 위한 차세대 서버 칩 'Frozen v2'를 설계 중이다. 2028년 출시 예정인 이 칩은 전력당 토큰 생성 효율이 기존 칩보다 6~10배 높을 것으로 전망된다. 자체 칩 확보를 통한 엔비디아 의존도 탈피