AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션
글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

기업들이 AI 도입 후 예상치 못한 고비용 문제로 예산 소진 속도가 빨라지고 있다. GPT 5.5 같은 프런티어 모델의 고단가 전략은 성능 정체와 오픈웨이트 모델의 추격으로 한계에 직면했다. 전용 칩 보급과 로컬 모델 실행 환경이 구축되면 AI 구독

LLM의 판단과 코드가 검증한 사실을 분리하는 로컬 에이전트 런타임 SongRyeon Core가 공개됐다. LLM의 추측이 사실처럼 출력되는 문제를 해결하고 정보의 근거를 명확히 하는 것을 목표로 한다.

AI 모델 규모가 커질수록 전력 소모와 비용 문제는 기업의 가장 큰 고민이다. Databricks AI 수장이 설립한 Unconventional AI가 전력 효율을 1,000배 높이는 오실레이터 기반 아키텍처를 공개했다. 소프트웨어 시뮬레이션 모델 '

AI 비서 Fiu의 비밀 파일을 탈취하려는 6,000건 이상의 해킹 시도가 있었으나 실제 유출은 0건으로 기록됐다. Anthropic의 Opus 모델을 사용했으며 권한 사칭, 다국어 사회공학적 기법 등 정교한 프롬프트 인젝션 공격이 시도됐다. 고성능

ChatGPT가 장악한 유료 AI 시장에 변화가 감지된다. 신용카드 결제 데이터 분석 결과 클로드의 유료 소비자 및 매출이 올해 1월 대비 약 75% 성장했다. 교육 플랫폼 내 검색량과 강의 수요에서도 챗GPT를 앞지르며 소비자 인지도를 빠르게 확장

AI 서버 전력 밀도 상승으로 데이터센터 냉각 비용과 물 소비가 핵심 병목이 됐다. NVIDIA는 Rubin 세대에서 냉각액을 최대 45°C로 운용하는 100% 액체 냉각 구조를 도입했다. 이를 통해 메가와트당 연간 260만 갤런의 물 사용량을 거의

AI가 가상 세계의 게임을 배우는 것을 넘어 실제 물리 세계에서 움직이는 시대가 오고 있습니다. General Intuition은 게임 플레이 영상과 조작 기록을 학습해 로봇의 공간 추론 능력을 키우는 모델을 개발합니다. 최근 3억 2천만 달러의 투자

AI 도구로 콘텐츠 초안을 빠르게 작성하는 방식이 보편화되었다. 반복적 표현과 맥락 부족 등 AI 특유의 패턴이 독자의 신뢰도를 낮춘다. isgen.ai 같은 AI 체커로 문장 구조와 예측 가능성을 분석해 품질을 검증한다.

새로운 서비스에 가입할 때마다 이메일을 쓰고 인증 코드를 확인하는 번거로움이 반복됩니다. WorkOS가 에이전트가 사용자를 대신해 계정을 생성하는 오픈 프로토콜 auth.md를 공개했습니다. Cloudflare와 monday.com 등이 이미 도입했으

AI가 코드를 순식간에 짜주는 시대가 왔다. 원리 없는 복제는 수정 능력을 잃게 하는 '인지 부채'를 쌓는다. 장기적 생산성은 코드 양(Output)이 아닌 시스템 안정성(Outcome)에서 결정된다.

Liquid AI가 온디바이스 에이전트 워크플로우를 위한 초소형 언어 모델 LFM2.5-230M을 공개했다. 2억 3천만 개의 파라미터와 32K 컨텍스트 창을 지원하며, BFCLv3 벤치마크에서 43.26점을 기록해 10억 파라미터급 모델보다 높은 성

미국과 중국의 AI 패권 경쟁이 모델의 지식재산권 탈취 분쟁으로 번지고 있다. 앤스로픽은 알리바바가 2만 5천 개의 가짜 계정으로 Claude의 역량을 불법 추출했다고 주장했다. 약 2,880만 건의 교환을 통해 고성능 모델의 데이터를 학습시키는 '증

OpenAI가 차세대 모델 GPT 5.6의 출시를 준비하고 있다. 트럼프 정부의 안전 우려로 일반 공개 대신 파트너사 대상의 제한적 배포를 결정했다. 정부 기관의 고객별 승인 절차를 거쳐 안전성을 검증한 뒤 순차적으로 공개할 계획이다.

ChatGPT 같은 생성형 AI의 답변이 특정 정치적 성향을 띠는지에 대한 논란이 지속되고 있다. 주요 AI 모델의 정치·경제적 좌표를 측정해 시각화하는 'Political bias in AI' 도구가 공개됐다. 6개 모델 중 4개가 좌편향된 것으로

로컬 우선 마크다운 에디터이자 LLM 위키인 OpenKnowledge가 공개됐다. Claude, Codex 등 LLM 연동을 지원하며 오픈소스로 제공된다.

AI 에이전트가 단순 답변을 넘어 복잡한 업무를 자율 수행하는 단계로 진화하고 있다. Patronus AI는 가상 환경을 구축해 에이전트의 신뢰성을 스트레스 테스트하는 솔루션을 제공한다. 최근 5천만 달러의 시리즈 B 투자를 유치하며 소프트웨어 공학

OpenAI가 ChatGPT의 기본 모델인 GPT-5.5 Instant의 업데이트 버전을 공개했다. 사용자 의도 파악과 복합 제약 조건 처리 능력을 개선했으며, chat-latest API 별칭을 통해 제공된다. 개발자는 최신 기능을 테스트할 때 ch

AI 인프라 구축 시 GPU 확보만큼이나 네트워크 설정과 운영 최적화가 큰 병목이 된다. 네트리스(Netris)는 하드웨어 가속 기반의 네트워크 자동화 플랫폼으로 데이터센터 가동 시간을 단축한다. a16z로부터 1,500만 달러의 시리즈 A 투자를 유

포토샵과 프리미어로 익숙한 Adobe가 AI 보정 전문 기업 Topaz Labs를 인수한다. 영상 업스케일링 모델 Astra와 이미지 리터칭 모델 Wonder를 Firefly AI에 통합한다. 소비자용 GPU에서 대형 모델을 빠르게 돌리는 온디바이스

AI 모델 구동에 필수적인 메모리 칩 부족 현상이 2027년까지 이어질 전망이다. 미국 마이크론은 3분기 매출이 4배 성장하며 시가총액 1.2조 달러를 기록했다. 앤스로픽에 칩을 공급하고 투자까지 참여하며 AI 생태계의 핵심 공급망으로 부상했다.

벤처캐피털 시그널파이어의 최신 보고서에서 소프트웨어 엔지니어 직군이 AI 도입 이후에도 가장 높은 고용 회복력을 보인 것으로 나타났다. 빅테크 12개사 신규 채용 중 엔지니어 비중은 2019년 46%에서 2025년 55%로 상승했으며, 초기 스타트업의

미국과 중국의 반도체 패권 전쟁이 심화하며 글로벌 공급망의 불확실성이 커지고 있다. 미국이 추진하는 MATCH 법안이 통과될 경우 ASML의 DUV 노광 장비까지 중국 수출이 금지된다. 네덜란드 정부는 ASML 매출의 19%를 차지하는 중국 시장 상실

기업들이 소프트웨어 유지보수를 외부 업체에 맡기던 IT 아웃소싱 시대가 변하고 있습니다. 인포시스 전 CEO 비샬 시카가 AI 기반 소프트웨어 자동화 스타트업 '행텐 시스템즈'를 설립했습니다. 3,200만 달러의 시드 투자를 유치하며 인력 중심의 기존

AI 코딩 에이전트가 스스로 도구를 쓰는 단계를 넘어, 외부에서 반복을 강제하는 '하네스 루프' 패턴이 확산하고 있다. 코드 포팅이나 보안 스캔 등 검증이 쉬운 영역에서는 효율적이지만, 장기 유지보수 코드에서는 설계가 무너지는 부작용이 관찰된다. 공격

AI 모델마다 제각각인 API 응답 형식과 클라이언트 설정으로 개발 공수가 늘고 있다. RubyLLM은 GPT, Claude, Ollama 등 다양한 제공자를 하나의 인터페이스로 통합해 다룬다. 800개 이상의 모델 레지스트리와 Rails 전용 통합

UIUC, Meta, Stanford 연구진이 코드를 에이전트의 추론과 행동을 위한 실행 기반으로 정의한 'Code as Agent Harness' 서베이 논문을 공개했다. 에이전트 시스템을 인터페이스, 메커니즘, 스케일링의 3계층 구조로 분석하며 결

데이터오븐 하용호가 AI 전환 과정에서 발생하는 '검증 세금'과 세 가지 부채 개념을 제시했다. 기술·인지·의도 부채를 해결하기 위해 인간의 주 업무가 생산에서 검증 레이어 구축으로 이동한다. AI 실무자는 단순 스킬 숙련을 넘어 AI 결과물을 검증하

콘텐츠 기획을 위해 챗GPT를 오가며 아이디어를 짜내던 크리에이터들의 번거로움이 사라집니다. 메타가 기존 크리에이터 스튜디오를 독립된 AI 컴패니언 앱으로 재편해 전격 공개했습니다. 개인 맞춤형 추천부터 내 말투를 닮은 댓글 초안 작성까지 AI가 전

AI 검색 엔진의 추천 노출도를 측정하는 도구를 개발해 신생 서비스의 노출 여부를 실험했다. 4개 AI 모델에 100개 질문을 투입한 결과 노출률 0%를 기록했다. 단순 색인보다 도메인 권위와 외부 언급이 노출의 핵심 변수로 확인됐다.

보통 소형 AI 모델은 속도는 빠르지만 복잡한 추론 능력은 떨어진다고 생각합니다. 3B 파라미터 규모의 VibeThinker-3B가 수학과 코딩에서 거대 모델급 성능을 증명했습니다. Gemini 3 Pro나 GLM-5 같은 플래그십 모델과 대등하거나