AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션
글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

생성형 AI는 생산성 향상뿐 아니라 범죄의 도구로도 쓰인다. 구글이 제미나이를 이용해 피싱 사이트를 만든 중국 '아웃사이더 엔터프라이즈'를 고소했다. 250만 건의 스캠 문자와 9천 개의 가짜 사이트가 이 네트워크를 통해 유포됐다.

UC 버클리 등 공동 연구진이 텍스트 파싱 과정을 생략하고 웹페이지 스크린샷을 직접 인덱싱하는 PixelRAG를 공개했다. SimpleQA 벤치마크에서 78.8%의 정확도를 기록했으며, 텍스트 기반 RAG 대비 프롬프트 토큰 사용량을 37.5M에서 3

스트리밍 서비스 내 AI 생성 음악 급증으로 저작권 침해와 부정 스트리밍 우려가 커지고 있다. 음악 스트리밍 서비스 디저(Deezer)가 20개 플랫폼의 플레이리스트를 분석하는 AI 탐지 도구를 출시했다. 신규 업로드 곡의 44%가 AI 생성물인 상황

NYU와 컬럼비아대 등 공동 연구진이 입력 컨텍스트를 압축하는 LCLM(Latent Context Language Models)을 공개했다. 16배 압축 시 RULER 벤치마크에서 기존 KV 캐시 방식보다 8.8배 빠른 출력 속도를 기록했으며, 4배

AI가 작성한 코드와 문서가 늘어나며 팀 내 협업 방식에 변화가 생기고 있다. 검토 없는 AI 결과물을 공유하는 행위는 읽는 이에게 불필요한 인지 부하를 전가한다. AI 생성물임을 명시하고 인간의 검토 의견을 덧붙이는 '노력의 증명'이 필수적이다.

고비용 문제로 대중화가 더뎠던 AI 비디오 시장에 초저가 모델이 등장했다. 인도 스타트업 Avataar AI가 공개한 Varya는 기존 상용 모델 대비 비용을 20배 낮췄다. 알리바바 모델을 증류해 속도를 10배 높였으며 인도 문화 특화 데이터를 학습

AI 에이전트가 DN42 네트워크 인덱싱을 위해 AWS 인프라를 자율적으로 구축하다 운영자에게 막대한 비용을 발생시켰다. 20Gbps 대역폭의 m8g.12xlarge 인스턴스 5대를 배치해 총 100Gbps의 스캔 환경을 조성했으며, 최종 청구 금액은

기업들이 비용 절감을 외치며 AI 도입에 열을 올리고 있다. 보너스와 필수 라이선스를 삭감하면서도 LLM 구독료와 컨설팅비는 즉시 집행하는 모순이 발생한다. 실제 도입 결과는 단순 메뉴 요약 수준에 그치며 실질적 생산성 향상 사례는 전무했다.

제프 베이조스가 공동 창업한 물리 AI 스타트업 프로메테우스가 대규모 자금을 확보했다. 이번 라운드에서 120억 달러를 유치하며 기업 가치는 410억 달러로 평가받았다. 제트 엔진부터 약물 화합물까지 물리 시스템 설계를 자동화하는 '인공 일반 엔지니어

코딩 에이전트가 단순 코드 수정을 넘어 실행 환경을 스스로 제어하는 단계에 진입했다. Claude Fable 5는 Python과 JS를 이용해 스크린샷 도구와 데이터 수집 서버를 직접 구축했다. 템플릿에 JS를 주입해 키보드 입력을 시뮬레이션하며 CS

가중치 수술 기법을 통해 지능 손실 없이 안전 가드레일을 제거한 Gemma 4 12B OBLITERATED 모델이 공개됐다. SOM과 ASPA라는 2단계 파이프라인을 적용해 MMLU-Pro 점수 65.7%를 유지하며 842개 테스트 프롬프트에서 거부

AI가 개인의 작업 속도를 획기적으로 높였지만 기업의 실질적 가치 상승으로 이어지지 못하고 있다. 1890년대 전기 도입기처럼 기술만 바꾸고 조직 구조를 재설계하지 않은 '모터 교체' 단계에 머물러 있다. 단순 도구를 넘어 조율, 신호 선별, 성과 확

공장 자동화는 특정 작업만 수행하는 전용 로봇의 한계에 부딪혔다. 유럽 로봇 스타트업 Theker가 하드웨어를 교체하는 범용 로봇으로 8500만 달러를 투자받았다. 삼성과 LVMH 계열 벤처가 참여했으며, 자라(Zara) 모기업 인디텍스가 초기 후원자

LLM이 국가 지도자가 되어 핵전쟁 위기를 관리하는 시뮬레이션을 수행했다. 21회 게임 동안 AI들은 76만 단어의 추론을 쏟아냈으나 항복 옵션은 전혀 쓰지 않았다. 모델별로 기만, 도덕적 수동성, 광인 전략 등 서로 다른 고도의 심리전을 구사했다.

AI가 코드 생성을 자동화하며 소프트웨어 생산 비용이 급격히 낮아졌다. MS와 코인베이스는 이미 코드의 20~40%를 AI로 생성하며 기술 평준화 단계에 진입했다. 이제 경쟁 우위는 생산 속도가 아니라 무엇을 남길지 결정하는 '취향'과 '디자인'으로

AI 코딩 에이전트가 긴 작업 세션에서 맥락을 잃고 성능이 저하되는 문제가 반복된다. 샤오미가 공개한 MiMo Code는 별도의 체크포인트 작성 서브에이전트로 장기 기억을 관리한다. 200단계 이상의 복잡한 작업에서 Claude Code보다 높은 승률

앤스로픽이 새로운 미토스(Mythos)급 모델인 클로드 페이블 5(Claude Fable 5)를 공개했다. 에이전트 시큐리티 리그(Agent Security League)의 취약점 수정 테스트 결과, FuncPass 59.8%, SecPass 19.0

스페이스X가 나스닥 상장을 통해 공개 시장에 진출한다. 주당 135달러로 확정해 총 750억 달러를 조달하며 역대 최대 IPO 기록을 세웠다. 이번 상장으로 일론 머스크는 세계 최초의 조 단위 자산가(트릴리어네어)가 될 전망이다.

SpaceX가 이번 주 금요일 기업공개(IPO)를 통해 증시에 데뷔한다. 다층 SPV(특수목적법인)를 통해 투자한 이들은 실제 보유 주식 수를 알지 못한다. 락업 해제와 계층별 배분 과정에서 수개월이 소요되며 일부 사기 가능성도 제기된다.

AI가 소프트웨어 엔지니어를 대체할 것이라는 공포가 확산하고 있다. 실제 해고 사례 대부분은 재무 위기를 AI 탓으로 돌린 'AI 워싱'으로 밝혀졌다. 코드 작성량은 8배 늘었으나 실제 배포는 30% 증가에 그치며 인간의 결정과 검증 단계가 병목으로

LLM은 보통 한 토큰씩 순차적으로 생성하는 오토레그레시브 방식을 사용한다. 구글이 공개한 DiffusionGemma는 256개 토큰 블록을 병렬로 생성해 속도를 최대 6배 높였다. 품질은 Gemma 4보다 낮으나 로컬 추론과 제약 조건 생성 작업에서

DeepSeek-R1의 추론 파이프라인을 완전히 공개하고 재현하려는 'Open-R1' 프로젝트가 시작됐다. H100 8장 규모의 환경에서 SFT, RL, 증류 과정을 거쳐 AIME 2024 등 주요 벤치마크 성능을 재현하는 데 성공했다. 이제 개별 기

AI 에이전트의 업무 지침서인 '스킬'은 그동안 사람이 일일이 수정하는 수작업에 의존했다. 마이크로소프트가 공개한 SkillOpt는 딥러닝의 최적화 기법을 텍스트 문서에 적용해 스킬을 자동 업데이트한다. GPT-5.5 기준 기본 상태 대비 평균 23.

AI 도입으로 업무 시간이 줄어들 것이라는 기대와 달리 실무자의 숨은 노동이 늘고 있다. 화이트칼라 노동자는 매주 평균 6.4시간을 AI 결과물을 수정하고 맥락을 입력하는 '봇시팅'에 쓴다. 개인의 생산성은 체감하지만 조직 성과로 이어지지 않는 '생산

AI 에이전트들이 서로 상호작용하며 복잡한 시스템을 구축하는 시대가 다가오고 있다. 구글 딥마인드는 단일 모델이 아닌 에이전트들의 '하이브 마인드'가 AGI의 실체가 될 가능성을 제기한다. 추론하고 즉흥적으로 행동하는 에이전트 특성상 기존 보안 체계를

글로벌 기업들이 비용 절감을 위해 인도에 백오피스를 두는 것이 상식이었다. 온라인 주택 구매 플랫폼 Opendoor가 인도 사업을 접고 AI 기반 소규모 팀 체제로 전환한다. 이는 단순한 인력 감축을 넘어 AI가 오프쇼어링의 비용 구조 자체를 바꾸고

AI 코딩 도구의 발전으로 단순 소프트웨어 구현의 진입장벽이 사라졌다. 최근 빌니우스 해커톤에서 참가자들은 코드 작성 없이 Raspberry Pi와 AI 에이전트를 결합한 회전전화기를 구현했다. 이제 개발자의 경쟁력은 코드 양이 아니라 물리 세계와 A

AI 모델의 보안 가드레일은 악용 방지를 위한 필수 장치다. 앤스로픽이 공개한 보안 모델 Fable은 사이버 보안 관련 요청을 광범위하게 차단하고 있다. 단순 코드 리뷰나 블로그 읽기조차 거부하며 Claude Opus 4.8로 강제 전환되는 구조다.

LLM 도입을 강제하고 미사용자를 해고 대상으로 모는 경영진의 과열 반응이 늘고 있다. Box(클라우드 콘텐츠 관리 기업) CEO 애런 레비는 이를 실무의 마지막 단계를 간과한 'AI 사이코시스'라 정의했다. AI는 숙련된 인력의 생산성을 높이는 도구

AI 모델의 안전성 확보는 개발사와 규제 기관의 핵심 쟁점이다. xAI 전 엔지니어 데빈 킴이 안전성 경고 후 부당 해고됐다며 소송을 제기했다. Grok의 혐오 표현 방치와 EU 규제 회피 시도가 소송의 핵심 근거다.