AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션
글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

누구나 계정 복구 메일을 바꿀 수 있는 보안 구멍이 메타 AI 봇에서 발견됐다. 공격자가 봇에게 요청해 복구 이메일을 변경하고 비밀번호를 초기화해 계정을 탈취했다. 로그인 단계의 MFA는 작동했지만, AI 봇이 관리하는 복구 경로에는 검증 장치가 없었

AI 스타트업 Quilty가 시나리오 분석을 통해 영화의 성공 여부를 예측하는 도구를 선보였습니다. 하지만 실제 사용자들 사이에서는 예측 정확도에 대한 회의적인 반응이 나오고 있습니다.

LLM에게 특정 시대의 글쓰기 스타일을 입히는 파인튜닝 실험이 진행됐다. 90년대 MS 매뉴얼 3,700만 단어를 학습시킨 결과, 7B 소형 모델이 당시 특유의 문서 구조를 정확히 흉내 냈다. RAG와 달리 스타일 전이에 집중한 이번 실험은 약 50달

AI 에이전트를 텍스트 메시지처럼 쉽게 사용하는 서비스가 늘고 있다. 스타트업 Poke가 애플 '메시지 포 비즈니스' 플랫폼에 첫 승인된 AI 에이전트가 됐다. 사용자당 과금 모델과 엄격한 UI 가이드라인 준수가 승인의 핵심 조건이었다.

고정된 취약점 목록 없이 스스로 타깃을 분석해 전파되는 자율형 AI 웜이 개발됐다. 오픈웨이트 sLLM을 감염 기기의 GPU에서 로컬로 구동하며 실시간 공격 전략을 수립한다. 테스트 결과 33개 호스트 중 약 62%를 감염시켰으며 학습 데이터 컷오프

코드 리뷰 자동화는 개발 생산성을 결정짓는 핵심 요소다. 알리바바가 2년간 수만 명의 개발자에게 검증한 Open Code Review를 오픈소스로 공개했다. 결정론적 설계와 LLM을 결합해 라인 단위의 정밀 리뷰와 보안 취약점 탐지를 수행한다.

OpenAI CTO 출신 미라 무라티가 설립한 Thinking Machines Lab이 공개됐다. 오픈소스 모델 파인튜닝 API 'Tinker'와 200ms 간격의 실시간 인터랙션 모델을 개발 중이다. 기존의 턴제 방식을 벗어나 인간의 대화 패턴을 실

한국 내 온라인 포럼들이 업로드되는 모든 이미지를 AI 검열 도구로 스캔해야 합니다. 불법 콘텐츠 유통을 차단하기 위한 강제 조치입니다.

뉴욕타임스 기자 라이언 맥이 저서 '캐릭터 리밋'을 통해 일론 머스크의 행보를 분석했습니다. SpaceX의 성장과 트위터 인수 이후의 변화가 머스크를 조 단위 달러 자산가로 이끄는 경로를 다룹니다.

AI가 단순 코딩 보조를 넘어 스스로를 설계하고 개선하는 단계로 진입하고 있습니다. Anthropic은 이미 내부 코드의 80% 이상을 Claude가 작성하며 개발 속도를 8배 높였습니다. 단순 구현을 넘어 연구 판단 영역까지 AI가 수행하며 'AI가

LLM 모델들이 서로 비슷해지며 기술적 차별화가 어려워진 환경이다. 이제는 모델 자체가 아니라 컨텍스트와 Eval 중심의 운영 체계가 핵심 경쟁력이다. 업무 매핑부터 피드백 루프까지 6단계의 AI-네이티브 전환 경로를 제시한다.

AI 인프라 경쟁이 가속화되며 데이터센터 구축 방식이 파격적으로 변하고 있다. Meta가 오하이오주에 12.5만 평방피트 규모의 텐트형 구조물 5동을 빠르게 구축했다. 공기 단축과 비용 절감을 위해 오프그리드 가스 터빈과 임시 구조물을 결합한 전략이다

LLM 에이전트의 고질적인 문제인 메모리 노이즈와 세션 휘발성을 해결하려는 시도가 계속되고 있다. 오픈소스 Show GN은 에이전트를 프롬프트가 아닌 파일 기반 레포지토리 구조로 설계해 런타임 독립성을 확보했다. 티켓 기반 메모리 승격 시스템과 PM

고성능 PC 조립의 필수 규격인 DDR5 32GB 메모리 가격이 급등하고 있다. AI 수요로 인한 제조 역량 부족으로 1년 전 100달러 미만이던 가격이 최저 374.97달러까지 올랐다. SSD 가격 역시 최대 5배 이상 상승하며 PC 하드웨어 전반의

LLM의 환각과 편향성은 이제 업계의 고질적인 문제로 자리 잡았다. 2020년 구글에서 해고된 팀닛 게브루의 '확률적 앵무새' 논문이 예견한 5가지 경고가 모두 현실화됐다. 데이터 오염으로 인한 모델 붕괴와 탄소 배출 급증 등 구조적 한계가 수치로 증

LLM의 긴 문맥 처리 시 발생하는 KV-캐시 메모리 부족은 추론 효율의 핵심 병목이다. 화웨이가 공개한 KVarN은 FP16 수준의 정확도를 유지하며 캐시 용량을 3~5배 확대한다. 별도 캘리브레이션 없이 플래그 설정만으로 vLLM에 즉시 적용 가능

투자자 케빈 오리어리가 유타주에 계획한 데이터센터 규모를 절반 수준으로 줄이기로 했습니다. 지역 주민과 환경 운동가들의 반대 압력이 거세지자 19,430에이커를 제외하기로 결정했습니다.

소프트웨어 취약점 분석은 전문가의 수작업과 많은 시간이 소요되는 영역이다. Anthropic이 Claude를 활용해 탐지부터 패치까지 자동화하는 오픈소스 레퍼런스를 공개했다. gVisor 샌드박스 기반의 7단계 파이프라인으로 C/C++ 메모리 취약점을

크리에이터들은 매번 복잡한 데이터 차트를 분석하며 업로드 시점을 고민합니다. 메타가 콘텐츠 스타일과 성과를 분석해 맞춤형 전략을 제안하는 AI 비서를 출시했습니다. AI 번역과 립싱크 기술을 결합해 주간 5억 명 이상의 글로벌 시청자를 확보합니다.

Angular가 v22 업데이트를 통해 AI 에이전트 중심의 개발 환경을 구축했다. Signal Forms와 Angular Aria 등 핵심 기능이 프로덕션 준비 상태로 승격됐다. OnPush를 기본 변경 감지 전략으로 채택하고 Webpack 지원을

LLM 에이전트의 실무 도입 시 가장 큰 걸림돌은 실행의 불안정성과 상태 관리다. 구글이 분산 에이전트 런타임 'Agent Executor(AX)'를 Apache 2.0 라이선스로 공개했다. 격리된 액터 구조와 이벤트 로그 기반의 자동 복구 기능을 통

구글 직원들이 내부 커뮤니티에서 자사 AI의 낮은 성능을 희화화하는 밈을 공유하고 있습니다. 세계 최고의 AI 기술력을 보유하고 있음에도 실제 제품의 완성도에 대한 내부 불만이 드러난 사례입니다.

애플이 WWDC 2026에서 시리의 대대적인 AI 업그레이드를 공개한다. 구글 제미나이를 활용해 문맥 이해와 멀티스텝 작업 수행 능력을 강화한다. 독립형 시리 앱과 앱스토어 AI 에이전트 통합으로 서비스 생태계를 확장한다.

아마존이 코딩 없이 언어로 상호작용하는 자율 주행 창고 로봇 '프로테우스'의 새 버전을 공개했습니다. AI 기반 업그레이드를 통해 현장 작업자가 말로 직접 업무를 지시할 수 있게 되었습니다.

AI 에이전트의 권한이 커질수록 사고 발생 시 피해 범위인 '폭발 반경'도 함께 넓어진다. Anthropic은 단순 승인 절차의 한계를 깨닫고 gVisor와 OS 샌드박스를 통한 물리적 격리를 도입했다. 설정 파일 자동 실행과 프롬프트 인젝션을 통한

내 노트북이나 스마트폰에서 AI를 돌리려면 모델 크기와 처리 속도가 가장 중요하다. 구글이 별도의 데이터 변환 과정 없이 오디오와 비디오를 직접 처리하는 Gemma 4를 공개했다. 12B 모델 기준 인코더 프리 구조를 채택해 배포 크기를 줄이고 온디바

아마존이 쇼핑 앱 검색창에 AI 생성 이미지를 도입한다. 사용자가 적절한 검색어를 모를 때 AI 이미지를 선택해 원하는 스타일의 상품으로 연결한다. 리뷰 요약, 알렉사 쇼핑 등 기존 AI 기능에 이어 시각적 탐색 영역까지 확장한 조치다.

우버가 올해 AI 예산을 4개월 만에 소진하며 코딩 에이전트 비용 관리에 나섰다. 직원 1인당 특정 AI 도구 사용액을 월 1,500달러로 제한하는 정책을 도입했다. 이는 엔지니어 평균 연봉의 약 11%에 해당하는 금액으로 실질적인 비용 가치를 보

UC 버클리 컴퓨터공학 수업에서 AI 도구 활용이 늘면서 학생들의 낙제율이 크게 올랐습니다. 기초 수학 역량 저하가 원인으로 지목되며 교육 현장의 AI 도입 전략에 제동이 걸렸습니다.

코딩 진입장벽을 낮추는 '바이브 코딩'이 기업 시장의 핵심 도구로 부상하고 있다. 스톡홀름 스타트업 Lovable이 구글 클라우드와 다년 계약을 맺고 AI 인프라 사용량을 5배 늘린다. Gemini와 Claude 모델을 동시에 활용하며 Wiz 보안 솔