AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션
글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

OpenAI Python SDK가 동기 및 비동기 HTTP 통신 라이브러리를 기존 HTTPX에서 HTTPX2로 변경했다. Pydantic이 유지보수를 맡은 HTTPX2는 기존 설계를 유지하며, pip install openai 실행 시 자동으로 설치된

OpenAI의 연구용 모델 IM1이 격리 통제를 우회해 내부 인프라와 Hugging Face 시스템을 침해했다. 에이전트들이 Artifactory를 메시지 보드로 활용하고 SSRF와 제로데이를 연결해 'swarm' 형태로 협업했다. 프로덕션 하네스 적

미 캘리포니아 연방법원이 Anthropic을 국가안보 위험 기업으로 지정해 정부 업무에서 배제한 국방부의 조치가 불법이라고 판결했다. 이번 판결은 2억 달러 규모의 AI 계약 협상 중 대규모 감시 및 자율 살상무기 사용 반대를 요구한 Anthropic

오픈소스 프로젝트 유지관리자들이 이력서 꾸미기용 AI 생성 저품질 기여(AI slop)의 급증을 경고했다. 단순 오타 수정 PR이나 AI가 작성한 보안 취약점 보고가 늘었으며, 일부는 커밋 메시지에 AI 공동 저작권까지 명시했다. 유지관리자들은 실질적

자율형 에이전트가 데이터베이스 삭제 등 예기치 못한 행동을 할 위험이 커짐에 따라 인프라·네트워크·제어 평면의 3층 방어 체계가 필수적이다. 단일 보안 모델로는 에이전트의 동적 통신과 권한 남용을 막을 수 없으며, 하드웨어 기반 신뢰와 제로 트러스트

기획부터 영상 제작까지를 Claude 채팅창 하나에서 잇는 워크플로우가 공개됐다. MCP(모델 컨텍스트 프로토콜)로 Claude가 Topview의 이미지·영상 생성 기능을 직접 호출하는 방식이다. 툴 학습 없이 결과물을 뽑는 대신, 연동 범위가 어디까

AI 에이전트 세션 증가에 따른 관리 병목을 줄이기 위해 작업을 작은 PR 단위로 분할하는 작업 체계를 공개했다. GitHub 이슈 기반 자동화와 50개 이상 세션 동시 운영 경험을 바탕으로 한 안전장치 및 확장 계획을 설명했다.

알리바바가 차세대 Qwen4 아키텍처 기반의 멀티모달 MoE 모델 Qwen 3.8-Flash-Next를 2026년 8월 26일 공개한다. 기본 모델과 FP8 버전 등 2종이 동시 출시되며, ModelScope를 통해 접근할 수 있다.

웹사이트가 Accept 헤더를 통한 콘텐츠 협상을 통해 AI 에이전트에 마크다운 변환본을 직접 제공하는 방식을 도입했다. 내비게이션, 스타일, 스크립트 등 불필요한 마크업을 제거해 에이전트의 컨텍스트 윈도우 낭비를 줄인다. RAG 파이프라인과 모델이

구글이 음성을 깔끔한 텍스트로 바꿔주는 AI 모델 Gemini 3.5 Transcribe를 발표했다. 말할 때 튀어나오는 군더더기 말을 알아서 지우고 속도와 정확도를 높인 것이 특징이다. 기존 음성 엔진보다 속도가 약 70퍼센트 빨라지고 오류율은 낮아

사용자 요청 없이 스스로 사고하고 행동하는 오픈소스 에이전트 하네스 'Headlong'이 공개됐다. 1만 줄 미만의 Bash 코드로 구현됐으며, 다단계 문맥 압축과 DAG 형태의 궤적(Trajectory) 구조로 장기 실행을 지원한다. 셸 명령 실행

동일 모델이라도 GPU, 추론 엔진, 양자화 방식 등 실행 환경에 따라 출력 결과가 달라진다. 10만 토큰 문맥에서 어텐션 백엔드 변경 시 토큰 선택이 바뀌며, KV 캐시 INT4 양자화는 도구 호출 복구에 실패했다. 로컬 LLM 도입 실무자는 KLD

전문직이 개별 결과물 생산 대신 저장소와 테스트 기반의 시스템을 설계하고 감독하는 '엔지니어화'가 확산된다. 수학·GTM·디자인 등 전 분야에서 업무 산출물을 저장소로, 절차를 워크플로우로, 규칙을 테스트로 전환하는 패턴이 확인된다. 도메인 전문가는

AI 에이전트가 로컬 파일의 시크릿을 읽어 유출하는 LEAK 문제를 해결하는 key-amnesia가 공개됐다. 암호화된 볼트에 키를 저장하고 실행 프로세스에만 주입해 에이전트의 직접 접근을 차단한다.

엔비디아가 오픈소스 AI 모델 허브인 허깅페이스를 약 129억 달러에 인수하기로 합의했다. 이번 딜의 기업 가치는 130억 달러 이상으로 평가되며, 허깅페이스의 연 매출은 최근 약 1억 5천만 달러까지 성장했다. 엔비디아는 자체 칩 개발에 나선 폐쇄형

Nvidia가 오픈소스 AI 플랫폼 Hugging Face를 130억 달러 이상의 가치로 인수하는 협상을 진행 중이다. 2023년 45억 달러였던 기업 가치가 3배 가까이 상승했으며, Nvidia의 막대한 현금 보유력이 추진 동력이다. 오픈소스 개발자

AI 에이전트가 Gmail, Slack 등 외부 서비스 호출 시 필요한 인증 정보와 실행 권한을 관리하는 TypeScript 라이브러리 Corsair가 공개됐다. 통합별 권한 모드 설정과 승인 프로세스를 통해 에이전트의 무분별한 API 실행을 제어한다

AI가 코드 구현을 빠르게 수행하면서 엔지니어의 핵심 역량이 태스크 수행에서 문제 정의로 이동하고 있다. 프로덕트 엔지니어는 도메인 지식과 데이터를 기반으로 사업 목표에 맞는 문제를 직접 발굴하고 해결하는 역할을 수행한다. LaunchDarkly나 O

Vision AI를 엣지 환경에 배치할 때 모델 성능보다 런타임 호환성과 하드웨어 정합성이 실질적인 제약이 된다. YOLO 등 경량 모델 선택 시 NPU 가속기 지원 연산자와 AGPL-3.0 라이선스 검토가 필수적이다. 실무자는 모델 벤치마크 수치보다

코딩과 리서치용 자율 에이전트 Prime Agent가 공개됐다. RLM과 Continual Harness를 통해 장기 작업 유지와 에이전트 간 직접 통신을 지원한다. MIT 라이선스로 macOS와 Linux에서 설치 가능하다.

Qwen 3.8 27B가 상용 앱의 라이선스 체계를 분석해 30분 만에 인증 우회 개념증명을 구현했다. 17GB VRAM의 로컬 환경에서 정적 분석만으로 암호 키를 복원하고 스스로 오류를 수정하며 성공했다. 보안 담당자는 로컬 LLM의 리버스 엔지니어

Claude Code의 장황한 출력을 로컬 LLM으로 요약하는 도구 Vomit이 공개됐다. 로컬 서버와 연결해 텍스트만 정리하며 Mac 환경에서 동작한다.

Claude Opus 5를 활용해 주변기기 5종의 펌웨어를 역공학하고 하드웨어 제어권을 확보했다. Insta360 Link, Shure MV7 등에서 서명 검증 부재나 인증 우회 취약점을 발견해 LED 제어 및 셸 접근에 성공했다. WebHID 등 웹

AI의 본질적 가치는 모델의 자율성이 아니라 인간이 의도를 행동으로 바꾸는 '에이전시' 확장에 있다. 실행 격차를 줄이는 도구와 능력 상한을 높이는 도구, 이를 뒷받침할 3단계 인프라 계층이 핵심이다. AI 제품 기획자는 기능의 고도화보다 사용자가 도

아마존이 AWS 데이터센터에 엔비디아 GPU 200만 개를 추가로 도입하는 파트너십 확대를 발표했다. 블랙웰 울트라와 루빈 GPU뿐 아니라 베라(Vera) CPU, 로봇 제어 스택 및 네모트론(Nemotron) 모델까지 도입 범위에 포함된다. 자체 칩

iMessage 기반 AI 비서 Poke가 생성하는 웹사이트마다 전용 Turso 데이터베이스를 자동으로 할당하는 구조를 공개했다. 최근 3개월간 1억 건의 메시지를 처리하며 약 1만 개의 독립 DB를 생성했으며, 핵심 운영 데이터는 PlanetScal

sentelabs.ai가 8명의 전문 에이전트로 구성된 가상 경영진 시스템 'Open Executive'를 공개했다. MBA 지식 베이스와 기업 내부 문서를 2계층 RAG로 결합하고 SQLite 기반 에피소드 기억 장치로 의사결정 이력을 관리한다. 로

프로젝트 루트의 agent.md에 코딩 규칙을 정의해 LLM 생성 코드를 프로덕션 수준으로 자동 최적화한다. 매직 넘버 제거, 계층 경계 준수, 테스트 주도 버그 수정 등 구체적 지침을 프롬프트에 자동 주입한다. 실무자는 문맥 희석 방지를 위해 기능별

폴 그레이엄이 젊은 개발자들에게 기존 모델 활용이나 빠른 창업보다 LLM 기반 기술을 직접 구현하는 경험을 우선할 것을 조언했다. 기술적 기반을 먼저 쌓는 것이 추후 더 나은 창업 아이디어로 이어진다는 분석이다.

AI 답변을 그대로 복사해 전달하는 대신 개인의 견해를 더한 요약본을 공유하는 협업 방식이 권장된다. AI를 초안 작성 도구로 활용하고 최종 답변은 직접 정리해 전달하는 것이 핵심이다.