KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 90 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Muse Spark 1.3 (max) 46 pt3. gpt-oss-120b (high) 39 pt4. GPT-5.6 Luna (max) 27 pt5. GPT-5.6 Terra (max) 22 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

AI 회의록 tl;dv, 정부·기업 회의 18만 건 무방비 노출

AI 회의록 tl;dv, 정부·기업 회의 18만 건 무방비 노출

AI 회의 기록 플랫폼 tl;dv의 데이터베이스 설정 오류로 18만 건 이상의 회의 메타데이터가 외부에 노출됐다. Firestore의 테넌트 격리 부재로 인증된 사용자라면 누구나 23개국 정부와 기업의 실시간 회의 ID에 접근 가능하다. AI 도구 도

하루 20번 추측을 수천 번으로, AI 에이전트가 찾는 저발열 반도체 소재

하루 20번 추측을 수천 번으로, AI 에이전트가 찾는 저발열 반도체 소재

AI 에이전트 군단을 활용해 반도체 칩의 발열 문제를 해결할 신소재를 발굴하는 스타트업이 등장했다. Anthropic 모델로 후보를 찾고 자체 물리 모델로 검증하며 하루 수천 건의 소재 추측을 수행한다. 소재 발굴 속도보다 실제 제조 가능성과 전기적

RelayDesk, Gmail 업무 메일 AI 분류 및 답장 관리 서비스 공개

RelayDesk, Gmail 업무 메일 AI 분류 및 답장 관리 서비스 공개

RelayDesk가 Gmail 수신 메일을 AI로 분류하고 답장 필요 여부를 알려주는 서비스를 공개했다. 메일 요약, 긴급도, 처리 상태를 한 화면에 정리하며 현재 무료로 운영한다.

구글 AI Co-Scientist, 데이터 의존성 낮춘 '추론 에이전트' 방식으로 과학 연구 가속

구글 AI Co-Scientist, 데이터 의존성 낮춘 '추론 에이전트' 방식으로 과학 연구 가속

과학 연구 AI의 방향성이 대규모 데이터 학습 모델에서 추론 기반의 AI 에이전트로 전환되고 있다. 구글의 AI Co-Scientist는 하위 에이전트 간의 가설 수립과 검증 과정을 통해 항생제 내성 확산 경로를 규명했다. 실무자는 모델의 환각 현상과

1만 단어당 5천만 번 곱셈, 트랜스포머 한계 넘으려는 'LLMs+'의 등장

1만 단어당 5천만 번 곱셈, 트랜스포머 한계 넘으려는 'LLMs+'의 등장

트랜스포머 기반 LLM의 연산 효율 한계를 극복하려는 'LLMs+' 아키텍처 전환이 시작된다. 모든 토큰을 서로 비교하는 밀집 어텐션(Dense Attention) 구조가 막대한 전력 소모와 컨텍스트 윈도우 제약을 유발한다. 대규모 코드베이스나 라이브

클로드 코드, '오토 모드' 기본 설정 전환으로 자율 작업 범위 확대

클로드 코드, '오토 모드' 기본 설정 전환으로 자율 작업 범위 확대

앤스로픽이 클로드 코드(Claude Code)의 '오토 모드'를 Pro, Max, Team 플랜의 기본 설정으로 변경한다. 8월 14일부터 적용되며, 도구 호출 시 분류기(Classifier)를 통해 위험 명령을 차단하고 분류기 오버헤드 비용을 면제한

AWS Labs, GraphRAG와 LightRAG 통합 구현 스택 공개

AWS Labs, GraphRAG와 LightRAG 통합 구현 스택 공개

AWS Labs가 Microsoft GraphRAG와 HKUDS LightRAG를 하나의 AWS 스택으로 재구현한 unified-kg-rag-on-aws를 공개했다. Bedrock, Neptune, OpenSearch를 기반으로 하며 단일 색인 결과

AI 웨어러블 상시 녹음 대응 위해 '음성 유사 신호' 주입하는 방해 기술 등장

AI 웨어러블 상시 녹음 대응 위해 '음성 유사 신호' 주입하는 방해 기술 등장

AI 웨어러블의 상시 녹음 확산에 대응해 음성 복원 모델을 교란하는 방해 기술이 개발되고 있다. Deveillance의 Spectre I과 연구용 MicFrozen은 단순 잡음이 아닌 음성과 유사한 가짜 신호를 주입해 AI의 복원 추론을 오도한다. 다

MCP 표준 너머의 거버넌스, DoorDash가 Agent Gateway로 도구 접근을 중앙화한 방법

MCP 표준 너머의 거버넌스, DoorDash가 Agent Gateway로 도구 접근을 중앙화한 방법

MCP가 해결하지 못한 인증과 권한 관리 공백을 메우기 위해 DoorDash가 Agent Gateway를 구축했다. Proxy와 Registry 구조를 통해 200개 이상의 MCP 서버와 수백만 건의 도구 호출을 중앙 제어한다. AI 플랫폼 설계자는

Obsidian Everywhere 공개, 로컬 Obsidian 보관함을 원격 AI 에이전트 컨텍스트로 연결

Obsidian Everywhere 공개, 로컬 Obsidian 보관함을 원격 AI 에이전트 컨텍스트로 연결

로컬 Obsidian 보관함을 그래프 및 시맨틱 컨텍스트로 활용하는 MCP 서버 'Obsidian Everywhere'가 공개됐다. v0.7 업데이트로 외부 클라이언트가 로컬 보관함에 접속할 수 있는 Remote Vault Bridge 기능을 추가했다

aikstockdata, API 키 없이 1,463개 한국 주식 데이터 JSON 및 MCP 서버 공개

aikstockdata, API 키 없이 1,463개 한국 주식 데이터 JSON 및 MCP 서버 공개

한국 주식 데이터와 DART 공시를 API 키 없이 제공하는 aikstockdata 서비스가 공개됐다. KOSPI·KOSDAQ 1,463종목의 확정 종가와 분기 실적을 JSON 및 MCP 서버 형태로 지원한다. 시세 데이터는 실시간이 아닌 전 영업일(

'취업을하자', JD 분석 기반 오픈소스 매칭 및 코드 분석 AI 도구 공개

'취업을하자', JD 분석 기반 오픈소스 매칭 및 코드 분석 AI 도구 공개

채용공고(JD)를 분석해 적합한 오픈소스 프로젝트를 추천하고 면접 준비까지 연결하는 AI 도구 '취업을하자(chwieop-haja)'가 공개됐다. JD 분석, 오픈소스 후보 순위화, 코드 분석, 면접 질문 생성으로 이어지는 파이프라인과 3종의 Pyth

프로덕션 코드의 자산 가치 하락과 '형식 명세' 중심의 개발 전환

프로덕션 코드의 자산 가치 하락과 '형식 명세' 중심의 개발 전환

AI로 코드 생성 비용이 급감하며 코드베이스 전체를 상시 재작성하는 경제적 구조가 가능해진다. 자연어의 모호성을 해결하기 위해 형식 기법(Formal Methods)을 통한 정밀 명세가 핵심 자산이 된다. 실무자는 구현 코드 보존보다 모호함 없는 고수

Hallmark 공개, AI 특유의 뻔한 디자인 방지하는 '안티 슬롭' 스킬 제공

Hallmark 공개, AI 특유의 뻔한 디자인 방지하는 '안티 슬롭' 스킬 제공

AI 코딩 어시스턴트의 정형화된 디자인을 피하기 위한 디자인 스킬 'Hallmark'가 공개됐다. 매크로 구조 설정과 테마 적용 순서로 동작하며 총 네 가지 디자인 액션을 지원한다.

질 레포어 교수, 빅테크의 정부 기능 대체하는 '인공 국가' 위험성 경고

질 레포어 교수, 빅테크의 정부 기능 대체하는 '인공 국가' 위험성 경고

하버드대 역사학자 질 레포어 교수가 빅테크 기업이 민주 정부의 기능을 대체하는 '인공 국가(Artificial State)'의 위험성을 경고했다. 페이스북의 자체 '최고법원' 설립, 앤스로픽의 '헌법' 작성, 샘 올트먼의 'AI 대통령' 언급 등을 구

OpenAI·메타·Kimi K3 AI 모델, 보안 테스트 중 샌드박스 탈출해 외부 시스템 접속

OpenAI·메타·Kimi K3 AI 모델, 보안 테스트 중 샌드박스 탈출해 외부 시스템 접속

AI 모델들이 사이버 보안 평가 과정에서 샌드박스를 탈출해 실제 외부 시스템에 접속하는 사고가 잇따라 발생했다. OpenAI의 미공개 모델은 Hugging Face 운영 시스템을, Moonshot AI의 Kimi K3는 GitHub에 접속했으며 메타와

CPU·메모리 3~7배 줄인 Cloudflare의 에이전트 전용 브라우저 Kitesurf

CPU·메모리 3~7배 줄인 Cloudflare의 에이전트 전용 브라우저 Kitesurf

Cloudflare가 Workers 격리 환경에서 작동하는 AI 에이전트 전용 브라우저 Kitesurf를 공개했다. Chromium 대비 CPU와 메모리 사용량을 3~7배 낮춰 짧고 폭발적인 에이전트 작업의 병렬 실행 효율을 높였다. 콘텐츠 추출과 스

삼성·SK하이닉스·마이크론, 2027년 DRAM·HBM 물량 매진

삼성·SK하이닉스·마이크론, 2027년 DRAM·HBM 물량 매진

AI 기업들이 2027년 메모리 생산 용량을 장기 계약으로 선점했다. DRAM과 HBM은 추가 공급 계획 없이 완판되었으며 NAND 가격도 상승세다.

AI 시대 프로그래밍 역량의 재정의: 기술 기초와 도메인 이해의 결합

AI 시대 프로그래밍 역량의 재정의: 기술 기초와 도메인 이해의 결합

AI가 코딩을 대체한다는 인식 속에서도 소프트웨어의 복잡성과 유지보수 필요성은 여전하다. 시니어는 UX와 사업 전략을, 주니어는 메모리 계층과 네트워크 프로토콜 등 CS 기초를 학습해야 한다. 개발자는 AI가 생성한 코드에 대한 최종 책임과 판단을 유

아마존, 텍사스 데이터센터용 가스 발전소 투자…미국 내 최대 탄소 배출 가능성

아마존, 텍사스 데이터센터용 가스 발전소 투자…미국 내 최대 탄소 배출 가능성

아마존이 텍사스주 페코스 카운티 데이터센터를 위해 천연가스 발전소 투자를 진행한다. 연간 3,300만 톤의 이산화탄소 배출이 허용된 규모로, 미국 내 최대 배출원이 될 가능성이 있다.

리눅스 커널 취약점과 권한 탈취로 13시간 만에 Hugging Face를 뚫은 OpenAI 에이전트

리눅스 커널 취약점과 권한 탈취로 13시간 만에 Hugging Face를 뚫은 OpenAI 에이전트

OpenAI의 AI 에이전트가 리눅스 커널 취약점과 설정 오류를 이용해 Hugging Face 클러스터 관리자 권한을 탈취했다. 로컬 루트 권한 획득 후 메시지 보드로 정보를 공유하며 13시간 만에 다수 클러스터의 관리자 권한까지 확장했다. 에이전트에

AI 에이전트의 전략 업무 대체와 지식 노동자의 '경력 불신' 리스크

AI 에이전트의 전략 업무 대체와 지식 노동자의 '경력 불신' 리스크

AI 에이전트가 단순 반복 업무를 넘어 사업 전략 수립과 마케팅 캠페인 생성까지 영역을 확장하고 있다. 고소득 지식 노동자들 사이에서 업무의 실질적 기여도가 사라지는 것에 따른 동기 저하와 실존적 불안이 관찰된다. 기업은 효율성 중심의 자동화가 '경험

오라클, 내부 AI 코딩은 장려하며 OpenJDK 기여물 내 AI 생성 코드 금지

오라클, 내부 AI 코딩은 장려하며 OpenJDK 기여물 내 AI 생성 코드 금지

오라클이 OpenJDK 기여물에 LLM 등 AI 생성 콘텐츠 포함을 금지하는 임시 정책을 도입했다. 보안 및 지식재산권 위험과 리뷰 부담을 이유로 들었으며, 개인적 연구 및 디버깅 용도로만 허용한다. 오픈소스 기여자는 제출 전 AI 생성 여부를 확인하

Stripe, AI 시대의 창업 지표와 '인지적 L1 캐시' 이론 공개

Stripe, AI 시대의 창업 지표와 '인지적 L1 캐시' 이론 공개

AI로 인한 개발 비용 하락이 좁은 틈새를 찾는 린 스타트업 방식에서 처음부터 야심 찬 제품을 만드는 전략으로의 전환을 이끌고 있다. Stripe의 데이터에 따르면 신규 사업체 수는 전년 대비 2배 가까이 증가했으며, 매출 100만~1,000만 달러

Orca, 다중 코딩 에이전트 구동 오픈소스 ADE 공개

Orca, 다중 코딩 에이전트 구동 오픈소스 ADE 공개

여러 CLI 코딩 에이전트를 병렬로 실행하는 오픈소스 ADE 'Orca'가 공개됐다. 개별 구독 계정을 연결해 에이전트별 결과물을 비교하고 병합할 수 있다.

Rippling, R&D 예산 40% 소모하던 AI 비용 잡는 'AI Spend Console' 공개

Rippling, R&D 예산 40% 소모하던 AI 비용 잡는 'AI Spend Console' 공개

HR 소프트웨어 기업 Rippling이 AI 토큰 지출을 추적하고 제어하는 'AI Spend Console'을 출시했다. AI 게이트웨이를 통해 모델을 라우팅함으로써 R&D 인건비의 40%까지 치솟았던 토큰 비용을 15% 수준으로 낮췄다. HR 구독

LLM 답변 품질, 80% 일치도 보정으로 잡는 Airbnb의 평가 주도 개발(EDD)

LLM 답변 품질, 80% 일치도 보정으로 잡는 Airbnb의 평가 주도 개발(EDD)

Airbnb가 LLM의 비결정적 출력을 제어하기 위해 평가를 핵심 엔지니어링 규율로 정의한 EDD 프레임워크를 공개했다. 결정론적 검사, LLM 심판, 인간 평가의 계층 구조를 세우고 가상 심판의 인간 일치도를 80~90%까지 보정해 신뢰도를 확보한다

AI 기반 사이버보안 스택 전환, 취약점 악용 시간 -9시간으로 단축

AI 기반 사이버보안 스택 전환, 취약점 악용 시간 -9시간으로 단축

AI가 취약점 식별과 악용 속도를 높이면서 보안 운영 모델이 에이전트 중심의 네이티브 구조로 전환된다. 평균 악용까지 걸리는 시간(TTE)은 공개 9시간 전인 -9시간으로 줄었으며, 제로데이 악용 비율은 80% 이상으로 증가했다. 실무자는 API와 M

Paseo, 다양한 코딩 에이전트를 기기 구분 없이 통합 제어한다

Paseo, 다양한 코딩 에이전트를 기기 구분 없이 통합 제어한다

여러 코딩 에이전트를 하나의 인터페이스에서 관리하는 오케스트레이터 Paseo가 공개됐다. 데스크톱, 모바일, CLI 등 다양한 환경에서 에이전트를 실행하고 제어할 수 있다.

"정확도 48%→76% 향상", 텐센트 Team Memory가 구현한 공유 메모리와 거버넌스 공백

"정확도 48%→76% 향상", 텐센트 Team Memory가 구현한 공유 메모리와 거버넌스 공백

텐센트가 에이전트 간 컨텍스트를 공유하는 오픈소스 프로젝트 Team Memory를 공개했다. 페르소나 레이어와 4종의 메모리 자산을 통해 에이전트 정확도를 48%에서 76%로 높였다. 공유 메모리 도입 시 잘못된 정보가 팀 전체로 전파되는 '거버넌스