KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. Wan 3.0 85 pt5. gemini-omni-1.1-flash 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Muse Spark 1.3 (max) 44 pt3. gpt-oss-120b (high) 36 pt4. GPT-5.6 Luna (max) 28 pt5. GPT-5.6 Terra (max) 21 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

파이썬 기초 지식과 무료 AI 3개로 구현한 1.09B 한국어 LLM 파이프라인

파이썬 기초 지식과 무료 AI 3개로 구현한 1.09B 한국어 LLM 파이프라인

중학교 2학년 학생이 무료 LLM 3종을 교차 활용해 1.09B 규모의 한국어 LLM 학습 파이프라인을 구현했다. Llama 3 구조와 8비트 AdamW 등 VRAM 최적화 기법을 적용했으며, 9GB GPU 환경에 맞춘 강제 휴식 코드를 포함했다. 기

구글 제미나이, 기능별 개별 브랜딩 도입 및 인터페이스 파편화

구글 제미나이, 기능별 개별 브랜딩 도입 및 인터페이스 파편화

구글이 음성 명령으로 다양한 작업을 수행하는 제미나이 라이브(Gemini Live)의 신규 기능을 공개했다. 제미나이 앱 내에서 개인 맞춤형 업데이트를 제공하는 '데일리 브리프'와 실행 에이전트인 '스파크'를 별도 브랜드로 구분해 운영한다. 사용자는

125B 규모를 6B로 가동하는 Qwen3.8-Flash-Next, 롱컨텍스트 지연 시간 잡았다

125B 규모를 6B로 가동하는 Qwen3.8-Flash-Next, 롱컨텍스트 지연 시간 잡았다

Qwen 팀이 롱컨텍스트 처리 지연 시간을 줄인 실험적 모델 Qwen3.8-Flash-Next를 공개했다. 125B 파라미터 중 6B만 활성화하는 MoE 구조와 하이브리드 어텐션을 통해 연산 효율을 극대화했다. 에이전트 기반 워크로드를 구축하는 개발자

Tenet Security, AI 에이전트가 로그 속 명령어를 실행하는 'GhostJacking' 취약점 공개

Tenet Security, AI 에이전트가 로그 속 명령어를 실행하는 'GhostJacking' 취약점 공개

Tenet Security가 AI 에이전트가 시스템 로그에 포함된 프롬프트 주입 공격을 명령어로 오인해 실행하는 'GhostJacking' 취약점을 공개했다. Claude Code(Sonnet 4.6)는 Cloudflare 권장 설정 환경에서 10번의

세일즈포스, 클로드 내 CRM 통합으로 '헤드리스' 인터페이스 전환

세일즈포스, 클로드 내 CRM 통합으로 '헤드리스' 인터페이스 전환

세일즈포스와 앤스로픽이 CRM 플랫폼을 클로드(Claude) 내부로 직접 통합하는 '클라우드포스(Claudeforce)' 파트너십을 발표했다. 클로드 코워크(Claude CoWork) 플러그인을 통해 미팅 준비, 딜 상태 검토 등 37개의 사전 구축된

AI 에이전트의 '오디오 맹점' 지우는 Radar, 13만 개 팟캐스트 인덱싱 공개

AI 에이전트의 '오디오 맹점' 지우는 Radar, 13만 개 팟캐스트 인덱싱 공개

Particle이 13만 개 이상의 팟캐스트를 인덱싱해 AI 에이전트가 검색 가능한 Radar를 출시했다. 매일 2만 개의 에피소드를 추가하며 화자 식별, 엔티티 분석, 광고 추적 데이터를 API로 제공한다. 오디오 데이터를 실시간으로 수집해 투자 판

AI가 짠 연결은 내 지식이 아니다: Obsidian AI 자동화의 함정과 경계

AI가 짠 연결은 내 지식이 아니다: Obsidian AI 자동화의 함정과 경계

AI로 노트 요약과 연결을 자동화하는 방식이 개인 지식 체계의 통찰력을 저해하는 '데드엔드'가 될 수 있다. Obsidian CLI와 Smart Connections를 통한 검색 효율은 높지만, AI 생성 텍스트가 섞인 'AI 슬롭'은 인간의 사고 과

빌 게이츠, AI 노동 대체 늦추는 '로봇세'와 '인간 전용 직무' 제안

빌 게이츠, AI 노동 대체 늦추는 '로봇세'와 '인간 전용 직무' 제안

빌 게이츠가 AI로 인한 노동 시장의 충격을 완화하기 위해 로봇세 도입과 인간 전용 직무 설정을 제안했다. 기업이 로봇 도입 시 세제 혜택을 받는 현재 구조를 바꾸고, 경제적·정서적 이유로 AI 사용이 금지된 영역을 지정하자는 내용이다. 이 제안은 사

10분의 1 비용으로 구현하는 에이전트, GLM-5.3-Flash의 18B 활성 파라미터 전략

10분의 1 비용으로 구현하는 에이전트, GLM-5.3-Flash의 18B 활성 파라미터 전략

네이티브 멀티모달 모델 GLM-5.3-Flash가 공개되었다. 320B 파라미터 중 18B만 활성화하는 구조와 하이브리드 어텐션으로 운영 비용을 10분의 1로 낮췄다. 저비용으로 Claude Opus 4.8 수준의 코딩 에이전트를 구축하려는 실무자는

이스라엘, 가짜 씽크탱크 세워 AI 챗봇 답변 조작 시도

이스라엘, 가짜 씽크탱크 세워 AI 챗봇 답변 조작 시도

이스라엘 정부가 AI 챗봇의 답변을 유리하게 유도하기 위해 가짜 씽크탱크를 설립하고 대규모 콘텐츠를 배포했다. 9일 만에 124건의 보고서와 56만 단어를 쏟아냈으며, AI 최적화 플랫폼 'Res'를 통해 생성형 엔진 최적화(GEO)를 수행했다. AI

QueryStory, 600만 달러 투자 유치하며 기업용 AI 데이터 분석 플랫폼 공개

QueryStory, 600만 달러 투자 유치하며 기업용 AI 데이터 분석 플랫폼 공개

기업용 AI 데이터 분석 플랫폼 QueryStory가 스텔스 모드를 마치고 공식 출시됐다. Brightmind Ventures와 New York Life Ventures로부터 600만 달러의 시드 투자를 유치했으며 기업 가치는 6,000만 달러로 평가

Runable, 2,100만 달러 투자 유치하며 '비즈니스 성장' AI 에이전트로 확장

Runable, 2,100만 달러 투자 유치하며 '비즈니스 성장' AI 에이전트로 확장

인도 스타트업 Runable이 2,100만 달러의 시리즈 A 투자를 유치했다. 웹사이트 제작을 넘어 광고 집행과 고객 유치까지 수행하는 비즈니스 성장 에이전트로 영역을 넓힌다. 170만 명의 사용자를 확보했으나 광고 계정 연결과 같은 외부 인프라 통합

RAG 구축 전략: BM25에서 전체 사전 임베딩까지 단계별 선택 기준

RAG 구축 전략: BM25에서 전체 사전 임베딩까지 단계별 선택 기준

RAG 시스템 구축 시 데이터 특성과 규모에 따라 BM25, 쿼리 재작성, 하이브리드 검색 중 최적의 경로를 선택하는 가이드라인이 제시됐다. 단순 키워드 검색(BM25)은 10ms 미만의 지연시간을 제공하며, GPT-4o-mini를 활용한 쿼리 재작성

월 2,000만 건 통화 처리하는 Ringg, '단순 음성' 버리고 '업무 완결' 오케스트레이션 선택

월 2,000만 건 통화 처리하는 Ringg, '단순 음성' 버리고 '업무 완결' 오케스트레이션 선택

인도 Voice AI 스타트업 Ringg가 Peak XV로부터 1,000만 달러를 추가 투자 유치했다. 단순 아웃바운드 콜에서 의료 예약·KYC 등 복잡한 워크플로우를 처리하는 오케스트레이션 레이어로 진화했다. 모델 성능 경쟁보다 고객 관계와 업무 완

라즈베리 파이 5와 Qwen 35B 모델 기반 로컬 자동차 AI 'CarWatch' 공개

라즈베리 파이 5와 Qwen 35B 모델 기반 로컬 자동차 AI 'CarWatch' 공개

라즈베리 파이 5와 Qwen 모델을 결합해 오프라인으로 작동하는 자동차 AI 'CarWatch'가 공개됐다. 16GB 램의 하드웨어에서 35B 파라미터 모델을 로컬로 구동하며, 블랙박스와 연동해 주행 요약 및 사고 영상을 전송한다. 약 300유로의 구

OpenAI, 데이터센터 수장 포함 임원 13명 이탈... IPO 2027년으로 연기

OpenAI, 데이터센터 수장 포함 임원 13명 이탈... IPO 2027년으로 연기

데이터센터 전략 수장 크리스 말론을 포함해 올해 총 13명의 핵심 임원이 OpenAI를 떠났다. 인프라 조직 개편과 리스크 관리 팀 해체가 이어지며 IPO 일정이 2027년으로 밀렸다. 인프라 파트너십을 맺은 기업과 실무자는 리더십 공백에 따른 전략

구글, 법률 전용 '제미나이 엔터프라이즈 포 리걸' 공개... MCP 커넥터로 데이터 권한 유지

구글, 법률 전용 '제미나이 엔터프라이즈 포 리걸' 공개... MCP 커넥터로 데이터 권한 유지

구글이 법률 업무에 특화된 '제미나이 엔터프라이즈 포 리걸(Gemini Enterprise for Legal)'을 프리뷰로 공개했다. MCP 커넥터를 통해 iManage, NetDocuments 등 기존 법률 시스템의 권한 설정을 그대로 유지하며 계약

보안 인력 파업 가능성에 샌프란시스코 전 직원 재택 근무 지시한 Anthropic

보안 인력 파업 가능성에 샌프란시스코 전 직원 재택 근무 지시한 Anthropic

Anthropic이 보안 인력 파업 가능성으로 샌프란시스코 오피스 직원에게 재택 근무를 지시했다. 보안 업체 Allied Universal의 파업 통보가 발단이 되었으나, 노조(SEIU)는 파업 투표 사실을 부인한다. 고평가된 AI 기업일수록 외부 보

OpenAI '잘라페뇨' 공개, 전성비(perf/W)로 블랙웰 앞선 추론 전용 칩의 실효성

OpenAI '잘라페뇨' 공개, 전성비(perf/W)로 블랙웰 앞선 추론 전용 칩의 실효성

OpenAI가 전력 효율(perf/W)에서 엔비디아 블랙웰을 앞서는 범용 추론 칩 '잘라페뇨'를 공개했다. HBM4 탑재와 하드웨어-소프트웨어 통합 설계로 전력 제한이 심한 데이터센터 환경에서 토큰 생산량을 극대화했다. 실무자는 8k1k 벤치마크 결과

프롬프트 인젝션의 순위 반전, CVE 수치만 믿다간 놓치는 LLM 보안 구멍

프롬프트 인젝션의 순위 반전, CVE 수치만 믿다간 놓치는 LLM 보안 구멍

전문가 순위 1위인 프롬프트 인젝션이 실제 사고 기록에서는 12위로 밀려났다. 공격이 스캐너에 잡히지 않는 구조적 특성 때문이며, 전문가 판단과 사고 데이터 간 일치도는 0.20으로 매우 낮다. 보안 담당자는 CVE 수치보다 MCP 도구 경계와 외부

OpenAI의 ChatGPT Work 및 Codex, Plus 플랜 '5시간 제한' 다시 적용

OpenAI의 ChatGPT Work 및 Codex, Plus 플랜 '5시간 제한' 다시 적용

OpenAI가 ChatGPT Plus 구독자의 Codex 및 ChatGPT Work 사용량에 5시간 제한을 다시 도입한다. 컴퓨팅 부하 분산과 주간 한도 조기 소진 방지를 위해 8월 25일부터 적용하며, Pro 플랜은 제외된다. Plus 플랜 사용자는

해커뉴스(개발자 커뮤니티) AI 관련 콘텐츠 비중 60% 기록

해커뉴스(개발자 커뮤니티) AI 관련 콘텐츠 비중 60% 기록

해커뉴스(개발자 커뮤니티)의 일일 상위 콘텐츠 중 AI 관련 비중이 최대 60%까지 상승했다. 2026년 2월과 6월 조사 결과, 일일 톱 5 항목의 상당수가 AI 주제이거나 AI가 작성한 글로 확인됐다. 텍스트 탐지 모델 Pangram을 통해 AI

키네이블, AI 에이전트 전용 웹 인덱싱으로 2,600만 달러 투자 유치

키네이블, AI 에이전트 전용 웹 인덱싱으로 2,600만 달러 투자 유치

AI 에이전트 전용 웹 검색 인덱스를 구축하는 키네이블(Keenable)이 2,600만 달러의 시드 투자를 유치했다. 액셀(Accel)이 주도한 이번 라운드를 통해 1,000억 개 이상의 문서 인덱스를 확보했으며, 보이스 AI 기업 그라디움(Gradi

Perplexity, 엔비디아 협력해 로컬 AI 에이전트 'Portable Computer' 공개

Perplexity, 엔비디아 협력해 로컬 AI 에이전트 'Portable Computer' 공개

Perplexity가 엔비디아와 협력해 사용자 하드웨어에서 완전히 로컬로 구동되는 AI 에이전트 'Portable Computer'를 출시했다. VRAM 24GB 이상의 RTX GPU가 탑재된 리눅스 환경에서 Qwen 3.8 27B 및 PPLX 27B

512GB 통합 메모리 M5 Ultra 공개, 온디바이스 LLM 실행 규모의 임계점 변화

512GB 통합 메모리 M5 Ultra 공개, 온디바이스 LLM 실행 규모의 임계점 변화

Apple이 2nm 공정의 M6와 쿼드다이 구조의 M5 Ultra를 공개했다. M5 Ultra는 최대 512GB 메모리와 1.2TB/s 대역폭으로 수천억 파라미터 모델의 로컬 실행을 지원한다. 로컬 추론 및 파인튜닝을 설계하는 AI 엔지니어는 하드웨어

2000만 명 확보한 ChatGPT Work, UI 최소화하고 '모델 자율성'에 집중

2000만 명 확보한 ChatGPT Work, UI 최소화하고 '모델 자율성'에 집중

OpenAI가 화이트칼라를 위한 AI 에이전트 플랫폼 'ChatGPT Work'로 2000만 명의 사용자를 확보했다. GPT 5.6의 문서 처리·리포트 생성 능력과 이메일·iMessage 연동을 통해 업무 자율성을 극대화했다. 실무자는 단순 챗봇을 넘

무작정 코딩하던 Claude가 설계도를 읽기 시작했다, 오픈소스 GitMir 공개

무작정 코딩하던 Claude가 설계도를 읽기 시작했다, 오픈소스 GitMir 공개

AI 에이전트가 코드 구조를 스스로 분석해 설계도를 만들고 이를 기반으로 코딩하는 GitMir가 공개됐다. MCP 서버를 통해 로컬에서 작동하며, 변경 사항이 시스템 전체에 미치는 영향을 미리 분석해 에이전트에게 전달한다. Claude Code나 Cu

추론 엔진 파서 버그를 이용한 LLM의 호스트 서버 제어 위험

추론 엔진 파서 버그를 이용한 LLM의 호스트 서버 제어 위험

LLM이 생성한 특정 토큰 시퀀스가 추론 엔진의 취약점을 자극해 GPU 호스트 서버의 제어권을 탈취할 수 있다. vLLM의 XML 파서가 tool-call 인자를 eval()로 처리해 임의 코드 실행(ACE)을 허용한 CVE-2025-9141 사례가

OpenAI, GPT-5.6 Sol 가격 인하 및 파인튜닝 플랫폼 종료 발표

OpenAI, GPT-5.6 Sol 가격 인하 및 파인튜닝 플랫폼 종료 발표

OpenAI가 gpt-5.6-sol 모델의 가격을 인하했다. Daybreak 프로그램의 모델 별칭 운영 방식과 파인튜닝 플랫폼 종료 계획을 공개했다.

제너럴 인튜이션, 60억 달러 기업가치로 투자 유치 추진

제너럴 인튜이션, 60억 달러 기업가치로 투자 유치 추진

제너럴 인튜이션이 60억 달러의 기업가치로 신규 투자 유치를 진행 중이다. 밸러 에퀴티 파트너스와 포인트72 벤처스 등이 참여하며, 최근 23억 달러 가치로 3억 2천만 달러를 조달한 지 몇 주 만에 이뤄진 움직임이다. 확보한 자금은 컴퓨팅 인프라 확