KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 90 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Muse Spark 1.3 (max) 46 pt3. gpt-oss-120b (high) 39 pt4. GPT-5.6 Luna (max) 27 pt5. GPT-5.6 Terra (max) 22 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

개인 블로그 내 AI 생성 이미지 사용이 콘텐츠 신뢰도 저하시킨다는 주장 제기

개인 블로그 내 AI 생성 이미지 사용이 콘텐츠 신뢰도 저하시킨다는 주장 제기

개인 블로그의 AI 생성 이미지가 텍스트까지 AI가 썼을 것이라는 의구심을 준다는 주장이 나왔다. 인간의 생각이 담긴 콘텐츠임을 증명하기 위해 AI 이미지보다 투박한 직접 그린 그림을 선호한다는 내용이다.

엔비디아 주도 OSAA 120개사 결집, AI 보안 표준화와 참여 모델의 격차

엔비디아 주도 OSAA 120개사 결집, AI 보안 표준화와 참여 모델의 격차

엔비디아가 주도한 OSAA가 120개 이상의 기업을 결집해 오픈 소스 AI 보안 체계 구축에 나섰다. SAFE 워킹그룹을 통해 AI 사이버 보안 사고 보고 및 분석 가이드라인을 제안하고 리눅스 재단이 이를 관리한다. 실무자는 Garak, Cedar 등

Mistral, 정책 적응형 3B 멀티모달 안전 분류 모델 'Shieldstral' 공개

Mistral, 정책 적응형 3B 멀티모달 안전 분류 모델 'Shieldstral' 공개

Mistral이 텍스트와 이미지를 동시에 평가하는 오픈 가중치 안전 분류 모델 'Shieldstral'을 공개했다. 3B 파라미터 규모로 Apache 2.0 라이선스를 따르며, 단일 16GB NVIDIA GPU에서 구동 가능하다. 추론 시 자연어 정책

엔지니어 코딩 비중 1% 시대, AI 에이전트 비용 통제와 모델 라우팅 전략

엔지니어 코딩 비중 1% 시대, AI 에이전트 비용 통제와 모델 라우팅 전략

AI 에이전트가 코드 작성의 99%를 대체하며 개발 워크플로우의 주도권이 인간에서 모델로 이동했다. 프런티어 모델로 설계하고 오픈 웨이트 모델로 구현하는 라우팅과 PR당 비용 측정으로 토큰 지출을 최적화한다. AI 도입 기업의 테크 리드는 모델 선택

Soup, 4GB VRAM 노트북 GPU에서 8B 모델 파인튜닝 가능케 하는 '레이어 스트리밍' 공개

Soup, 4GB VRAM 노트북 GPU에서 8B 모델 파인튜닝 가능케 하는 '레이어 스트리밍' 공개

LLM 파인튜닝 도구 Soup이 4GB VRAM 환경에서 8B 모델 학습을 지원하는 레이어 스트리밍 기술을 공개했다. RTX 3050 Laptop 4GB 기준 Llama-3.1-8B-Instruct 모델을 NF4 양자화로 처리해 피크 VRAM 3.32

수년 걸릴 데이터센터 구축을 며칠로, Runware의 모듈형 팟

수년 걸릴 데이터센터 구축을 며칠로, Runware의 모듈형 팟

Runware가 이동과 확장이 자유로운 모듈형 데이터센터 'Sonic Inference Pod'를 출시했다. 냉각수 없이 폐쇄 루프 시스템을 쓰고 전력만 있으면 며칠 내 설치해 추론 비용을 낮춘다. 인프라 구축 속도와 지연 시간이 중요한 AI 서비스

Gemini·Grok 구독 서비스를 OpenAI API 호환 프록시로 전환하는 오픈소스 공개

Gemini·Grok 구독 서비스를 OpenAI API 호환 프록시로 전환하는 오픈소스 공개

Gemini CLI와 Grok Build를 OpenAI API 호환 HTTP 프록시로 변환하는 오픈소스가 공개됐다. 기존 구독 비용만으로 API 형태의 활용이 가능해 별도의 API 호출 비용을 절감한다.

DeepSeek V4 Flash, AMD MI300X 1대로 구동하는 프로덕션 설정 공개

DeepSeek V4 Flash, AMD MI300X 1대로 구동하는 프로덕션 설정 공개

DeepSeek-V4-Flash-0731 모델을 AMD MI300X GPU 1대에서 구동할 수 있는 최적화 설정과 패치가 공개됐다. 304B 파라미터 모델을 위해 FP8 포맷 호환성과 MoE 라우팅 오류를 수정했으며, 단일 GPU 배포 환경을 구축했다

EON, 해저 케이블 대신 '우주 레이저'로 데이터 고속도로 뚫는다

EON, 해저 케이블 대신 '우주 레이저'로 데이터 고속도로 뚫는다

해저 광케이블을 대체해 데이터 센터를 잇는 우주 레이저 통신망이 구축된다. EON은 20기의 위성으로 2.4Tbps급 전송 속도를 구현해 데이터 전송 효율을 높인다. 대규모 데이터를 옮기는 하이퍼스케일러와 AI 연구소는 전송 경로의 제약과 비용 변화를

레딧, AI 기반 SEO 스팸의 정교한 침투에 직면했다

레딧, AI 기반 SEO 스팸의 정교한 침투에 직면했다

레딧 내 특정 제품 추천을 위해 인간을 모방한 AI SEO 스팸이 확산하고 있다. 피부 관리 서브레딧에서 AI 계정이 일반 사용자인 척 제품을 추천하며 검색 엔진 최적화를 시도한 사례가 확인됐다. 커뮤니티 기반의 '실제 사용자 리뷰'를 신뢰하던 기존의

iPhone 17에서 2.5GB RAM으로 35B 모델을 돌리는 Swiftlet의 가중치 스트리밍

iPhone 17에서 2.5GB RAM으로 35B 모델을 돌리는 Swiftlet의 가중치 스트리밍

Swiftlet 런타임이 가중치 스트리밍 기술로 iPhone과 Mac에서 35B~80B 규모의 Qwen 모델 구동을 가능하게 했다. 메모리에는 핵심 코어만 유지하고 MoE 가중치를 저장소에서 실시간 호출해 iPhone 17 기준 2.5GB RAM만 사

AutoArk-AI, 0.6B 규모 Audio8 TTS 공개... 11개 언어 및 제로샷 클로닝 지원

AutoArk-AI, 0.6B 규모 Audio8 TTS 공개... 11개 언어 및 제로샷 클로닝 지원

AutoArk-AI가 0.6B 파라미터 규모의 음성 합성 모델 Audio8 TTS Preview를 공개했다. 듀얼 AR 구조를 통해 한국어 포함 11개 언어를 지원하며 추가 학습 없는 제로샷 보이스 클로닝 기능을 제공한다. 모델 로드 시 trust_r

설정 파일 대신 소스 직접 수정, AI 에이전트가 낮춘 개인용 소프트웨어 구축 비용

설정 파일 대신 소스 직접 수정, AI 에이전트가 낮춘 개인용 소프트웨어 구축 비용

AI 에이전트가 소스 수정과 유지보수를 자동화하며 개인 맞춤형 소프트웨어 제작 비용이 급감했다. 오픈소스 도구를 로컬 빌드하고 매일 최신 버전을 리베이스하는 과정을 프롬프트와 크론 작업으로 자동화한다. 실무자는 사용 중인 AI 에이전트가 오픈소스인지

Asana AWM, 기업용 AI 에이전트에 '공유 메모리' 탑재해 상태 유지 해결

Asana AWM, 기업용 AI 에이전트에 '공유 메모리' 탑재해 상태 유지 해결

Asana가 기업 내 AI 에이전트 간 기억을 공유하는 Agentic Work Management(AWM)를 공개했다. 18년 된 Work Graph 구조를 활용해 개별 프롬프트를 넘어 전사 목표와 프로젝트 상태를 공유하는 영구 상태를 구현했다. 에이

LLM 결과물 품질 결정하는 핵심 변수로 '도메인 전문성'의 효용 확인

LLM 결과물 품질 결정하는 핵심 변수로 '도메인 전문성'의 효용 확인

LLM 활용 시 프롬프트 기법보다 사용자의 도메인 전문성이 결과물의 가치를 결정하는 핵심 요소로 분석됐다. 테렌스 타오(Terence Tao)의 수학적 추론 과정과 개발자의 코드베이스 이해도를 통해 전문 지식이 모델의 응답 방향을 교정하는 메커니즘이

OpenAI, 인플루언서 초청 럭셔리 투어로 '여론 역풍' 맞았다

OpenAI, 인플루언서 초청 럭셔리 투어로 '여론 역풍' 맞았다

OpenAI가 뉴욕주에서 인플루언서들을 대상으로 한 럭셔리 리트리트 '서머 클럽'을 진행했다. 제품 활용 교육과 웰니스 활동이 제공됐으나, 데이터 센터의 환경 파괴와 국방부 계약 등 윤리적 논란이 제기됐다. AI 기업의 브랜드 마케팅이 인프라 확장으로

30B 이하 음성 모델 한국어 1위, 크래프톤 'A.X K2 Raon-Speech' 공개

30B 이하 음성 모델 한국어 1위, 크래프톤 'A.X K2 Raon-Speech' 공개

크래프톤이 한영 이중언어 음성 AI 모델 'A.X K2 Raon-Speech'를 공개했다. 30B 이하 공개 모델 중 한국어 종합 1위를 기록했으며, STT와 TTS를 포함한 멀티모달 대화를 지원한다.

카카오, 한국어 효율 30% 높인 '카나나-2' SLM 4종 공개

카카오, 한국어 효율 30% 높인 '카나나-2' SLM 4종 공개

카카오가 경량 모델 '카나나-2' SLM 4종을 오픈소스로 공개했다. 3B와 1.3B 규모의 Base 및 Instruct 모델로 구성되며 한국어 토큰화 효율을 30% 이상 개선했다.

LobeHub, AI 팀 구성 및 운영 플랫폼 'Chief Agent Operator' 공개

LobeHub, AI 팀 구성 및 운영 플랫폼 'Chief Agent Operator' 공개

LobeHub가 여러 AI 에이전트를 고용하고 스케줄링하며 보고받는 Chief Agent Operator를 공개했다. 에이전트 빌더로 개인화된 AI 팀을 자동 구성하며 1만 개 이상의 스킬과 연동 가능하다.

AI 코딩 도구가 만든 '생산성 격차', 주니어 개발자 효율 25% 높였다

AI 코딩 도구가 만든 '생산성 격차', 주니어 개발자 효율 25% 높였다

AI 도입 이후 코딩 속도는 빨라졌으나 전체 업무 시간 대비 실제 생산성 향상은 기대보다 낮은 '생산성 격차'가 확인됐다. 시니어 개발자는 하루 평균 1.25시간(15%)을 절약하는 반면, 코딩 비중이 높은 주니어는 2시간(25%)의 효율 향상을 보였

GPT-5.6를 앞선 Qwen3.8-Max의 컴퓨터 제어 성능과 오픈 웨이트 공개 일정

GPT-5.6를 앞선 Qwen3.8-Max의 컴퓨터 제어 성능과 오픈 웨이트 공개 일정

알리바바가 2.4조 파라미터 MoE 모델 Qwen3.8-Max를 공개하며 에이전트 기반 컴퓨터 제어 성능에서 GPT-5.6를 앞섰다. OSWorld-Verified 86.1점을 기록했으며, 다음 주 중 Max급 모델 최초로 오픈 웨이트 버전을 출시할

미국 빅테크 AI '숨은 부채' 1.65조 달러, 자산 경량 모델에서 중량 모델로 전환

미국 빅테크 AI '숨은 부채' 1.65조 달러, 자산 경량 모델에서 중량 모델로 전환

미국 AI 하이퍼스케일러들의 장부 외 '숨은 부채' 규모가 1.65조 달러에 달한다는 분석이 나왔다. S&P 글로벌에 따르면 올해 관련 기업들의 채권 발행액은 2,250억 달러로 연말까지 4,000억 달러 규모로 늘어날 전망이다. 정부 부채 증가와 맞

Nightcrawler, 스마트폰 기반 로컬 AI 모의해킹 에이전트 공개

Nightcrawler, 스마트폰 기반 로컬 AI 모의해킹 에이전트 공개

스마트폰에서 독립적으로 작동하는 자율 모의해킹 에이전트 'Nightcrawler'가 공개됐다. 12억 파라미터 규모의 LFM2.5-1.2B-Instruct-Heretic 모델을 Adreno 650 GPU에서 OpenCL로 구동한다. 배터리 전력 제한으

AWS, Superblocks와 손잡고 '프라이빗 클라우드 바이브 코딩' 도입

AWS, Superblocks와 손잡고 '프라이빗 클라우드 바이브 코딩' 도입

AWS가 바이브 코딩 스타트업 Superblocks를 프라이빗 클라우드에 내장한다. 데이터가 외부 모델 제공자로 유출되지 않고 Aurora와 Bedrock 내에서만 처리된다. CIO는 특정 모델 종속을 피하기 위한 멀티 모델 오케스트레이션 전략을 점검

애플, iOS 27 베타에서 Gemini 기반 'Siri AI' 공개

애플, iOS 27 베타에서 Gemini 기반 'Siri AI' 공개

애플이 iOS 27 소비자 베타 버전에 개인 문맥 이해 능력을 갖춘 'Siri AI'를 도입했다. 구글 제미나이(Gemini) 기술로 훈련한 자체 파운데이션 모델을 기반으로 하며 애플 실리콘과 프라이빗 클라우드 컴퓨트(Private Cloud Comp

미국 하원, AI 도구 지출 90%를 ChatGPT에 사용

미국 하원, AI 도구 지출 90%를 ChatGPT에 사용

미국 하원 사무실과 위원회가 AI 도구 지출액의 약 90%를 ChatGPT에 사용했다. 총 11만 3,740달러 이상의 지출 중 10만 580달러가 ChatGPT 결제액으로 확인됐다.

SQLite 가짜 CVE 54건 발견, LLM 생성 허위 취약점이 보안 체계 교란

SQLite 가짜 CVE 54건 발견, LLM 생성 허위 취약점이 보안 체계 교란

JFrog 연구팀이 SQLite 취약점으로 보고된 CVE 중 상당수가 LLM이 생성한 허위 정보임을 밝혔다. 분석 대상 55건 중 54건이 조작되었으며, NVD와 CISA 등 주요 기관이 이를 '심각' 단계로 분류했다가 수정했다. 보안 실무자는 자동화

AirLLM, 4GB GPU 단일 카드로 70B 모델 추론 지원

AirLLM, 4GB GPU 단일 카드로 70B 모델 추론 지원

저사양 GPU에서 거대언어모델(LLM)을 구동할 수 있는 AirLLM 라이브러리가 공개됐다. Llama 3 70B는 4GB, DeepSeek-V3(671B)는 약 12GB VRAM에서 작동하며 Kimi K3(2.8T)는 3.72GB VRAM만으로 추론

NTT DATA AIVista, '라스트 마일' 전문화로 기업용 AI 실무 적용 한계 해결

NTT DATA AIVista, '라스트 마일' 전문화로 기업용 AI 실무 적용 한계 해결

NTT DATA AIVista가 프런티어 모델을 기업 실무에 적용하기 위한 '라스트 마일' 전문화 전략을 공개했다. 파인튜닝 대신 기업 고유 데이터와 워크플로우, 가드레일을 결합한 시스템 구축과 모델 앙상블 운영에 집중한다. 규제 산업 실무자는 기술

레거시 데이터 엉킨 기업용 AI, 'June'이 배포 로드맵 자동화로 푼다

레거시 데이터 엉킨 기업용 AI, 'June'이 배포 로드맵 자동화로 푼다

기업용 AI 도입의 병목인 레거시 시스템 연동과 데이터 파편화 문제를 해결하는 플랫폼 'June'이 공개됐다. 기존 시스템을 스캔해 병목을 찾고, 데이터 정제부터 에이전트 구축까지의 단계별 로드맵을 자동 생성한다. 전문 엔지니어(FDE) 투입 비용을