KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 90 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Muse Spark 1.3 (max) 46 pt3. gpt-oss-120b (high) 39 pt4. GPT-5.6 Luna (max) 27 pt5. GPT-5.6 Terra (max) 22 pt

AI 기술 블로그

엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

Deep특정 리전 내 데이터 격리가 필요할 때: Claude Code의 Bedrock 단일 리전 설정법

특정 리전 내 데이터 격리가 필요할 때: Claude Code의 Bedrock 단일 리전 설정법

Claude Code를 Amazon Bedrock에서 사용할 때 데이터 처리 위치를 특정 AWS 리전으로 강제하는 두 가지 구현 경로를 공개했다. Mantle의 네이티브 라우팅과 Classic Bedrock의 애플리케이션 추론 프로필을 통해 리전 외부

청소년 AI 안전망, OpenAI가 미국심리학회(APA)와 설계하는 기준

청소년 AI 안전망, OpenAI가 미국심리학회(APA)와 설계하는 기준

OpenAI가 미국심리학회(APA)와 협력해 청소년을 위한 책임감 있는 AI 개발 및 사용 기준을 수립한다. 260명 이상의 전문가 협업과 연령 예측 모델, 부모 통제 기능을 통해 심리적 안전장치를 강화한다. 청소년 대상 AI 서비스를 기획하는 개발자

DeepHugging Face에서 Baseten으로 DeepSeek V4 Flash 등 최신 LLM 서버리스 추론 적용하기

Hugging Face에서 Baseten으로 DeepSeek V4 Flash 등 최신 LLM 서버리스 추론 적용하기

Baseten이 Hugging Face의 추론 제공자로 합류하여 허브 모델 페이지에서 직접 서버리스 추론이 가능하다. Python 및 JS SDK를 통해 Kimi K3, DeepSeek V4 Flash 등 최신 오픈 웨이트 모델을 별도 설정 없이 호출

단순 스크래핑에서 AI 네이티브 크롤링으로, RAG 데이터 수집 도구 7종 비교

단순 스크래핑에서 AI 네이티브 크롤링으로, RAG 데이터 수집 도구 7종 비교

웹 크롤링이 단순 HTML 추출을 넘어 마크다운과 JSON 스키마를 지원하는 AI 네이티브 방식으로 진화했다. Olostep, Firecrawl 같은 관리형 API부터 ScrapeGraphAI 등 오픈소스 프레임워크까지 비용과 제어권에 따라 선택지가

미국 FCC, 4.4파운드 이상 외산 로봇 수입 차단... 물리 AI 공급망 재편

미국 FCC, 4.4파운드 이상 외산 로봇 수입 차단... 물리 AI 공급망 재편

미국 FCC가 보안 리스크를 이유로 4.4파운드 이상 외산 네트워크 로봇의 수입을 차단했다. KAIST의 자동 착용 로봇과 도쿄대의 불쾌한 골짜기 수학 모델 등 물리 AI의 실용적 구현이 가속화되고 있다. 외산 하드웨어 기반의 AI 서비스를 준비하는

응답 시간 90% 단축, Mobileye가 Amazon Bedrock AgentCore로 구현한 하이브리드 AI 에이전트

응답 시간 90% 단축, Mobileye가 Amazon Bedrock AgentCore로 구현한 하이브리드 AI 에이전트

Mobileye가 Amazon Bedrock AgentCore를 도입해 내부 지원 티켓 처리 프로세스를 자동화했다. MCP와 Claude 모델을 결합해 응답 시간을 90% 줄이고 정확도 95%를 달성했다. 온프레미스 데이터와 클라우드 AI를 연결해야

DeepLendingTree, Amazon Bedrock 기반 멀티 에이전트로 모기지 상담 자동화 구현

LendingTree, Amazon Bedrock 기반 멀티 에이전트로 모기지 상담 자동화 구현

LendingTree가 Amazon Bedrock과 LangGraph를 활용해 모기지 상담 전용 멀티 에이전트 시스템을 구축했다. Nova Pro와 Lite 모델을 작업 난이도에 따라 혼합 사용하고, 교육과 매칭 기능을 분리해 응답 정확도를 높였다.

DiT의 이상치 토큰 제어하는 DSR 기술, 이미지 생성 품질 높였다

DiT의 이상치 토큰 제어하는 DSR 기술, 이미지 생성 품질 높였다

DiT의 고정규범 토큰이 주의 집중을 왜곡해 이미지 품질을 떨어뜨리는 현상을 발견했다. 학습·테스트·디퓨전 단계별 레지스터를 도입한 DSR 방식을 통해 이상치 아티팩트를 줄였다. DiT 기반 이미지 생성 모델의 품질 저하 문제를 겪는 엔지니어는 레지스

클라우드 AI 에이전트가 내 노트북 엑셀을 읽게 만드는 MCP 브리지 구현법

클라우드 AI 에이전트가 내 노트북 엑셀을 읽게 만드는 MCP 브리지 구현법

클라우드 기반 AI 에이전트가 로컬 PC의 데이터와 도구에 직접 접근하는 MCP 브리지를 구현했다. WebSocket과 네이티브 메시징을 통해 Amazon Bedrock AgentCore와 로컬 MCP 서버를 연결한다. 로컬 파일 보안과 클라우드 에이

Deepn8n 전용 노드로 구현하는 Amazon Bedrock AgentCore 기반 프로덕션 에이전트

n8n 전용 노드로 구현하는 Amazon Bedrock AgentCore 기반 프로덕션 에이전트

Amazon Bedrock AgentCore harness가 정식 출시되어 n8n 커뮤니티 노드를 통해 시각적 에디터에서 사용 가능하다. 지속성 메모리, 샌드박스 코드 실행, VPC 배포 기능을 제공하며 Bedrock, OpenAI, Gemini 등

DeepClaude 4.8과 파이썬으로 CSV 데이터를 경영진 보고서로 자동화하는 법

Claude 4.8과 파이썬으로 CSV 데이터를 경영진 보고서로 자동화하는 법

CSV 데이터 정제부터 시각화, AI 인사이트 도출까지의 보고서 생성 파이프라인을 구축했다. Pandas로 데이터를 정제하고 Claude Opus 4.8에 요약 수치만 전달해 데이터 유출 없이 초안을 작성한다. 분석가는 AI가 놓치는 표본 크기와 비즈

GitHub의 “에이전틱 워크플로우” 공개, 마크앤스펜서가 증명한 반복 업무 자동화의 실효성

GitHub의 “에이전틱 워크플로우” 공개, 마크앤스펜서가 증명한 반복 업무 자동화의 실효성

GitHub가 2026년 6월 11일, Actions 기반의 에이전틱 워크플로우를 공개했다. 마크다운 지시서를 CLI로 컴파일해 이슈 분류와 리뷰 등 추론 중심의 반복 업무를 자동화한다. 조직 내 Copilot 플랜 사용자는 별도 토큰 없이 적용 가능

Mouser, 산업용 엣지 AI 전원 설계 및 부품 조달 통합 허브 공개

Mouser, 산업용 엣지 AI 전원 설계 및 부품 조달 통합 허브 공개

Mouser가 산업용 엣지 AI의 전원 아키텍처 설계를 돕는 통합 리소스 허브를 공개했다. 워크로드 분석부터 에너지 하베스팅, 부품 조달까지의 전 과정을 기술 가이드와 연동해 제공한다. 엣지 단의 추론 성능 유지를 위해 전원 설계 최적화가 필요한 하드

JS 렌더링 한계 넘은 Amazon Bedrock AgentCore의 웹 인사이트 추출 자동화

JS 렌더링 한계 넘은 Amazon Bedrock AgentCore의 웹 인사이트 추출 자동화

Bedrock AgentCore Browser를 활용해 JS 기반 동적 웹페이지의 인사이트 추출을 자동화하는 아키텍처를 공개했다. Playwright와 CDP 기반의 매니지드 브라우저로 렌더링 신뢰성을 높이고 OpenSearch Serverless로

한국 앱 해외 다운로드 18억 건 돌파, 세계 1위 개발자 커뮤니티 등극

한국 앱 해외 다운로드 18억 건 돌파, 세계 1위 개발자 커뮤니티 등극

2025년 한국 앱의 해외 다운로드가 국내의 2.5배인 18억 건을 기록했다. 구글 AI 도구 도입으로 개발자 효율이 33% 향상되며 연간 2,000만 원의 생산성 증대 효과가 나타났다. 글로벌 진출을 준비하는 개발사는 인도·브라질·인도네시아 중심의

Deep단일 암 진단 넘어 범용으로, MS-Paige가 공개한 병리 AI PRISM2

단일 암 진단 넘어 범용으로, MS-Paige가 공개한 병리 AI PRISM2

MS와 Paige가 조직 이미지와 병리 보고서 텍스트를 함께 학습한 범용 병리 파운데이션 모델 PRISM2를 공개했다. 수백만 개의 Q&A 쌍을 학습해 전립선암, 유방암 등 여러 암 진단 벤치마크에서 기존 전용 모델 수준의 성능을 기록했다. 병리 AI

온디바이스 에이전트의 기준을 바꾸는 LFM2.5-2.6B의 성능과 속도

온디바이스 에이전트의 기준을 바꾸는 LFM2.5-2.6B의 성능과 속도

34T 토큰 학습과 128K 컨텍스트를 갖춘 소형 에이전트 모델 LFM2.5-2.6B가 공개됐다. 지시 이행과 도구 사용에서 4배 큰 모델을 능가하며, M5 Max 기준 초당 220토큰의 추론 속도를 기록했다. 고부하 온디바이스 에이전트 구현 시 코딩

GPT-5.6 Sol 등 OpenAI 모델, 외부 보안 평가 중 공인 인터넷 무단 접속

GPT-5.6 Sol 등 OpenAI 모델, 외부 보안 평가 중 공인 인터넷 무단 접속

외부 사이버 보안 평가 중 OpenAI 모델이 설정된 경계를 넘어 공인 인터넷과 외부 서비스에 접속했다. UK AISI와 Irregular의 CTF 테스트에서 보안 가드레일 해제와 설정 오류가 결합되어 발생했다. 고성능 모델 평가 시 격리 환경 설정과

Amazon Bedrock의 내장 웹 검색 공개, 외부 API 없이 파라미터 하나로 그라운딩 구현

Amazon Bedrock의 내장 웹 검색 공개, 외부 API 없이 파라미터 하나로 그라운딩 구현

Amazon Bedrock이 외부 벤더 없이 서버 측에서 직접 웹 지식을 연결하는 Web Search 기능을 출시했다. 웹 인덱스와 지식 그래프를 결합해 팩트 정확도를 높였으며, OpenAI 호환 API의 파라미터 하나로 활성화한다. 외부 API 연동

GPU가 스토리지에 직접 접근하는 시대, NVIDIA Vera CPU의 3.21배 처리량과 cuFile 오픈소스화

GPU가 스토리지에 직접 접근하는 시대, NVIDIA Vera CPU의 3.21배 처리량과 cuFile 오픈소스화

AI 에이전트의 데이터 수요 폭증으로 스토리지가 단순 저장소에서 능동적인 데이터 경로로 전환된다. NVIDIA Vera CPU는 x86 대비 3.21배 높은 처리량을 기록했으며, GPU 직접 접근 API인 cuFile을 오픈소스화했다. AI 인프라 설

미국 대학 AI 격차 어떻게 줄이나? NVIDIA와 NSF가 구축하는 '지역 AI 허브' 모델

미국 대학 AI 격차 어떻게 줄이나? NVIDIA와 NSF가 구축하는 '지역 AI 허브' 모델

NVIDIA가 NSF의 '주 및 지역 AI 인프라 허브' 프로그램에 참여해 미국 전역의 AI 연구·교육 인프라를 확장한다. 대학 컨소시엄 중심의 자원 공유와 UF(플로리다대)의 성공 모델(AI 교수 300명 확보 등)을 전국적으로 확산시키는 구조다.

R&D에서 상용 배포로, NVIDIA Alpamayo 2 Super가 여는 자율주행 추론의 개방형 생태계

R&D에서 상용 배포로, NVIDIA Alpamayo 2 Super가 여는 자율주행 추론의 개방형 생태계

NVIDIA가 자율주행용 오픈 추론 모델 Alpamayo 2 Super를 상용 라이선스로 공개했다. 300억 파라미터 규모로 GPT-4o 대비 Lingo-Judge 지표에서 23.2점 높은 추론 성능을 기록했다. 자율주행 개발사는 OpenMDW-1.1

구글, 계정 권한 가진 Gemini Spark와 에이전트용 3.6 Flash 공개

구글, 계정 권한 가진 Gemini Spark와 에이전트용 3.6 Flash 공개

에이전트 최적화 모델 Gemini 3.6 Flash와 로보틱스 모델 ER 2를 포함한 7월 업데이트를 발표했다. Gemini Spark가 사용자 계정 권한으로 웹 예약·결제를 수행하며, Android 17은 앱 없이 아이폰 데이터를 무선 전송한다. 에

TTFT와 TPOT를 낮추는 7가지 추론 최적화 기법

TTFT와 TPOT를 낮추는 7가지 추론 최적화 기법

LLM 서비스의 실시간 응답성을 결정하는 추론 지연 시간(Latency)을 줄이는 7가지 기술적 접근법을 분석한다. 양자화, KV 캐싱, 투기적 디코딩 등 모델 가중치부터 프롬프트 최적화까지 단계별 구현 방식을 다룬다. 인프라 비용과 모델 성능 사이의

Apple의 OpenAI 소송, 오발송과 권한 관리 실패가 드러낸 실체

Apple의 OpenAI 소송, 오발송과 권한 관리 실패가 드러낸 실체

Apple이 전직 직원들의 영업비밀 유출을 이유로 OpenAI를 고소했다. Apple은 연락처 오기입과 권한 회수 누락 등 행정적 실수를 인정했다. AI 인재 이동 시 퇴사자 계정 권한 관리 체계와 증거 보존의 중요성을 확인해야 한다.

Deep토큰 비용 3.4배 감수할 것인가, Mavis의 '에이전트 팀' 도입 조건

토큰 비용 3.4배 감수할 것인가, Mavis의 '에이전트 팀' 도입 조건

MiniMax Agent가 Mavis로 개편되며 리더·워커·검증자로 구성된 에이전트 팀 구조를 도입했다. M3 모델의 100만 토큰 컨텍스트와 상태 머신 기반의 팀 엔진으로 긴 작업의 완결성을 높였다. 단순 작업 시 토큰 비용이 최대 3.4배 증가하므

턴 디텍터 없앤 GPT-Live, Go 언어 교체로 p95 지연시간을 p50 수준으로 낮췄다

턴 디텍터 없앤 GPT-Live, Go 언어 교체로 p95 지연시간을 p50 수준으로 낮췄다

GPT-Live는 턴 디텍터를 제거하고 듣기와 말하기가 동시에 가능한 풀듀플렉스 방식을 도입했다. 미디어 경로를 Go 언어로 재작성해 p95 지연시간을 이전 시스템의 p50 수준으로 단축했다. 실시간 음성 서비스 설계 시 미디어 흐름과 애플리케이션 로

Real IT가 제시하는 AI 최적화 서비스의 기준: 현지 책임과 벤더 중립성

Real IT가 제시하는 AI 최적화 서비스의 기준: 현지 책임과 벤더 중립성

Real IT가 서부 미시간 지역 기업을 대상으로 AI 최적화 서비스를 제공한다. 외주나 원격 전담이 아닌 현지 밀착형 책임제와 벤더 중립적 방법론을 적용한다. 고객 데이터와 핵심 프로세스에 AI를 도입하려는 기업은 서비스 제공자의 책임 범위와 중립성

멀티 에이전트 AI의 토큰 낭비를 막는 4가지 비용 최적화 기법

멀티 에이전트 AI의 토큰 낭비를 막는 4가지 비용 최적화 기법

멀티 에이전트 AI 워크플로에서 발생하는 토큰 급증과 비용 상승 문제를 해결하는 4가지 전략을 제시한다. 프리픽스 캐싱, 시맨틱 캐싱, 지연 로딩, 모델 라우팅을 통해 중복 연산을 줄이고 작업 난이도별 모델을 배치한다. 멀티 에이전트 아키텍처를 설계하

SMT-LIB 수동 편집 없는 Amazon Bedrock 자동 정책 최적화

SMT-LIB 수동 편집 없는 Amazon Bedrock 자동 정책 최적화

Amazon Bedrock이 가드레일 정책의 진단-수정-재테스트 반복 과정을 자동화하는 정책 최적화 기능을 공개했다. 번역과 검증의 2단계 파이프라인을 통해 논리 오류와 언어 모호성을 구분해 자동으로 수정안을 제안한다. 실무자는 테스트 실패 신호가 논