KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 85 pt3. Muse Spark 1.3 (max) 47 pt4. gpt-oss-120b (high) 43 pt5. GPT-5.6 Luna (max) 28 pt

AI 기술 블로그

엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

AI 에이전트 도구 테스트, 실시간 API 대신 LLM 시뮬레이션으로 해결

AI 에이전트 도구 테스트, 실시간 API 대신 LLM 시뮬레이션으로 해결

Strands Evals가 AI 에이전트의 도구 호출을 검증하는 ToolSimulator를 공개했다. 실제 API 호출 없이 LLM 기반 시뮬레이션으로 상태를 유지하며 테스트를 수행한다. 개발자는 복잡한 다단계 워크플로우를 안전하고 확장성 있게 검증할

Olostep API로 문서 사이트 전체를 마크다운으로 크롤링하는 법

Olostep API로 문서 사이트 전체를 마크다운으로 크롤링하는 법

Olostep이 Scrapy나 Selenium보다 문서 크롤링에 더 적합한 API를 제공한다. Python SDK로 설정 10줄이면 전체 문서 사이트를 마크다운으로 추출 가능하다. Gradio 웹앱을 붙여 URL만 입력하면 누구나 크롤링 결과를 바로

Unsloth Studio로 LLM 합치기, 코드 없이 5분이면 끝난다

Unsloth Studio로 LLM 합치기, 코드 없이 5분이면 끝난다

Unsloth Studio가 브라우저 기반 GUI로 LLM 병합을 지원한다. SLERP, TIES, DARE 세 가지 병합 방식을 코드 없이 선택할 수 있다. 4비트 모델도 자동 변환 후 병합해 Ollama 등에 바로 배포 가능하다.

파이썬 앱 무료 호스팅 5종 비교: Hugging Face와 Modal 등 리소스 격차 분석

파이썬 앱 무료 호스팅 5종 비교: Hugging Face와 Modal 등 리소스 격차 분석

파이썬 애플리케이션을 무료로 배포할 수 있는 5가지 플랫폼을 분석했다. Hugging Face Spaces는 16GB RAM을 제공하며 가장 높은 하드웨어 사양을 갖췄다. Modal은 월 30달러의 크레딧을 제공해 인프라 정의의 유연성을 높였다.

Amazon Nova Forge SDK 활용한 데이터 혼합 미세 조정 가이드

Amazon Nova Forge SDK 활용한 데이터 혼합 미세 조정 가이드

Amazon Nova Forge SDK를 이용한 모델 미세 조정 절차가 공개되었다. 데이터 혼합 기술로 일반 성능 저하 없이 도메인 특화 학습이 가능하다. 데이터 정제부터 LoRA 기반 학습까지의 전체 워크플로우를 제공한다.

DeepAmazon Bedrock Nova Micro로 95%↓ 비용·50%↓ 지연 라우팅 증류

Amazon Bedrock Nova Micro로 95%↓ 비용·50%↓ 지연 라우팅 증류

Amazon Bedrock에서 Nova Premier 라우팅을 Nova Micro에 증류한다. 추론 비용이 95% 이상 줄고 지연이 50% 감소한다. 10,000개 합성 프롬프트-응답으로 수시간 내 학습을 끝낸다.

DeepAmazon Bedrock, 추론 비용 사용자별 자동 추적 기능 도입

Amazon Bedrock, 추론 비용 사용자별 자동 추적 기능 도입

Amazon Bedrock이 추론 비용을 IAM 주체별로 자동 분류한다. 기업은 팀이나 프로젝트 단위로 비용을 상세하게 집계할 수 있다. 기존 워크플로우 변경 없이 AWS 비용 보고서에서 확인 가능하다.

770M 파라미터로 1.3B를 따라잡는 오픈소스 클로드 미토스 재구성

770M 파라미터로 1.3B를 따라잡는 오픈소스 클로드 미토스 재구성

Kye Gomez가 클로드 미토스 구조를 추정한 오픈소스 프로젝트 OpenMythos를 공개했다. 이 구조는 반복 깊이 변환기(RDT)를 기반으로 하여 770M 파라미터로 1.3B 표준 모델과 성능이 같다. 추론 시 루프 횟수를 늘리면 재학습 없이도

DeepNVIDIA·파트너, Hannover Messe 2026서 Industrial AI Cloud·디지털 트윈을 실물로

NVIDIA·파트너, Hannover Messe 2026서 Industrial AI Cloud·디지털 트윈을 실물로

NVIDIA가 4월 20~24일 Hannover Messe 2026에서 AI 제조 시연을 진행했다. Deutsche Telekom이 독일에서 Industrial AI Cloud를 구축해 유럽 확산 기반을 제시했다. Omniverse·CUDA-X·Nem

PrfaaS, 이더넷 기반 KVCache 전송으로 추론 처리량 54% 향상

PrfaaS, 이더넷 기반 KVCache 전송으로 추론 처리량 54% 향상

Moonshot AI와 칭화대가 PrfaaS라는 분산 추론 아키텍처를 제안했다. 하이브리드 어텐션을 통해 KVCache 크기를 줄여 일반 이더넷 전송이 가능해졌다. 1조 파라미터 모델 기준 기존 대비 추론 처리량을 최대 54% 향상시켰다.

TabPFN 98.8% 정확도 기록, CatBoost 대비 학습 시간 94% 단축

TabPFN 98.8% 정확도 기록, CatBoost 대비 학습 시간 94% 단축

TabPFN이 정형 데이터 분석에서 기존 트리 기반 모델보다 높은 정확도를 기록했다. 사전 학습된 모델을 활용해 별도의 학습 과정 없이 즉시 예측을 수행한다. 정확도는 높지만 추론 속도가 느린 특성을 보이며 이를 해결하기 위한 증류 기술을 제공한다.

Magika와 OpenAI 결합해 파일 위조 탐지 및 보안 분석 자동화

Magika와 OpenAI 결합해 파일 위조 탐지 및 보안 분석 자동화

Magika와 OpenAI를 결합한 파일 분석 파이프라인이 공개됐다. 딥러닝 기반 바이트 분석으로 파일 확장자 위조를 정확히 찾아낸다. 기술적 분석 결과를 GPT가 경영진용 보안 리포트로 자동 변환한다.

구글 제미나이 기반 여행 도구 7종 공개, 일정 짜기부터 식당 예약까지 자동화

구글 제미나이 기반 여행 도구 7종 공개, 일정 짜기부터 식당 예약까지 자동화

구글이 제미나이를 적용한 7가지 여행 지원 도구를 공개했다. AI가 일정을 짜고 식당을 예약하며 매장 재고 확인 전화까지 대신한다. 단순 정보 검색을 넘어 실행까지 담당하는 AI 에이전트 시대로 진입했다.

NVIDIA Ising 출시, 양자 오류 수정 정확도 3배 높이고 튜닝 시간 단축한다

NVIDIA Ising 출시, 양자 오류 수정 정확도 3배 높이고 튜닝 시간 단축한다

NVIDIA가 양자-고전 하이브리드 시스템을 위한 AI 모델 제품군인 Ising을 공개했다. Ising Calibration은 하드웨어 튜닝 시간을 며칠에서 몇 시간 단위로 줄여준다. Ising Decoding은 기존 표준 대비 오류 수정 정확도를 3

Grok 음성 API 공개, STT 오차율 5%로 ElevenLabs 추월했다

Grok 음성 API 공개, STT 오차율 5%로 ElevenLabs 추월했다

xAI가 Grok의 음성 인식 및 합성 API를 독립적으로 출시했다. STT 모델은 전화 통화 인식 오차율 5%를 기록하며 경쟁사를 앞섰다. TTS 모델은 웃음이나 속삭임 같은 감정 태그 기능을 제공한다.

Bonsai 1-bit LLM과 GGUF로 VRAM 한계 넘는 로컬 서버 구축

Bonsai 1-bit LLM과 GGUF로 VRAM 한계 넘는 로컬 서버 구축

PrismML이 1비트 양자화 모델인 Bonsai-1.7B의 실행 가이드를 공개했다. GGUF 형식을 통해 메모리 사용량을 극단적으로 줄여 CUDA 환경에서 구동한다. JSON 생성과 RAG 등 실무 기능을 OpenAI 호환 서버 형태로 제공한다.

Hypothesis 5가지 전략으로 엣지케이스 자동 탐색하고 상태 검증하기

Hypothesis 5가지 전략으로 엣지케이스 자동 탐색하고 상태 검증하기

Hypothesis를 활용한 속성 기반 테스트 가이드가 공개되었다. 단순 단위 테스트를 넘어 상태 기반 및 변형 테스트 기법을 제시한다. 자동 입력 생성과 축소 기능을 통해 숨겨진 버그를 효율적으로 찾는다.

구글 Auto-Diagnose, 통합 테스트 실패 원인 90.14% 자동 진단

구글 Auto-Diagnose, 통합 테스트 실패 원인 90.14% 자동 진단

구글이 통합 테스트 실패 원인을 자동 진단하는 Auto-Diagnose를 공개했다. Gemini 2.5 Flash를 활용해 실제 사례에서 90.14%의 진단 정확도를 기록했다. 프롬프트 엔지니어링만으로 로그 분석 시간을 단축하며 인프라 버그까지 찾아냈

19가지 공격 도구로 AI 모델의 숨은 약점 찾아내는 방법

19가지 공격 도구로 AI 모델의 숨은 약점 찾아내는 방법

나쁜 사람처럼 행동해 AI의 허점을 찾는 레드팀 활동의 필요성 일반적인 프로그램 보안 검사와 AI 전용 보안 검사의 차이점 자동화 도구를 통해 AI의 돌발 행동을 미리 막는 실무적 방향

아마존 노바, 글자 없이 영상 속 장면 1초까지 찾는 검색 기술 공개

아마존 노바, 글자 없이 영상 속 장면 1초까지 찾는 검색 기술 공개

아마존이 영상과 소리를 동시에 이해하는 노바 기술을 발표했다. 영상을 글자로 바꾸지 않고 그대로 분석해 검색 정확도를 높였다. 스포츠와 뉴스 등 빠른 영상 편집이 필요한 산업의 판도를 바꾼다.

AWS 마케팅 웹페이지 제작 4시간을 10분으로 줄인 AI 비서

AWS 마케팅 웹페이지 제작 4시간을 10분으로 줄인 AI 비서

AWS가 마케팅 웹페이지 제작 시간을 획기적으로 줄인 AI 시스템을 도입했다. 4시간 걸리던 작업이 10분으로 줄어들며 효율이 95% 이상 높아졌다. 말 한마디로 페이지를 만들고 실시간으로 오류를 잡는 기술이 핵심이다.

Nemotron OCR v2, 1200만 장 합성 데이터로 CJK 인식률 높이고 초당 34.7페이지 처리

Nemotron OCR v2, 1200만 장 합성 데이터로 CJK 인식률 높이고 초당 34.7페이지 처리

Nvidia가 다국어 OCR 모델인 Nemotron OCR v2를 공개했다. 1200만 장의 합성 데이터를 학습해 한중일 언어 인식 성능을 대폭 높였다. A100 GPU 한 장으로 초당 34.7페이지를 처리하는 속도를 구현했다.

OpenAI Whisper와 로컬 AI로 고객 전화 1,000건 감정 분석하기

OpenAI Whisper와 로컬 AI로 고객 전화 1,000건 감정 분석하기

목소리를 글자로 바꾸고 감정을 읽는 로컬 AI 도구 제작 외부 서버 없이 내 컴퓨터에서 처리해 개인 정보 보호 소리를 그림으로 바꿔 분석하는 Whisper의 작동 원리