AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션
엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

Strands Evals가 AI 에이전트의 도구 호출을 검증하는 ToolSimulator를 공개했다. 실제 API 호출 없이 LLM 기반 시뮬레이션으로 상태를 유지하며 테스트를 수행한다. 개발자는 복잡한 다단계 워크플로우를 안전하고 확장성 있게 검증할

Olostep이 Scrapy나 Selenium보다 문서 크롤링에 더 적합한 API를 제공한다. Python SDK로 설정 10줄이면 전체 문서 사이트를 마크다운으로 추출 가능하다. Gradio 웹앱을 붙여 URL만 입력하면 누구나 크롤링 결과를 바로

Unsloth Studio가 브라우저 기반 GUI로 LLM 병합을 지원한다. SLERP, TIES, DARE 세 가지 병합 방식을 코드 없이 선택할 수 있다. 4비트 모델도 자동 변환 후 병합해 Ollama 등에 바로 배포 가능하다.

파이썬 애플리케이션을 무료로 배포할 수 있는 5가지 플랫폼을 분석했다. Hugging Face Spaces는 16GB RAM을 제공하며 가장 높은 하드웨어 사양을 갖췄다. Modal은 월 30달러의 크레딧을 제공해 인프라 정의의 유연성을 높였다.

Amazon Nova Forge SDK를 이용한 모델 미세 조정 절차가 공개되었다. 데이터 혼합 기술로 일반 성능 저하 없이 도메인 특화 학습이 가능하다. 데이터 정제부터 LoRA 기반 학습까지의 전체 워크플로우를 제공한다.

Amazon Bedrock에서 Nova Premier 라우팅을 Nova Micro에 증류한다. 추론 비용이 95% 이상 줄고 지연이 50% 감소한다. 10,000개 합성 프롬프트-응답으로 수시간 내 학습을 끝낸다.

Amazon Bedrock이 추론 비용을 IAM 주체별로 자동 분류한다. 기업은 팀이나 프로젝트 단위로 비용을 상세하게 집계할 수 있다. 기존 워크플로우 변경 없이 AWS 비용 보고서에서 확인 가능하다.

Kye Gomez가 클로드 미토스 구조를 추정한 오픈소스 프로젝트 OpenMythos를 공개했다. 이 구조는 반복 깊이 변환기(RDT)를 기반으로 하여 770M 파라미터로 1.3B 표준 모델과 성능이 같다. 추론 시 루프 횟수를 늘리면 재학습 없이도

NVIDIA가 4월 20~24일 Hannover Messe 2026에서 AI 제조 시연을 진행했다. Deutsche Telekom이 독일에서 Industrial AI Cloud를 구축해 유럽 확산 기반을 제시했다. Omniverse·CUDA-X·Nem

Moonshot AI와 칭화대가 PrfaaS라는 분산 추론 아키텍처를 제안했다. 하이브리드 어텐션을 통해 KVCache 크기를 줄여 일반 이더넷 전송이 가능해졌다. 1조 파라미터 모델 기준 기존 대비 추론 처리량을 최대 54% 향상시켰다.

TabPFN이 정형 데이터 분석에서 기존 트리 기반 모델보다 높은 정확도를 기록했다. 사전 학습된 모델을 활용해 별도의 학습 과정 없이 즉시 예측을 수행한다. 정확도는 높지만 추론 속도가 느린 특성을 보이며 이를 해결하기 위한 증류 기술을 제공한다.

Magika와 OpenAI를 결합한 파일 분석 파이프라인이 공개됐다. 딥러닝 기반 바이트 분석으로 파일 확장자 위조를 정확히 찾아낸다. 기술적 분석 결과를 GPT가 경영진용 보안 리포트로 자동 변환한다.

구글이 제미나이를 적용한 7가지 여행 지원 도구를 공개했다. AI가 일정을 짜고 식당을 예약하며 매장 재고 확인 전화까지 대신한다. 단순 정보 검색을 넘어 실행까지 담당하는 AI 에이전트 시대로 진입했다.

NVIDIA가 양자-고전 하이브리드 시스템을 위한 AI 모델 제품군인 Ising을 공개했다. Ising Calibration은 하드웨어 튜닝 시간을 며칠에서 몇 시간 단위로 줄여준다. Ising Decoding은 기존 표준 대비 오류 수정 정확도를 3

xAI가 Grok의 음성 인식 및 합성 API를 독립적으로 출시했다. STT 모델은 전화 통화 인식 오차율 5%를 기록하며 경쟁사를 앞섰다. TTS 모델은 웃음이나 속삭임 같은 감정 태그 기능을 제공한다.

PrismML이 1비트 양자화 모델인 Bonsai-1.7B의 실행 가이드를 공개했다. GGUF 형식을 통해 메모리 사용량을 극단적으로 줄여 CUDA 환경에서 구동한다. JSON 생성과 RAG 등 실무 기능을 OpenAI 호환 서버 형태로 제공한다.

Hypothesis를 활용한 속성 기반 테스트 가이드가 공개되었다. 단순 단위 테스트를 넘어 상태 기반 및 변형 테스트 기법을 제시한다. 자동 입력 생성과 축소 기능을 통해 숨겨진 버그를 효율적으로 찾는다.

구글이 통합 테스트 실패 원인을 자동 진단하는 Auto-Diagnose를 공개했다. Gemini 2.5 Flash를 활용해 실제 사례에서 90.14%의 진단 정확도를 기록했다. 프롬프트 엔지니어링만으로 로그 분석 시간을 단축하며 인프라 버그까지 찾아냈

나쁜 사람처럼 행동해 AI의 허점을 찾는 레드팀 활동의 필요성 일반적인 프로그램 보안 검사와 AI 전용 보안 검사의 차이점 자동화 도구를 통해 AI의 돌발 행동을 미리 막는 실무적 방향

아마존이 영상과 소리를 동시에 이해하는 노바 기술을 발표했다. 영상을 글자로 바꾸지 않고 그대로 분석해 검색 정확도를 높였다. 스포츠와 뉴스 등 빠른 영상 편집이 필요한 산업의 판도를 바꾼다.

AWS가 마케팅 웹페이지 제작 시간을 획기적으로 줄인 AI 시스템을 도입했다. 4시간 걸리던 작업이 10분으로 줄어들며 효율이 95% 이상 높아졌다. 말 한마디로 페이지를 만들고 실시간으로 오류를 잡는 기술이 핵심이다.

Nvidia가 다국어 OCR 모델인 Nemotron OCR v2를 공개했다. 1200만 장의 합성 데이터를 학습해 한중일 언어 인식 성능을 대폭 높였다. A100 GPU 한 장으로 초당 34.7페이지를 처리하는 속도를 구현했다.

목소리를 글자로 바꾸고 감정을 읽는 로컬 AI 도구 제작 외부 서버 없이 내 컴퓨터에서 처리해 개인 정보 보호 소리를 그림으로 바꿔 분석하는 Whisper의 작동 원리