KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 80 pt3. Muse Spark 1.3 (max) 44 pt4. gpt-oss-120b (high) 40 pt5. GPT-5.6 Luna (max) 27 pt

AI 기술 블로그

엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

ChatGPT, 대화 맥락 파악 능력 강화로 안전성 39% 높였다

ChatGPT, 대화 맥락 파악 능력 강화로 안전성 39% 높였다

OpenAI가 대화 맥락을 파악해 위험 상황에 대응하는 기능을 강화했다. 자살 및 자해 관련 위험 상황에서 안전한 응답률이 최대 52% 개선되었다. 안전 요약 기능을 도입해 대화 간 맥락을 연결하고 위험을 식별한다.

DeepAmazon, 규제 대응 업무에 Claude 3.5 Sonnet과 RAG 도입

Amazon, 규제 대응 업무에 Claude 3.5 Sonnet과 RAG 도입

Amazon 재무 기술팀이 규제 대응 업무 자동화 시스템을 구축했다. Amazon Bedrock과 RAG 기술을 활용해 방대한 문서를 분석한다. Claude 3.5 Sonnet으로 실시간 대화형 응답을 생성해 효율을 높였다.

AWS-Cisco, MCP 및 A2A 에이전트 보안 자동화로 배포 병목 해결

AWS-Cisco, MCP 및 A2A 에이전트 보안 자동화로 배포 병목 해결

AWS와 Cisco가 MCP 및 A2A 에이전트를 위한 자동 보안 스캔 체계를 구축했다. AI Registry를 통해 모든 AI 자산의 가시성을 확보하고 취약점을 자동 분석한다. 수주가 소요되던 수동 보안 검토 과정을 자동화하여 AI 에이전트 배포 속

IBM Granite R2 임베딩 모델, 97M 파라미터로 60.3점 기록

IBM Granite R2 임베딩 모델, 97M 파라미터로 60.3점 기록

IBM이 200개 이상의 언어를 지원하는 Granite Embedding Multilingual R2 모델을 공개했다. 97M 파라미터 모델이 100M 이하급에서 가장 높은 60.3점의 검색 성능을 기록했다. 기존 R1 대비 64배 확장된 32K 토큰

Amazon Quick, Athena 교차 계정 액세스로 데이터 비용 분산 실현

Amazon Quick, Athena 교차 계정 액세스로 데이터 비용 분산 실현

Amazon Quick이 Athena의 교차 계정 액세스 기능을 출시했다. IAM 역할 체이닝을 통해 데이터가 있는 계정으로 쿼리 비용을 청구한다. 데이터 복제 없이 여러 계정의 데이터를 중앙에서 통합 분석할 수 있다.

Amazon Bedrock AgentCore, 450개 크롬 정책으로 AI 에이전트 브라우징 제어

Amazon Bedrock AgentCore, 450개 크롬 정책으로 AI 에이전트 브라우징 제어

Amazon Bedrock AgentCore가 크롬 엔터프라이즈 정책 지원을 시작했다. 450개 이상의 브라우저 설정을 통해 AI 에이전트의 접속 경로를 제어한다. 커스텀 루트 CA 지원으로 기업 내부 서비스 연결 시 인증서 오류를 해결했다.

Poetiq 메타시스템, GPT 5.5 High 코딩 성능 93.9%로 향상

Poetiq 메타시스템, GPT 5.5 High 코딩 성능 93.9%로 향상

Poetiq이 모델 튜닝 없이 코딩 성능을 높이는 메타시스템을 공개했다. GPT 5.5 High의 LCB Pro 점수를 89.6%에서 93.9%로 높였다. 자동으로 최적화 도구를 만들어 어떤 모델에도 적용 가능한 것이 특징이다.

Amazon Lex Assisted NLU, 의도 분류 정확도 92% 달성

Amazon Lex Assisted NLU, 의도 분류 정확도 92% 달성

Amazon Lex가 LLM 기반의 Assisted NLU 기능을 도입했다. 의도 분류 정확도 92%와 슬롯 분석 정확도 84%를 기록했다. 기존 표준 가격 체계에 포함되어 추가 비용 없이 제공된다.

PwC, Anthropic과 손잡고 금융·의료 분야 AI 전면 도입

PwC, Anthropic과 손잡고 금융·의료 분야 AI 전면 도입

PwC가 Anthropic의 Claude를 활용해 기업 재무 및 운영 체계를 재설계한다. 금융과 의료 등 규제 산업을 중심으로 업무 효율을 최대 70% 개선한다. 미국 내 3만 명의 전문가를 대상으로 AI 교육 및 인증 프로그램을 운영한다.

OpenAI Codex 모바일 앱 출시, 원격 SSH로 개발 제어권 확장

OpenAI Codex 모바일 앱 출시, 원격 SSH로 개발 제어권 확장

OpenAI가 Codex를 ChatGPT 모바일 앱에 통합했다. 원격 SSH 지원으로 모바일에서 개발 서버를 직접 제어할 수 있다. 무료 플랜을 포함한 모든 사용자에게 프리뷰 버전으로 제공된다.

비동기 배치 처리로 GPU 유휴 시간 24.0%를 제거하는 법

비동기 배치 처리로 GPU 유휴 시간 24.0%를 제거하는 법

연속 배치 처리에서 CPU와 GPU의 동기화 지연이 발생한다. 비동기 배치를 도입하면 GPU 유휴 시간을 24.0% 줄일 수 있다. CUDA 스트림을 활용해 연산 병렬화를 구현하는 것이 핵심이다.

Anthropic, 빌 게이츠 재단과 2억 달러 규모 AI 협력 시작

Anthropic, 빌 게이츠 재단과 2억 달러 규모 AI 협력 시작

Anthropic이 빌 게이츠 재단과 2억 달러 규모의 파트너십을 체결했다. 글로벌 보건과 교육 등 공익 분야에 Claude 모델과 기술을 지원한다. HPV 관련 사망자의 90%가 저소득 국가에 집중된 문제를 해결할 계획이다.

Dos Pinos, AI 에이전트로 패키징 오류 50% 줄이고 출시 기간 10일 단축

Dos Pinos, AI 에이전트로 패키징 오류 50% 줄이고 출시 기간 10일 단축

Dos Pinos가 AI 에이전트를 도입해 패키징 설계 오류를 50% 이상 줄였다. 제품 출시 기간을 10일 단축하며 운영 민첩성을 확보했다. Copilot을 1,000명에게 배포하고 2026년까지 전사 확대를 추진한다.

NVIDIA GeForce NOW, Subnautica 2 포함 11종 게임 추가로 진입장벽 제거

NVIDIA GeForce NOW, Subnautica 2 포함 11종 게임 추가로 진입장벽 제거

NVIDIA가 GeForce NOW에 Subnautica 2 등 11종의 게임을 추가했다. 설치 없이 고사양 게임을 즐길 수 있는 클라우드 환경을 확장했다. 하드웨어 제약을 없애 게임 유통의 인프라 지배력을 강화하고 있다.

Pulse AI와 Amazon Bedrock 결합, 금융 문서 1,000장 처리 3시간으로 단축

Pulse AI와 Amazon Bedrock 결합, 금융 문서 1,000장 처리 3시간으로 단축

Pulse AI와 Amazon Bedrock 기반의 금융 문서 처리 파이프라인이 공개됐다. Nova Micro 모델을 통해 1,000장의 복잡한 문서를 3시간 만에 처리했다. 전통적 OCR의 한계를 넘어 의미론적 구조 분석과 맞춤형 모델 학습을 지원한

AutoScout24, Codex 도입으로 개발 주기 '주 단위'에서 '일 단위'로 단축

AutoScout24, Codex 도입으로 개발 주기 '주 단위'에서 '일 단위'로 단축

AutoScout24가 OpenAI의 Codex와 ChatGPT를 전사적으로 도입했다. 개발 주기 속도가 주 단위에서 일 단위로 대폭 단축되었다. 2,000명의 직원 중 1,000명의 개발 인력이 AI 코딩 에이전트를 활용한다.

Codex, 재무팀 MBR 작성과 모델 QA 자동화

Codex, 재무팀 MBR 작성과 모델 QA 자동화

Codex가 재무팀의 보고서 작성과 모델 검증을 자동화한다. 엑셀과 대시보드 데이터를 기반으로 경영 보고서 초안을 생성한다. 수식 오류 검토와 데이터 정제 작업을 통해 모델 신뢰도를 높인다.

TanStack 공급망 공격 여파, OpenAI macOS 앱 업데이트 강제

TanStack 공급망 공격 여파, OpenAI macOS 앱 업데이트 강제

OpenAI가 TanStack 라이브러리 공급망 공격에 대응해 보안 인증서를 교체한다. macOS 사용자는 2026년 6월 12일까지 앱을 최신 버전으로 업데이트해야 한다. 사용자 데이터 유출이나 제품 변조 흔적은 발견되지 않았다고 밝혔다.

Codex 활용한 재무 보고서 자동화 및 모델 검증 프로세스

Codex 활용한 재무 보고서 자동화 및 모델 검증 프로세스

Codex가 재무 팀의 월간 사업 리뷰 및 보고서 작성을 지원한다. 엑셀 수식 오류 검증과 데이터 정제 기능을 통해 모델 신뢰도를 높인다. 구글 드라이브와 슬랙 등 다양한 플러그인을 통해 기업 데이터에 접근한다.

Codex 윈도우 샌드박스 구현: SID와 토큰으로 관리자 권한 없이 제어

Codex 윈도우 샌드박스 구현: SID와 토큰으로 관리자 권한 없이 제어

OpenAI가 윈도우용 Codex를 위한 전용 샌드박스를 구현했다. SID와 쓰기 제한 토큰을 활용해 관리자 권한 없이 파일 쓰기를 제어한다. 환경 변수와 경로 조작을 통해 네트워크 외부 유출 가능성을 차단했다.

15%의 클로드 언급, AI 챗봇이 개인 전화번호를 유출하는 이유

15%의 클로드 언급, AI 챗봇이 개인 전화번호를 유출하는 이유

Google Gemini 등 생성형 AI가 실제 개인 전화번호를 답변에 포함해 유출하는 사례가 보고되고 있다. 개인정보 삭제 서비스 기업에 따르면 생성형 AI 관련 문의가 최근 7개월간 400% 급증했다. 학습 데이터에 포함된 개인 식별 정보가 모델에

Amazon Nova Sonic과 WebRTC로 구현하는 실시간 음성 스트리밍

Amazon Nova Sonic과 WebRTC로 구현하는 실시간 음성 스트리밍

Amazon Nova Sonic과 WebRTC를 결합한 실시간 음성 대화 아키텍처가 공개되었다. WebRTC는 가변 비트레이트 조절을 통해 불안정한 네트워크 환경에서도 지연 시간을 최소화한다. Nova Sonic은 음성 대 음성 모델로 외부 도구 호출

Anthropic, 소상공인 위한 Claude for Small Business 출시

Anthropic, 소상공인 위한 Claude for Small Business 출시

Anthropic이 소상공인을 위한 전용 AI 도구 모음인 Claude for Small Business를 공개했다. QuickBooks, PayPal 등 기존 업무 도구와 연동하여 급여 관리와 송장 처리 등 15가지 자동화 워크플로우를 제공한다. P

구글 딥마인드, 마우스 포인터에 AI 시각 이해 기능 탑재

구글 딥마인드, 마우스 포인터에 AI 시각 이해 기능 탑재

구글 딥마인드가 제미나이 기반 AI 마우스 포인터를 실험 공개했다. 포인터가 커서 주변 화면의 시각·의미 맥락을 실시간으로 이해한다. 크롬과 구글북 노트북에 통합되며 음성 명령만으로 작업이 가능해진다.

Hermes 에이전트, 14만 GitHub 스타 돌파…NVIDIA RTX·DGX Spark에서 로컬 구동

Hermes 에이전트, 14만 GitHub 스타 돌파…NVIDIA RTX·DGX Spark에서 로컬 구동

Hermes 에이전트가 14만 GitHub 스타를 넘으며 가장 많이 사용되는 오픈소스 에이전트로 자리 잡았다. NVIDIA RTX GPU와 DGX Spark에서 최적화된 로컬 구동이 가능하며, Qwen 3.6 모델과 결합해 성능을 극대화한다. Qwen

NVIDIA, Ineffable Intelligence와 강화학습 전용 인프라 공동 설계

NVIDIA, Ineffable Intelligence와 강화학습 전용 인프라 공동 설계

NVIDIA가 데이비드 실버의 Ineffable Intelligence와 협력한다. 경험을 통해 스스로 지식을 발견하는 대규모 강화학습 인프라를 구축한다. Grace Blackwell과 Vera Rubin 플랫폼을 통해 최적화된 파이프라인을 설계한다.

알파고 10년의 진화, 노벨상 수상한 알파폴드와 제미나이의 현재

알파고 10년의 진화, 노벨상 수상한 알파폴드와 제미나이의 현재

구글 딥마인드의 알파폴드가 단백질 구조 분석 성과로 노벨 화학상을 수상했다. 구글의 AI 기술은 질병 진단과 기후 예측 등 과학 난제 해결에 활용되고 있다. 이러한 기술적 성취가 현재 스마트폰 속 제미나이 서비스에 통합되고 있다.

OpenAI 기반 하이브리드 메모리 자율 에이전트 구축 가이드

OpenAI 기반 하이브리드 메모리 자율 에이전트 구축 가이드

OpenAI 모델을 활용한 모듈형 자율 에이전트 설계법을 공개한다. 벡터 검색과 키워드 매칭을 결합한 하이브리드 메모리 구조를 구현한다. 런타임 도구 교체가 가능한 유연한 아키텍처로 실무 적용성을 높였다.

AWS P6 인스턴스와 EFA로 구현하는 파운데이션 모델 학습 인프라

AWS P6 인스턴스와 EFA로 구현하는 파운데이션 모델 학습 인프라

AWS가 파운데이션 모델 학습과 추론을 위한 통합 인프라 구조를 공개했다. NVIDIA H100과 B200 기반의 P5, P6 인스턴스 라인업을 통해 연산 성능을 높였다. EFA 기술로 수천 대의 서버를 하나처럼 연결해 데이터 통신 병목 현상을 해결했

Amazon SageMaker AI, EU AI Act 대응 위해 FLOPs 측정 도구 공개

Amazon SageMaker AI, EU AI Act 대응 위해 FLOPs 측정 도구 공개

Hugging Face가 Amazon SageMaker AI에 연산량 측정 도구를 통합했다. EU AI Act의 30% 연산량 기준을 초과하면 모델 제공자로 분류된다. 설정 한 줄로 실시간 연산량 추적과 감사 문서 생성이 가능해졌다.