KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 80 pt3. Muse Spark 1.3 (max) 44 pt4. gpt-oss-120b (high) 40 pt5. GPT-5.6 Luna (max) 27 pt

AI 기술 블로그

엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

OpenAI, AI 사이버 방어 도구 민주화 액션 플랜 발표

OpenAI, AI 사이버 방어 도구 민주화 액션 플랜 발표

OpenAI가 AI 기반 사이버 방어 민주화를 위한 액션 플랜을 발표했다. 공격자의 AI 활용에 대응해 방어자용 인프라 구축과 도구 접근성을 확대한다. 정부 및 민간 전문가와 협력해 5가지 핵심 기둥 중심의 보안 체계를 세운다.

StereoFoley, 영상 속 사물 위치까지 파악해 입체 음향 생성

StereoFoley, 영상 속 사물 위치까지 파악해 입체 음향 생성

StereoFoley가 영상의 사물 위치를 인식해 48kHz 입체 음향을 생성한다. 기존 모델의 한계였던 모노 사운드를 넘어 공간감이 살아있는 소리를 구현한다. 합성 데이터 파이프라인을 통해 객체별 거리와 방향을 정밀하게 제어한다.

확산 모델의 구성적 일반화, 국소적 조건부 점수에서 해답 찾다

확산 모델의 구성적 일반화, 국소적 조건부 점수에서 해답 찾다

확산 모델이 학습 범위를 벗어난 조합을 생성하는 원리를 분석했다. 연구팀은 국소적 조건부 점수가 구성적 일반화의 핵심 기제임을 입증했다. SDXL 모델은 픽셀 공간이 아닌 특징 공간에서 이러한 국소성을 보인다.

LaDiR, 거대언어모델의 추론 한계를 확산 모델로 돌파하다

LaDiR, 거대언어모델의 추론 한계를 확산 모델로 돌파하다

LaDiR은 거대언어모델의 추론 과정을 잠재 공간에서 반복적으로 개선하는 새로운 프레임워크다. 기존의 순차적 생성 방식과 달리 잠재 확산 모델을 활용해 전체 추론 과정을 다각도로 검토한다. 수학적 추론 및 계획 수립 벤치마크에서 기존 모델 대비 향상된

Vanguard의 가상 분석가 구축: AWS 기반 AI 준비 데이터 전략

Vanguard의 가상 분석가 구축: AWS 기반 AI 준비 데이터 전략

Vanguard가 금융 데이터 분석을 위한 가상 분석가 솔루션을 구축했다. AWS의 Redshift, Glue, Bedrock을 활용해 AI 준비 데이터 인프라를 설계했다. 단순 모델 도입보다 데이터 거버넌스와 메타데이터 관리가 핵심임을 입증했다.

OpenAI GPT-5.5와 Codex, AWS Bedrock 탑재로 기업 AI 배포 가속

OpenAI GPT-5.5와 Codex, AWS Bedrock 탑재로 기업 AI 배포 가속

OpenAI가 GPT-5.5를 포함한 최신 모델을 Amazon Bedrock에 제공한다. 코딩 도구인 Codex와 관리형 에이전트 기능이 AWS 환경에 통합된다. 기업 고객은 기존 AWS 보안 및 결제 체계 내에서 OpenAI 모델을 사용한다.

Anthropic, Claude와 주요 창작 도구 연결하는 커넥터 공개

Anthropic, Claude와 주요 창작 도구 연결하는 커넥터 공개

Anthropic이 Blender와 Autodesk 등 창작 도구용 커넥터를 출시했다. MCP 기술을 활용해 Claude가 외부 소프트웨어와 직접 데이터를 주고받는다. 주요 예술 대학과 협력하여 창작 분야의 AI 활용 교육을 지원한다.

Google Translate 20주년, AI 발음 교정 기능 추가

Google Translate 20주년, AI 발음 교정 기능 추가

Google이 번역 서비스 20주년을 맞아 새 기능을 공개했다. Android 앱에서 AI 기반 발음 연습 도구를 사용할 수 있다. Gemini 모델을 통해 문맥을 파악하는 자연스러운 번역이 가능하다.

90일간의 AI 업무 전환 가이드: Copilot 활용 실전 전략

90일간의 AI 업무 전환 가이드: Copilot 활용 실전 전략

LinkedIn과 Microsoft 경영진이 90일간의 AI 업무 적응 로드맵을 제시했다. 업무를 AI 자동화 영역과 인간 고유 역량 영역으로 재분류하는 것이 핵심이다. Microsoft 365 Copilot을 활용해 반복 업무를 줄이고 전략적 성과를

NVIDIA Nemotron 3 Nano Omni 공개, 비디오 효율 9.2배 높였다

NVIDIA Nemotron 3 Nano Omni 공개, 비디오 효율 9.2배 높였다

NVIDIA가 멀티모달 모델 Nemotron 3 Nano Omni를 공개했다. 비디오 처리 효율을 기존 오픈 모델 대비 9.2배 높였다. 텍스트, 오디오, 비디오를 통합 처리하는 에이전트 기능을 제공한다.

OpenAI, FedRAMP 20x Moderate 인증 획득 및 GPT-5.5 제공

OpenAI, FedRAMP 20x Moderate 인증 획득 및 GPT-5.5 제공

OpenAI가 ChatGPT Enterprise와 API 플랫폼의 FedRAMP 20x Moderate 인증을 획득했다. 미국 정부 기관은 이제 보안 환경에서 GPT-5.5 모델을 즉시 사용할 수 있다. GSA가 도입한 20x 프로세스를 통해 인증 속

NVIDIA Omniverse와 OpenUSD로 구현하는 제조 공정 시뮬레이션

NVIDIA Omniverse와 OpenUSD로 구현하는 제조 공정 시뮬레이션

제조업계가 실제 환경 대신 고정밀 시뮬레이션 기반의 AI 학습을 도입하고 있다. ABB Robotics와 JLR 등은 시뮬레이션 환경을 통해 공정 시간을 최대 80% 단축했다. OpenUSD와 SimReady 표준을 통해 3D 자산의 물리적 정확성을

Choco, OpenAI API로 수동 주문 입력 80% 줄이고 생산성 2배 높였다

Choco, OpenAI API로 수동 주문 입력 80% 줄이고 생산성 2배 높였다

Choco가 OpenAI API를 활용해 식품 유통 주문 자동화 시스템을 구축했다. OrderAgent와 VoiceAgent를 통해 수동 주문 입력량을 80% 감소시켰다. 연간 1억 건 이상의 주문을 처리하며 영업팀 생산성을 2배로 끌어올렸다.

Anthropic 시드니 지사 개소 및 테오 후르무지스 신임 지사장 선임

Anthropic 시드니 지사 개소 및 테오 후르무지스 신임 지사장 선임

Anthropic이 호주 시드니에 공식 사무소를 열고 현지 사업을 본격화한다. Snowflake 출신의 테오 후르무지스가 호주 및 뉴질랜드 총괄 책임자로 임명되었다. Canva와 Xero 등 현지 기업과의 파트너십을 통해 Claude 활용 범위를 넓힌

NVIDIA, 초음파 원시 데이터 직접 학습하는 NV-Raw2Insights-US 공개

NVIDIA, 초음파 원시 데이터 직접 학습하는 NV-Raw2Insights-US 공개

NVIDIA와 지멘스 헬시니어스가 초음파 원시 데이터를 직접 학습하는 모델을 개발했다. 기존의 고정된 물리적 가정을 넘어 환자별 음속 지도를 실시간으로 생성한다. Holoscan Sensor Bridge를 통해 기존 초음파 장비와 고대역폭 데이터 연동

Symphony: Linear 이슈를 제어판으로 써서 PR 500% 늘린 오케스트레이터

Symphony: Linear 이슈를 제어판으로 써서 PR 500% 늘린 오케스트레이터

OpenAI가 이슈 트래커를 제어판으로 쓰는 Symphony를 공개했다. 에이전트가 티켓을 스스로 가져와 처리하며 PR 수를 500% 증가시켰다. 코딩의 중심이 세션 관리에서 티켓 발행이라는 기획 영역으로 이동했다.

Popsa, Amazon Nova 도입으로 개인화 제목 550만 건 생성

Popsa, Amazon Nova 도입으로 개인화 제목 550만 건 생성

Popsa가 Amazon Nova와 Claude 3 Haiku를 도입해 포토북 제목 추천 기능을 개선했다. 기존 그래프 알고리즘 대비 사용자 긍정 피드백이 58%에서 71%로 13%p 상승했다. 2025년 기준 총 550만 건 이상의 개인화된 제목을

Privacy Filter 모델과 Gradio Server를 활용한 웹 앱 구축 전략

Privacy Filter 모델과 Gradio Server를 활용한 웹 앱 구축 전략

Privacy Filter 모델이 128k 컨텍스트로 개인정보를 탐지한다. Gradio Server를 통해 모델 추론과 웹 인터페이스를 통합한다. FastAPI 기반의 구조로 데이터 처리와 UI 로직을 분리한다.

Google과 Kaggle, 6월 15일부터 자연어 기반 바이브 코딩 과정 운영

Google과 Kaggle, 6월 15일부터 자연어 기반 바이브 코딩 과정 운영

Google과 Kaggle이 6월 15일부터 5일간 AI 에이전트 집중 과정을 운영한다. 자연어로 프로그램을 만드는 바이브 코딩을 통해 실무형 에이전트 구축법을 다룬다. 지난 과정에서 150만 명의 학습자가 참여하며 높은 수요를 증명했다.

Microsoft와 OpenAI 파트너십 수정 계약으로 데이터센터 및 실리콘 협력 강화

Microsoft와 OpenAI 파트너십 수정 계약으로 데이터센터 및 실리콘 협력 강화

Microsoft와 OpenAI가 파트너십 수정 계약을 체결했다. 데이터센터 용량 확대와 차세대 실리콘 개발에 집중한다. 사이버 보안 분야의 AI 적용을 위해 협력을 강화한다.

Google, 한국에 AI 캠퍼스 설립하고 K-문샷 미션 협력한다

Google, 한국에 AI 캠퍼스 설립하고 K-문샷 미션 협력한다

Google이 서울 사무소 내에 AI 캠퍼스를 설립한다. 과학기술정보통신부의 K-문샷 미션과 연계해 연구 생산성을 높인다. 5만 명의 AI 에센셜 장학금과 구글 딥마인드 인턴십을 제공한다.

OpenAI AGI 5대 원칙과 인프라 수직 계열화 추진

OpenAI AGI 5대 원칙과 인프라 수직 계열화 추진

OpenAI가 인류 전체의 이익을 위한 AGI 개발 5대 원칙을 발표했다. 인프라 비용 절감을 위해 수직 계열화와 글로벌 데이터센터 구축을 추진한다. 반복적 배포 전략을 통해 사회적 적응과 기술적 정렬을 동시에 꾀한다.

Grok-voice-think-fast-1.0, τ-voice 벤치마크 67.3%로 음성 AI 성능 갱신

Grok-voice-think-fast-1.0, τ-voice 벤치마크 67.3%로 음성 AI 성능 갱신

xAI가 새로운 음성 AI 모델인 grok-voice-think-fast-1.0을 공개했다. τ-voice 벤치마크에서 67.3%를 기록하며 경쟁 모델들을 앞섰다. 스타링크 고객센터에 적용되어 70%의 자율 해결률을 달성했다.

GitNexus, 28,000개 별 받은 AI 코드 구조 분석 엔진

GitNexus, 28,000개 별 받은 AI 코드 구조 분석 엔진

GitNexus가 AI 코딩 에이전트를 위한 오픈소스 지식 그래프 엔진을 공개했다. 코드베이스의 의존성을 미리 분석해 MCP 서버를 통해 AI에게 전달한다. Claude Code와 Cursor 등 주요 AI 도구에서 구조적 인지 능력을 높여준다.

DeepSeek-V4, 100만 토큰 추론 비용을 90% 낮추다

DeepSeek-V4, 100만 토큰 추론 비용을 90% 낮추다

DeepSeek가 100만 토큰 컨텍스트를 지원하는 V4 시리즈를 공개했다. 압축 어텐션 기술로 추론 FLOPs를 V3.2 대비 27% 수준으로 낮췄다. 모델 체크포인트가 허깅페이스에 공개되어 누구나 내려받을 수 있다.

GPT-5.5 출시, 터미널 벤치마크 82.7%…개발자 작업 자동화 판 바꾼다

GPT-5.5 출시, 터미널 벤치마크 82.7%…개발자 작업 자동화 판 바꾼다

OpenAI가 완전 재학습된 에이전트 모델 GPT-5.5를 공개했다. 터미널 벤치마크 82.7%로 클로드 오퍼스 4.7을 크게 앞질렀다. 토큰당 가격은 두 배 올랐지만, 작업당 토큰 소모량이 줄어 실질 비용은 낮아졌다.

Anthropic, Amazon에 1000억 달러 투자하고 5GW 전력 확보

Anthropic, Amazon에 1000억 달러 투자하고 5GW 전력 확보

Anthropic이 Amazon과 협력해 최대 5GW의 컴퓨팅 용량을 확보했다. Amazon은 Anthropic에 50억 달러를 추가 투자하며 파트너십을 강화했다. Claude 플랫폼이 AWS 내에 직접 통합되어 제공될 예정이다.

Anthropic, 클로드 선거 중립성 96% 달성…미드텀 앞두고 안전장치 강화

Anthropic, 클로드 선거 중립성 96% 달성…미드텀 앞두고 안전장치 강화

Anthropic이 클로드의 정치적 중립성을 96%까지 개선했다. 미국 중간선거 앞두고 선거 오정보 생성 요청 차단율 99.8%를 기록했다. 모델이 자율적으로 영향력 작전을 수행하는지 처음으로 평가했다.

KPMG 캐나다 AI 책임자가 말하는 Copilot의 진짜 가치, 시간 절약이 아니다

KPMG 캐나다 AI 책임자가 말하는 Copilot의 진짜 가치, 시간 절약이 아니다

KPMG 캐나다가 Microsoft 365 Copilot을 전 직원 1만2000명에게 배포했다. Christine Andrew는 Copilot이 행정 업무를 압축해 전략적 활동에 시간을 재배치한다고 말한다. Copilot은 회의 요약과 전략 검토 도구

구글 Gemini 3.1 Flash Live 공개, 음성 지연 50% 줄이고 200개국 확장

구글 Gemini 3.1 Flash Live 공개, 음성 지연 50% 줄이고 200개국 확장

구글이 Gemini 3.1 Flash Live를 공개했다. 복잡한 함수 호출 벤치마크에서 90.8%를 기록했다. 200개국 이상에서 검색 라이브와 제미나이 라이브를 지원한다.