KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 85 pt3. Muse Spark 1.3 (max) 47 pt4. gpt-oss-120b (high) 43 pt5. GPT-5.6 Luna (max) 28 pt

AI 기술 블로그

엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

OpenAI, 개인정보 필터 모델 공개…1.5B 파라미터로 96% 정확도

OpenAI, 개인정보 필터 모델 공개…1.5B 파라미터로 96% 정확도

OpenAI가 개인정보 탐지 및 마스킹 모델 Privacy Filter를 공개했다. 모델은 1.5B 파라미터로 로컬 실행이 가능하며 96% F1 점수를 기록했다. 기존 정규식 기반 도구 대비 문맥을 이해해 더 정교한 필터링이 가능하다.

Deep양자 머신러닝 학습을 위한 5가지 GitHub 리포지토리

양자 머신러닝 학습을 위한 5가지 GitHub 리포지토리

양자 머신러닝은 양자 컴퓨팅과 머신러닝의 아이디어를 결합한다. 5개의 GitHub 리포지토리가 양자 머신러닝 학습에 유용하다. 각 리포지토리는 다양한 학습 스타일에 맞춘 자료를 제공한다.

NVIDIA Earth-2, 단일 GPU로 기상 전처리 연산 50% 병목 해결

NVIDIA Earth-2, 단일 GPU로 기상 전처리 연산 50% 병목 해결

NVIDIA가 기후 예측 AI 스택인 Earth-2를 공개했다. 데이터 전처리 연산량을 줄여 단일 GPU 구동을 구현했다. 초단기 기상 예측의 해상도를 킬로미터 단위로 정밀화했다.

Google DeepMind, 5대 컨설팅사와 기업용 에이전트 AI 생산 단계 진입 가속화

Google DeepMind, 5대 컨설팅사와 기업용 에이전트 AI 생산 단계 진입 가속화

Google DeepMind가 5대 글로벌 컨설팅사와 파트너십을 맺었다. 전 세계 기업의 AI 생산 단계 도입률을 25%에서 끌어올릴 계획이다. 단순 챗봇을 넘어 스스로 과업을 수행하는 에이전트 AI 보급에 집중한다.

Google TPU 8i·8t 공개, AI 에이전트 추론 속도와 학습 효율 잡는다

Google TPU 8i·8t 공개, AI 에이전트 추론 속도와 학습 효율 잡는다

Google이 AI 에이전트 시대를 위한 TPU 8i와 8t 칩을 공개했다. TPU 8i는 에이전트의 다단계 워크플로우 실행 속도를 높이는 데 최적화되었다. TPU 8t는 거대 모델을 단일 메모리 풀에서 학습시킬 수 있도록 설계되었다.

Deep구글 클라우드, 엔비디아 루빈 GPU 탑재 A5X 인스턴스 공개…추론 비용 10분의 1로

구글 클라우드, 엔비디아 루빈 GPU 탑재 A5X 인스턴스 공개…추론 비용 10분의 1로

구글 클라우드가 엔비디아 루빈 GPU 기반 A5X 인스턴스를 발표했다. 이전 세대 대비 추론 비용은 10분의 1, 처리량은 10배 향상됐다. 보안 GPU 가상머신과 제미나이 온프레미스 배포도 함께 공개됐다.

DeepHyatt가 ChatGPT Enterprise를 전사 배치하며 온보딩을 라이브로 진행했다

Hyatt가 ChatGPT Enterprise를 전사 배치하며 온보딩을 라이브로 진행했다

Hyatt가 전 세계 직원에 ChatGPT Enterprise를 배치했다. Hyatt가 OpenAI와 함께 라이브 온보딩·교육을 진행했다. OpenAI는 전 세계 100만+ 비즈니스 고객이 사용 중이라고 밝혔다.

GPT-5.1 기반 NZGD, 지질 데이터 검색 시간 40% 단축

GPT-5.1 기반 NZGD, 지질 데이터 검색 시간 40% 단축

뉴질랜드가 GPT-5.1 기반의 지질 데이터베이스 NZGD를 구축했다. 자연어 쿼리를 통해 데이터 검색 시간을 기존 대비 40% 단축했다. AI가 분석이 아닌 데이터 필터링에 집중하도록 가드레일을 설정했다.

OpenAI Codex Labs 출시, 7개 GSI 파트너십으로 기업 코드 자동화 가속

OpenAI Codex Labs 출시, 7개 GSI 파트너십으로 기업 코드 자동화 가속

OpenAI가 기업용 도입을 돕는 Codex Labs를 출시했다. 400만 명의 개발자가 사용하며 7개 글로벌 시스템 통합 기업과 협력한다. 단순 코딩을 넘어 브라우저 작업과 문서 작성 등 업무 전반으로 확장한다.

Spectrum 출시, 앱 설치 없이 iMessage에서 AI 에이전트와 대화한다

Spectrum 출시, 앱 설치 없이 iMessage에서 AI 에이전트와 대화한다

Photon이 AI 에이전트 배포 프레임워크 Spectrum을 공개했다. iMessage와 왓츠앱 등 기존 메시징 앱에 에이전트를 직접 연결한다. 엣지 네트워크를 통해 150~250ms의 초저지연 응답 속도를 구현했다.

Hyperopt TPE로 모델 선택과 튜닝을 자동화하는 조건부 최적화 파이프라인

Hyperopt TPE로 모델 선택과 튜닝을 자동화하는 조건부 최적화 파이프라인

Hyperopt와 TPE 알고리즘을 활용한 하이퍼파라미터 최적화 파이프라인을 구현했다. 모델 선택과 파라미터 튜닝을 동시에 수행하는 조건부 탐색 공간을 구축했다. 조기 종료 기능과 결과 분석 도구를 통해 최적화 효율을 높였다.

DVC와 SageMaker MLflow로 머신러닝 데이터 계보 추적하기

DVC와 SageMaker MLflow로 머신러닝 데이터 계보 추적하기

DVC와 SageMaker AI MLflow를 결합해 모델 학습 데이터의 계보를 완벽히 추적한다. 데이터 버전 관리와 모델 수명 주기 관리를 분리하여 감사 요구사항을 충족한다. Git 커밋 해시를 매개변수로 기록하여 학습 데이터와 모델을 정밀하게 연결

Claude Cowork, Amazon Bedrock 연동으로 기업용 AI 확장

Claude Cowork, Amazon Bedrock 연동으로 기업용 AI 확장

Anthropic이 Claude Cowork를 Amazon Bedrock에서 실행하는 기능을 발표했다. 기업은 AWS 환경 내에서 데이터 보안을 유지하며 지식 노동자에게 AI를 배포할 수 있다. 기존 AWS 청구 체계를 활용하며 별도의 좌석 라이선스

딥페이크 악용 실태와 규제의 한계: Grok 사례와 정치적 왜곡

딥페이크 악용 실태와 규제의 한계: Grok 사례와 정치적 왜곡

AI 생성 이미지 기술이 성적 착취물과 정치적 선동에 악용되고 있다. Grok의 이미지 편집 기능이 성적 이미지 생성에 활용되는 등 부작용이 크다. 기술적 방어와 법적 규제만으로는 악의적인 딥페이크 확산을 막기 어렵다.

AI 도구로 강화된 사이버 범죄의 새로운 양상

AI 도구로 강화된 사이버 범죄의 새로운 양상

AI 도구가 사이버 범죄자들에게 새로운 기회를 제공하고 있다. 범죄자들이 AI를 활용해 피싱 이메일과 딥페이크 영상을 제작하고 있다. 사이버 공격의 양과 질이 증가하면서 방어의 중요성이 더욱 커지고 있다.

LLM+ 전환: 트랜스포머 대체하고 재귀 구조로 복잡한 문제 해결한다

LLM+ 전환: 트랜스포머 대체하고 재귀 구조로 복잡한 문제 해결한다

LLM이 복잡한 문제를 스스로 해결하는 LLM+ 단계로 진화하고 있다. 트랜스포머 구조를 벗어나 확산 모델과 재귀적 처리 방식을 도입한다. 컨텍스트 윈도우 확장과 효율적 연산으로 자율적 업무 수행을 목표로 한다.

AI 10대 핵심 동향: 휴머노이드 학습과 중국 모델 무료 배포의 실체

AI 10대 핵심 동향: 휴머노이드 학습과 중국 모델 무료 배포의 실체

휴머노이드 로봇 학습을 위해 인간의 동작 영상 데이터 수집이 가속화되고 있다. 중국 AI 연구소들이 최첨단 모델을 무료로 배포하며 글로벌 영향력을 확대하고 있다. 단일 AI 에이전트에서 협력형 멀티 에이전트 체계로 기술 패러다임이 전환 중이다.

오프라인 AI 코딩 도우미 구축하기: OpenCode, Ollama, Qwen3-Coder

오프라인 AI 코딩 도우미 구축하기: OpenCode, Ollama, Qwen3-Coder

OpenCode, Ollama, Qwen3-Coder를 결합해 오프라인 AI 코딩 도우미를 구축할 수 있다. 이 설정은 개인 정보 보호와 비용 절감의 장점을 제공한다. 설치 과정과 사용법을 통해 개발자들이 효율성을 높일 수 있다.

구글, 합성 데이터 생성 프레임워크 '시뮬라' 공개…4단계 제어로 전문 영역 커버

구글, 합성 데이터 생성 프레임워크 '시뮬라' 공개…4단계 제어로 전문 영역 커버

구글과 EPFL 연구팀이 합성 데이터 생성 프레임워크 '시뮬라'를 발표했다. 시뮬라는 계층적 분류체계와 이중 비평 구조로 데이터 품질·다양성·복잡성을 동시에 제어한다. 사이버보안·법률·수학 등 전문 영역에서 최대 51만2000개 데이터 포인트를 생성할

판다스 6가지 패턴으로 데이터 과학 속도 100배 높인다

판다스 6가지 패턴으로 데이터 과학 속도 100배 높인다

iterrows() 대신 벡터화 조건문으로 50~100배 속도 향상이 가능하다. merge() 검증 없이 조인하면 데이터가 조용히 수백만 행으로 부풀어 오른다. transform()과 pipe()로 그룹 연산과 체인을 한 단계로 압축한다.

Deep5가지 도커 최적화 기법으로 이미지 크기 줄이기

5가지 도커 최적화 기법으로 이미지 크기 줄이기

개발자들이 도커 이미지 크기 문제로 어려움을 겪고 있다. 최적화 기법을 적용하면 이미지 크기를 60~80% 줄일 수 있다. 이 기법들은 도커 사용자의 빌드 시간을 단축시키는 데 도움을 준다.

아랍어 LLM 성능 측정의 함정, QIMMA가 검증한 109개 벤치마크 데이터

아랍어 LLM 성능 측정의 함정, QIMMA가 검증한 109개 벤치마크 데이터

아랍어 LLM 평가를 위한 새로운 리더보드 QIMMA가 공개되었다. 기존 벤치마크의 품질 문제를 해결하기 위해 다단계 검증을 도입했다. 검증 결과 Jais-2-70B-Chat 모델이 종합 성능 1위를 차지했다.

Deep중국 Moonshot AI, Kimi K2.6 오픈소스…300개 하위 에이전트 동시 제어

중국 Moonshot AI, Kimi K2.6 오픈소스…300개 하위 에이전트 동시 제어

Moonshot AI가 Kimi K2.6 모델을 오픈소스로 공개했다. 모델은 300개 하위 에이전트와 4,000개 협력 단계를 지원한다. SWE-Bench Pro에서 58.6점을 기록하며 GPT-5.4를 앞질렀다.

DeepPhi-4-mini로 경량 AI 시스템 구축하기

Phi-4-mini로 경량 AI 시스템 구축하기

Microsoft의 Phi-4-mini 모델이 4비트 양자화로 제공된다. 개발자는 이를 통해 대화형 AI와 도구 호출을 구현할 수 있다. LoRA를 활용한 경량화된 맞춤형 학습이 가능해졌다.

Nemotron-Personas-Korea로 한국 에이전트 20분 내 배포

Nemotron-Personas-Korea로 한국 에이전트 20분 내 배포

Nemotron-Personas-Korea가 600만 개 합성 페르소나를 제공한다. KOSIS·대법원·건보공단·농촌경제연구원 통계로 인구 분포를 고정한다. PII 없이 PIPA를 고려해 페르소나를 시스템 프롬프트로 주입한다.

모델 내부 로짓에서 이미지 정보가 새나간다

모델 내부 로짓에서 이미지 정보가 새나간다

연구팀이 비전-언어 모델의 내부 표현에서 불필요한 정보가 유출될 위험을 체계적으로 비교했다. 모델의 최종 로짓만으로도 이미지의 작업과 무관한 세부 정보를 상당 부분 복원할 수 있었다. 튜닝 렌즈로 얻은 저차원 투영과 로짓 기반 정보량이 거의 동등한 수

크롬 제미나이 아이콘, 탭 20개 정보 요약까지 클릭 한 번으로

크롬 제미나이 아이콘, 탭 20개 정보 요약까지 클릭 한 번으로

Google이 크롬 브라우저 우측 상단에 제미나이 아이콘을 추가했다. 열려 있는 여러 탭의 정보를 한 번에 비교하고 정리할 수 있다. 기기 내부에서 작동하는 제미나이 나노 모델로 이미지 변환 기능도 제공한다.

크롬에 AI 제미나이 탑재, 브라우징 혁신 시작

크롬에 AI 제미나이 탑재, 브라우징 혁신 시작

구글이 AI 제미나이를 크롬에 통합했다. 이제 복잡한 작업을 쉽게 처리할 수 있는 기능이 추가되었다. 브라우저에서 멀티태스킹과 정보 검색이 한층 수월해졌다.

G7e 인스턴스, Amazon SageMaker AI에서 비용 절감과 성능 향상

G7e 인스턴스, Amazon SageMaker AI에서 비용 절감과 성능 향상

Amazon SageMaker AI에서 G7e 인스턴스가 출시됐다. NVIDIA RTX PRO 6000 GPU를 활용해 성능이 2.3배 향상됐다. 비용은 G6e 대비 2.6배 절감 가능하다.

DeepBedrock AgentCore로 옴니채널 음성 주문: Nova 2 Sonic

Bedrock AgentCore로 옴니채널 음성 주문: Nova 2 Sonic

Amazon Bedrock AgentCore로 음성 주문 에이전트를 배포했음. Amazon Nova 2 Sonic을 Bedrock에서 speech-to-speech로 썼음. Amplify·API Gateway·DynamoDB로 옴니채널 주문 흐름을 연