KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 90 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Muse Spark 1.3 (max) 46 pt3. gpt-oss-120b (high) 39 pt4. GPT-5.6 Luna (max) 27 pt5. GPT-5.6 Terra (max) 22 pt

AI 기술 블로그

엔지니어링·제품·전략 관점에서 기술 리더와 연구자들의 심층 인사이트를 큐레이션합니다.

맥락 끊김 없는 AI 병렬 개발, Git Worktree로 구축하는 가상 AI 팀

맥락 끊김 없는 AI 병렬 개발, Git Worktree로 구축하는 가상 AI 팀

AI 에이전트로 작업 중 브랜치를 바꾸면 그동안 쌓아온 맥락이 사라져 다시 설명해야 하는 불편함이 있다. Git Worktree를 쓰면 하나의 저장소에서 여러 작업 디렉토리를 독립적으로 운영해 AI 에이전트를 병렬로 배치할 수 있다. MS 해커톤 사례

헤어드라이어 하나로 2만 달러 챙긴 기상 데이터 조작 사건

헤어드라이어 하나로 2만 달러 챙긴 기상 데이터 조작 사건

날씨 예보는 농업부터 에너지 가격까지 산업 전반의 의사결정에 결정적인 영향을 미친다. 최근 파리 공항에서 헤어드라이어로 기온을 조작해 예측 시장에서 거액을 챙긴 사례가 발생했다. 데이터 의존도가 높은 AI 기상 모델이 확산하며 이러한 데이터 오염이 시

논문 분석부터 에이전트 구현까지, AI 실무자 필수 유튜브 채널 10선

논문 분석부터 에이전트 구현까지, AI 실무자 필수 유튜브 채널 10선

쏟아지는 AI 논문과 오픈소스 저장소를 모두 읽는 것은 물리적으로 불가능하다. 2026년 현재 유튜브는 코드 워크스루부터 산업 분석까지 제공하는 핵심 교육 플랫폼이다. 연구 분석, 실전 구현, 기초 개념, 산업 분석의 4개 영역으로 분류된 10개 채널

"며칠 걸릴 RAG 구축을 몇 분 만에", 아마존 베드록 매니지드 지식베이스 공개

"며칠 걸릴 RAG 구축을 몇 분 만에", 아마존 베드록 매니지드 지식베이스 공개

기업 데이터를 AI에 연결하는 RAG 시스템 구축은 복잡한 인프라 설정이 필수적이다. 아마존 베드록이 데이터 연결부터 벡터 저장소 관리까지 자동화한 매니지드 지식베이스를 출시했다. 6종의 기본 커넥터와 에이전트 기반 검색으로 구축 시간을 며칠에서 몇

Deep월 150통 놓치는 식당 전화, 아마존 Nova 2 Sonic으로 자동화하기

월 150통 놓치는 식당 전화, 아마존 Nova 2 Sonic으로 자동화하기

식당은 바쁜 저녁 시간대 전화 주문과 예약을 놓치는 경우가 많다. 아마존이 Bedrock AgentCore와 Nova 2 Sonic을 이용한 AI 호스트 구축법을 공개했다. 전화망과 AI 에이전트, 백엔드를 분리해 확장성을 높인 실무 아키텍처를 제시한

구글 검색 AI 모드, 인스타카트·캔바 등 외부 앱 직접 연결 지원

구글 검색 AI 모드, 인스타카트·캔바 등 외부 앱 직접 연결 지원

검색 결과에서 다른 앱으로 이동해 작업을 수행하던 번거로움이 줄어든다. 구글이 검색 내 AI 모드에서 인스타카트, 캔바, 유튜브 뮤직 등의 앱 연결 기능을 공개했다. 이번 업데이트는 이번 주부터 미국 지역을 대상으로 순차 적용된다.

월 100만 분의 상담을 AI로 대체한 Cars24의 OpenAI 운영 전략

월 100만 분의 상담을 AI로 대체한 Cars24의 OpenAI 운영 전략

중고차 거래는 앱 클릭 몇 번으로 끝나지 않고 수많은 전화와 서류 확인이 필요하다. 인도의 Cars24는 OpenAI API로 음성·채팅 에이전트를 구축해 월 100만 분 이상의 상담을 처리한다. 내부적으로는 Codex를 도입해 엔지니어링부터 재무 보

xAI Grok 4.3, 아마존 베드락 출시... 추론 강도 조절 기능 탑재

xAI Grok 4.3, 아마존 베드락 출시... 추론 강도 조절 기능 탑재

AI 모델을 쓸 때 복잡한 문제는 느리고 단순한 문제는 정확도가 떨어지는 경험을 한다. xAI의 Grok 4.3이 아마존 베드락에 출시되어 100만 토큰의 컨텍스트 윈도우를 제공한다. 요청마다 추론 강도를 4단계로 설정해 성능과 지연 시간 사이의 균형

RAG 검색 1위 달성, 엔비디아가 공개한 Nemotron 3 Embed의 실무 효율

RAG 검색 1위 달성, 엔비디아가 공개한 Nemotron 3 Embed의 실무 효율

AI가 엉뚱한 문서를 찾아와 답변이 틀리는 RAG의 고질적 문제는 검색 모델의 성능에 달렸다. 엔비디아가 RTEB 리더보드 1위를 기록한 Nemotron 3 Embed 모델 컬렉션을 공개했다. 고성능 8B 모델부터 블랙웰 가속을 지원하는 1B 모델까지

Google Vids, Gemini Omni 탑재로 '말 한마디'에 영상 편집·아바타 생성

Google Vids, Gemini Omni 탑재로 '말 한마디'에 영상 편집·아바타 생성

영상 제작은 촬영과 편집에 많은 시간과 전문 기술이 소요되는 작업이다. Google Vids가 Gemini Omni를 도입해 텍스트와 이미지로 영상을 생성하고 세부 편집하는 기능을 공개했다. 셀카와 음성 녹음만으로 나를 대신할 디지털 아바타를 만들어

엔비디아, RTX 5080급 클라우드 게임 확대... 인도 정식 출시

엔비디아, RTX 5080급 클라우드 게임 확대... 인도 정식 출시

고사양 게임을 위해 수백만 원대 그래픽카드를 구매해야 하는 부담이 크다. 엔비디아가 GeForce NOW에 RTX 5080급 성능을 도입하며 '오니무샤'를 출시한다. 인도 시장의 베타를 종료하고 UPI 결제를 지원하는 정식 서비스를 시작했다.

허깅페이스 보안 사고, 분석을 가로막은 상용 AI의 '가드레일'

허깅페이스 보안 사고, 분석을 가로막은 상용 AI의 '가드레일'

AI 모델 공유 플랫폼은 편리하지만 그만큼 공격 표면이 넓어 보안 위험이 크다. 허깅페이스가 자율형 AI 에이전트 공격을 받아 내부 데이터와 자격 증명이 유출됐다. 사고 분석 중 상용 AI의 안전 필터가 분석을 차단해 오픈웨이트 모델로 선회했다.

구글 딥마인드·이소모픽 랩스, AI 기반 '바이오 복원력' 체계 공개

구글 딥마인드·이소모픽 랩스, AI 기반 '바이오 복원력' 체계 공개

팬데믹 이후 감염병의 빠른 변이와 확산을 막기 위한 생물학적 보안의 중요성이 커지고 있다. 구글 딥마인드와 이소모픽 랩스가 AlphaFold, AlphaGenome 등 AI 모델을 활용한 바이오 복원력 전략을 발표했다. AI 생성 DNA 시퀀스 워터마

구글, 기업용 AI 플랫폼 '제미나이 엔터프라이즈'로 에이전트 전환 가속

구글, 기업용 AI 플랫폼 '제미나이 엔터프라이즈'로 에이전트 전환 가속

구글이 지난 14일부터 16일까지 서울에서 '구글 AI 포 비즈니스 2026' 행사를 개최했다. 기업의 업무 혁신을 지원하는 풀 스택 AI 전략과 제미나이 엔터프라이즈를 공개했다. 국내 주요 기업들의 실제 도입 사례와 최신 연구 성과를 공유하며 비즈니

사람보다 6배 강한 공격자, OpenAI의 자동 레드팀 모델 'GPT-Red'

사람보다 6배 강한 공격자, OpenAI의 자동 레드팀 모델 'GPT-Red'

사람이 일일이 찾아내던 AI 취약점을 AI가 스스로 공격하며 보완한다. OpenAI는 자동 레드팀 모델 GPT-Red를 통해 GPT-5.6의 보안성을 높였다. 프롬프트 인젝션 공격 성공률을 기존 대비 6배 낮추며 방어력을 강화했다.

14개 AI 스타트업 전원 제미나이 도입, 구글 포 스타트업 액셀러레이터 2026 성과

14개 AI 스타트업 전원 제미나이 도입, 구글 포 스타트업 액셀러레이터 2026 성과

AI 모델 도입과 사업화는 모든 스타트업의 필수 과제가 됐다. 구글이 10주간 14개 AI 스타트업을 육성한 GFSA 2026 프로그램을 마무리했다. 참가사 전원이 제미나이를 서비스에 적용하며 100% 도입률을 기록했다.

며칠 걸리던 부동산 서류 검토, AWS Bedrock으로 '분 단위'로 줄인 Built Technologies

며칠 걸리던 부동산 서류 검토, AWS Bedrock으로 '분 단위'로 줄인 Built Technologies

부동산 금융은 수천 페이지의 복잡한 서류를 사람이 일일이 검토해야 하는 수작업 중심 산업이다. Built Technologies는 Amazon Bedrock 기반의 문서 지능 엔진을 구축해 250종 이상의 서류를 자동 처리한다. 단순 텍스트 추출을 넘

로봇의 뇌를 더 작고 강하게, 엔비디아 Jetson Thor T3000·T2000 공개

로봇의 뇌를 더 작고 강하게, 엔비디아 Jetson Thor T3000·T2000 공개

연구실을 벗어나 일상으로 나오는 휴머노이드 로봇의 수요가 늘고 있다. 엔비디아가 엣지 AI(기기 자체에서 데이터를 처리하는 기술) 전용 Thor 아키텍처 기반 T3000과 T2000 모듈을 발표했다. 40억 개 파라미터의 Cosmos 3 Edge 모델

1조 파라미터 멀티모달 Inkling 공개, 100만 컨텍스트와 오디오·이미지 통합 추론

1조 파라미터 멀티모달 Inkling 공개, 100만 컨텍스트와 오디오·이미지 통합 추론

텍스트를 넘어 이미지와 오디오를 동시에 이해하는 멀티모달 AI 수요가 늘고 있다. Thinking Machines가 1조 파라미터 규모와 100만 컨텍스트를 지원하는 Inkling을 공개했다. BF16 및 NVFP4 정밀도를 제공하며 transform

씬 랩톱에 심는 AI 슈퍼칩, NVIDIA RTX Spark 공개

씬 랩톱에 심는 AI 슈퍼칩, NVIDIA RTX Spark 공개

고성능 게임과 AI 작업을 위해선 무거운 노트북이 필수였다. NVIDIA가 슬림 랩톱과 소형 PC용 슈퍼칩 RTX Spark를 공개했다. SEGA의 버추어 파이터 크로스로드 등 최신 타이틀이 이 칩을 지원한다.

주 정부가 먼저 닦은 길, 미국 AI 안전 국가 표준으로

주 정부가 먼저 닦은 길, 미국 AI 안전 국가 표준으로

강력한 AI 모델의 안전성을 누가, 어떻게 검증할 것인가에 대한 논의가 전 세계적으로 치열합니다. 미국은 캘리포니아, 뉴욕, 일리노이주가 만든 기준을 국가 표준으로 통합하는 '역연방주의' 전략을 취하고 있습니다. 8월 초까지 사이버 보안 테스트 체계를

정확도 너머의 '인간미'를 측정하는 음성 AI 벤치마크 Real World VoiceEQ 공개

정확도 너머의 '인간미'를 측정하는 음성 AI 벤치마크 Real World VoiceEQ 공개

음성 AI가 텍스트를 대체하고 있지만 여전히 기계적인 느낌이 남는다. Hume이 100만 건의 인간 평가 데이터를 기반으로 한 Real World VoiceEQ를 발표했다. 40개 이상의 모델을 60개 이상의 지표로 분석해 감정과 톤 같은 인간적 품질

Deep병원 예약 대기 8분 없앤다, ScienceSoft의 AWS 기반 AI 음성 스케줄러

병원 예약 대기 8분 없앤다, ScienceSoft의 AWS 기반 AI 음성 스케줄러

병원 예약 시 겪는 긴 대기 시간과 반복적인 정보 확인의 불편함을 해결한다. ScienceSoft가 Amazon Nova Sonic과 Bedrock Guardrails를 결합해 HIPAA 준수 AI 음성 예약 시스템을 구축했다. 음성-대-음성 구조로

구글, 제미나이 3.5 플래시·안티그래비티 2.0으로 앱 개발 주기 단축

구글, 제미나이 3.5 플래시·안티그래비티 2.0으로 앱 개발 주기 단축

구글과 같은 빅테크의 AI 모델 업데이트는 앱 개발 환경을 빠르게 바꾼다. 구글코리아는 7월 13일 '2026 책임감있는AI X 앱생태계 공동 포럼'을 개최했다. 제미나이 3.5 플래시와 개발 플랫폼 안티그래비티 2.0을 통한 생태계 변화를 논의했다.

코드 수정 없이 갈아타는 DeepSeek API, OpenAI·Anthropic 호환성 확보

코드 수정 없이 갈아타는 DeepSeek API, OpenAI·Anthropic 호환성 확보

많은 개발자가 OpenAI나 Anthropic의 API 표준을 통해 AI 서비스를 구축한다. DeepSeek API가 이들과 호환되는 형식을 지원하며 백엔드 모델 교체 비용을 없앴다. 기존 모델은 2026년 7월 24일 종료되며 deepseek-v4-

스크립트 없이 화면 보고 테스트한다 — 아마존 노바 액트(Nova Act) 공개

스크립트 없이 화면 보고 테스트한다 — 아마존 노바 액트(Nova Act) 공개

웹 서비스의 UI가 조금만 바뀌어도 자동화 테스트 코드가 깨져 고생하는 일이 잦다. 아마존이 시각 정보와 행동을 결합해 웹 브라우저를 직접 조작하는 노바 액트를 공개했다. 문서에서 테스트 시나리오를 자동 생성하고 실행 결과까지 지표로 산출하는 전체 파

리드 발굴 30분 리서치, Amazon Bedrock 멀티에이전트로 자동화

리드 발굴 30분 리서치, Amazon Bedrock 멀티에이전트로 자동화

잠재 고객 한 명을 찾기 위해 여러 커뮤니티를 뒤지는 수동 리서치는 시간이 너무 많이 걸리는 작업이다. Thrad.ai는 Amazon Bedrock과 Strands Agents로 6개 소스를 분석하는 멀티에이전트 시스템을 구축했다. 유연한 Swarm

테스트 20개를 동시에 돌리는 에이전트 QA, Amazon Nova Act 기반 QA Studio

테스트 20개를 동시에 돌리는 에이전트 QA, Amazon Nova Act 기반 QA Studio

배포 전마다 반복하는 지루한 회귀 테스트를 자동화하고 싶다. Amazon Nova Act를 활용한 QA Studio가 테스트 스위트와 CLI를 통해 이를 해결한다. ECS Fargate 기반 병렬 실행과 CI/CD 통합으로 테스트 시간을 획기적으로 줄

Deep전력 한계 넘는 엔비디아 Blackwell, Hopper 대비 와트당 성능 25배 달성

전력 한계 넘는 엔비디아 Blackwell, Hopper 대비 와트당 성능 25배 달성

AI 모델 규모가 커지며 전력 공급과 전기료가 인프라 확장의 핵심 제약이 되고 있다. 엔비디아는 Blackwell NVL72를 통해 이전 세대 대비 와트당 성능을 최대 25배 높였다. 하드웨어와 소프트웨어 통합 설계로 동일 전력 예산 내 GPU 배치

구글 이미지 25년, 텍스트 검색 넘어 '나노 바나나' AI 생성까지

구글 이미지 25년, 텍스트 검색 넘어 '나노 바나나' AI 생성까지

우리는 웹에서 원하는 사진을 찾기 위해 검색창에 단어를 입력해 왔다. 구글이 서비스 25주년을 맞아 개인 맞춤형 갤러리와 AI 이미지 생성 기능을 공개했다. 최신 나노 바나나 모델을 통해 AI 오버뷰에서 텍스트만으로 맞춤형 이미지를 즉시 만든다.