KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 80 pt3. Muse Spark 1.3 (max) 44 pt4. gpt-oss-120b (high) 40 pt5. GPT-5.6 Luna (max) 27 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

HyperDesk, Hyper-V 및 RDP 세션 통합 임베딩 앱 공개

HyperDesk, Hyper-V 및 RDP 세션 통합 임베딩 앱 공개

Hyper-V와 RDP 세션을 하나의 창에 임베딩하는 데스크톱 앱 HyperDesk가 공개됐다. Win32 Window Swallowing 방식을 통해 여러 원격 세션을 단일 뷰에서 즉시 전환하며 관리할 수 있다.

AI 시대 코드 비용 하락에 따른 데이터 모델 단순화 및 스크립트 분리 전략

AI 시대 코드 비용 하락에 따른 데이터 모델 단순화 및 스크립트 분리 전략

AI로 인한 코드 작성 비용 하락으로 복잡한 데이터 모델링 대신 스크립트 기반의 로직 분리 방식이 제안되었다. AI가 생성한 스크립트로 상위 로직을 변환해 구조를 단순화하고 책임 범위를 좁히는 것이 핵심이다.

Tencent, 210억 활성 파라미터 기반 MoE 모델 'Hy3' 공개

Tencent, 210억 활성 파라미터 기반 MoE 모델 'Hy3' 공개

Tencent Hy Team이 MoE 구조의 오픈 소스 LLM Hy3를 정식 공개했다. 전체 295B 파라미터 중 21B만 활성화하며 256K 컨텍스트 길이와 MTP 레이어를 탑재했다. 개발자는 도구 호출 안정성과 JSON 출력 준수 성능을 바탕으로

온디바이스 AI 관상·손금 앱 '아우라(AURA)' 오픈소스로 공개

온디바이스 AI 관상·손금 앱 '아우라(AURA)' 오픈소스로 공개

사진이 기기 외부로 전송되지 않는 온디바이스 AI 관상·손금 분석 앱 아우라(AURA)가 공개됐다. Google Gemma와 MediaPipe를 활용해 모든 분석을 기기 내부에서 처리하며, 오픈소스로 제공된다.

국산 AI 키운다더니, 뒤로는 팔란티어 쇼핑한 캐나다 정부

국산 AI 키운다더니, 뒤로는 팔란티어 쇼핑한 캐나다 정부

많은 국가가 AI 주권을 위해 자국 모델과 인프라 구축에 사활을 걸고 있다. 캐나다 정부는 2034년까지 기업 AI 도입률을 60%로 높이는 'AI for All' 전략을 발표했다. 하지만 정작 국방부와 경찰은 미국 팔란티어의 시스템을 수천만 달러 규

사라지는 목업 단계, 피그마가 '오퍼레이팅 레이어'를 선언한 이유

사라지는 목업 단계, 피그마가 '오퍼레이팅 레이어'를 선언한 이유

디자이너와 개발자가 협업하는 표준 도구로 피그마가 시장을 지배해 왔다. AI가 코드로 UI를 직접 생성하며 정적 목업 단계가 생략되는 위기에 직면했다. Config 2026에서 코드 레이어와 모션을 도입해 디자인 운영 체제로 전환한다.

AI 에이전트 시대의 엔지니어링, 코드 양보다 '제거'의 판단력이 핵심

AI 에이전트 시대의 엔지니어링, 코드 양보다 '제거'의 판단력이 핵심

AI 에이전트를 통한 코드 및 기능 생성 속도가 비약적으로 상승하며 제품의 양적 팽창이 가속화되고 있다. 하루 200회 동작하는 300ms 애니메이션이 연간 6시간의 사용자 시간을 소모한다는 계산처럼, 불필요한 추가가 사용자 경험을 저해한다. 개발자는

긴 컨텍스트 LLM 학습 메모리 절감을 위한 FLCE 기법 공개

긴 컨텍스트 LLM 학습 메모리 절감을 위한 FLCE 기법 공개

LLM 학습 시 긴 컨텍스트와 큰 어휘집으로 발생하는 메모리 부족 문제를 해결하는 FLCE 기법이 공개되었다. 포워드 패스 내에서 각 청크의 그래디언트를 즉시 계산해 피크 메모리를 낮춘다.

AI가 짠 코드를 제품으로 만드는 '맥락 설계자'의 등장

AI가 짠 코드를 제품으로 만드는 '맥락 설계자'의 등장

ChatGPT 같은 AI가 코드를 짜주는 시대가 왔습니다. 이제 개발자는 단순 코딩보다 문제 정의와 작업 설계에 집중해야 합니다. AI 산출물을 검토하고 지속 가능한 제품으로 다듬는 능력이 핵심 경쟁력이 됩니다.

성능은 올랐는데 도구 호출은 퇴보 — Claude 최신 모델의 스키마 오류

성능은 올랐는데 도구 호출은 퇴보 — Claude 최신 모델의 스키마 오류

모델 성능이 올라가면 복잡한 도구 호출 스키마도 더 정확하게 따를 것이라 기대한다. 그러나 Claude Opus 4.8과 Sonnet 5는 Pi의 edit 도구 호출 시 스키마 외 가짜 필드를 추가하는 오류를 보였다. 특정 하네스에 최적화된 후학습이

아마존, '인간 AI' Mechanical Turk 신규 가입 중단

아마존, '인간 AI' Mechanical Turk 신규 가입 중단

AI 모델 학습을 위해 사람이 데이터를 분류하는 라벨링 작업은 필수적이었다. 아마존이 2026년 7월 30일부터 Mechanical Turk의 신규 고객 가입을 중단한다. 작업자의 LLM 사용으로 인한 데이터 오염과 봇 문제는 서비스의 존립 근거를 없

앤스로픽 클로드 디자인 시스템 프롬프트 공개, 14개 전문 스킬셋 포함

앤스로픽 클로드 디자인 시스템 프롬프트 공개, 14개 전문 스킬셋 포함

앤스로픽의 클로드 디자인 시스템 프롬프트와 스킬 라이브러리가 MIT 라이선스로 공개됐다. 20개 챕터의 디자인 철학과 14개의 절차적 스킬을 통해 전형적인 AI 생성 디자인의 정형성을 탈피한다. LLM을 단순 생성 도구가 아닌 구체적인 철학을 가진 디

API 과금 걱정 지운 Honcho용 Codex 어댑터 개발

API 과금 걱정 지운 Honcho용 Codex 어댑터 개발

AI 에이전트의 메모리 관리 비용이 실무자와 학생들에게 부담이 되고 있다. Codex 구독 할당량을 API 요청처럼 전환해 주는 honcho-codex-gateway가 공개됐다. 로컬 임베딩 모델 BGE-M3를 결합해 외부 API 의존도와 비용을 동시

구글 리서치, 제로샷 표 데이터 파운데이션 모델 TabFM 1.0.0 공개

구글 리서치, 제로샷 표 데이터 파운데이션 모델 TabFM 1.0.0 공개

구글 리서치가 별도의 미세 조정 없이 표 데이터를 처리하는 파운데이션 모델 TabFM 1.0.0을 공개했다. 탭아레나(TabArena) 51개 데이터셋 평가에서 튜닝된 GBDT 모델보다 높은 성능을 기록했으며, 최대 10개 클래스의 분류와 회귀 작업을

LLM Wiki 공개, '신문 편집국' 구조로 멀티에이전트 토큰 낭비와 컨텍스트 손실 억제

LLM Wiki 공개, '신문 편집국' 구조로 멀티에이전트 토큰 낭비와 컨텍스트 손실 억제

LLM Wiki가 멀티에이전트 시스템의 토큰 과소비와 컨텍스트 유실 문제를 해결하기 위한 '신문 편집국' 구조를 공개했다. LLM 판단은 '데스크' 역할로 한정하고 규칙 기반 파이썬 린트와 컨텍스트 격리를 통해 문서의 중복과 부풀림을 제어한다. 개발자

브라우저 렌더링까지 직접 확인하는 AI 코딩 에이전트, Safari MCP 서버

브라우저 렌더링까지 직접 확인하는 AI 코딩 에이전트, Safari MCP 서버

웹 개발자는 코드를 수정하고 브라우저에서 결과를 확인하는 과정을 수없이 반복한다. Safari Technology Preview 247에 코딩 에이전트를 브라우저에 직접 연결하는 MCP 서버가 추가됐다. 에이전트가 DOM, 네트워크 요청, 스크린샷에

"B200 성능 80%에 가격은 2.75배 저렴" AMD MI355X의 추론 가성비

"B200 성능 80%에 가격은 2.75배 저렴" AMD MI355X의 추론 가성비

AI 추론 수요 급증으로 NVIDIA GPU 공급 부족과 토큰 비용 상승이 이어지고 있다. AMD MI355X는 B300 대비 2.75배 저렴하며 B200 성능의 80% 수준을 구현했다. 소프트웨어 지원 격차는 존재하나 성능 대비 비용 효율성에서 강력

GPT-5.5 추론 성능 저하, '516토큰' 고정 제한 의혹

GPT-5.5 추론 성능 저하, '516토큰' 고정 제한 의혹

복잡한 코딩 작업에서 AI의 답변 정확도가 떨어지는 현상이 관찰된다. GPT-5.5 모델이 추론 토큰을 516개 등 특정 수치에서 강제로 멈추는 패턴이 발견됐다. 이는 자연스러운 추론 과정이 아니라 인위적인 예산 제한이나 절단 가능성을 시사한다.

독립선언서도 AI로 썼다면? 구글이 보여준 워크스페이스의 미래

독립선언서도 AI로 썼다면? 구글이 보여준 워크스페이스의 미래

구글 워크스페이스의 협업 기능이 역사적 사건과 만났습니다. 제미나이(Gemini)를 활용해 미국 독립선언서를 작성하는 가상 광고를 공개했습니다. AI 시각화와 자동 회의록 등 실무 기능이 강조됐으나, 정치적 협업 도구로서의 효용성 논란이 제기됐습니다.

Unanimous AI, 'Thinkscape'로 277명 규모의 실시간 집단지성 토론 구현했다

Unanimous AI, 'Thinkscape'로 277명 규모의 실시간 집단지성 토론 구현했다

Unanimous AI가 하이퍼 커뮤니케이션 기술을 활용해 277명의 미국인을 대상으로 한 실시간 집단 토론을 진행했다. Thinkscape 플랫폼의 AI 에이전트가 소그룹 간 연결을 최적화해 94개의 아이디어를 3개의 핵심 혁신 사례로 압축했다. A

미드저니, 디즈니·워너브라더스 내부 AI 사용 내역 공개 요구

미드저니, 디즈니·워너브라더스 내부 AI 사용 내역 공개 요구

디즈니와 워너브라더스 등 할리우드 스튜디오들이 미드저니를 저작권 침해로 고소했다. 미드저니는 스튜디오들이 내부적으로 AI를 어떻게 활용하는지 모든 기록을 공개하라고 맞섰다. 내부 스토리보드 제작 등 비공개 AI 활용 사례가 입증되면 '업계 관행'이라는

OpenAI를 넘어 'AI판 팔란티어'로, Mistral AI가 그리는 주권 AI의 실체

OpenAI를 넘어 'AI판 팔란티어'로, Mistral AI가 그리는 주권 AI의 실체

미국 중심의 AI 생태계에서 유럽의 기술 주권 확보 움직임이 거세지고 있다. Mistral AI는 단순 챗봇을 넘어 기업·정부 맞춤형 배포 전략으로 ARR 10억 달러를 정조준한다. 자체 데이터센터 구축과 오픈 웨이트 모델 전략으로 폐쇄형 AI의 대안

프롬프트 대신 '운영 설계'로, AI 에이전트 자율성 6단계 모델

프롬프트 대신 '운영 설계'로, AI 에이전트 자율성 6단계 모델

ChatGPT 같은 AI에게 일을 맡길 때 얼마나 믿고 맡길지 고민하는 경우가 많습니다. 이제는 단순한 프롬프트 작성을 넘어 에이전트의 자율성 수준을 설계하는 운영 단계로 진화하고 있습니다. 앤스로픽의 데이터에 따르면 사람은 계획의 70%를, AI는

자율 루프 코딩 에이전트 'retry-now' 공개

자율 루프 코딩 에이전트 'retry-now' 공개

매 이터레이션마다 새로운 세션을 생성해 코드를 개선하는 retry-now가 공개됐다. 분석, 개선, 검증 단계를 반복하며 코드베이스를 점진적으로 최적화한다. opencode, Codex CLI, Claude Code와 연동해 사용할 수 있다.

AI 에이전트의 인력 대체 전제는 틀렸다 — 저커버그의 인정

AI 에이전트의 인력 대체 전제는 틀렸다 — 저커버그의 인정

AI 에이전트를 통한 업무 자동화는 모든 기업의 화두다. 메타는 이를 위해 수천 명을 해고하며 조직 구조를 개편했다. 마크 저커버그는 최근 에이전트 개발 궤적이 기대만큼 가속하지 않았음을 인정했다.

백도어 우려에 Claude Code 사용 금지한 알리바바

백도어 우려에 Claude Code 사용 금지한 알리바바

AI 코딩 도구는 이제 개발자의 필수품이 됐다. 알리바바가 보안 위험을 이유로 사내 Claude Code 사용을 전면 금지했다. 미국 AI 기업의 추적 기능과 중국의 모델 증류 갈등이 촉발한 조치다.

역전됐다, 에이전틱 코딩의 병목은 모델이 아닌 '미지'의 정의

역전됐다, 에이전틱 코딩의 병목은 모델이 아닌 '미지'의 정의

AI 코딩 에이전트를 써도 결과물이 만족스럽지 않은 이유는 프롬프트 부족이 아니다. Claude Fable은 사용자가 정의하지 못한 '미지(Unknowns)'를 찾는 과정이 품질을 결정한다고 분석한다. 블라인드 스팟 패스와 구현 노트를 통해 지도와 영

끝났다 — 모델만 갈아끼우던 에이전트 개발의 시대

끝났다 — 모델만 갈아끼우던 에이전트 개발의 시대

ChatGPT 같은 모델만 좋다고 AI 에이전트가 똑똑하게 일하는 것은 아닙니다. 작업을 반복하고 검증하며 스스로 개선하는 4단계 '루프' 설계가 핵심입니다. 랭체인의 도구들을 활용해 단순 자동화를 넘어 자가 발전하는 시스템을 구축합니다.

AI 코딩 에이전트의 기억력 함정, 세션 기록 저장이 성능 깎아먹는 이유

AI 코딩 에이전트의 기억력 함정, 세션 기록 저장이 성능 깎아먹는 이유

AI 에이전트에게 과거 대화 기록을 기억시키면 더 똑똑해질 것이라 믿어왔습니다. 하지만 실제 테스트 결과, 세션 기록 검색 권한을 줘도 코딩 작업 성능 향상은 전혀 없었습니다. 오히려 불필요한 정보가 섞이며 토큰 비용만 늘고 모델 품질은 저하되는 결과

NVIDIA, 4비트 양자화 Qwen3.6-27B 공개... VRAM 부담 덜고 추론 속도 높였다

NVIDIA, 4비트 양자화 Qwen3.6-27B 공개... VRAM 부담 덜고 추론 속도 높였다

대규모 언어 모델의 상용화 단계에서 메모리 점유율과 추론 속도는 늘 해결해야 할 과제다. NVIDIA가 4비트 부동 소수점 양자화를 적용해 효율을 극대화한 Qwen3.6-27B NVFP4를 공개했다. 262K의 방대한 컨텍스트 윈도우와 멀티모달 능력을