KO EN

AX BRIEF

AI 뉴스 · 벤치마크 · 기술 블로그 큐레이션

● LIVE
지능1. Claude Fable 5.1 (max with fallback) 100 pt2. Claude Fable 5 (with fallback) 96 pt3. Claude Opus 5 (max) 95 pt4. GPT-6 Astra (max) 95 pt5. GPT-5.6 Sol (max) 91 pt코딩1. Claude Fable 5.1 (max) 100 pt2. Claude Opus 5 (xhigh) 94 pt3. GPT-6 Astra (max) 91 pt4. Muse Spark 1.3 (xhigh) 81 pt5. Grok 4.5 (high) 81 pt이미지1. GPT Image 2 (high) 100 pt2. MAI-Image-2.6 93 pt3. GPT Image 1.5 (high) 91 pt4. Reve 2.1 88 pt5. Muse Image 85 pt비디오1. Gemini Omni Flash 100 pt2. Minimax H3 Max (post-trained by fal) 94 pt3. Dreamina Seedance 2.0 720p 91 pt4. gemini-omni-1.1-flash 85 pt5. Wan 3.0 85 pt가격1. Claude Fable 5.1 (max with fallback) 100 pt2. GPT-6 Astra (max) 100 pt3. Claude Fable 5 (with fallback) 100 pt4. Claude Opus 5 (max) 49 pt5. GPT-5.6 Sol (max) 39 pt속도1. Gemini 3.5 Flash-Lite 100 pt2. Gemini 3.8 Flash (high) 80 pt3. Muse Spark 1.3 (max) 44 pt4. gpt-oss-120b (high) 40 pt5. GPT-5.6 Luna (max) 27 pt

AI 뉴스

글로벌 AI 기업과 스타트업의 투자·제품·정책·핵심 동향을 매일 정리합니다.

AI 에이전트 '신뢰 극장' 현상과 실무 채용 기준의 변화

AI 에이전트 '신뢰 극장' 현상과 실무 채용 기준의 변화

AI 에이전트가 삶을 바꿨다는 과장된 성과를 공유하는 'AI 신뢰 극장(Confidence Theater)' 현상이 확산하고 있다. 전문 용어는 능숙하게 사용하지만 실제로는 단순 요약 수준의 워크플로우에 그치는 사례가 많으며, 이는 기업 내 성과 부풀

sukhi-fedi, ActivityPub 연합 기능 fedify 라이브러리 제거하고 Elixir로 직접 구현

sukhi-fedi, ActivityPub 연합 기능 fedify 라이브러리 제거하고 Elixir로 직접 구현

페디버스 서버 sukhi-fedi가 JSON-LD 조립과 HTTP 서명을 담당하던 fedify 라이브러리를 제거하고 Elixir로 자체 구현했다. Bun 워커의 메모리 부족(OOM) 문제와 프로세스 간 데이터 전송 오버헤드를 해결하기 위해 12개 파일

샌드위치 팔면서 'AI' 22번 강조한 저지 마이크스의 IPO

샌드위치 팔면서 'AI' 22번 강조한 저지 마이크스의 IPO

누구나 아는 샌드위치 가게가 상장 준비 서류에 AI를 언급했다. 저지 마이크스는 IPO 서류(S-1)에서 'AI'라는 단어를 22번이나 사용했다. 구체적인 활용법 없이 투자자 유혹을 위해 AI를 마케팅 도구로 쓴 사례다.

AI에게 핸들을 맡기지 않는 고품질 소프트웨어 전략 '숏리쉬' 코딩법

AI에게 핸들을 맡기지 않는 고품질 소프트웨어 전략 '숏리쉬' 코딩법

AI 에이전트가 코드를 다 짜준다는 '자동화 환상'이 개발 현장에서 퍼지고 있다. 하지만 보안이 중요한 시스템에서는 AI가 짠 비효율적인 코드가 치명적인 결함이 된다. AI를 린터로 쓰고 인간이 최종 검토하는 '숏리쉬' 방식이 대안이다.

정부 명령에 셧다운된 모델, 기업 66%를 '멀티 모델'로 밀어넣다

정부 명령에 셧다운된 모델, 기업 66%를 '멀티 모델'로 밀어넣다

AI 모델 하나에만 의존하는 것은 서비스 중단이라는 치명적인 리스크를 동반한다. 최근 Claude Fable 5의 갑작스러운 서비스 중단으로 벤더 종속 문제가 현실화됐다. 조사 대상 기업의 66%는 이미 폐쇄형과 오픈 웨이트 모델을 혼용하는 헷징 전략

VHK, AI 코딩 에이전트 간 규칙 및 맥락 동기화 CLI 도구 공개

VHK, AI 코딩 에이전트 간 규칙 및 맥락 동기화 CLI 도구 공개

AI 코딩 에이전트 변경 시 규칙과 맥락을 유지하는 CLI 하네스 VHK가 공개됐다. 규칙 파일 자동 동기화와 기계적 증거 기반의 완료 검증 기능을 제공한다.

클로드 오푸스도 75% 낙제, 시니어급 코딩 실력 검증하는 Senior SWE-Bench 공개

클로드 오푸스도 75% 낙제, 시니어급 코딩 실력 검증하는 Senior SWE-Bench 공개

AI 코딩 도구가 단순한 코드 작성을 넘어 실제 개발자의 업무를 대체하려 합니다. 시니어 엔지니어의 복잡한 기능 개발과 버그 수정을 평가하는 'Senior SWE-Bench'가 공개되었습니다. 최상위 모델인 Claude Opus 4.8조차 정답률 24

고정 프레임의 한계 극복, LLM이 영상을 '진짜' 보게 만드는 claude-real-video

고정 프레임의 한계 극복, LLM이 영상을 '진짜' 보게 만드는 claude-real-video

대부분의 AI는 영상 링크를 넣어도 자막만 읽거나 일정 간격의 사진만 본다. claude-real-video는 장면 전환을 감지해 의미 있는 프레임만 로컬에서 추출한다. 불필요한 중복을 제거해 토큰 비용을 낮추고 LLM의 영상 이해도를 높인다.

버그는 잡고 설계는 망쳤다, 프런티어 모델의 코딩 실효성

버그는 잡고 설계는 망쳤다, 프런티어 모델의 코딩 실효성

AI 코딩 도구는 이제 개발자의 일상적인 보조 수단이 되었다. Opus 4.8과 GPT 5.5는 버그 탐색과 리팩터링에서 높은 가치를 보였으나 자율 구현에서는 한계를 드러냈다. 모델 지능보다 검증 비용을 낮추는 하네스와 정적 분석 등 실무적 보완책이

토큰 소모 99% 줄인 알리바바의 AI 에이전트 프레임워크 'SkillWeaver'

토큰 소모 99% 줄인 알리바바의 AI 에이전트 프레임워크 'SkillWeaver'

기업용 AI 에이전트가 수백 개의 도구를 다루면 토큰 비용이 급증하고 정확도가 떨어진다. 알리바바가 개발한 SkillWeaver는 작업을 분해해 필요한 도구만 선택적으로 호출한다. 기존 방식 대비 토큰 사용량을 99% 이상 절감하며 복잡한 작업의 수행

코딩-리뷰-배포를 하나로, GLM-5.2 전용 하네스 ZCode 3.0 공개

코딩-리뷰-배포를 하나로, GLM-5.2 전용 하네스 ZCode 3.0 공개

AI 코딩 도구는 이제 단순 코드 생성을 넘어 전체 개발 흐름을 관리하는 방향으로 진화하고 있다. GLM-5.2의 공식 하네스인 ZCode 3.0이 계획, 코딩, 리뷰, 배포를 통합한 워크플로우를 공개했다. 월 16.2달러부터 시작하는 요금제와 함께

실시간 그래픽스 프로그래머 역량: CPU 명시적 API와 GPU 셰이딩 통합 경로

실시간 그래픽스 프로그래머 역량: CPU 명시적 API와 GPU 셰이딩 통합 경로

실시간 그래픽스 프로그래머에게 요구되는 CPU 측 명시적 API 제어 능력과 GPU 측 조명·셰이딩 구현 역량을 정의했다. DirectX12, Vulkan 등 현대적 API와 PBR(물리 기반 렌더링), Path Tracing 학습을 위한 구체적인 도

X, FTC 데이터 감사 종료 요청에 시민단체 "개인정보 위험" 경고

X, FTC 데이터 감사 종료 요청에 시민단체 "개인정보 위험" 경고

시민단체들이 FTC에 일론 머스크의 X에 대한 데이터 감시를 유지하라고 촉구했다. X는 플랫폼 변경을 이유로 기존의 데이터 처리 감사 종료를 요청한 상태다.

AI가 짠 코드는 못 믿겠다 — git-annex의 'LLM 제로' 선언

AI가 짠 코드는 못 믿겠다 — git-annex의 'LLM 제로' 선언

AI 코딩 도구로 개발 속도를 높이는 것이 당연해진 시대다. git-annex 개발자가 LLM 생성 코드가 포함된 의존성을 제거하는 데 100시간을 투입했다. 무분별한 AI 코드 도입이 프로젝트 품질 저하와 저작권 리스크를 초래하고 있다.

OpenAI, 미국 정부에 지분 5% 제공하는 방안 논의

OpenAI, 미국 정부에 지분 5% 제공하는 방안 논의

OpenAI가 미국 정부에 회사 지분 5%를 제공하는 방안을 초기 단계에서 논의 중이다. 샘 올트먼 CEO는 AI의 경제적 혜택을 공공과 나누기 위해 알래스카 영구기금 형태의 국부펀드 모델을 제안했다. 정부와의 관계 개선과 정치적 지지 확보를 목적으로

마이크로소프트, 25억 달러 투입해 AI 도입 전담 '프론티어 컴퍼니' 설립

마이크로소프트, 25억 달러 투입해 AI 도입 전담 '프론티어 컴퍼니' 설립

마이크로소프트가 기업용 AI 도입을 전담하는 '마이크로소프트 프론티어 컴퍼니'를 설립했다. 25억 달러의 투자금과 6,000명의 전문가를 투입해 기존 AI 도구의 실제 현장 적용을 지원한다. 모델 공급을 넘어 실제 구현 단계의 엔지니어링 역량이 기업

메타, AI 프롬프트로 인터랙티브 게임 만드는 '포켓' 출시

메타, AI 프롬프트로 인터랙티브 게임 만드는 '포켓' 출시

메타가 AI 프롬프트를 통해 소규모 게임과 앱을 제작하는 '포켓(Pocket)'을 출시했다. 올해 초 인수한 기즈모(Gizmo) 팀의 기술을 바탕으로 하며, 사용자는 '기즈모'라 불리는 인터랙티브 경험을 생성하고 공유할 수 있다. 이미지와 영상에 이어

앤스로픽, 엔비디아 독립 위해 삼성과 AI 전용 칩 논의

앤스로픽, 엔비디아 독립 위해 삼성과 AI 전용 칩 논의

AI 모델 개발사들이 엔비디아 의존도를 낮추기 위해 직접 칩 제작에 나섰다. 앤스로픽이 삼성과 맞춤형 AI 칩 협력을 논의 중이라는 소식이 전해졌다. 오픈AI의 '할라피뇨' 칩 발표 등 빅테크 간 하드웨어 독립 전쟁이 가속화되는 양상이다.

"연애까지 자동화" — SNS 릴스부터 이별 통보까지 맡는 OpenClaw

"연애까지 자동화" — SNS 릴스부터 이별 통보까지 맡는 OpenClaw

SNS 릴스 시청과 데이팅 앱 사용 같은 일상적인 디지털 소통이 AI로 자동화되고 있다. 오픈소스 AI 에이전트 OpenClaw는 월드컵 결과에 맞춰 릴스를 자동 생성해 100만 뷰를 기록했다. 단순 일정 관리를 넘어 이별 통보까지 수행하며 AI 에이

OpenAI 지분 5%를 미국 국부펀드에 기부 제안

OpenAI 지분 5%를 미국 국부펀드에 기부 제안

AI 기술의 혜택이 소수 기업에 집중된다는 우려가 커지고 있다. 샘 올트먼 OpenAI CEO가 회사 지분 5%를 미국 국부펀드에 기부하는 방안을 제안했다. 정치적 리스크를 해소하고 국민이 AI 성장의 수익을 공유하는 구조를 설계하려는 시도다.

API 키 유출 원천 차단한 오픈소스 AI 에이전트 'Valmis' 공개

API 키 유출 원천 차단한 오픈소스 AI 에이전트 'Valmis' 공개

AI 에이전트를 실무에 도입할 때 가장 큰 걸림돌은 API 키와 같은 민감 정보의 보안 관리다. Valmis는 에이전트를 격리된 컨테이너에서 실행하고 프록시 시스템으로 권한을 제어하는 오픈소스 솔루션이다. 100개 이상의 앱 연동과 4단계 인지 메모리

지역 신문 폐간 조작해 신뢰 쌓고 대만 여론 흔든 AI 가짜 뉴스

지역 신문 폐간 조작해 신뢰 쌓고 대만 여론 흔든 AI 가짜 뉴스

AI가 쓴 가짜 뉴스는 이제 흔한 일이 되었습니다. 최근 'The Editorial'이라는 사이트가 앨라배마 지역 신문 47곳의 폐간 과정을 정교하게 조작해 유포했습니다. 이는 단순 스팸이 아니라, 정교한 AI 기사로 신뢰를 구축한 뒤 대만·일본 등

뻔한 답변만 반복하는 AI '집단사고' 깼다 — Springboards의 Flint 공개

뻔한 답변만 반복하는 AI '집단사고' 깼다 — Springboards의 Flint 공개

ChatGPT 같은 대규모 언어 모델은 정해진 답을 내놓는 경향이 강하다. 호주 스타트업 Springboards가 정형화된 답변에서 벗어난 LLM 'Flint'를 개발했다. Flint는 개방형 질문에 대해 기존 모델보다 더 다양하고 창의적인 응답을 생

Z.ai, GLM-5.2 기반 에이전트 개발 환경 'ZCode' 출시

Z.ai, GLM-5.2 기반 에이전트 개발 환경 'ZCode' 출시

Z.ai가 GLM-5.2 모델에 최적화된 에이전트 중심 개발 환경 'ZCode'를 공개했다. GLM-5.2는 744B 파라미터 MoE 구조와 100만 토큰 컨텍스트 창을 갖췄으며 화웨이 실리콘으로 학습됐다. 오픈 소스 가중치 제공과 BYOK 지원을 통

"챗봇 추가는 정답 아니다" MS 오피스 대항마 AI 플랫폼 Neo 공개

"챗봇 추가는 정답 아니다" MS 오피스 대항마 AI 플랫폼 Neo 공개

많은 기업이 기존 협업 툴에 AI 챗봇을 덧붙여 사용하고 있다. 인도 기업가 바빈 투라키아가 3,000만 달러를 투입해 AI 전용 워크 플랫폼 Neo를 개발했다. 기존 툴의 단순 업그레이드가 아닌 AI 중심의 전면 재설계와 모델 선택권을 제공한다.

오픈소스 에이전트 OS 'Hephaestus' 공개

오픈소스 에이전트 OS 'Hephaestus' 공개

전문 에이전트를 영구 자산으로 관리하고 오케스트레이터를 일회성으로 사용하는 Hephaestus가 공개됐다. Apache-2.0 라이선스로 제공되며 기존 LLM 프레임워크 상위 계층에서 동작한다.

깃허브 코파일럿, 첫 오픈웨이트 모델 'Kimi K2.7 Code' 도입

깃허브 코파일럿, 첫 오픈웨이트 모델 'Kimi K2.7 Code' 도입

개발자들은 깃허브 코파일럿의 모델 선택 기능을 통해 코딩 효율을 높인다. 코파일럿이 첫 오픈웨이트 모델인 Kimi K2.7 Code를 선택 옵션으로 추가했다. 프로 플랜부터 순차 적용되며 기존보다 저렴한 비용의 워크플로우를 제공한다.

Cloudflare, 2026년부터 '혼합 목적' AI 크롤러 기본 차단 적용

Cloudflare, 2026년부터 '혼합 목적' AI 크롤러 기본 차단 적용

Cloudflare가 검색과 AI 학습을 동시에 수행하는 '혼합 목적' 크롤러의 접근을 기본적으로 차단한다. 2026년 9월 15일부터 광고가 포함된 페이지에 대해 신규 및 무료 고객을 대상으로 해당 설정이 적용된다. AI 기업들은 데이터 수집을 위해

DeepSeek-V4, KV 캐시 90% 절감하며 100만 토큰 처리 구현

DeepSeek-V4, KV 캐시 90% 절감하며 100만 토큰 처리 구현

거대 모델로 긴 문서를 처리할 때 발생하는 메모리 부족과 속도 저하는 고질적인 문제다. DeepSeek-V4는 하이브리드 어텐션 구조로 KV 캐시 사용량을 10%까지 낮췄다. 최대 100만 토큰의 컨텍스트를 지원해 대규모 코드 저장소 분석이 가능해졌다

Anthropic, Fable 5 사이버보안 보호장치 업데이트 및 접근 조건 공개

Anthropic, Fable 5 사이버보안 보호장치 업데이트 및 접근 조건 공개

Anthropic이 미국 정부와의 협의 후 Fable 5의 사이버보안 보호장치를 업데이트했다. 플래그된 요청은 Opus 4.8로 대체 제공되며, 유료 플랜 사용자는 7월 7일까지 한정된 한도로 접근 가능하다.