AI 산업의 진화 속도가 무섭다. 이번 주에는 DeepSeek V4 Flash Vision Experimental 모델이 공개되며, API를 통해 시각과 텍스트를 동시에 처리하는 멀티모달(multimodal) 성능 경쟁이 한층 치열해졌다. 하지만 기술적 도약 뒤에는 현실적인 마찰이 따른다. 대규모 데이터센터 증설을 둘러싼 지역 사회의 반발이 거세지며, 위스콘신 등지에서는 투명한 정보 공개와 전력망 자금 조달 요구가 쏟아지고 있다. 소프트웨어 생태계의 판도 역시 변하고 있다. Codex의 활성 사용자 수가 2,000만 명을 돌파하며 코딩 AI의 대중화를 입증했고, DigitalOcean은 개발자가 특정 작업에 최적화된 모델을 쉽게 선택하고 관리할 수 있는 라우팅 도구를 통해 효율성을 높였다. AI의 영향력은 이제 금융과 물리적 영역으로 빠르게 확장 중이다. 트레이더들은 Kalshi와 Codeex를 결합해 투자 전략을 자동화하고 있으며, 물리 AI 분야에서는 새로운 시뮬레이션과 강화 학습 업무 흐름(workflow)을 통해 정밀도를 다듬고 있다. 제미나이 4의 텍스트를 화면에 그려내는 렌더링(text-rendering) 기능 유출부터 구글의 Anti-Gravity를 통한 로컬 환경 학습 코드 이전까지, 현재 AI 산업은 압도적인 성능 구현과 운영 효율성, 그리고 사회적 수용성이라는 세 가지 과제를 동시에 해결해야 하는 시점에 서 있다.

01AI가 화면을 직접 보고 판단한다 — DeepSeek V4 Flash Vision의 성능 도약

이제 AI 에이전트가 사람처럼 디지털 환경을 직접 보고 상호작용하는 시대가 왔다. DeepSeek가 시각 능력을 강화한 V4 Flash Vision Experimental 모델을 공개했다. 이 모델은 스크린샷 같은 시각 데이터를 처리해 기술적 문제를 진단하거나 인터페이스를 직접 조작한다. 사용자가 상황 설명을 위해 일일이 텍스트를 입력할 필요가 사라진 것이다. 기존 V4 Flash의 추론, 코딩, 일반 지식 능력은 그대로 유지했으며, 현재 API와 웹 인터페이스로 사용할 수 있다.

복잡한 과제를 시각적으로 해결하는 성능 시험(eval)에서 이 모델은 Opus 4.8과 대등한 수준에 올라섰다. Deep Sway 벤치마크에서는 59.3점을 기록하며 Opus 4.8의 58점을 앞질렀다. 자율형 에이전트 시험(agents last exam)에서도 27.3점을 기록해 Opus 4.8보다 2점 높았다. Terminal Bench 2.1(83.9점 vs 85점)과 Apex Bench(36.5점 vs 39.4점)에서는 소폭 뒤처졌지만, 멀티모달 자율형 에이전트의 성능 격차는 사실상 사라졌다.

이번 업데이트의 실질적인 가치는 장기적인 자율 프로젝트 수행 능력에서 드러난다. 실험 단계의 체크포인트 모델은 단 한 번의 명령만으로 90분 동안 스스로 작업해 정교한 3D 헬리콥터 시뮬레이션을 구축하고 개선했다. 놀라운 점은 이 모든 과정에 든 비용이 1달러 미만이라는 사실이다. 시각적 지능과 비용 효율성이 결합되면서, 사람이 계속 개입하지 않아도 AI가 복잡한 시각 프로젝트를 반복 수정하는 새로운 작업 흐름(workflow)이 가능해졌다. 최근 가격이 인상되었음에도 불구하고, 고성능 자율 기능을 원하는 개발자에게 여전히 강력하고 접근성 높은 도구다.

02DigitalOcean 라우터 — 비용은 3분의 1, 성능은 그대로

많은 개발자가 AI 성능 순위표 상위 모델에 집착하지만, 이는 자원 낭비로 이어진다. 모든 요청에 완벽한 단 하나의 모델은 없다. 정답은 벤치마크 점수가 아니라 구체적인 목표와 필요한 속도, 그리고 예산에 맞는 모델을 선택하는 것이다. DigitalOcean은 이를 해결하기 위해 작업에 가장 적합한 AI를 동적으로 선택하는 전용 배정 모델(routing model)을 개발했다. 고성능 컴퓨팅 자원을 꼭 필요한 곳에만 쓰겠다는 전략이다.

이 배정 시스템은 오직 '모델 선택'이라는 목적 하나로 설계되어 처리 속도가 200밀리초(ms) 미만으로 매우 빠르다. 특정 작업에 특화된 덕분에 모델 배정 능력만큼은 GPT-5 같은 범용 최신 모델보다 뛰어나다. 보안 검토 같은 치명적인 작업에는 최첨단 모델을 붙이고, 단순한 요청은 효율적인 모델로 돌린다. 고품질 답변을 얻으면서도 시간과 컴퓨팅 자원을 획기적으로 줄였다. 효율의 시대다.

비용 절감 효과는 즉각적이다. 소프트웨어 개발 작업 흐름(workflow)에서 'long before Maverick'이나 'Cloud 5 Summit' 같은 특화 모델에 작업을 배정한 결과, 클로드 Opus 하나만 썼을 때보다 훨씬 빠르고 저렴했다. 실제 앱 개발 테스트에서 클로드 Opus는 25센트가 들었지만, 배정 모델을 거친 경우 단 8센트면 충분했다. 비용을 3분의 1로 줄인 셈이다. 품질 차이도 미미했다. 클로드 Opus의 정답률이 95%일 때 배정 모델은 90%를 기록했는데, 이는 사람이 판단할 때 오차 범위 내에 있는 수준이다.

단순한 비용 절감을 넘어, 이 배정 계층은 더 고도화된 최적화의 기반이 된다. 모델의 실질적인 효과를 입증하는 성능 시험(eval)을 도입하거나, 동일한 답변에 비용을 중복 지불하지 않도록 캐싱 기술을 적용할 수 있다. 시간이 흐를수록 개발 팀의 개별 취향을 학습해 맞춤형 결과를 내놓는 것도 가능하다. 특정 모델에 종속되지 않고 요청을 분리함으로써, 기업은 품질 저하 없이 성능과 비용의 균형을 잡을 수 있게 됐다.

03데이터 센터의 무분별한 확장, 주민들이 요구하는 '입장권'은 무엇일까?

데이터 센터가 빠르게 늘고 있지만 지역 사회의 반발도 거세다. 거대 시설이 초래하는 환경 파괴와 경제적 비용에 주민들이 민감하게 반응하기 때문이다. 무조건적인 개발 차단보다는 구체적인 지역 피해를 해결할 엄격한 규제 틀을 요구하는 추세다. 기술 자체를 거부하는 것이 아니라, 땅과 전력을 사용하는 대가로 책임 있는 보상과 실질적인 혜택을 내놓으라는 압박이다. 기술의 문제가 아니라 보상의 문제다.

위스콘신주의 주지사 후보 데이비드 크롤리(David Crowley)는 데이터 센터 승인 절차를 관리할 투명성과 지속 가능성 체계를 제안했다. 핵심은 비밀유지계약(NDA) 금지다. 개발사와 정부 간의 밀실 협상을 끝내겠다는 의지다. 또한 100% 재생 에너지 사용과 노조 인력 고용을 조건으로 내걸었다. 특히 인프라 및 전력망 확충 비용 전액을 개발사가 부담하게 하고, 주 에너지 기금을 조성해 주민들의 전기 요금을 낮추는 방안을 포함했다.

오하이오주의 비벡 라마스와미(Vivek Ramaswamy) 주지사 후보 역시 지역 주민을 위한 직접적인 경제적 혜택에 집중했다. 데이터 센터가 들어서는 지역 주민의 전기료를 완전히 면제해 주는 파격적인 제안이다. 공기와 수질 기준을 엄격히 준수한다면 재산세 감면 혜택까지 제공하는 방안을 검토 중이다.

이러한 움직임은 정파를 넘어 지역 사회의 권한을 강화하는 추세로 이어진다. 정치인들이 개발사가 반드시 충족해야 할 체크리스트를 만들어 승인 조건으로 활용하는 방식이다. 전력망 현대화와 에너지 비용 부담을 납세자가 아닌 개발사가 지게 함으로써, 데이터 센터를 지역의 짐이 아닌 경제적 안정의 동력으로 바꾸겠다는 전략이다.

04AI가 직접 돈을 번다 — Kalshi 거래 봇, 하루 만에 15.7% 수익

AI 에이전트가 단순한 실험적 보조 도구를 넘어 실제 돈을 버는 수익 창출 도구로 진화하고 있다. 예측 시장 Kalshi에서 최근 한 AI 거래 전략이 24시간 만에 15.7%의 수익을 기록했다. 총 18번의 거래 중 14번을 성공시키며 잔고를 137달러로 늘렸고, 약 20달러의 순이익을 냈다. 철저한 전략만 뒷받침된다면 AI가 단기 시장 변동성도 충분히 제어할 수 있음을 증명한 사례다.

하지만 이런 수익을 내려면 단순한 채팅창 수준의 인터페이스를 벗어나야 한다. 현재의 AI 도구 상당수는 운전석에 사람이 앉아 있어야 하는 자율주행 트랙터와 같다. 동작은 스스로 하지만, 끊임없는 감시가 필요하기 때문이다. 개발자들은 이를 해결하기 위해 Codeex 같은 플랫폼을 활용해 더 독립적인 시스템을 구축하고 있다. 정해진 시간에만 작동하는 정기 실행 작업(cron jobs) 방식 대신, 특정 사건이 발생했을 때 반응하는 사건 기반 구조(event-driven architectures)를 도입한 것이다. 이제 AI는 단순히 시계가 특정 시간을 가리켜서가 아니라, 새 이메일이 도착하거나 음성 메모가 입력되는 등 '실제 사건'이 벌어졌을 때 즉각 반응한다.

에이전트의 신뢰도는 프롬프트 엔지니어링을 엄격한 소프트웨어 문제로 다루느냐에 달려 있다. 버전 관리가 제대로 되지 않으면, 프롬프트를 아주 조금만 수정해도 고품질의 시장 분석 보고서가 순식간에 쓸모없는 쓰레기로 변하며 이를 되돌릴 방법조차 없다. 이를 막기 위해 엔지니어들은 git이나 nyx 같은 버전 관리 도구처럼 모든 프롬프트와 도구 설명을 고유 식별값(hash)으로 저장하는 콘텐츠 주소 지정 방식(content-addressed systems)을 도입하고 있다. 이렇게 하면 수정 불가능한 영구 로그가 생성되어, AI가 답변을 내놓기 전 내부적으로 무엇을 보았는지 정확히 추적할 수 있다. 에이전트를 시스템 커널 내의 독립된 프로세스로 처리함으로써 모든 행동을 기록하고, 복잡한 다중 에이전트 간의 상호작용을 재현해 오류를 잡는 것이 가능해진다. 결국 AI 거래와 연구의 확장성은 지능의 신비가 아니라, 표준적인 소프트웨어 조율(orchestration)의 문제다.

05뭉개지던 AI 글자, 제미나이 4가 구현한 정밀함

생성형 AI에게 읽을 수 있고 철자가 정확한 글자를 만드는 일은 오랫동안 고질적인 난제였다. 특히 곡면이나 움직이는 물체 위에 글자를 배치하면 형태가 무너지거나 의미 없는 기호로 변하는 경우가 많았다. 하지만 최근 유출된 구글 제미나이 4(제미나이 4)의 결과물은 이 장벽이 허물어지고 있음을 보여준다. 복잡한 시각

06AI 리더들의 소통 실패: 막연한 공포가 인프라 거부로 이어진다

대중의 AI 회의론이 깊어지고 있다. 이는 업계 최상위 리더들의 소통 실패가 불러온 결과다. 미래에 대한 희망이나 기대감을 심어주는 대신, 이들은 정작 우리가 어떤 세상을 맞이하게 될지 설득력 있게 제시하지 못했다. 스토리텔링의 공백을 불신과 불안이 채웠다. 이제 AI는 혁신이 아니라 강요된 변화처럼 느껴진다.

차마스 팔리하피티야(Chamath Palihapitiya)는 업계 리더들이 '무엇이 가능한가'라는 가장 기본적인 그림을 그리는 데 실패했다고 지적한다. 사회가 누릴 실질적인 혜택보다 난해한 전문 용어 뒤에 숨거나, 최악의 시나리오를 강조하는 공포 마케팅에 치중했다. 대중이 이해할 수 없는 복잡함과 두려움을 앞세운 결과, 사람들은 이제 이 기술이 과연 누구를 위해 존재하는지 의심하기 시작했다.

소통의 부재는 단순한 논쟁을 넘어 산업의 물리적 확장이라는 실질적인 걸림돌이 됐다. 특히 인프라를 바라보는 대중의 시선이 달라졌다. 일반 데이터센터는 단순한 불편함 정도로 여겨지지만, AI 전용 데이터센터는 정치적으로 매우 민감한 기피 대상이 됐다. 최근 조사에 따르면 AI 전용 시설에 대한 반대 여론이 훨씬 높다. 일자리 상실과 기술의 목적에 대한 설명 부족이 결국 하드웨어 거부라는 실체적인 저항으로 나타난 것이다. 리더가 기술의 존재 이유를 증명하지 못하면, 그들이 세우는 건물은 대중의 분노를 받는 표적이 될 뿐이다.

07Hermes 에이전트의 정체 — 하루 1,000조 토큰을 뿜어내는 괴물의 주인은?

AI 커뮤니티가 Hermes 에이전트와 Ox Alpha라는 두 정체불명의 존재를 두고 뜨거운 논쟁에 빠졌다. 공식적인 발표가 없는 공백을 틈타 X(구 트위터)에서는 이 도구들의 진짜 주인이 누구인지에 대한 가설이 쏟아지고 있다. 보통 이런 추측전은 기존의 상식으로는 설명되지 않는 압도적인 성능이 나타날 때 벌어진다. 정체를 알 수 없는 '유령 모델'의 정체를 찾는 과정은 곧 다음 AI 패권을 누가 쥐게 될지를 예측하는 지표가 된다. 정체가 곧 권력이다.

이번 소동의 발단은 Hermes 에이전트가 하루에 1,000조 개의 토큰을 처리할 수 있다는 믿기 힘든 주장이다. 토큰(token)은 AI가 언어를 처리할 때 사용하는 최소 단위인 텍스트 조각을 말한다. 하루 1,000조 개라는 수치는 상상을 초월하는 규모다. 이것이 단순한 과장인지, 아니면 컴퓨팅 인프라의 전례 없는 도약인지에 대해 의견이 갈린다. 이 정도의 처리 용량을 실제로 구현하려면 지구상에서 극소수만이 보유한 하드웨어와 에너지 자원이 필수적이기 때문이다. 물리적 한계를 비웃는 수치다.

성능과 주장이 워낙 극단적이다 보니, 전 세계 테크 거물들의 이름이 모두 거론된다. 일부는 GLM을 의심하고, 일부는 제미나이 3.5를 지목한다. 마이크로소프트나 엔비디아, 혹은 미국의 Frontier AI 연구소의 작품이라는 설도 유력하다. 커뮤니티는 모델의 성능을 역추적해 현재 누가 고성능 AI 배포 능력을 선점했는지 파악하려 한다. 결국 이 추측 게임은 단순한 호기심을 넘어, AI의 한계를 밀어붙이는 기업의 전략과 자본 규모를 확인하려는 시도다. 결국 인프라 전쟁의 결과물이다.

08Codex 사용자 2000만 명 — 실험실을 벗어나 표준 도구로 안착

Codex가 최근 활성 사용자 2000만 명을 돌파하며 폭발적인 성장세를 보였다. 이는 단순한 수치 증가 이상의 의미를 갖는다. AI를 일상적인 업무 흐름(workflow)에 통합하려는 수요가 그만큼 거대하다는 방증이다. 특정 전문가들만 쓰던 실험적 단계는 끝났다. 이제 Codex는 산업 전반에서 쓰이는 표준 도구로 자리 잡았다. 전 세계적으로 효율성과 자동화에 대한 갈증이 임계점에 도달했음을 보여준다.

Tibbo는 이번 성장을 기념해 전체 사용량을 초기화한다고 발표했다. 일반 사용자 입장에서는 기존의 사용 기록이 삭제되어 Codex를 다시 처음부터 넉넉하게 쓸 수 있게 된 셈이다. 핵심은 요청 제한(rate limits)의 100% 복구다. 정해진 시간 내에 보낼 수 있는 요청 횟수 제한을 완전히 푼 것이다. 사용자는 이전의 활동 기록 때문에 속도가 느려지거나 제약을 받는 일 없이, 훨씬 더 매끄럽고 빈번하게 모델과 상호작용할 수 있다.

이번 초기화는 전략적인 선택이다. 사용자가 모델의 한계치까지 성능을 밀어붙이도록 유도하려는 계산이다. 사용량 부담이 사라지면 프롬프트를 더 공격적으로 수정하고 프로젝트를 반복해서 다듬을 수 있다. 가장 정확하거나 창의적인 결과가 나올 때까지 계속 시도하는 것이 가능해진다. 치열한 AI 경쟁 상황에서 이런 접근성은 매우 중요하다. 사용자들이 실제 현장에서 다양한 사례를 발견하고 모델을 극한까지 테스트하며 성능을 끌어올릴 수 있기 때문이다. 사용량 제한이라는 허들을 없앰으로써, 2000만 명의 사용자가 천장에 부딪힐 걱정 없이 도구의 잠재력을 완전히 탐색하게 만들었다. 발견의 속도가 빨라지는 구조다.

09로봇의 뇌를 만드는 법, 가상 훈련으로 시간을 줄일 수 있을까?

물리 AI의 뇌를 만드는 핵심은 단 한 번의 성공이 아니라, 다양한 상황에 적응하는 일반화 능력이다. 특정 환경에서만 학습한 AI는 조건이 조금만 바뀌어도 무용지물이 된다. 슈퍼 마리오의 '낮' 스테이지를 정복한 AI가 '밤' 스테이지에서는 완전히 무너지는 식이다. 특정 시나리오에만 과하게 최적화되는 과적합(overfitting) 현상을 막아야 한다. 결국 실제 세상에서 작동하게 하려면 수많은 가상 환경에 AI를 노출시켜 적응력을 키우는 과정이 필수적이다. 적응력이 곧 성능이다.

이 반복적인 시행착오 과정을 효율적으로 만들기 위해 개발자들은 가상 세계라는 도구 상자를 활용한다. 오픈AI의 Gymnasium은 AI가 물체를 목표 지점으로 옮기는 등의 과제를 끊임없이 연습할 수 있는 시뮬레이션 환경을 제공한다. 여기에 복잡한 수학적 설계를 처음부터 짤 필요 없이, 이미 구현된 학습 알고리즘 모음집인 Stable Baselines 3를 결합한다. 특히 강화 학습의 핵심 방법론인 PPO 알고리즘을 통해 AI는 수천 번의 반복 경험을 통해 스스로 정답을 찾아간다. 시뮬레이터와 기성 알고리즘의 결합은 로봇의 움직임을 구현하는 데 드는 시간과 기술적 비용을 획기적으로 낮췄다. 이제 로봇 학습은 '노동'이 아니라 '설정'의 영역이다.

이렇게 최적화된 작업 흐름(workflow)의 마지막 단계는 완성된 지능을 공유하고 관리하는 것이다. PPO Pusher 같은 학습 모델이 완성되면 이를 압축 파일 형태로 내보내 Hugging Face에 올린다. 이곳은 전 세계 개발자들이 작업물을 분류하고 업데이트하는 거대한 저장소 역할을 한다. 강화 학습 섹션에서 서로의 모델을 공유하고 개선하는 생태계가 구축된 셈이다. 물리 AI 개발은 이제 혼자 하는 코딩 작업에서 커뮤니티 중심의 협업 체제로 변했다. 지능의 공유가 물리적 진화를 가속한다.

10구글 Anti-Gravity, 서버에 숨은 AI 학습을 내 PC 화면으로

이제 개발자는 AI 학습이라는 복잡한 과정을 원격 서버가 아닌 개인 컴퓨터(PC)로 직접 옮겨올 수 있다. AI가 어떻게 학습하는지 더 명확하게 확인하기 위해서다. 구글의 Anti-Gravity는 학습 코드를 로컬 환경으로 이전시키는 특화된 코딩 도구 역할을 한다. 서버에 갇혀 있던 데이터와 학습 과정을 직관적인 웹 기반 인터페이스로 바꿀 수 있게 됐다. AI 모델을 기반으로 웹 서비스를 구축하거나, 학습 진행 상황을 실시간으로 시각화해 확인해야 하는 이들에게 특히 유용하다. 학습의 블랙박스가 사라진다.

작동 방식은 간단하다. 기존 학습 코드를 가져와 로컬 PC에서 실행 가능하도록 최적화하는 식이다. 예를 들어, 특정 학습 코드 블록을 복사해 Anti-Gravity에 입력하고 시각화 명령을 내리면 된다. 그러면 도구가 로컬 PC의 환경 설정을 자동으로 처리한다. 개발자는 서버 콘솔의 텍스트 줄을 읽는 대신, 시각화된 대시보드를 통해 모델이 진화하는 과정을 지켜본다. 로컬 환경 특성상 고성능 그래픽 처리 장치(GPU) 대신 중앙 처리 장치(CPU)에 의존할 수 있어 학습 속도는 느려질 수 있다. 하지만 즉각적인 제어와 시각적 확인이라는 확실한 이점이 있다. 텍스트의 시대에서 대시보드의 시대로 넘어가는 과정이다.

이러한 작업 흐름(workflow)의 변화는 원천 AI 개발과 최종 제품 제작 사이의 간극을 좁힌다. 학습 과정을 멀리 떨어진 데이터 센터에 숨겨두는 대신, Anti-Gravity를 통해 눈에 보이는 상호작용 경험으로 바꾼다. 학습 과정 자체가 하나의 웹 서비스처럼 구현되므로, 모델을 정교하게 다듬거나 진행 상황을 공유하기가 훨씬 쉬워진다. 결국 기술적인 백엔드 작업이 프론트엔드의 시각적 경험으로 전환되는 셈이다. 최종 사용자 인터페이스(UI)를 설계하는 이들에게 AI 모델 개발 과정은 이제 더 투명하고 접근하기 쉬운 영역이 됐다. 개발의 문턱이 낮아졌다.