인공지능(AI)의 진화 속도가 무섭다. 이론 수학과 생물학 같은 기초 과학부터 기업의 생산성 도구, 일반 소비자 시장에 이르기까지 AI의 영향력은 전방위로 확산하고 있다.
최근 오픈AI는 복잡한 수학적 증명의 정확성을 보장하기 위해 Lean 정리 증명기(theorem prover)를 모델에 통합했다. 내부 모델을 통해 리만 가설(Riemann hypothesis) 같은 난제 해결에도 일부 진전을 보였다. 생물학 연구에서는 구글 딥마인드의 AlphaGenome이 세포 수준에서 인간 게놈을 해독하는 생물물리학적 설명 가능 예측 모델을 선보였다. 과학적 발견의 도구가 바뀌고 있다.
반면 소비자 시장의 수용 속도는 기대에 못 미친다. 미국 가구의 AI 유료 구독률은 2.2% 수준에서 정체된 상태다. 이에 기업들은 구독료 외에 광고와 같은 새로운 수익 모델을 찾기 시작했다. 기술의 발전과 시장의 괴리가 나타나고 있다.
고성능을 유지하면서 운영 비용을 낮추려는 움직임도 뚜렷하다. 앤스로픽과 오픈AI는 고효율 모델 개발로 방향을 틀었다. Mistral은 데이터 보안을 위해 자체 서버 설치가 가능한 오픈 웨이트(open-weight) 모델인 Mistral Large 4 preview를 출시했다. 서비스 차원에서는 ChatGPT가 자동 일일 페이지 생성과 회의록 작성 플러그인을 추가하며 편의성을 높였다. 이를 뒷받침하기 위해 Lambda는 AI 연구와 재현성 가속화에 필수적인 고성능 GPU를 공급하고 있다. 인프라와 효율의 시대다.
01오픈AI와 Lean의 결합 — 확률적 추측을 넘어 논리적 증명으로
인공지능이 단순히 그럴듯한 답을 내놓는 수준을 넘어, 논리적으로 완벽한 증명을 만들어내는 단계로 진입하고 있다. 오픈AI는 이를 위해 정리 증명기(theorem prover)인 Lean을 모델에 통합했다. Lean은 수학적 논증의 모든 단계가 엄격한 논리 규칙을 따르는지 확인하는 특수 소프트웨어다. 이번 변화의 핵심은 거대언어모델(LLM) 특유의 확률적 특성에서 벗어나는 데 있다. 복잡한 추론 과정에서 발생하는 미세한 오류를 잡고, 기계가 검증한 '정답 보증서'를 제공할 수 있게 된 것이다. 논리의 시대가 왔다.
오픈AI는 이러한 성능을 증명하기 위해 github.com/openai/math에 722건의 수학 원고를 공개했다. 이 문서들에는 초기 가설부터 단계별 추론 과정, 그리고 Lean 환경에서 수행된 최종 형식 검증(formal verification)까지 AI의 사고 과정이 상세히 담겨 있다. 생성형 AI와 형식 논리를 결합해 수학의 한계를 어떻게 확장할 수 있는지 보여준 사례다. 복잡한 증명을 구축하고 검증하는 방식 자체가 완전히 바뀌고 있다.
오픈AI는 특히 과거에 수백만 달러의 상금이 걸렸을 만큼 난도가 높고 권위 있는 난제들을 정조준하고 있다. 공개된 작업물 중 일부는 수학의 근본적인 이해를 돕는 핵심 열쇠로 알려진 '준-리만 가설(quasi-Riemann hypothesis)' 관련 문제들에 집중되어 있다. 막대한 컴퓨팅 자원과 Lean의 정밀함을 결합해, 수십 년간 인간 연구자들이 풀지 못한 새로운 수학적 진리를 찾아내겠다는 전략이다.
02앤스로픽과 오픈AI — 압도적 성능보다 '실용적 효율'로의 전환
사용자와 기업이 체감하는 AI 도구의 진화 방향이 바뀔 것으로 보인다. 단순히 성능을 비약적으로 높이기보다, 더 빠르고 저렴한 모델을 만드는 쪽으로 무게중심이 이동하고 있다. 앤스로픽과 오픈AI는 고효율 버전을 우선시하는 방향으로 전략을 수정하는 모양새다. 업계가 정의하는 '발전'의 개념 자체가 근본적으로 변하고 있음을 시사한다. 이제는 접근성이 곧 경쟁력이다.
'프런티어 속도 조절(pacing the frontier)'이라 불리는 이번 전략의 핵심은 세계 최고 수준의 성능은 유지하되, 구동 비용과 시간은 획기적으로 줄이는 모델을 내놓는 것이다. 최근 출시된 6.1 Soul과 Opus 5.5가 이러한 흐름을 잘 보여준다. AI 연구소들은 다른 대안보다 저렴하고 빠른 모델을 공급함으로써 도구의 실질적인 활용도에 우선순위를 두고 있다. 세계 최고의 AI가 효율성 중심으로 최적화되면서, 고성능 지능을 사용하기 위해 감수해야 했던 과도한 비용이나 느린 응답 속도라는 장벽이 낮아지고 있다.
다만 효율성에 집중하면서 발생하는 기회비용은 차세대 거대 모델의 개발 속도가 늦어질 수 있다는 점이다. 이로 인해 GPT7이나 Fable 6처럼 기대를 모으는 차세대 모델의 성능 도약 시점이 뒤로 밀릴 가능성이 있다. 차세대 모델을 위해 막대한 자원을 쏟아붓는 '빅 런(big runs, 대규모 학습)'의 속도를 늦추는 대신, 현재 제공하는 하이엔드 모델의 접근성과 속도를 정교하게 다듬겠다는 계산이다. 속도보다 내실을 택한 셈이다.
일반 사용자와 기업 입장에서는 AI 지능의 '천장'이 올라가는 속도는 더뎌지겠지만, 실제로 쓸 만한 고성능 AI의 '바닥'은 높아지는 효과가 있다. 최강의 모델을 만드는 것에서, 현존하는 최선의 모델을 가장 효율적으로 구현하는 것으로 우선순위가 옮겨갔다. 덕분에 최첨단 AI 기능이 이론적인 성능 지표에 머물지 않고, 과도한 비용 부담 없이 일상적인 업무 흐름(workflow)에 즉시 통합될 수 있는 실질적인 도구가 된다. 이론보다 실용이 앞선다.
03ChatGPT가 스스로 내용을 바꾸는 대시보드와 회의록 작성까지 맡는다면?
ChatGPT가 대화를 주고받는 챗봇을 넘어 스스로 일하는 생산성 도구로 진화한다. 사용자가 매번 최신 정보를 일일이 물어볼 필요 없이, 설정한 주기나 매일 정해진 시간에 알아서 내용을 갱신하는 페이지 기능이 추가된다. 이를 활용하면 이메일과 사내 메신저(Slack), 처리해야 할 일들을 한눈에 모아 보여주는 아침 브리프 같은 살아 움직이는 대시보드를 만들 수 있다. 일반 텍스트 문서가 아니라 실제로 작동하는 페이지를 만들려면 "@pages" 명령어를 입력해 원하는 형식과 목적을 지정하면 된다.
정기적인 업데이트 기능 외에도 회의록 정리를 돕는 전용 회의(meetings) 연동 기능이 추가되면서 업무 처리 방식이 한층 간소화된다. 이 도구는 ChatGPT 데스크톱 앱에서만 쓸 수 있으며, AI가 예정된 회의에 직접 참석해 허드렛일인 회의록 작성을 대신 도맡는다. 설정 방법은 앱 내 연동 기능 메뉴로 이동해 회의 연동을 추가하면 된다. 설정을 마치면 예정된 회의 목록을 확인하고 AI가 참석할 회의를 직접 고를 수 있다.
이러한 자동화된 작업 흐름은 사람이 직접 데이터를 입력하고 정리하는 번거로움을 줄여준다. 일정 관리와 소통 도구가 직접 연결되면서, ChatGPT는 업무 시간의 행정적인 잡무를 스스로 관리하는 구조로 나아가고 있다. 매일 바뀌는 우선순위를 실시간으로 띄워두거나 실시간 대화의 핵심을 놓치지 않고 기록하는 등, 이번 업데이트는 AI를 끊임없이 명령을 내려야 하는 도구에서 업무 배경 속에서 알아서 움직이는 시스템으로 탈바꿈시킨다.
04오픈AI 내부 모델, 리만 가설 0.875 한계치 설정 등 수학 난제 부분 해결
인공지능이 수십 년간 인간 연구자들을 괴롭힌 순수 수학의 영역을 파고들기 시작했다. 최근 오픈AI의 내부 모델은 수학계의 가장 까다로운 난제로 꼽히는 리만 가설(Riemann hypothesis)과 버치-스위너튼-다이어 추측(Birch-Swinnerton-Dyer conjecture)에서 유의미한 부분적 성과를 냈다. 완전한 해답을 찾은 것은 아니지만, AI가 인간보다 더 깊게 복잡한 수학적 영역을 탐색할 수 있음을 증명했다. 새로운 기준점이 세워진 셈이다.
해결 시 100만 달러의 상금이 걸려 있을 만큼 권위 있는 리만 가설의 경우, AI는 0.875라는 고정 한계치를 설정했다. 최종 목표인 0.5를 향해 가는 과정에서 이번 결과는 매우 중요한 이정표가 된다. 가설을 완전히 푼 것은 아니나, 문제라는 '산'의 높이가 최소한 이 한계치만큼은 된다는 사실을 효과적으로 입증했다. 기존 인간의 성과보다 더 높이 올라감으로써 수학자들이 딛고 일어설 새로운 토대를 마련했다.
버치-스위너튼-다이어 추측에서도 진전이 있었다. AI는 해당 추측 내의 광범위한 문제군에 대해 완전한 공식을 도출하는 데 성공했다. 이는 보편적인 정답을 찾지 못한 상태에서도, AI가 특정 부분 집합에서 일반적인 패턴을 식별하고 포괄적인 수학적 규칙을 만들 수 있음을 시사한다.
이러한 발전은 고등 수학을 연구하는 방식의 변화를 예고한다. 이제 연구자들은 오직 인간의 직관에만 의존해 길을 찾는 대신, AI를 활용해 문제의 한계를 탐색하고 새로운 경계선을 설정할 수 있다. 알려진 결과의 기준선을 끌어올림으로써, 오픈AI의 내부 모델은 이론 과학의 발견을 돕는 강력한 도구가 될 수 있음을 보여줬다. 세계에서 가장 어려운 수학적 미스터리를 풀기 위한 간극이 좁혀지고 있다.
05AlphaGenome — 단순한 패턴 분석을 넘어 생물학적 작동 원리를 규명하다
세포의 복잡한 작동 원리를 이해하는 것은 암과 같은 질병과의 싸움에서 혁신적인 전환점이 될 수 있다. AlphaGenome은 30억 개의 문자로 이루어진 '생명의 설계도'인 인간 게놈을 해독하기 위해 설계된 머신러닝 모델이다. 이 모델은 유전 코드의 문자 하나가 바뀔 때 생명체에 어떤 영향을 미치는지 예측해, 유전적 변이가 가져오는 정확한 결과를 연구자가 파악하도록 돕는다.
기존의 많은 AI 도구들은 특정 변이가 질병과 함께 자주 나타난다는 단순한 상관관계만 찾아냈을 뿐, 그 이유를 설명하지 못했다. 반면 AlphaGenome은 생물물리학적으로 설명 가능한 예측을 제공한다. 세포 수준에서 유전자 발현과 스플라이스 부위(splice sites)에 대한 통찰을 제공함으로써, 과학자들이 단순한 패턴을 넘어 실제 생물학적 메커니즘을 이해할 수 있게 한다. 단순한 패턴을 넘어 실제 원리를 본다. 이 모델은 인간 단백질체(proteome)의 20,000개 단백질을 합성하는 코딩 영역뿐만 아니라, 단백질 발현 방식과 양을 조절하는 비코딩 영역까지 모두 해독하도록 설계됐다.
데이터의 규모부터 압도적이다. AlphaGenome Atlas는 AlphaFold 데이터베이스보다 30배 더 크며, 게놈 변이에 대해 미리 계산된 방대한 데이터를 제공한다. 개발팀은 학습 데이터에 과하게 최적화되는 오버피팅(overfitting) 문제를 막기 위해 4~5년에 걸쳐 신경망의 정확도를 정밀하게 다듬는 신중한 접근 방식을 택했다. 이러한 예측 결과는 이미 실험실 환경에서 검증을 마쳤으며, 모델이 제시한 세포 수준의 통찰이 실제 물리적 현실과 일치한다는 점이 확인됐다.
앞으로 모델의 규모를 더 키운다면 더 야심 찬 과학적 돌파구를 찾을 수 있을 것으로 보인다. 향후 10년 내에 컴퓨팅 속도가 100만 배 빨라진다면 세포 전체를 시뮬레이션하는 것이 가능해진다. 인간의 능력으로는 불가능했던 생물학적 난제들을 탐구할 수 있는 '가상 세포'가 탄생하는 셈이다.
06미국 가구 AI 구독: 2.2%의 낮은 보급률, 광고 수익으로 눈 돌린 기업들
대부분의 미국 가구가 AI 서비스에 비용을 지불하지 않고 있다. 업계의 기대와 실제 소비자 행동 사이에 상당한 간극이 존재한다는 뜻이다. 4월 기준 미국 가구의 유료 AI 구독률은 2.2%에 불과했다. 인구의 98%가 유료 생태계 밖에 머물고 있는 셈이다. 이는 단순히 도입 속도가 느린 것인지, 아니면 유료 결제 의사가 있는 사용자의 한계치(hard ceiling)에 도달한 것인지에 대한 논쟁을 불러일으킨다.
이러한 괴리의 주된 원인은 개발자들이 자신의 고강도 업무 환경을 보편적인 인간의 필요로 착각하는 '버블' 현상일 수 있다. 하비비 슬랩(Habibi Slap)은 항공권 예약 같은 작업을 수행하는 자율형 AI(AI agents)를 홍보하는 방식에 근본적인 결함이 있다고 주장한다. 항공권 예약이라는 수동 작업은 이미 충분히 간단하며, 미국 성인의 약 55%는 연간 비행기를 한 번도 타지 않기 때문이다. 테크 개발자들이 잦은 출장과 행정 업무가 일상인 자신들의 라이프스타일을, 그런 부담이 없는 일반 대중에게 투영했다는 분석이다.
구독 성장세가 꺾이면서 기업들은 새로운 수익원을 찾고 있다. ChatGPT는 최근 광고 사업으로 방향을 틀었다. 광고 수익은 6주 만에 1억 달러에서 8월까지 10억 달러 규모로 급성장했다. 성장 속도는 빠르지만, 구글과 Meta가 벌어들이는 합산 광고 수익 5,000억 달러에 비하면 여전히 극히 일부에 불과하다. AI 광고 시장은 이제 막 걸음마를 뗀 단계다.
하지만 현재의 낮은 보급률이 단순히 시기의 문제라고 보는 분석가들도 있다. 과거 사례를 보면 혁신적인 기술이 대중화되기까지는 수년이 걸렸다. 컴퓨터는 19년, 자동차는 15년, 스마트폰은 6.5년이 소요됐다. 이런 관점에서 보면 2.2%라는 구독률은 실패의 징후가 아니라, 시장이 아직 초기 단계에 머물러 있다는 신호로 해석할 수 있다.
07Mistral Large 4 — 성능보다 보안과 통제권에 집중한 가중치 공개 전략
Mistral이 Mistral Large 4 preview를 공개했다. 이 모델은 단순한 지능 수준보다 개인정보 보호와 배포 제어권을 우선시하는 기업들을 겨냥했다. 모델의 핵심 파라미터를 공개해 사용자가 자체 서버에서 직접 구동할 수 있는 가중치 공개(open-weight) 방식을 채택했다. 이는 폐쇄적인 독점 시스템에 대한 전략적 대안이 된다. GPT 6.1 Soul이나 Opus 5.5 같은 최첨단 모델보다 절대적인 성능은 낮지만, 기업이 AI를 직접 호스팅하며 보안 가이드라인을 자유롭게 설정하고 데이터를 자체 관리할 수 있다는 점이 핵심이다. 외부 제공업체에 의존할 필요가 없다.
이번 모델은 유럽 AI 인프라의 중요한 이정표로 평가받는다. Mistral의 유럽 데이터 센터에서 3,800대의 Nvidia Grace Blackwell GPU를 투입해 처음부터 끝까지 직접 학습시켰기 때문이다. Qwen이나 Kimmy 같은 기존 모델을 기반으로 사후 학습(post-trained)한 경쟁 모델들과는 궤를 달리한다. 하지만 가중치 공개 모델과 폐쇄형 최첨단 모델 사이의 성능 격차는 여전하다. 인공지능 성능 평가 기관인 Artificial Analysis의 지능 지수에서 Mistral Large 4 preview는 38점을 기록하며 25위에 머물렀다. 53점을 기록한 GPT6 Astra 같은 선두 그룹과는 차이가 크다.
한 번에 처리할 수 있는 텍스트 양인 문맥 창(context window)에서도 차이가 난다. MIMO, GLM53, GPT6 Astra 등이 100만 토큰 표준으로 나아가는 추세지만, Mistral Large 4는 50만(500k) 토큰으로 제한된다. 전반적인 추론 능력과 용량은 부족할지 몰라도, 특정 전문 분야에서는 매우 강력하다. 특히 실제 소프트웨어의 보안 결함을 찾아내고 수정하는 Artificial Analysis 사이버 지수에서 전 세계 톱 5 안에 들었다. 중국 외 지역에서 개발된 가중치 공개 모델 중에서는 압도적 1위다.
08AI 연산 규모의 확장 — 10년 사이 백만 배 빨라진 처리 속도
AI의 정보 처리 및 복잡한 문제 해결 능력은 단순한 패턴 인식 수준을 넘어 정교한 과학적 추론 단계로 빠르게 진화했다. 지난 10년 동안 AI의 처리 속도는 무려 백만 배나 빨라졌다. 단 한 번의 돌파구가 아닌 여러 요인이 맞물린 결과다. 하드웨어의 성능 향상이 기초 체력을 제공했다면, 데이터를 더 효율적으로 처리하는 구조(트랜스포머 아키텍처)의 도입과 정교한 엔지니어링, 소프트웨어 구현 능력이 결합하며 가속도를 붙였다.
이러한 기하급수적 성장세가 이어진다면, 향후 10년 뒤에는 다시 한번 백만 배의 성능 향상이 일어날 수 있다. 이 경우 AI의 영향력은 단순한 디지털 도구를 넘어 생물학적 근본 혁신으로 확장된다. 특히 단일 세포의 복잡한 내부 작동 원리를 정밀하게 구현하는 '가상 세포' 제작이 가능해질 전망이다. 이는 암과 같은 질병을 정복하는 새로운 길이 될 것이며, 연구자가 실험실에 가기 전 가상 환경에서 가설을 검증하는 합성 생물학의 가능성을 크게 넓힐 것으로 보인다.
연산 규모 확장의 최종 목적지는 세포 단위를 넘어 생명체 전체를 시뮬레이션하는 단계다. 살아있는 시스템 전체를 모델링함으로써, 유전 정보가 물리적으로 나타난 형태인 분자 표현형(molecular phenotypes)과 이것이 특정 질병에 걸릴 확률에 어떤 영향을 주는지 명확히 이해할 수 있다. 결국 연산 능력의 확장은 단순히 AI를 더 빠르게 만들거나 대화 능력을 높이는 일이 아니다. 생명이라는 정교한 생물학적 기계를 시뮬레이션하는 힘을 갖추는 과정이다. 이는 현재 인간의 지능이나 기존 컴퓨터의 계산 능력으로는 도저히 해결할 수 없는 과학적 난제를 푸는 열쇠가 될 가능성이 높다.
09Lambda의 GPU 인프라, AI 연구의 실용화 속도를 어떻게 앞당길까?
Lambda는 Nvidia GPU 인프라를 제공해 AI 연구의 실용화 속도를 높이고 있다. 새로운 AI 발견을 빠르게 검증하는 능력은 이론적 돌파구를 실제 도구로 바꾸는 결정적 차이를 만든다. 연구자들은 복잡한 AI 논문을 실제 작동하는 시제품(prototype)으로 구현하는 시간을 단 몇 분 수준으로 대폭 줄일 수 있다. 고가의 장비라는 진입 장벽이 사라진 셈이다.
이러한 인프라는 단순한 검증을 넘어 AI의 구축과 개선 전 과정을 지원한다. 사용자는 GPU를 활용해 완전히 새로운 모델을 학습시키거나, 기존 모델을 특정 작업에 맞춰 정교하게 다듬는 미세 조정(fine-tuning) 작업을 수행한다. 모델을 실제로 실행해 결과물을 만들어내는 추론(inference) 과정 역시 원활하게 이루어진다. 특히 텍스트로 고해상도 이미지나 영상을 생성하는 고부하 작업에서 그 진가가 드러난다. 연산 능력의 한계가 창의성의 한계가 되지 않게 한다.
하드웨어의 신뢰성은 대화형 AI 도구의 안정적인 배포로 이어진다. DeepSeek의 챗봇이나 자율형 시스템(agents)을 빠르고 안정적으로 운영할 수 있는 환경이 마련된 것이다. 사용자는 이제 하드웨어 안정성이라는 기초적인 고민 대신, AI의 논리와 출력값이라는 본질적인 문제에 집중할 수 있다. 아이디어를 테스트하고 개선해 배포하는 실험 사이클이 획기적으로 빨라진다. 하드웨어 제약이 사라진 자리에 아이디어만 남는다.
10AI의 리만 가설 접근 — 0.875라는 새로운 기준점
인공지능이 수학적 증명에 접근하는 방식은 향후 생물학, 물리학, 경제학 등에서 자동 발견(automated discovery)이 어떻게 구현될지를 보여주는 설계도와 같다. 수학 정리는 사람이 객관적으로 검증할 수 있어, 다른 과학 분야에서 흔히 발생하는 모호함 없이 AI의 한계를 시험할 수 있는 통제된 환경을 제공한다. 수학적 해답은 정답이거나 오답일 뿐, 중간 지대가 없다. 명확하다. 이러한 확실성 덕분에 개발자들은 AI 기반의 획기적인 성과를 관리하는 프로세스를 정교화할 수 있으며, 증명을 찾아내는 방식을 다른 복잡한 과학 분야로 안정적으로 확장할 수 있다.
이러한 역학 관계를 가장 잘 보여주는 사례가 리만 가설(Riemann hypothesis) 해결 노력이다. 이 문제는 해결 시 100만 달러의 상금이 걸려 있을 만큼 비중이 크다. 여기서 AI는 인간이 단독으로 도달할 수 없는 수준까지 이해도를 높이는 도구로 활용됐다. AI가 0.875라는 고정 한계치를 설정함으로써, 지적 산맥의 일부를 이미 올라왔음을 입증한 셈이다. 가설의 최종 목표치인 0.5에는 미치지 못해 전체 문제를 해결한 것은 아니지만, AI가 연구의 경계를 어디까지 넓힐 수 있는지 보여줬다. 이제 인간은 정상까지 남은 거리를 평가하기만 하면 된다.
이는 AI가 모든 연구 분야에서 가속기 역할을 할 수 있다는 가능성을 시사한다. 복잡한 문제에서 특정 높이에 도달함으로써 AI는 인간이 노력해야 할 새로운 기준점(baseline)을 제시하고, 모델이 한계에 부딪히기 전까지 어디까지 갈 수 있는지 정확히 보여준다. 경계를 넓히고 그 결과를 검증하는 과정이 바로 AI 기반 발견의 핵심 메커니즘이다. 모델이 진화함에 따라 수학이라는 시험장에서 얻은 교훈은 새로운 물리 법칙을 발견하거나 생물학적 돌파구를 찾는 방식으로 확장될 것이다. 부분적인 결과가 완전한 과학적 해답으로 진화하는 과정이다.
11구글·사카나 AI의 성과 — 수학적 발견으로 문제 해결 속도 10배 가속
인공지능이 복잡한 고난도 문제를 해결하는 능력이 빠르게 성장하고 있다. 연구자들이 머신러닝 모델 설계에 심오한 수학적 발견을 접목하기 시작했기 때문이다. 단순히 방대한 데이터와 연산 능력에만 의존하던 기존 방식에서 벗어나, 깊이 있는 수학적 원리를 적용해 더 정교한 시스템을 구축하는 방향으로 흐름이 바뀌고 있다. 이제 다음 세대 모델은 데이터 속의 통계적 패턴을 찾는 수준을 넘어, 지난 한 세기 동안 쌓인 인류의 수학적 통찰을 통해 기술적 한계를 극복하려 한다. 데이터의 양보다 원리의 깊이가 중요해진 시대다.
이러한 변화는 구글 AlphaEvolve와 Sakana AI의 사례에서 명확히 드러난다. 수학적 돌파구를 모델 개발에 직접 적용했을 때, 문제 해결 능력의 향상은 완만한 직선 형태가 아니라 기하급수적인 곡선을 그리며 나타났다. 발전 속도는 놀라울 정도로 가파르다. 해결 가능한 문제의 수가 매달 10배씩 증가하고 있다. 실제로 8월에는 10개였던 해결 문제 수가 9월에는 100개로 늘었고, 10월 6일에는 이미 722개에 도달했다. 성장의 기울기가 완전히 달라졌다.
갑작스러운 성능 도약은 현대 AI가 기존의 방대한 지식을 습득하고 이를 확장하기 시작하면서 가능해졌다. 활용되는 수학적 원리 중 상당수는 수십 년, 길게는 100년 전 이미 정립된 것들이다. 개발자들은 이러한 과거의 발견과 현대의 머신러닝 구조 사이의 간극을 메우며 전례 없는 속도로 모델의 이해도를 높이고 있다. 고전 수학과 최신 AI 기술의 시너지는 복리 효과를 일으키며, 하나의 돌파구가 다음 단계의 적용을 가속하는 구조를 만든다. 고급 모델이 진화하는 규모와 속도의 판 자체가 바뀌고 있다.
