facts

세 자리 수 두 개를 머릿속으로 곱하는 일은 단순한 계산 능력의 문제가 아니다. 계산 과정에서 발생하는 중간 결과값들을 잊지 않고 유지해야 하는 '작업 기억(Working Memory)'의 한계 때문이다. 인간의 뇌는 한 번에 유지하고 조작할 수 있는 정보의 양이 매우 제한적이며, 이를 극복하기 위해 종이에 식을 적는 '외부 메모리'를 사용한다. 종이를 쓴다고 해서 지능이 높아지는 것은 아니지만, 인지적 한계를 확장해 문제를 풀 수 있게 만드는 원리다.

최근 AI 모델이 보여주는 놀라운 수학적 성능은 이 '외부 메모리'의 규모를 극단적으로 키운 결과로 해석된다. AI는 인간과 달리 방대한 컨텍스트 윈도우(Context Window)를 통해 문제 정의, 수백 개의 중간 방정식, 폐기된 접근 방식, 제약 조건과 이전 결론을 동시에 유지한다. 이는 생물학적 뇌가 가진 가장 강력한 제약 중 하나인 작업 기억의 병목 현상을 기술적으로 제거한 상태와 같다.

특히 수학 분야에서 이러한 이점이 극대화되는 이유는 수학적 추론이 명확한 기호로 변환 가능하기 때문이다. 변수의 정의나 부등호의 방향 같은 정보는 한 번 기록되면 맥락이나 기분에 따라 변하지 않고 안정적으로 유지된다. AI는 매 단계마다 현재 적용 중인 가정(예: n은 홀수이고 p는 소수이며 x≠0이다)을 다시 진술하며 컨텍스트를 일종의 '추론 장부'로 활용한다. 결과적으로 AI는 인간보다 더 깊은 통찰력을 가졌다기보다, 100단계에 이르는 긴 추론 사슬을 놓치지 않고 끝까지 유지하는 '북키핑(Bookkeeping)' 능력이 압도적인 것이다.

market-flow

최근 AI 모델들이 응답 전 '생각하는 시간'을 늘려 성능을 개선하는 흐름은 이러한 작업 기억의 확장 전략과 궤를 같이 한다. 더 많은 연산 자원을 투입해 중간 상태를 더 많이 생성하고, 대안적인 경로를 탐색하며, 부분적인 결론을 보존하는 과정이 성능 향상으로 이어진다. 이는 추론의 '깊이'가 깊어지는 것이라기보다, 거대한 노트 위에서 수행하는 '탐색 범위(Broad Search)'가 넓어지는 것에 가깝다.

이러한 특성은 AI의 채택 효율이 도메인별로 극명하게 갈리는 원인이 된다. 수학이나 코드처럼 기호가 명확하고 검증 가능한 영역에서는 컨텍스트 윈도우와 스크래치패드(Scratchpad), 코드 실행 도구의 결합이 즉각적인 성능 폭발을 일으킨다. 정답을 대입해 확인하거나 공식 검증 도구(Lean 등)를 통해 오류를 수정하는 피드백 루프가 명확하기 때문이다.

반면 사회적 질문이나 비즈니스 전략, 심리적 판단 같은 영역에서는 작업 기억의 확장이 주는 이점이 제한적이다. "상대방이 왜 답장을 하지 않는가"와 같은 문제는 기억력의 문제가 아니라, 관찰되지 않은 숨겨진 원인을 추론하는 '인과 모델'의 문제이기 때문이다. 모호한 개념(공정함, 성공 등)은 기호처럼 고정되어 있지 않아, 아무리 큰 컨텍스트 윈도우를 가져도 근본적인 이해 없이는 해결되지 않는다. 결국 시장의 경쟁 구도는 단순한 파라미터 경쟁에서, 특정 도메인의 특성에 맞는 '인지 아키텍처'를 누가 더 효율적으로 설계하느냐로 옮겨가고 있다.

reader-impact

AI 실무자와 개발자가 주목해야 할 지점은 모델의 성능을 평가할 때 '통찰력'과 '기록 관리 능력'을 엄격히 구분하는 것이다. 모델이 복잡한 문제를 풀었다고 해서 그것을 인간 수준의 수학적 직관으로 해석하면, 정작 직관이 필요한 '문제의 재개념화(Reconceptualization)' 단계에서 모델의 한계에 부딪힐 수 있다. AI는 기존 프레임워크 내에서 정교하게 추론하는 데 능숙하지만, 프레임 자체가 잘못되었음을 깨닫고 완전히 새로운 접근법을 발명하는 능력은 여전히 부족하다.

실무적인 활용 측면에서는 AI에게 단순히 정답을 요구하는 대신, 추론 과정을 최대한 외부로 끄집어내도록 유도하는 전략이 유효하다. 중간 단계의 제약 조건을 명시적으로 기록하게 하거나, 외부 메모리 도구를 연결해 '추론 장부'를 강제하는 방식이다. 이는 모델의 내부적인 추론 능력에 기대는 것이 아니라, AI가 가장 잘하는 '거대한 외부 작업 공간 활용' 능력을 극대화하는 방향이다.

향후 관찰해야 할 신호는 AI가 단순히 계산 속도와 기억력을 높이는 것을 넘어, 문제의 정의 자체를 바꾸는 '아인슈타인적 통찰'을 보여주는지 여부다. 현재의 AI는 방대한 정보를 빠르게 처리하는 '폰 노이만적 천재성'의 기계적 확장판에 가깝다. 따라서 실무자는 AI를 '정답을 내는 지능'이 아니라 '방대한 추론 경로를 누락 없이 관리하는 고성능 워크스페이스'로 정의하고 워크플로우를 설계해야 한다.