GLM-5.3 모델을 API로 출시했으며, 가격은 이전 버전인

입력 토큰 100만 개당 1.40달러, 출력 토큰 100만 개당 4.40달러라는 기존 가격 체계가 성능 향상 이후에도 그대로 유지된다. z.ai(중국 AI 스타트업)가 API로 출시한 GLM-5.3는 전작인 GLM-5.2와 동일한 비용을 책정해 사용자가 추가 예산 편성 없이 더 높은 지능의 모델로 즉시 전환할 수 있는 환경을 구축했다.

Artificial Analysis(AI 모델 성능 분석 플랫폼)가 측정하는 인텔리전스 지수에서 GLM-5.3는 60점을 기록했다. 이는 이전 버전인 GLM-5.2보다 7점 더 높은 점수이며, Kimi K3와 공동 1위를 기록하며 세계 최고 성능의 오픈 웨이트(모델 가중치 공개) 모델 중 하나로 평가받았다. 모델의 절대적인 지능 수치를 높이면서도 API 단가는 동결해 성능 대비 비용 효율을 극대화했다.

데이터 처리 비용을 줄이기 위한 캐시 기능의 세부 가격도 공개했다. 캐시된 입력 비용은 100만 토큰당 0.26달러로 책정했으며, 캐시 입력 저장 비용은 한시적으로 무료로 제공한다. API 호출 시 반복되는 입력값에 대한 비용을 낮춰 실질적인 운영 지출을 줄이는 방식이다.

투자금과 참여 투자자가 보여주는 신호

입력 토큰 100만 개와 출력 토큰 100만 개를 사용한 단순 비교 시 5.80달러가 소요된다. GLM-5.3(범용 대규모 언어 모델 5.3)의 API(응용 프로그램 인터페이스) 가격은 Grok 4.6가 낮은 컨텍스트 요율에서 적용하는 8달러보다 낮다. Kimi K3의 18달러, Claude Opus 5의 30달러, GPT-5.6 Sol의 35달러와 비교해도 낮은 수치다. 고성능을 지향하는 주요 하이엔드 프런티어 모델들보다 비용 부담을 낮춘 가격대다.

저가형 모델군과 비교하면 GLM-5.3는 시장에서 가장 저렴한 모델은 아니다. GPT-5.6 Luna는 입력 0.20달러와 출력 1.20달러로 가격이 책정되어 있다. Gemini 3.7 Flash는 2026년 12월 31일까지 입력 0.75달러와 출력 3.75달러라는 도입 가격을 제공한다. GLM-5.3는 최상위 프리미엄 모델보다는 저렴한 비용을 제시하지만, Gemini 3.7 Flash나 GPT-5.6 Luna 같은 저가형 모델보다는 가격이 높게 형성되어 있다.

이전 모델보다 답변이 더 장황(verbose)하여, 토큰당

Intelligence Index 작업당 소요 비용이 약 $0.44에서 $0.68로 상승했다. Artificial Analysis(AI 모델 성능 분석 매체)는 GLM-5.3가 이전 모델인 GLM-5.2보다 답변이 더 장황(verbose)하다는 점을 분석했다. API 토큰 단가가 동일하게 책정되었더라도 실제 작업 완료를 위해 소비되는 토큰 양이 늘어나면서 전체 비용 구조가 변했다. 단순히 토큰당 단가가 고정되었다고 해서 전체 작업 비용까지 고정되는 것은 아니다.

z.ai(AI 모델 개발사)는 GLM-5.3의 모델 가중치(weights)를 공개적으로 제공할 계획이라고 밝혔다. 다만 정확한 공개 날짜와 구체적인 라이선스 조건은 아직 미정인 상태다. 현재 개발자들은 OpenAI Chat Completions(OpenAI API 규격) 호환 프로토콜을 통해 모델을 즉시 호출하고 사용할 수 있다. 가중치 공개 전까지는 API 기반의 접근 방식이 유일한 경로다.

초고가 프런티어 모델보다 저렴하게 코딩 에이전트를 구축하려는 팀은 100만 입력 및 100만 출력 토큰 합산 비용을 기준으로 모델을 선택해야 한다. 합산 비용은 GLM-5.3($5.80) < Grok 4.6($8) < Kimi K3($18) < Claude Opus 5($30) < GPT-5.6 Sol($35) 순으로 낮다.