← Back to all pricing

GLM-5.2 API Pricing: 1M Context Frontier Coding Intelligence

Examine Z.ai GLM-5.2 API pricing ($1.40/M input, $4.40/M output), 1M token context window, software engineering capabilities, and developer token tariffs.

Full specs, context window and API limits →

How much does GLM-5.2 cost per million tokens?

Z.ai GLM-5.2 charges $1.40 per million input tokens and $4.40 per million output tokens ($2.15/M blended at 3:1). Provides high coding precision and 1M context. Verified 2026-09-08.

Verified 2026-09-07 source
Input
$1.40/M
Output
$4.40/M
Blended
$2.15/M
Provider
Verified 2026-06-19source

How much does GLM-5.2 cost per 1,000 requests?

Computed from generated token pricing. Each row assumes the listed input and output tokens per request; output is adjusted by this model's measured 3.87× verbosity factor.

Request shapeInput tokensOutput tokensCost / 1,000 requests
Short10050$0.9914
Medium1,000500$9.9140
Long4,0002,000$39.6560

Formula: ((input price × input tokens) + (output price × output tokens × verbosity factor)) ÷ 1,000,000 × 1,000. Assumptions: short 100/50, medium 1,000/500, long 4,000/2,000 input/output tokens per request. Verbosity run: 2026-06-21T00:00:00.000Z.

Three model-specific pricing decisions

GLM-5.2’s direct-API bill is calculated here. Open-weight, hardware, region, currency, cache, and batch questions remain explicit evidence gaps.

1. GLM-5.1 → 5.2 coding-agent migration bill

Fixed workload (input / output)GLM-5.2GLM-5.1Decision boundary
Coding · 8,000 / 1,200$1648.00$744.0015% accepted-result uplift required to justify the higher bill
Long coding · 32,000 / 4,000$6240.00$2800.0020% accepted-result uplift required to justify the higher bill

Formula: 100,000 × (input tokens × input $/M + output tokens × output $/M) ÷ 1,000,000. Uplift is a decision threshold, not a measured quality claim.

2. 1M-context long-horizon coding ladder

Context shapeInput / outputGLM-5.2 / 100KExpansion boundary
128K128,000 / 2,000$18800.00Output is fixed at 2K
512K512,000 / 2,000$72560.00Linear token sensitivity only
1M1,000,000 / 4,000$141760.00Context fit/output behavior needs model evidence

3. Direct API versus open-weight deployment ledger

DeploymentDated calculationUnavailable inputsDecision
Direct Z.ai API$1648.00$1.40 / $4.40 per MSourced token spend
Open-weightNo API billHardware, utilization, region, currency, cache, batchUser-supplied model required

Verified 2026-06-19. Luna is the data owner for this server-rendered module. “Unavailable” means no compatible dated evidence was found; it is never treated as zero. First-party price source · Run this exact scenario.

All three decisions are server-rendered for GLM-5.2; fixed inputs, formulas, dated sources, and unavailable states are intentionally visible.

Batch 67 · exact model pricing decision contributions · verified 2026-09-07

Exact model boundary: Z.ai glm-5.2 (slug glm-5-2). First-party provider pricing and API documentation remain fact owners.

Token pricing and enterprise coding monthly spend board

Frozen Batch 67 scenario board. Formula / deterministic rule: monthly_spend = calls * ((in_tokens * 1.40 + out_tokens * 4.40) / 1M) Boundary: Owns base token tariff comparisons and software development budgeting.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch67-glm-5-2-m1-r1
15K code review tasks
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=15K code review tasks; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 15K code review tasks is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-glm-5-2-m1-r2
50K unit test generation calls
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=50K unit test generation calls; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 50K unit test generation calls is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-glm-5-2-m1-r3
100K repository static analysis passes
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=100K repository static analysis passes; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 100K repository static analysis passes is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-glm-5-2-m1-r4
prompt caching active (75% read discount)
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=prompt caching active (75% read discount); workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — prompt caching active (75% read discount) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-glm-5-2-m1-r5
batch processing active (50% both)
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=batch processing active (50% both); workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — batch processing active (50% both) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-glm-5-2-m1-r6
unresolved foreign currency conversion
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=unresolved foreign currency conversion; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unresolved foreign currency conversion has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: Z.ai GLM API pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.

Repository ingestion and context scaling (1M boundary) gate

Frozen Batch 67 scenario board. Formula / deterministic rule: eligible = (context <= 1M ? Eligible : Excluded); full repository context ingestion Boundary: Owns repository-scale codebase ingestion boundaries.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch67-glm-5-2-m2-r1
small library codebase (50K tokens)
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=small library codebase (50K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — small library codebase (50K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-glm-5-2-m2-r2
medium application service (250K tokens)
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=medium application service (250K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — medium application service (250K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-glm-5-2-m2-r3
large monolithic codebase (500K tokens)
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=large monolithic codebase (500K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — large monolithic codebase (500K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-glm-5-2-m2-r4
massive enterprise monorepo (800K tokens)
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=massive enterprise monorepo (800K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — massive enterprise monorepo (800K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-glm-5-2-m2-r5
1M full context saturation test
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=1M full context saturation test; context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 1M full context saturation test is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-glm-5-2-m2-r6
unsupported repository archive format
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=unsupported repository archive format; context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unsupported repository archive format has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: Z.ai GLM documentation; verification date 2026-09-07. Missing or conflicting joins fail closed.

Coding agent iterative tool loop token burn ledger

Frozen Batch 67 scenario board. Formula / deterministic rule: session_cost = sum_loops((cumulative_prompt * 1.40 + tool_call_out * 4.40) / 1M) Boundary: Owns multi-step coding agent loop cost modeling.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch67-glm-5-2-m3-r1
3-step function execution loop
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=3-step function execution loop; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 3-step function execution loop is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-glm-5-2-m3-r2
10-step autonomous bug hunting
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=10-step autonomous bug hunting; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 10-step autonomous bug hunting is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-glm-5-2-m3-r3
25-step full PR generation loop
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=25-step full PR generation loop; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 25-step full PR generation loop is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-glm-5-2-m3-r4
50-step multi-file architectural refactor
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=50-step multi-file architectural refactor; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — 50-step multi-file architectural refactor is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-glm-5-2-m3-r5
infinite loop circuit breaker trigger
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=infinite loop circuit breaker trigger; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — infinite loop circuit breaker trigger is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch67-glm-5-2-m3-r6
unhandled tool call syntax error
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=unhandled tool call syntax error; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicitUnavailable — unhandled tool call syntax error is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: Z.ai GLM documentation; verification date 2026-09-07. Missing or conflicting joins fail closed.

Method and limitations: formulas are deterministic; observed and assumed inputs are labeled; no missing provider, host, account, region, realm, alias, snapshot, revision, weight, artifact, control, tool, modality, workload, rate-period, timestamp, or result is transferred. Run the glm-5-2 Batch 67 scenario →

Batch 75 Verified Model Pricing IntelligenceModel owner: glm-5-2 (Z.ai)Audit date: 2026-09-08

GLM-5.2 API Pricing: 1M Context Frontier Coding Intelligence

Z.ai GLM-5.2 charges $1.40 per million input tokens and $4.40 per million output tokens ($2.15/M blended at 3:1). Provides high coding precision and 1M context. Verified 2026-09-08.

Token pricing and enterprise coding monthly spend board

Frozen Batch 75 scenario board. Formula / deterministic rule: monthly_spend = calls * ((in_tokens * 1.40 + out_tokens * 4.40) / 1M) Boundary: Owns base token tariff comparisons and software development budgeting.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch75-glm-5-2-m1-r1
15K code review tasks
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=15K code review tasks; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 15K code review tasks is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-glm-5-2-m1-r2
50K unit test generation calls
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=50K unit test generation calls; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 50K unit test generation calls is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-glm-5-2-m1-r3
100K repository static analysis passes
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=100K repository static analysis passes; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 100K repository static analysis passes is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-glm-5-2-m1-r4
prompt caching active (75% read discount)
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=prompt caching active (75% read discount); workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — prompt caching active (75% read discount) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-glm-5-2-m1-r5
batch processing active (50% both)
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=batch processing active (50% both); workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — batch processing active (50% both) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-glm-5-2-m1-r6
unresolved foreign currency conversion
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=unresolved foreign currency conversion; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unresolved foreign currency conversion has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: Z.ai official API pricing; verification date 2026-09-08. Missing or conflicting joins fail closed.

Repository ingestion and context scaling (1M boundary) gate

Frozen Batch 75 scenario board. Formula / deterministic rule: eligible = (context <= 1M ? Eligible : Excluded); full repository context ingestion Boundary: Owns repository-scale codebase ingestion boundaries.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch75-glm-5-2-m2-r1
small library codebase (50K tokens)
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=small library codebase (50K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — small library codebase (50K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-glm-5-2-m2-r2
medium application service (250K tokens)
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=medium application service (250K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — medium application service (250K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-glm-5-2-m2-r3
large monolithic codebase (500K tokens)
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=large monolithic codebase (500K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — large monolithic codebase (500K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-glm-5-2-m2-r4
massive enterprise monorepo (800K tokens)
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=massive enterprise monorepo (800K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — massive enterprise monorepo (800K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-glm-5-2-m2-r5
1M full context saturation test
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=1M full context saturation test; context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 1M full context saturation test is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-glm-5-2-m2-r6
unsupported repository archive format
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=unsupported repository archive format; context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unsupported repository archive format has no matched, dated bilateral observation.FAIL CLOSED — manual, probe, or source evidence required

First-party provenance: Z.ai developer documentation; verification date 2026-09-08. Missing or conflicting joins fail closed.

Coding agent iterative tool loop token burn ledger

Frozen Batch 75 scenario board. Formula / deterministic rule: session_cost = sum_loops((cumulative_prompt * 1.40 + tool_call_out * 4.40) / 1M) Boundary: Owns multi-step coding agent loop cost modeling.

Frozen scenario / field IDModel, identity, provider, and evidence fieldsResultState
batch75-glm-5-2-m3-r1
3-step function execution loop
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=3-step function execution loop; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 3-step function execution loop is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-glm-5-2-m3-r2
10-step autonomous bug hunting
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=10-step autonomous bug hunting; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 10-step autonomous bug hunting is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-glm-5-2-m3-r3
25-step full PR generation loop
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=25-step full PR generation loop; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 25-step full PR generation loop is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-glm-5-2-m3-r4
50-step multi-file architectural refactor
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=50-step multi-file architectural refactor; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — 50-step multi-file architectural refactor is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-glm-5-2-m3-r5
infinite loop circuit breaker trigger
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=infinite loop circuit breaker trigger; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — infinite loop circuit breaker trigger is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict
batch75-glm-5-2-m3-r6
unhandled tool call syntax error
model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=unhandled tool call syntax error; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicitUnavailable — unhandled tool call syntax error is a frozen fixture pending exact identity, configuration, and denominator joins.UNTESTED — assumption cannot establish a verdict

First-party provenance: Z.ai developer documentation; verification date 2026-09-08. Missing or conflicting joins fail closed.

How fast is GLM-5.2?

Not yet measured — see the speed benchmark leaderboard for models we do track.

How much does GLM-5.2 cost at scale?

Tokens / monthEst. cost (blended 3:1)
100,000$0.21
1,000,000$2.15
10,000,000$21.50
100,000,000$215.00

How does GLM-5.2 compare with other models?

GLM-5.1$1.00/MGPT-5.6 Luna$2.25/MClaude Haiku 4.5$2.00/MMuse Spark 1.3$2.00/M
See all Z.ai models →

What is GLM-5.2 best for?

#2 for Coding#2 for Math & Reasoning#2 for Agents & Tool Use
Looking for a cheaper option?
Muse Spark 1.3 Contributor is 94.2% cheaper — a config migration. See all 8 alternatives to GLM-5.2

Which GLM-5.2 head-to-head comparisons are available?

GLM-5.2 vs Claude Opus 4.8GLM-5.2 vs GLM-5.1

What are common questions about GLM-5.2?

Is GLM-5.2 cheaper than GPT-5.6 Luna?

GLM-5.2 costs $2.15/M blended tokens, GPT-5.6 Luna costs $2.25/M — GLM-5.2 is cheaper.

How much does 1 million tokens cost with GLM-5.2?

At a 3:1 input:output ratio, 1 million blended tokens costs approximately $2.15. Pure input costs $1.40/M; pure output costs $4.40/M.

What does GLM-5.2 cost at high volume?

At 100 million blended tokens a month, GLM-5.2 costs approximately $215.00. See the cost-at-scale table below for other volumes.

Try GLM-5.2 for free

Run real prompts against GLM-5.2 and every other model on this page in one workspace.

Try GLM-5.2 Free