GLM-5.2 API Pricing: 1M Context Frontier Coding Intelligence
Examine Z.ai GLM-5.2 API pricing ($1.40/M input, $4.40/M output), 1M token context window, software engineering capabilities, and developer token tariffs.
Full specs, context window and API limits →How much does GLM-5.2 cost per million tokens?
Z.ai GLM-5.2 charges $1.40 per million input tokens and $4.40 per million output tokens ($2.15/M blended at 3:1). Provides high coding precision and 1M context. Verified 2026-09-08.
How much does GLM-5.2 cost per 1,000 requests?
Computed from generated token pricing. Each row assumes the listed input and output tokens per request; output is adjusted by this model's measured 3.87× verbosity factor.
| Request shape | Input tokens | Output tokens | Cost / 1,000 requests |
|---|---|---|---|
| Short | 100 | 50 | $0.9914 |
| Medium | 1,000 | 500 | $9.9140 |
| Long | 4,000 | 2,000 | $39.6560 |
Formula: ((input price × input tokens) + (output price × output tokens × verbosity factor)) ÷ 1,000,000 × 1,000. Assumptions: short 100/50, medium 1,000/500, long 4,000/2,000 input/output tokens per request. Verbosity run: 2026-06-21T00:00:00.000Z.
Three model-specific pricing decisions
GLM-5.2’s direct-API bill is calculated here. Open-weight, hardware, region, currency, cache, and batch questions remain explicit evidence gaps.
1. GLM-5.1 → 5.2 coding-agent migration bill
| Fixed workload (input / output) | GLM-5.2 | GLM-5.1 | Decision boundary |
|---|---|---|---|
| Coding · 8,000 / 1,200 | $1648.00 | $744.00 | 15% accepted-result uplift required to justify the higher bill |
| Long coding · 32,000 / 4,000 | $6240.00 | $2800.00 | 20% accepted-result uplift required to justify the higher bill |
Formula: 100,000 × (input tokens × input $/M + output tokens × output $/M) ÷ 1,000,000. Uplift is a decision threshold, not a measured quality claim.
2. 1M-context long-horizon coding ladder
| Context shape | Input / output | GLM-5.2 / 100K | Expansion boundary |
|---|---|---|---|
| 128K | 128,000 / 2,000 | $18800.00 | Output is fixed at 2K |
| 512K | 512,000 / 2,000 | $72560.00 | Linear token sensitivity only |
| 1M | 1,000,000 / 4,000 | $141760.00 | Context fit/output behavior needs model evidence |
3. Direct API versus open-weight deployment ledger
| Deployment | Dated calculation | Unavailable inputs | Decision |
|---|---|---|---|
| Direct Z.ai API | $1648.00 | $1.40 / $4.40 per M | Sourced token spend |
| Open-weight | No API bill | Hardware, utilization, region, currency, cache, batch | User-supplied model required |
Verified 2026-06-19. Luna is the data owner for this server-rendered module. “Unavailable” means no compatible dated evidence was found; it is never treated as zero. First-party price source · Run this exact scenario.
All three decisions are server-rendered for GLM-5.2; fixed inputs, formulas, dated sources, and unavailable states are intentionally visible.
Batch 67 · exact model pricing decision contributions · verified 2026-09-07
Exact model boundary: Z.ai glm-5.2 (slug glm-5-2). First-party provider pricing and API documentation remain fact owners.
Token pricing and enterprise coding monthly spend board
Frozen Batch 67 scenario board. Formula / deterministic rule: monthly_spend = calls * ((in_tokens * 1.40 + out_tokens * 4.40) / 1M) Boundary: Owns base token tariff comparisons and software development budgeting.
| Frozen scenario / field ID | Model, identity, provider, and evidence fields | Result | State |
|---|---|---|---|
batch67-glm-5-2-m1-r115K code review tasks | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=15K code review tasks; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 15K code review tasks is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch67-glm-5-2-m1-r250K unit test generation calls | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=50K unit test generation calls; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 50K unit test generation calls is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch67-glm-5-2-m1-r3100K repository static analysis passes | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=100K repository static analysis passes; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 100K repository static analysis passes is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch67-glm-5-2-m1-r4prompt caching active (75% read discount) | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=prompt caching active (75% read discount); workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — prompt caching active (75% read discount) is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch67-glm-5-2-m1-r5batch processing active (50% both) | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=batch processing active (50% both); workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — batch processing active (50% both) is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch67-glm-5-2-m1-r6unresolved foreign currency conversion | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=unresolved foreign currency conversion; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — unresolved foreign currency conversion has no matched, dated bilateral observation. | FAIL CLOSED — manual, probe, or source evidence required |
First-party provenance: Z.ai GLM API pricing; verification date 2026-09-07. Missing or conflicting joins fail closed.
Repository ingestion and context scaling (1M boundary) gate
Frozen Batch 67 scenario board. Formula / deterministic rule: eligible = (context <= 1M ? Eligible : Excluded); full repository context ingestion Boundary: Owns repository-scale codebase ingestion boundaries.
| Frozen scenario / field ID | Model, identity, provider, and evidence fields | Result | State |
|---|---|---|---|
batch67-glm-5-2-m2-r1small library codebase (50K tokens) | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=small library codebase (50K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — small library codebase (50K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch67-glm-5-2-m2-r2medium application service (250K tokens) | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=medium application service (250K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — medium application service (250K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch67-glm-5-2-m2-r3large monolithic codebase (500K tokens) | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=large monolithic codebase (500K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — large monolithic codebase (500K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch67-glm-5-2-m2-r4massive enterprise monorepo (800K tokens) | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=massive enterprise monorepo (800K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — massive enterprise monorepo (800K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch67-glm-5-2-m2-r51M full context saturation test | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=1M full context saturation test; context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 1M full context saturation test is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch67-glm-5-2-m2-r6unsupported repository archive format | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=unsupported repository archive format; context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — unsupported repository archive format has no matched, dated bilateral observation. | FAIL CLOSED — manual, probe, or source evidence required |
First-party provenance: Z.ai GLM documentation; verification date 2026-09-07. Missing or conflicting joins fail closed.
Coding agent iterative tool loop token burn ledger
Frozen Batch 67 scenario board. Formula / deterministic rule: session_cost = sum_loops((cumulative_prompt * 1.40 + tool_call_out * 4.40) / 1M) Boundary: Owns multi-step coding agent loop cost modeling.
| Frozen scenario / field ID | Model, identity, provider, and evidence fields | Result | State |
|---|---|---|---|
batch67-glm-5-2-m3-r13-step function execution loop | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=3-step function execution loop; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 3-step function execution loop is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch67-glm-5-2-m3-r210-step autonomous bug hunting | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=10-step autonomous bug hunting; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 10-step autonomous bug hunting is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch67-glm-5-2-m3-r325-step full PR generation loop | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=25-step full PR generation loop; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 25-step full PR generation loop is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch67-glm-5-2-m3-r450-step multi-file architectural refactor | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=50-step multi-file architectural refactor; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — 50-step multi-file architectural refactor is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch67-glm-5-2-m3-r5infinite loop circuit breaker trigger | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=infinite loop circuit breaker trigger; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — infinite loop circuit breaker trigger is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch67-glm-5-2-m3-r6unhandled tool call syntax error | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=unhandled tool call syntax error; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-07; measurement versus assumption=explicit | Unavailable — unhandled tool call syntax error is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
First-party provenance: Z.ai GLM documentation; verification date 2026-09-07. Missing or conflicting joins fail closed.
Method and limitations: formulas are deterministic; observed and assumed inputs are labeled; no missing provider, host, account, region, realm, alias, snapshot, revision, weight, artifact, control, tool, modality, workload, rate-period, timestamp, or result is transferred. Run the glm-5-2 Batch 67 scenario →
GLM-5.2 API Pricing: 1M Context Frontier Coding Intelligence
Z.ai GLM-5.2 charges $1.40 per million input tokens and $4.40 per million output tokens ($2.15/M blended at 3:1). Provides high coding precision and 1M context. Verified 2026-09-08.
Token pricing and enterprise coding monthly spend board
Frozen Batch 75 scenario board. Formula / deterministic rule: monthly_spend = calls * ((in_tokens * 1.40 + out_tokens * 4.40) / 1M) Boundary: Owns base token tariff comparisons and software development budgeting.
| Frozen scenario / field ID | Model, identity, provider, and evidence fields | Result | State |
|---|---|---|---|
batch75-glm-5-2-m1-r115K code review tasks | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=15K code review tasks; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — 15K code review tasks is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch75-glm-5-2-m1-r250K unit test generation calls | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=50K unit test generation calls; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — 50K unit test generation calls is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch75-glm-5-2-m1-r3100K repository static analysis passes | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=100K repository static analysis passes; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — 100K repository static analysis passes is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch75-glm-5-2-m1-r4prompt caching active (75% read discount) | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=prompt caching active (75% read discount); workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — prompt caching active (75% read discount) is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch75-glm-5-2-m1-r5batch processing active (50% both) | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=batch processing active (50% both); workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — batch processing active (50% both) is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch75-glm-5-2-m1-r6unresolved foreign currency conversion | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=unresolved foreign currency conversion; workload; prompt tokens; completion tokens; standard spend; cached spend; cost winner; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — unresolved foreign currency conversion has no matched, dated bilateral observation. | FAIL CLOSED — manual, probe, or source evidence required |
First-party provenance: Z.ai official API pricing; verification date 2026-09-08. Missing or conflicting joins fail closed.
Repository ingestion and context scaling (1M boundary) gate
Frozen Batch 75 scenario board. Formula / deterministic rule: eligible = (context <= 1M ? Eligible : Excluded); full repository context ingestion Boundary: Owns repository-scale codebase ingestion boundaries.
| Frozen scenario / field ID | Model, identity, provider, and evidence fields | Result | State |
|---|---|---|---|
batch75-glm-5-2-m2-r1small library codebase (50K tokens) | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=small library codebase (50K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — small library codebase (50K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch75-glm-5-2-m2-r2medium application service (250K tokens) | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=medium application service (250K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — medium application service (250K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch75-glm-5-2-m2-r3large monolithic codebase (500K tokens) | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=large monolithic codebase (500K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — large monolithic codebase (500K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch75-glm-5-2-m2-r4massive enterprise monorepo (800K tokens) | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=massive enterprise monorepo (800K tokens); context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — massive enterprise monorepo (800K tokens) is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch75-glm-5-2-m2-r51M full context saturation test | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=1M full context saturation test; context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — 1M full context saturation test is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch75-glm-5-2-m2-r6unsupported repository archive format | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=unsupported repository archive format; context size; codebase eligible; prompt cost; completion cost; context gate verdict; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — unsupported repository archive format has no matched, dated bilateral observation. | FAIL CLOSED — manual, probe, or source evidence required |
First-party provenance: Z.ai developer documentation; verification date 2026-09-08. Missing or conflicting joins fail closed.
Coding agent iterative tool loop token burn ledger
Frozen Batch 75 scenario board. Formula / deterministic rule: session_cost = sum_loops((cumulative_prompt * 1.40 + tool_call_out * 4.40) / 1M) Boundary: Owns multi-step coding agent loop cost modeling.
| Frozen scenario / field ID | Model, identity, provider, and evidence fields | Result | State |
|---|---|---|---|
batch75-glm-5-2-m3-r13-step function execution loop | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=3-step function execution loop; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — 3-step function execution loop is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch75-glm-5-2-m3-r210-step autonomous bug hunting | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=10-step autonomous bug hunting; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — 10-step autonomous bug hunting is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch75-glm-5-2-m3-r325-step full PR generation loop | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=25-step full PR generation loop; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — 25-step full PR generation loop is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch75-glm-5-2-m3-r450-step multi-file architectural refactor | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=50-step multi-file architectural refactor; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — 50-step multi-file architectural refactor is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch75-glm-5-2-m3-r5infinite loop circuit breaker trigger | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=infinite loop circuit breaker trigger; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — infinite loop circuit breaker trigger is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
batch75-glm-5-2-m3-r6unhandled tool call syntax error | model=glm-5.2; slug=glm-5-2; provider=Z.ai; scenario=unhandled tool call syntax error; agent loop depth; cumulative input tokens; emitted tool tokens; session spend; agent status; prompt/config/input/output/result/cache/checkpoint/artifact hashes=required; evidence=2026-09-08; measurement versus assumption=explicit | Unavailable — unhandled tool call syntax error is a frozen fixture pending exact identity, configuration, and denominator joins. | UNTESTED — assumption cannot establish a verdict |
First-party provenance: Z.ai developer documentation; verification date 2026-09-08. Missing or conflicting joins fail closed.
How fast is GLM-5.2?
How much does GLM-5.2 cost at scale?
| Tokens / month | Est. cost (blended 3:1) |
|---|---|
| 100,000 | $0.21 |
| 1,000,000 | $2.15 |
| 10,000,000 | $21.50 |
| 100,000,000 | $215.00 |
How does GLM-5.2 compare with other models?
What is GLM-5.2 best for?
What should you explore next for GLM-5.2?
Which GLM-5.2 head-to-head comparisons are available?
What are common questions about GLM-5.2?
Is GLM-5.2 cheaper than GPT-5.6 Luna?
GLM-5.2 costs $2.15/M blended tokens, GPT-5.6 Luna costs $2.25/M — GLM-5.2 is cheaper.
How much does 1 million tokens cost with GLM-5.2?
At a 3:1 input:output ratio, 1 million blended tokens costs approximately $2.15. Pure input costs $1.40/M; pure output costs $4.40/M.
What does GLM-5.2 cost at high volume?
At 100 million blended tokens a month, GLM-5.2 costs approximately $215.00. See the cost-at-scale table below for other volumes.
