Z.ai

glm-5.2

Z.aiToken-based
Create API Key

Z.ai 的 glm-5.2 模型,支持文本输入和文本输出。支持推理、工具调用。

textfunction_callingtoolsjson_modereasoningcontext:1048576
Starting price
Input / Output · 1M
Context
1M
Maximum input window
Max output
131.1K
Maximum tokens per response
Modalities
→

Pricing by Supplier

official
官方接口直连
Input$1.4/ 1M
Output$4.4/ 1M
Cache Read$0.26/ 1M
Volcengine
-8%
火山引擎官方接口
Input$1.4$1.288/ 1M
Output$4.4$4.048/ 1M
Cache Read$0.26$0.2392/ 1M
Alibaba
阿里巴巴百炼官方
Input$1.4/ 1M
Output$4.4/ 1M
Cache Read$0.26/ 1M
火山引擎特价
-55%
火山引擎官方接口,高并发,活动特价
Input$1.4$0.63/ 1M
Output$4.4$1.98/ 1M
Cache Read$0.26$0.117/ 1M

Capabilities / Supported modalities

Function callingToolsJSON modeReasoning
Input
Output

Provider & data privacy

Provider
Zhipu AIDocs
Tokenizer
GLM tokenizer
License
GLM-4 LicenseOpen weights
Data retention4 daysNot used for upstream training by default

Performance

API access

Code samples

RequestPOST/v1/chat/completions
Example request
Parameters
ParameterTypeDefault / rangeDescription
temperature
number
=10 ~ 2
Sampling temperature; lower is more deterministic
top_p
number
=10 ~ 1
Nucleus sampling probability mass
max_tokens
integer>= 1Maximum number of tokens in the response
frequency_penalty
number
=0-2 ~ 2
Penalises repetition of frequent tokens
presence_penalty
number
=0-2 ~ 2
Encourages introducing new topics
stop
array—Up to 4 strings that stop generation
seed
integer—Deterministic sampling seed (best-effort)
n
integer
=1>= 1
Number of completions to generate
stream
boolean
=false
Stream tokens via Server-Sent Events
response_format
object—Force JSON object or schema-conforming output
tools
array—Tool / function declarations the model may call
tool_choice
string
autononerequired
Tool-choice policy or specific tool name
logprobs
boolean
=false
Return per-token log probabilities
top_logprobs
integer0 ~ 20Number of top log probabilities returned per token
logit_bias
object—Per-token logit bias map
user
string—End-user identifier for abuse monitoring

Replace <YOUR_API_KEY> with the API key from your token settings.

Authentication

All requests must include Authorization: Bearer <TOKEN> header. Anthropic-formatted endpoints accept the x-api-key header instead.

Generate tokens from the Tokens page; you can scope them to specific models, groups, IPs, and rate-limits.

Supported parameters

Generation parameters
ParameterTypeDefault / rangeDescription
temperature
number
=10 ~ 2
Sampling temperature; lower is more deterministic
top_p
number
=10 ~ 1
Nucleus sampling probability mass
max_tokens
integer>= 1Maximum number of tokens in the response
frequency_penalty
number
=0-2 ~ 2
Penalises repetition of frequent tokens
presence_penalty
number
=0-2 ~ 2
Encourages introducing new topics
stop
array—Up to 4 strings that stop generation
seed
integer—Deterministic sampling seed (best-effort)
n
integer
=1>= 1
Number of completions to generate
stream
boolean
=false
Stream tokens via Server-Sent Events
response_format
object—Force JSON object or schema-conforming output
tools
array—Tool / function declarations the model may call
tool_choice
string
autononerequired
Tool-choice policy or specific tool name
logprobs
boolean
=false
Return per-token log probabilities
top_logprobs
integer0 ~ 20Number of top log probabilities returned per token
logit_bias
object—Per-token logit bias map
user
string—End-user identifier for abuse monitoring

Rate limits

SupplierRPMTPMRPD
Alibaba850340K17K
official880354K18K
Volcengine700281K14K
火山引擎特价580231K12K

RPM = requests per minute, TPM = tokens per minute, RPD = requests per day. Limits apply per token group.

API access questions

Everything you need to decide before creating an account.

Discover more models