智谱 · Released 2026-08-26

GLM-5.3 flash

可用
glm-5.3-flash

在 Lazu 上调用 glm-5.3-flash:$0.15 / 百万输入 token、$0.50 / 百万输出 token,与 智谱 官方价相同。1M 上下文,最长输出 128k,支持工具调用、图像理解、推理、结构化输出。

GLM-5.3-Flash,支持视觉、工具调用与推理。thinking 始终启用。

获取 API Key
复制页面
Context1M
Max output128k
Input文本 · 图像 · 视频 · PDF
Output文本
Endpoints/v1/chat/completions · /v1/responses

价格与线路

单位:美元 / 百万 token。可用率为近 7 天,每格 2 小时。

线路 输入输出缓存读缓存写 5m 7 天可用率
智谱 官方价 $0.15 $0.50$0.03— —
稳定 同官方 $0.15 $0.50$0.03— 100.0%

价格读取于 2026-10-03 16:50 UTC · 怎么选线路 · glm-5.3-flash.json · glm-5.3-flash.md

能力

工具调用图像理解推理结构化输出提示缓存PDF 输入
思考深度
low · high · max

调用示例

POST /v1/chat/completions
curl -X POST https://api.lazu.ai/v1/chat/completions \
  -H "Authorization: Bearer $LAZU_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3-flash",
    "messages": [{ "role": "user", "content": "Hello from Lazu" }]
  }'

也可以用 OpenAI SDK 调用:把 base_url 换成 https://api.lazu.ai/v1。 完整接入文档

常见问题

稳定线路和优惠线路有什么区别?

稳定线路走各家官方 API,按标价计费,可用率最高,适合所有场景。优惠线路是逆向渠道:由第三方供应商通过官方客户端接入,不是官方 API。价格低很多,但可用率会有波动,失败时不会自动切到稳定线路,上游也可能附带自己的系统提示,所以只建议在对应的 Agent 工具里使用:Claude 模型配 Claude Code,GPT 模型配 Codex,Gemini 模型配 Antigravity。自己写的程序或需要精确控制输出的场景,请用稳定线路。两条线路用同一个 Key,可以在每把 Key 上按模型选线路。

用 OpenAI 的 SDK 能调用 glm-5.3-flash 吗?

可以。把 SDK 的 base URL 设为 https://api.lazu.ai/v1,模型名填 glm-5.3-flash。

怎么计费?

按实际用掉的输入、输出和缓存 token 计费,从钱包余额里扣,没有月费。每次请求都能在用量页看到明细。

同系列模型

拿一个 Key,现在就调用

免费开始 读文档