Skip to main content
Z.AI 是 GLM 模型的 API 平台。它为 GLM 提供 REST API,并使用 API 密钥进行身份验证。请在 Z.AI 控制台中创建你的 API 密钥。OpenClaw 使用带有 Z.AI API 密钥的 zai 提供方。

GLM 模型

GLM 是一个模型系列,而不是独立的提供商。在 OpenClaw 中,GLM 模型使用类似 zai/glm-5.2 的引用:提供商为 zai,模型 ID 为 glm-5.2

入门

首先安装提供方插件:
最适合: 大多数用户。OpenClaw 会使用你的 API 密钥探测受支持的 Z.AI 端点,并自动应用正确的基础 URL。
1

运行初始化

2

验证模型已列出

端点

Z.AI 还提供与 Anthropic 兼容的 Coding Plan 基础 URL https://api.z.ai/api/anthropic。OpenClaw 的 Z.AI 选项使用上面文档中 列出的 OpenAI Chat Completions 端点;Anthropic URL 供直接使用 Anthropic Messages 协议的客户端使用。 zai-api-key 会通过依次探测每个端点的 chat-completions API 来自动检测这四种端点之一, 先检查通用端点(zai-global, 然后是 zai-cn),再检查 Coding Plan 端点(zai-coding-global,然后 是 zai-coding-cn),并在第一个接受请求的端点处停止。 如果你的密钥在两个端点上都可用,请使用显式的 --auth-choice 来强制指定 Coding Plan 端点。

速率限制和过载

Z.AI 将 Coding Plan 和通用代理工具文档为容量管理型服务。在 Z.AI 自己的文档中:
  • 通用代理工具, 包括 OpenClaw,按尽力而为的方式提供服务。在推理负载较高时, 通常是新加坡时间下午 2 点到 6 点左右,部分请求可能会遇到临时 速率限制。
  • Coding Plan 速率和并发限制 取决于套餐层级,并可根据资源可用性动态调整。非高峰时段可能有更高的并发。
  • API 错误码 1302 表示“请求已达到 速率限制”。API 错误码 1305 表示“服务可能暂时过载,请稍后再试”。
如果你在繁忙时段看到临时的 4291305 响应,请等待并 重试请求。如果在非高峰时段仍反复失败,或者只在某一个端点、 模型或请求形态下发生,请先检查已配置的端点和模型:
Coding Plan 密钥应使用 Coding Plan 端点,例如 https://api.z.ai/api/coding/paas/v4;通用 API 密钥应使用通用 API 端点,例如 https://api.z.ai/api/paas/v4。同一密钥和端点下持续失败, 可能表明是提供方侧拒绝或套餐限制,而不是普通的高峰负载限流。

配置示例

zai-api-key 允许 OpenClaw 根据密钥检测匹配的 Z.AI 端点,并自动应用正确的基础 URL。当你想强制使用特定的 Coding Plan 或通用 API 接口时,请使用显式的区域选项。

内置目录

zai 提供方插件将其目录随插件清单一起提供,因此只读 列表可以在不加载提供方运行时的情况下显示已知的 GLM 行:
当前由清单支持的目录包括: 目录 token 成本元数据遵循 Z.AI 当前的 按量付费定价。Coding Plan 订阅使用套餐额度而非按 token 计费;请参阅实时的 订阅页面了解套餐价格和可用性。
GLM 模型可用作 zai/<model>(例如:zai/glm-5.2)。
所有新的 Z.AI 配置路径默认指向 zai/glm-5.2。在 Coding Plan 端点上, 当密钥/套餐未公开 GLM-5.2 时,自动检测会依次回退到 glm-5.1,然后是 glm-4.7。GLM 版本和可用性可能会变化;请运行 openclaw models list --all --provider zai 查看与你已安装版本已知的目录。

思考级别

全范围:offlowhighmax(默认 off)。OpenClaw 将 lowhigh 映射到 Z.AI 的 high 推理强度,并将 max 映射到 Z.AI 的 max 强度,通过请求负载中的 reasoning_effort 实现。
将思考设置为 off 可避免响应在可见文本之前将输出预算花在 reasoning_content 上。

高级配置

未知的 glm-5* id 在提供方路径上仍会通过 从 glm-4.7 模板合成由提供方拥有的元数据来进行转发解析,只要该 id 匹配当前 GLM-5 家族的形状。
tool_stream 默认已为 Z.AI 的工具调用流式传输启用。如需禁用:
保留思考内容 是可选启用的,因为 Z.AI 需要重放完整的历史 reasoning_content,这会增加提示词 token。可按模型启用:
启用后且 thinking 开启时,OpenClaw 会发送 thinking: { type: "enabled", clear_thinking: false },并为同一份 OpenAI 兼容的对话记录重放之前的 reasoning_content。snake_case 的 preserve_thinking 参数键也可作为别名使用。高级用户仍然可以通过 params.extra_body.thinking 覆盖精确的提供方负载。
Z.AI 插件会注册图像理解功能。图像理解会根据已配置的 Z.AI 身份验证自动解析,无需额外配置。
  • Z.AI 使用你的 API 密钥进行 Bearer 认证。
  • zai-api-key 初始化选项会通过使用你的密钥探测受支持的端点来自动检测匹配的 Z.AI 端点。
  • 当你想强制使用特定 API 接口时,请使用显式的区域选项(zai-coding-globalzai-coding-cnzai-globalzai-cn)。
  • 仍然接受旧环境变量 Z_AI_API_KEY;如果 ZAI_API_KEY 未设置,OpenClaw 会在启动时将其复制到 ZAI_API_KEY

相关内容

模型选择

选择提供方、模型引用和故障转移行为。

配置参考

完整的 OpenClaw 配置模式,包括提供方和模型设置。