安装插件
开始使用
1
创建 Baseten 账户和 API 密钥
Baseten 的 Basic 计划不收取月度平台费用;模型 API 调用按使用量计费。在 Baseten API 密钥设置 中创建密钥,并在定价页面查看当前费率。
2
运行初始化
3
验证在线目录
GET /v1/models,并列出该账户返回的所有模型。没有身份验证信息时,插件会保持离线状态并使用捆绑的备用目录。Inkling
Thinking Machines Lab 的 Inkling 是默认模型。在 OpenClaw 中,它支持文本和图像输入、工具调用、结构化工具模式、可配置的推理强度、1.048M token 的上下文窗口,以及最多 32k 个输出 token:/model baseten/thinkingmachines/inkling -s 切换当前会话。
捆绑的备用目录
经过身份验证的实时目录具有权威性。在发现成功之前,这些条目可确保设置和模型选择功能可用:
所有捆绑模型均支持工具调用和推理。OpenClaw 将其思考级别映射到原生支持
reasoning_effort 的模型。Baseten 中选择启用的 GLM、Kimi 和 Nemotron 模型默认关闭思考功能;大多数模型提供二进制的关闭/开启控制,而 GLM 5.2 提供关闭、高和最高三个级别。OpenClaw 通过 Baseten 的 chat_template_args.enable_thinking 控制项发送这些选项;对于 GLM 5.2,则通过经过验证的顶层 reasoning_effort 参数发送。
Baseten 可以独立于 OpenClaw 的发布版本添加、移除或更改 Model API。该插件会从经过身份验证的 API 刷新模型 ID、上下文限制、输出限制,以及输入、缓存输入和输出定价,同时保留特定于模型的 OpenClaw 传输策略。
手动配置
大多数设置只需要 API 密钥。若要明确指定提供商:如果 Gateway 作为守护进程(launchd、systemd、Docker)运行,请确保
BASETEN_API_KEY 对该进程可用。仅在交互式 shell 中导出的密钥,对于已经运行的受管理服务不可见。相关内容
模型提供商
选择提供商、模型引用和故障转移行为。
思考模式
选择 OpenClaw 推理强度级别。
模型 CLI
列出、检查并选择已发现的模型。
模型常见问题
身份验证配置和模型选择故障排除。