Skip to main content
NVIDIA 通过 OpenAI 兼容的 API 在 https://integrate.api.nvidia.com/v1 免费提供开放模型,并使用来自 build.nvidia.com 的 API 密钥进行身份验证。OpenClaw 默认将 NVIDIA 提供商设置为 Nemotron 3 Ultra,这是 NVIDIA 的 550B 总参数 / 55B 活跃推理模型,适用于长上下文的智能体工作。

入门指南

1

获取你的 API key

build.nvidia.com 创建一个 API key。
2

导出 key 并运行初始化

3

设置 NVIDIA 模型

对于非交互式设置,请直接传入 key:
--nvidia-api-key 会将 key 记录到 shell history 和 ps 输出中。尽可能优先使用 NVIDIA_API_KEY 环境变量。

配置示例

精选目录

配置 NVIDIA API 密钥后,设置和模型选择路径会从 https://assets.ngc.nvidia.com/products/api-catalog/featured-models.json 获取 NVIDIA 的公开精选模型目录,并将结果缓存 24 小时(前 32 条,以免费文本输入 条目的形式导入)。因此,来自 build.nvidia.com 的新精选模型或重新发布的精选模型会在 缓存刷新后出现在设置和模型选择界面中,无需等待 OpenClaw 发布新版本。新的 NVIDIA 目录会覆盖随附的停用元数据。当实时数据源可用时,NVIDIA 设置过程中会预选其中的第一个模型。 该获取过程对 assets.ngc.nvidia.com 使用固定的 HTTPS 主机策略。如果未配置 NVIDIA API 密钥,或者该源不可用或格式错误,OpenClaw 将回退到内置目录和下面的内置默认值。

Nemotron 3 Ultra

Nemotron 3 Ultra 是 OpenClaw 中默认的 NVIDIA 模型。NVIDIA 的构建页面 nvidia/nemotron-3-ultra-550b-a55b 将其列为可用的免费端点,并提供 1M token 的上下文规格。 捆绑的 Ultra 行默认发送 chat_template_kwargs: { enable_thinking: false, force_nonempty_content: true } ,因此正常的聊天输出会保留在可见答案中,而不会暴露推理文本。 在需要最高能力的 NVIDIA 默认模型时使用 Ultra。如果你想要更小的 Nemotron 3 选项,就保持选择 Super;或者在 NVIDIA 目录中选择一个第三方模型,当它们的上下文、延迟或行为更适合时使用。

内置回退目录

可选的内置条目快照了 NVIDIA 的精选模型目录。已弃用的兼容性条目保留现有的完整模型引用以便识别,但不会显示在模型选择器中。 完整的兼容性目录还保留了这些已发布的引用,以支持现有配置和迁移:nvidia/qwen/qwen3.5-397b-a17bnvidia/moonshotai/kimi-k2.5nvidia/z-ai/glm-5.1nvidia/z-ai/glm5 以及 nvidia/minimaxai/minimax-m2.7。除非 NVIDIA 在其精选目录中重新发布这些模型,否则这些引用不会显示在内置和离线模型选择器中。NVIDIA 已停用 Qwen 端点,因此使用其模型引用的请求将不再有效。请将现有的 Qwen 配置迁移到活跃模型。

高级配置

当设置了 NVIDIA_API_KEY 环境变量,或在引导过程中已保存密钥时,提供方会自动启用。除密钥外,无需额外的提供方配置。
配置 NVIDIA 身份验证后,OpenClaw 会优先使用 NVIDIA 的公开精选模型目录,并将其缓存 24 小时。内置的可选回退目录是 NVIDIA 精选模型目录的静态快照;已弃用的精确引用兼容性条目会从该回退目录中隐藏。最新的精选条目可以重新启用 NVIDIA 已重新发布的模型。由于 NVIDIA 目前为所列模型提供免费 API 访问,源代码中的费用默认为 0
OpenClaw 使用 openai-completions 适配器通过标准的 /v1 聊天补全路由与 NVIDIA 通信。任何兼容 OpenAI 的工具都应可在 NVIDIA 基础 URL 下直接使用。
NVIDIA 的 Ultra 示例请求使用 chat_template_kwargs.enable_thinkingreasoning_budget 来控制推理输出。OpenClaw 内置的 Ultra 行默认禁用模板推理,以用于正常聊天。如果你需要启用 NVIDIA 的推理输出,或者强制设置其他 NVIDIA 特定请求字段,请按模型设置参数,并将提供方级别的覆盖限定在 NVIDIA 模型上:
params.chat_template_kwargs 会合并到请求中已有的 chat_template_kwargs ,而不是替换整个对象。 params.extra_body 是最终的 OpenAI 兼容请求体覆盖项, 会覆盖冲突的负载键,因此仅应将其用于 NVIDIA 针对所选端点 文档中说明的字段。
某些由 NVIDIA 托管的自定义模型,在发出第一段响应之前,所需时间可能会超过默认约 120 秒的模型空闲看门狗阈值。对于自定义 NVIDIA 提供方条目,应提高提供方超时,而不是提高整个代理运行时超时;timeoutSeconds 同时覆盖提供方的 HTTP 请求,并提高该提供方的空闲/流式看门狗上限:
NVIDIA 模型目前可免费使用。请查看 build.nvidia.com 以获取最新的可用性和 速率限制详情。

相关内容

模型选择

选择提供方、模型引用和故障转移行为。

配置参考

agents、models 和 providers 的完整配置参考。