Skip to main content
Moonshot 通过与 OpenAI 兼容的端点提供 Kimi API。全新的 Moonshot 引导流程会选择 moonshot/kimi-k3;对于独立的 Kimi Coding 提供方,请使用 kimi/kimi-for-coding
Moonshot 和 Kimi Coding 是独立的提供方,并且各自作为单独的外部插件提供。密钥不能互换,端点也不同,模型引用也不同(moonshot/... vs kimi/...)。

内置模型目录

目录成本估算使用 Moonshot 发布的按需付费费率。在做出成本决策前,请查看 Kimi K3Kimi K2.7 Code 的实时供应商页面。 Kimi K3 始终进行推理,并接受 reasoning_effortlowhighmax(默认值)。OpenClaw 暴露这些确切级别,并将 /think xhigh 映射为 max;它会省略 K2 专用的 thinking 字段,并移除采样覆盖项(temperaturetop_pnpresence_penaltyfrequency_penalty),因为 K3 将这些参数固定为供应商默认值。Kimi K2.7 Code 同样始终使用原生思考,但要求省略 thinkingreasoning_effort;HighSpeed 变体使用相同的契约。Kimi K3 是引导流程中的默认模型。 请参阅 Moonshot 的 Kimi K3 快速入门

开始使用

Moonshot 和 Kimi Coding 都是外部插件 - 请先安装其中一个再进行 引导。
最适合: 通过 Moonshot Open Platform 使用 Kimi K3 和 K2 模型。
1

安装插件

2

选择你的端点区域

3

运行初始化

或者对于中国端点:
4

确认 Kimi K3 默认设置

全新引导会选择 Kimi K3。现有安装可以显式切换:
5

验证模型可用

6

运行一次实时冒烟测试

当你想在不影响正常会话的情况下验证模型访问和成本 跟踪时,请使用隔离的状态目录:
JSON 响应应报告 provider: "moonshot"model: "kimi-k3"。当 Moonshot 返回使用量元数据时,助手会话记录条目会在 usage.cost 下存储标准化的令牌使用量以及预估成本。

配置示例

Kimi 网页搜索

Moonshot 插件还会将 Kimi 注册为 web_search 提供方,由 Moonshot 网页搜索提供支持。
1

运行交互式网页搜索设置

在网页搜索部分选择 Kimi,以保存 plugins.entries.moonshot.config.webSearch.*
2

配置网页搜索区域和模型

交互式设置会提示:
配置位于 plugins.entries.moonshot.config.webSearch 下:

高级配置

Moonshot API Kimi K3 始终以最大努力进行推理。OpenClaw 仅公开 /think max,发送 reasoning_effort: "max",并忽略过时的较低级别或 off 设置。Kimi Code K3 公开 /think off|minimal|low|medium|high|adaptive|xhigh|max。 其兼容 Anthropic 的端点会针对 off 接收 thinking.type: "disabled"。 每个启用的级别都会使用自适应思考;minimal/low 映射到低努力程度, medium/high/adaptive 映射到高努力程度,而 xhigh/max 映射到最大努力程度。 这同时适用于 kimi/k3kimi/k3-256k。旧版 kimi/k3[1m] 会规范化为 kimi/k3。 Moonshot API K3 支持 autononerequired 以及固定的工具选择, 因此 OpenClaw 会保留请求的 tool_choice。对于多轮工具使用, OpenClaw 会保留 Moonshot 重放协议所需的 assistant 推理内容。Kimi K2.7 Code 始终使用原生思考。Moonshot 要求客户端对此模型省略 thinking 字段,因此 OpenClaw 仅公开 on,并忽略过时的 off 设置。 K2.7 还会固定 temperaturetop_pnpresence_penaltyfrequency_penalty;OpenClaw 会省略这些字段中已配置的覆盖值。其他 Moonshot Kimi 模型支持二进制原生思考:
  • thinking: { type: "enabled" }
  • thinking: { type: "disabled" }
通过 agents.defaults.models.<provider/model>.params 按模型配置:
OpenClaw 会将这些模型的运行时 /think 级别映射如下:
启用 Moonshot K2 思考时,tool_choice 必须是 autonone。固定的工具选择(type: "tool"type: "function")会强制将思考恢复为 disabled,以便请求的工具仍然运行;tool_choice: "required" 则会被规范化为 auto。Kimi K2.7 Code 无法禁用思考,因此其不兼容的 tool_choice 会被规范化为 auto。Kimi K3 使用独立的推理努力程度协议,并保留受支持的工具选择。
Kimi K2.6 还接受一个可选的 thinking.keep 字段,用于控制 reasoning_content 的多轮保留。将其设为 "all" 可在轮次之间保留 完整推理;省略它(或将其设为 null)则使用服务器默认策略。 OpenClaw 只会将 thinking.keep 转发给 moonshot/kimi-k2.6,并从其他模型中移除它。Kimi K2.7 Code 默认保留完整推理历史,而 OpenClaw 会省略整个 thinking 字段。
Moonshot Kimi 提供的原生 tool_call ID 形如 functions.<name>:<index>。OpenClaw 会保留每个原生 Kimi ID 的首次出现,并将后续重复项重写为确定性的 OpenAI 风格 call_* ID。匹配的工具结果会使用相同的 ID 重新映射,因此重放时仍保持唯一性,而不会剥离 Kimi 的首个原生 ID。此行为已集成到捆绑的 Moonshot provider 中,不是用户可配置的设置。
原生 Moonshot 端点(https://api.moonshot.ai/v1https://api.moonshot.cn/v1)声明支持流式 usage 兼容性。 OpenClaw 是根据端点 host 而不是 provider id 来判断的,因此指向相同原生 Moonshot host 的自定义 provider id 也会继承相同的流式 usage 行为。使用目录中的 K3 定价时,包含输入、输出和缓存读取 token 的流式用量 也会转换为本地估算的美元成本,用于 /status/usage full/usage cost 以及基于 transcript 的会话计费。
  • Kimi 网页搜索使用 KIMI_API_KEYMOONSHOT_API_KEY,并默认使用 https://api.moonshot.ai/v1 和模型 kimi-k2.6
  • 如有需要,可在 models.providers 中覆盖定价和上下文元数据。
  • 如果 Moonshot 为某个模型发布了不同的上下文限制,请相应调整 contextWindow

相关

模型选择

选择提供商、模型引用和故障转移行为。

网页搜索

配置包括 Kimi 在内的网页搜索提供商。

配置参考

提供商、模型和插件的完整配置 schema。

Moonshot 开放平台

Moonshot API 密钥管理和文档。