moonshot/kimi-k3;对于独立的 Kimi Coding 提供方,请使用
kimi/kimi-for-coding。
内置模型目录
目录成本估算使用 Moonshot 发布的按需付费费率。在做出成本决策前,请查看 Kimi K3 和 Kimi K2.7 Code 的实时供应商页面。
Kimi K3 始终进行推理,并接受
reasoning_effort 值 low、high 和 max(默认值)。OpenClaw 暴露这些确切级别,并将 /think xhigh 映射为 max;它会省略 K2 专用的 thinking 字段,并移除采样覆盖项(temperature、top_p、n、presence_penalty 和 frequency_penalty),因为 K3 将这些参数固定为供应商默认值。Kimi K2.7 Code 同样始终使用原生思考,但要求省略 thinking 和 reasoning_effort;HighSpeed 变体使用相同的契约。Kimi K3 是引导流程中的默认模型。
请参阅 Moonshot 的 Kimi K3 快速入门。
开始使用
Moonshot 和 Kimi Coding 都是外部插件 - 请先安装其中一个再进行 引导。- Moonshot API
- Kimi Coding
最适合: 通过 Moonshot Open Platform 使用 Kimi K3 和 K2 模型。或者对于中国端点:
1
安装插件
2
选择你的端点区域
3
运行初始化
4
确认 Kimi K3 默认设置
全新引导会选择 Kimi K3。现有安装可以显式切换:
5
验证模型可用
6
运行一次实时冒烟测试
当你想在不影响正常会话的情况下验证模型访问和成本
跟踪时,请使用隔离的状态目录:JSON 响应应报告
provider: "moonshot" 和
model: "kimi-k3"。当 Moonshot 返回使用量元数据时,助手会话记录条目会在
usage.cost 下存储标准化的令牌使用量以及预估成本。配置示例
Kimi 网页搜索
Moonshot 插件还会将 Kimi 注册为web_search 提供方,由 Moonshot 网页搜索提供支持。
1
运行交互式网页搜索设置
plugins.entries.moonshot.config.webSearch.*。2
配置网页搜索区域和模型
交互式设置会提示:
plugins.entries.moonshot.config.webSearch 下:
高级配置
原生思考模式
原生思考模式
Moonshot API Kimi K3 始终以最大努力进行推理。OpenClaw 仅公开
OpenClaw 会将这些模型的运行时
/think max,发送 reasoning_effort: "max",并忽略过时的较低级别或
off 设置。Kimi Code K3 公开 /think off|minimal|low|medium|high|adaptive|xhigh|max。
其兼容 Anthropic 的端点会针对 off 接收 thinking.type: "disabled"。
每个启用的级别都会使用自适应思考;minimal/low 映射到低努力程度,
medium/high/adaptive 映射到高努力程度,而 xhigh/max 映射到最大努力程度。
这同时适用于 kimi/k3 和 kimi/k3-256k。旧版 kimi/k3[1m]
会规范化为 kimi/k3。
Moonshot API K3 支持 auto、none、required 以及固定的工具选择,
因此 OpenClaw 会保留请求的 tool_choice。对于多轮工具使用,
OpenClaw 会保留 Moonshot 重放协议所需的 assistant 推理内容。Kimi K2.7 Code 始终使用原生思考。Moonshot 要求客户端对此模型省略
thinking 字段,因此 OpenClaw 仅公开 on,并忽略过时的 off 设置。
K2.7 还会固定 temperature、top_p、n、presence_penalty 和
frequency_penalty;OpenClaw 会省略这些字段中已配置的覆盖值。其他 Moonshot Kimi 模型支持二进制原生思考:thinking: { type: "enabled" }thinking: { type: "disabled" }
agents.defaults.models.<provider/model>.params 按模型配置:/think 级别映射如下:Kimi K2.6 还接受一个可选的
thinking.keep 字段,用于控制
reasoning_content 的多轮保留。将其设为 "all" 可在轮次之间保留
完整推理;省略它(或将其设为 null)则使用服务器默认策略。
OpenClaw 只会将 thinking.keep 转发给
moonshot/kimi-k2.6,并从其他模型中移除它。Kimi K2.7 Code
默认保留完整推理历史,而 OpenClaw 会省略整个
thinking 字段。工具调用 ID 清理
工具调用 ID 清理
Moonshot Kimi 提供的原生 tool_call ID 形如
functions.<name>:<index>。OpenClaw 会保留每个原生 Kimi ID 的首次出现,并将后续重复项重写为确定性的 OpenAI 风格 call_* ID。匹配的工具结果会使用相同的 ID 重新映射,因此重放时仍保持唯一性,而不会剥离 Kimi 的首个原生 ID。此行为已集成到捆绑的 Moonshot provider 中,不是用户可配置的设置。流式用量兼容性
流式用量兼容性
原生 Moonshot 端点(
https://api.moonshot.ai/v1 和
https://api.moonshot.cn/v1)声明支持流式 usage 兼容性。
OpenClaw 是根据端点 host 而不是 provider id 来判断的,因此指向相同原生 Moonshot host 的自定义 provider id 也会继承相同的流式 usage 行为。使用目录中的 K3 定价时,包含输入、输出和缓存读取 token 的流式用量
也会转换为本地估算的美元成本,用于 /status、/usage full、
/usage cost 以及基于 transcript 的会话计费。端点和模型引用参考
端点和模型引用参考
- Kimi 网页搜索使用
KIMI_API_KEY或MOONSHOT_API_KEY,并默认使用https://api.moonshot.ai/v1和模型kimi-k2.6。 - 如有需要,可在
models.providers中覆盖定价和上下文元数据。 - 如果 Moonshot 为某个模型发布了不同的上下文限制,请相应调整
contextWindow。
相关
模型选择
选择提供商、模型引用和故障转移行为。
网页搜索
配置包括 Kimi 在内的网页搜索提供商。
配置参考
提供商、模型和插件的完整配置 schema。
Moonshot 开放平台
Moonshot API 密钥管理和文档。