Kimi / Moonshot 开放平台
Kimi 的官方文档有个别家少见的特点:它为好几个主流编程工具单独写了接入页——Claude Code、Codex、OpenCode、OpenClaw、Hermes Agent 各一页。所以「怎么把 Kimi 接进我现在用的工具」这件事,在这里是有官方口径可依的,不用靠猜。 本专题共 27 篇。 内容依据 Kimi 开放平台文档 整理,核对日 2026-08-25。 本专题只讲计费与接入机制,不列具体价格数字——价格变动频繁,写进正文只会过期误导,请以各平台官方定价页为准。
Kimi API 怎么接入?从拿 Key 到第一次调用跑通
按官方文档梳理 Kimi API 的接入路径:服务地址与认证方式、OpenAI 兼容能覆盖到哪、哪两个专有参数必须换写法、新账户第一次调用最容易卡住的四个地方,以及接入后立刻要做的三件事。
在各工具里怎么配
官方为这几个编程工具分别写了接入页:环境变量怎么设、不设会怎样、哪些模型的思考行为不一样、常见报错文案对应什么。按官方口径走,少踩坑。
在 Claude Code 里配置 Kimi:环境变量、模型档位与排错
按 Kimi 官方文档梳理 Claude Code 接入 Kimi 的完整步骤:先清理旧配置,再选终端变量或 settings.json 两种方式之一,配齐各档位模型变量,用 /status 验证生效,并给出 401、model not found、思考未开启等常见报错的对照排查。
在 Codex CLI 里配置 Kimi K3:CC Switch 路由完整步骤
Codex CLI 走 Responses API,Kimi 给的是 OpenAI 兼容的 Chat Completions,协议对不上才要 CC Switch 转换。本文按官方文档拆在 Codex 里配置 Kimi 的四步流程、高级配置取值,以及配完不生效怎么按错误码定位。
在 Hermes Agent 里用 Kimi 模型:配置字段与常见问题
按 Kimi 官方文档梳理 Hermes Agent 接入中国区 Kimi 开放平台的四步路径:选中国区 Provider、写自定义 Provider 配置、启用视频工具,以及模型列表没有 kimi-k3、连错 Endpoint、429 这几类问题官方给的判法。
在 OpenClaw 里用 Kimi 模型:K3 配置与排错
按 Kimi 官方文档梳理在 OpenClaw 中接入 Kimi K3 的完整路径:装官方 Moonshot Provider、跑 onboard 向导选中国区认证、模型列表里没有 K3 时怎么手改配置,以及 401、认证选项缺失这些常见问题的官方处置说法。
在 OpenCode 里配 Kimi K3:内置认证、选模型与推理强度
按 Kimi 官方文档梳理 OpenCode 接入中国区 Kimi 开放平台的完整路径:先确认余额与 IP 白名单前提,再用 opencode auth login 选 Moonshot AI (China) 填 Key,用 /models 选 Kimi K3、用 /variants 调推理强度,并给出配完仍报 401、404、429 的官方排查顺序。
缓存与批量推理
上下文缓存怎么建怎么命中、Batch 接口怎么提交和查询、什么样的任务适合走批量。
Kimi 批量推理适合什么场景:Batch API 的门槛与取舍
从官方文档拆解 Kimi 批量推理的适用边界——Batch API 锁死了哪些参数、completion_window 决定了什么、状态机怎么轮询、结果文件怎么回连业务主键,以及哪些任务根本不该丢进批量推理。
Kimi 上下文缓存怎么用:自动命中的条件与失效场景
Kimi API 的上下文缓存没有"创建缓存"这一步,它对所有模型请求自动启用、按前缀匹配命中。这篇讲清命中的条件、messages 该怎么摆、怎么用 cached_tokens 确认命中、prompt_cache_key 是干什么的,以及动态加载工具时哪些改动会把前缀缓存打碎。
Kimi Batch API 怎么提交和查询
讲清 Kimi Batch API 的完整链路:JSONL 输入文件的四个必填字段、purpose 与 completion_window 怎么填、八种任务状态各代表什么、结果文件和错误文件怎么取回,以及官方文档里两处对不上的地方。
能力边界
partial mode 让模型按你给的开头往下写、reasoning_effort 怎么调、思考模型怎么用、动态工具加载是怎么回事、tool_choice 怎么控、JSON mode 怎么保格式。
Kimi 的 Partial Mode 是什么:怎么让它按你给的开头往下写
Kimi API 的 Partial Mode 就是在 messages 末尾追加一条 partial 为真的 assistant 消息,让模型强制以你给的内容开头继续生成。本文讲清它的开启方式、拼接前缀的必要动作、续写被截断输出的完整流程、name 字段的作用,以及它和 JSON 模式混用时的官方限制。
Kimi 的 reasoning_effort 怎么调:low/high/max 三档怎么选
Kimi K3 的思考关不掉,reasoning_effort 是唯一能调推理深度的旋钮。这篇讲清它放在请求哪一层、三档官方怎么定性、为什么中途换档会破坏前缀缓存,以及从 K2.x 和 OpenAI 代码迁过来分别要改什么。
Kimi 的 tool_choice 怎么控制模型调不调工具
讲清 Kimi API 里 tool_choice 的四种取值怎么选:auto 默认自行判断、required 强制走工具链路、none 只出纯文本、传函数对象强制指定工具,并说明哪些 Kimi 模型不支持 required、和思考开启冲突时会报什么错、以及它对前缀缓存的影响。
Kimi 动态工具加载是怎么回事:按需注入工具与前缀缓存
Kimi 动态工具加载允许在对话中途用一条携带 tools 字段的 system 消息按需注入工具声明,缓解工具定义膨胀。本文按官方文档讲清注入格式、可见性规则、与前缀缓存的叠加条件,以及模型支持范围和 400 报错这两处最容易踩的限制。
Kimi 思考模型怎么用:和普通模型的调用差异
Kimi 思考模型比普通模型多出一个 reasoning_content 字段,还多出 thinking.type、thinking.keep、reasoning_effort 三个控制入口。这篇按官方文档梳理各模型的参数差异、reasoning_content 的正确读法、多步工具调用的配置要求,以及保留式思考对上下文与计费的影响。
Kimi JSON mode 与 response_format 怎么用
Kimi 的 response_format 有 json_object 和 json_schema 两种模式,即 JSON Mode 与 Structured Output。本文按官方文档讲清机制差异、strict 与 MFJS 规范、字段缺失的表达,及解析失败的排查顺序。
成本与用量监控
token 预估接口能在发请求前把成本算出来、余额怎么查、限流机制怎么读。
Kimi 的限流机制怎么读:并发、RPM、TPM、TPD 四道闸
Kimi API 的限流由并发、RPM、TPM、TPD 四道闸共同衡量,任意一道先到就触发 429。本文按官方文档讲清限速额度与账户等级的关系、网关按 max_completion_tokens 预扣额度这条反直觉规则,以及收到 429 后怎么按 error.type 分诊。
Kimi 计算 Token 接口怎么用:调用前把 token 数和成本估出来
Kimi 开放平台的计算 Token 接口(estimate-token-count)能在发起对话补全之前算出这组 messages 要占多少输入 token。本文讲清它的入参出参、官方推荐的用法、成本估算算式,以及预估值和实际账单对不上的几种原因。
Kimi 余额查询与用量监控怎么做:接口字段、项目预算与账单对账
Kimi 开放平台的余额查询接口返回哪三个字段、available_balance 归零后会报什么错、项目日月预算和消费提醒各管什么、账单跟客户端记录对不上时按什么顺序查。全部按官方文档口径讲机制,不列价格数字。
Kimi API 的限额怎么看?撞上了怎么处理
Kimi(Moonshot)API 说的"限额"其实是三件不同的事:上下文窗口、速率限流、账户余额与按次计费。这篇讲清各自在哪里看、撞上时分别是什么症状、对应的处理动作是什么,附退避重试写法、缓存与联网搜索计费的注意点,以及模型下线这种"隐形断供"怎么提前防。
Kimi API 价格怎么算?Moonshot 各模型多少钱与省钱用法
Kimi(Moonshot)的价格不是一口价——同一个模型,缓存命中和未命中是两档,Batch 又是另一档,大陆站和国际站连币种都不一样。这篇把各模型的 token 单价表、缓存与 Batch 的折扣口径、两个站点的域名与币种差异、OpenAI 兼容调用示例,以及月成本怎么估算,一次讲清。
Kimi API 有没有免费额度?先把口径搞清楚
搜「Kimi API 免费额度」得到的答案为什么互相打架?这篇先拆清「免费」被混用的四种口径——网页版免费、平台赠额、缓存命中低价、工具调用另计费,再说清大陆站与国际站两套账户体系的差别、哪些老教程里的「免费模型」其实已经下线,以及怎么在控制台自己把当前政策核实清楚。
排查与调试
流式断了怎么自动重连、错误码怎么对号入座、官方调试工具怎么用。
用 MoonPalace 调试 Kimi API 调用
MoonPalace 是 Moonshot AI 官方提供的 Kimi API 调试工具,启动后把 base_url 指向本地即可截获完整请求。本文按官方文档梳理安装、启动、日志字段、三种检索 ID 的对应关系、重复输出检测与强制流式两个选项,以及导出 Case 的完整流程。
Kimi 错误码对照与处置:401/403/429/504 分别怎么查
按 Kimi 官方错误码文档整理的排查路径,讲清 error.type 比 HTTP 状态码更重要的原因,401 的平台隔离、403 的三种权限拒绝、429 的三类成因、504 与 Connection 错误的处理,以及账单异常该带哪些材料反馈。
Kimi 流式输出断了怎么自动重连:判据、续写与账单
Kimi API 流式输出中途断开时,怎么判断到底传完没有、怎么重连、怎么用 Partial Mode 从断点接着写,以及重连之后 Tokens 用量该怎么补算。按官方文档给出的判据、错误类型和排查顺序整理,附上重连救不了的几种情况。
其他
本专题下尚未归入上面任何一组的文章。
DeepSeek vs Kimi vs 豆包:国产对话工具怎么选
deepseek kimi 豆包哪个好?这篇从推理、长文、写作、联网、价格四个维度横向拆解三款国产对话工具,给出分用途的选型结论和对比表,帮你按需求一眼选对。
Kimi API vs DeepSeek API:国产低价 API 怎么选、成本与能力对比
Kimi(Moonshot)API 和 DeepSeek API 都便宜,但便宜的方式不一样。这篇从两家官方定价页拉出硬价对比缓存命中/未命中差价、上下文窗口和并发限制、OpenAI 兼容接入难度,给出分人群的选型建议。
Kimi Code CLI 上手:月之暗面的终端编码 Agent 怎么装、怎么登、和 Claude Code 差在哪
Kimi Code 是 Moonshot AI 开源的终端编码 Agent,单二进制不依赖 Node。讲清 macOS/Linux/Windows 的安装命令、OAuth 与 API Key 两种登录方式的取舍,以及它相比 Claude Code 多出来的子代理、视频输入和 ACP 这几处差异。
想把模型平台的差异挡在业务代码之外?
站内有成体系的 AI 编程与 Agent 工程教程,从接入到成本治理都覆盖。