模型平台选型
选模型平台的时候,单价是最不值得比的那一项——它变得最快,而且各家计价口径根本不一样,直接比数字等于比了个寂寞。真正决定你账单的是缓存能不能命中、限流按什么维度算、思考 token 算不算钱、Batch 能不能用上。本专题只比这些机制,不做排名,不写跑分,不说谁更好。 本专题共 14 篇。 内容依据各平台官方文档整理,核对日 2026-08-25。 本专题只讲计费与接入机制,不列具体价格数字——价格变动频繁,写进正文只会过期误导,请以各平台官方定价页为准。
机制横向对比
缓存、Batch、限流维度、OpenAI 兼容程度、Anthropic 兼容、思考 token 计费口径、结构化输出、错误码风格——一项一项对照着看。
各家的 OpenAI 兼容到底兼容到什么程度:六个平台的兼容层对照
OpenAI 兼容不是一个开关。本文按 base_url、端点清单、参数取舍、专有能力出口四层,把智谱 GLM、Kimi、阶跃星辰、MiniMax、Gemini、xAI 六家官方文档里明写的兼容边界摆出来,说明为什么跑通 hello world 不等于兼容。
各家限流维度不一样:RPM、TPM、RPD 之外还有什么
把六家模型平台的官方限流文档摊开对照,会发现 RPM、TPM、RPD 只是其中一部分口径:并发数、每秒请求数、每日 token、每小时窗口积分、最大并行任务数、请求爬坡速率都在被限。这篇讲清各家限流维度的结构差异、触发关系与归属主体。
结构化输出对照:GLM、Kimi、Grok、阶跃星辰的 response_format 差异
同样叫 response_format,各家支持的档位并不一样。这篇按官方文档对照 GLM、Kimi、Grok、阶跃星辰的结构化输出实现,讲清 json_object 与 json_schema 的分界、strict 与 additionalProperties 的默认方向差异,以及跨家迁移时最容易翻车的几处。
模型 API 各家错误码风格不一样:怎么做一层统一封装
智谱 GLM、Kimi、MiniMax、阶跃星辰、Grok、Gemini 六家的错误码放在不同层、用不同键、同一个 HTTP 状态码底下含义还完全不同。这篇按官方文档逐家拆开错误码结构,给出一层统一封装该保留哪些字段、怎么分类、哪些类别才允许退避重试。
哪些平台兼容 Anthropic API:这条路怎么走,坑在哪
智谱 GLM、MiniMax、Kimi、阶跃星辰都提供了 Anthropic Messages 协议的兼容端点,xAI 则已把这层标为废弃。本文按官方文档对照兼容层的接入方式、参数取舍、模型名映射与鉴权变量,讲清 Anthropic 兼容到底兼容到哪一步、哪里会静默出错。
思考 token 算不算钱:GLM、Kimi、Grok、Gemini 计费口径对照
推理模型的思考内容到底算不算 token、算在输入还是输出、能不能关掉,六家平台的官方口径并不一致。这篇把 GLM、Kimi、Grok、Gemini、MiniMax 与阶跃星辰的思考 token 计费与控制机制逐条对照,只讲机制不列价格。
Batch 批量接口机制对照:GLM、Kimi、Grok、Gemini 差在哪
把智谱 GLM、Kimi、Grok、Gemini 四家 Batch 批量接口的官方文档摊开对照,讲清提交形态、请求对账字段、单批能不能混模型混端点、状态机结构、结果拉取方式、超时过期后谁付费,以及限流账本为什么是分开的一本,帮你在写批量任务代码前先选对平台。
迁移与多厂商
从 OpenAI 迁出去要过哪些坎、多厂商网关怎么设计才能把差异挡在业务代码外、换平台前的通用检查清单。
从 OpenAI 迁到国产模型平台:一份可执行的迁移检查清单
各家都说改 api_key 和 base_url 就能迁过来,但真正让线上出事的是被静默忽略的参数、拿不到的思考内容、搬不动的 JSON Schema 和完全不同的错误码体系。这份从 OpenAI 迁移的检查清单按真实改造顺序列出每一项该核什么,全部对照官方文档。
多厂商模型网关怎么设计:把 API 差异挡在业务代码之外
接了两家以上模型 API 之后,差异会顺着业务代码到处渗。这篇按官方文档逐条对照智谱 GLM、Kimi、MiniMax、阶跃星辰、xAI 与 Gemini 的接入形态、思考参数、错误语义、流式异常和限流维度,给出多厂商网关该在哪几层做隔离。
换模型平台之前,这份迁移检查清单先过一遍
换模型平台不是改一行 base_url 那么简单。这份迁移检查清单按真实操作顺序排了八项:兼容层形态、Key 归属、模型名下线、思考参数、缓存字段、限流维度、错误码封装、切流前回归,每一项都标明各家官方文档的具体差异点在哪。
按场景选型
编程、长文、Agent 三类场景各自该看哪几件事,以及成本结构该怎么对比。
编程场景选模型平台要看哪几件事:套餐、宿主工具与额度窗口
编程场景选模型平台,真正决定体验的不是模型名字,而是套餐额度窗口的形状、能不能在你的宿主工具里用、Base URL 与 Key 怎么分叉、额度耗尽后会发生什么。本文按官方文档逐条对照 GLM、MiniMax、阶跃、Kimi 与 xAI 的机制差异,给出一张可以照着过的选型检查表。
别只比单价:模型平台的成本结构该怎么对比
对照智谱 GLM、Grok、Kimi、Gemini、MiniMax、阶跃星辰六家官方计费文档,拆开单价之外的四层成本结构:计价单位、长上下文分档、缓存优惠扣在哪一段、工具调用算谁的账,以及余额与额度上限的差别,给出一份可复用的成本结构对比方法。
长文场景选模型平台要看哪几件事:缓存、长上下文与超限
长文场景选模型平台,比单价更该看的是缓存怎么命中、缓存命中的 token 算不算进长上下文档位、超限时怎么报错、以及文档该塞进上下文还是走检索。本文按官方文档逐条对照 GLM、Grok、Kimi、Gemini、MiniMax、阶跃星辰六家的机制差异,只讲机制不列价格。
Agent 场景选模型平台要看哪几件事:工具调用机制对比
做 Agent 选模型平台,光看「支持 function calling」没用。对照 GLM、Grok、Kimi、Gemini、MiniMax、阶跃星辰六家官方文档,把工具执行方、tool_choice 约束、服务端工具、多轮上限、计费口径和缓存影响逐条摆开,给出选型该问的清单。
想把模型平台的差异挡在业务代码之外?
站内有成体系的 AI 编程与 Agent 工程教程,从接入到成本治理都覆盖。