模型平台专题

模型平台选型

选模型平台的时候,单价是最不值得比的那一项——它变得最快,而且各家计价口径根本不一样,直接比数字等于比了个寂寞。真正决定你账单的是缓存能不能命中、限流按什么维度算、思考 token 算不算钱、Batch 能不能用上。本专题只比这些机制,不做排名,不写跑分,不说谁更好。 本专题共 14 篇。 内容依据各平台官方文档整理,核对日 2026-08-25。 本专题只讲计费与接入机制,不列具体价格数字——价格变动频繁,写进正文只会过期误导,请以各平台官方定价页为准。

机制横向对比

缓存、Batch、限流维度、OpenAI 兼容程度、Anthropic 兼容、思考 token 计费口径、结构化输出、错误码风格——一项一项对照着看。

2026-08-25

各家的 OpenAI 兼容到底兼容到什么程度:六个平台的兼容层对照

OpenAI 兼容不是一个开关。本文按 base_url、端点清单、参数取舍、专有能力出口四层,把智谱 GLM、Kimi、阶跃星辰、MiniMax、Gemini、xAI 六家官方文档里明写的兼容边界摆出来,说明为什么跑通 hello world 不等于兼容。

2026-08-25

各家限流维度不一样:RPM、TPM、RPD 之外还有什么

把六家模型平台的官方限流文档摊开对照,会发现 RPM、TPM、RPD 只是其中一部分口径:并发数、每秒请求数、每日 token、每小时窗口积分、最大并行任务数、请求爬坡速率都在被限。这篇讲清各家限流维度的结构差异、触发关系与归属主体。

2026-08-25

结构化输出对照:GLM、Kimi、Grok、阶跃星辰的 response_format 差异

同样叫 response_format,各家支持的档位并不一样。这篇按官方文档对照 GLM、Kimi、Grok、阶跃星辰的结构化输出实现,讲清 json_object 与 json_schema 的分界、strict 与 additionalProperties 的默认方向差异,以及跨家迁移时最容易翻车的几处。

2026-08-25

模型 API 各家错误码风格不一样:怎么做一层统一封装

智谱 GLM、Kimi、MiniMax、阶跃星辰、Grok、Gemini 六家的错误码放在不同层、用不同键、同一个 HTTP 状态码底下含义还完全不同。这篇按官方文档逐家拆开错误码结构,给出一层统一封装该保留哪些字段、怎么分类、哪些类别才允许退避重试。

2026-08-25

哪些平台兼容 Anthropic API:这条路怎么走,坑在哪

智谱 GLM、MiniMax、Kimi、阶跃星辰都提供了 Anthropic Messages 协议的兼容端点,xAI 则已把这层标为废弃。本文按官方文档对照兼容层的接入方式、参数取舍、模型名映射与鉴权变量,讲清 Anthropic 兼容到底兼容到哪一步、哪里会静默出错。

2026-08-25

思考 token 算不算钱:GLM、Kimi、Grok、Gemini 计费口径对照

推理模型的思考内容到底算不算 token、算在输入还是输出、能不能关掉,六家平台的官方口径并不一致。这篇把 GLM、Kimi、Grok、Gemini、MiniMax 与阶跃星辰的思考 token 计费与控制机制逐条对照,只讲机制不列价格。

2026-08-25

Batch 批量接口机制对照:GLM、Kimi、Grok、Gemini 差在哪

把智谱 GLM、Kimi、Grok、Gemini 四家 Batch 批量接口的官方文档摊开对照,讲清提交形态、请求对账字段、单批能不能混模型混端点、状态机结构、结果拉取方式、超时过期后谁付费,以及限流账本为什么是分开的一本,帮你在写批量任务代码前先选对平台。

迁移与多厂商

从 OpenAI 迁出去要过哪些坎、多厂商网关怎么设计才能把差异挡在业务代码外、换平台前的通用检查清单。

按场景选型

编程、长文、Agent 三类场景各自该看哪几件事,以及成本结构该怎么对比。

2026-08-25

编程场景选模型平台要看哪几件事:套餐、宿主工具与额度窗口

编程场景选模型平台,真正决定体验的不是模型名字,而是套餐额度窗口的形状、能不能在你的宿主工具里用、Base URL 与 Key 怎么分叉、额度耗尽后会发生什么。本文按官方文档逐条对照 GLM、MiniMax、阶跃、Kimi 与 xAI 的机制差异,给出一张可以照着过的选型检查表。

2026-08-25

别只比单价:模型平台的成本结构该怎么对比

对照智谱 GLM、Grok、Kimi、Gemini、MiniMax、阶跃星辰六家官方计费文档,拆开单价之外的四层成本结构:计价单位、长上下文分档、缓存优惠扣在哪一段、工具调用算谁的账,以及余额与额度上限的差别,给出一份可复用的成本结构对比方法。

2026-08-25

长文场景选模型平台要看哪几件事:缓存、长上下文与超限

长文场景选模型平台,比单价更该看的是缓存怎么命中、缓存命中的 token 算不算进长上下文档位、超限时怎么报错、以及文档该塞进上下文还是走检索。本文按官方文档逐条对照 GLM、Grok、Kimi、Gemini、MiniMax、阶跃星辰六家的机制差异,只讲机制不列价格。

2026-08-25

Agent 场景选模型平台要看哪几件事:工具调用机制对比

做 Agent 选模型平台,光看「支持 function calling」没用。对照 GLM、Grok、Kimi、Gemini、MiniMax、阶跃星辰六家官方文档,把工具执行方、tool_choice 约束、服务端工具、多轮上限、计费口径和缓存影响逐条摆开,给出选型该问的清单。

想把模型平台的差异挡在业务代码之外?

站内有成体系的 AI 编程与 Agent 工程教程,从接入到成本治理都覆盖。

看 AI 编程学习路线