免费大模型 API 盘点:哪些是真免费,哪些只是试用额度

2026-07-27

数据截至 2026-07,价格与限额以各官网为准。

大部分被叫作”免费 API”的东西其实是三样完全不同的东西:长期免费的模型档位、新用户注册赠送的一次性额度、以及订阅制套餐里包含的用量。只有第一类能安心写进技术方案,后两类本质上是有期限的预付,用完就得掏钱或者换模型——分不清这三者,就会出现”demo 跑得很爽、上线第三周突然全线报错”的经典事故。

我见过太多人踩同一个坑:搜到一篇标题写着”注册送两千万 token”的文章,兴冲冲把这个模型写进架构图,甚至按这个额度算了一遍成本,结果几个月后额度耗尽或者政策调整,整条链路直接停摆。更糟的是那篇文章本身就没标日期,数字可能早就不是现在的样子了。所以这篇不打算给你一张”各家免费额度对照表”——那种表格的保质期通常不超过三个月。它想给你的是一套判断方法,外加一个我确实核实到官方文档原文的样本。

先把”免费”这个词拆成三类

在动手比价之前,先建立分类习惯。看到任何一个”免费”宣传,先把它归到下面某一类里去:

第一类:长期免费的模型档位。 平台在模型清单里明确标注某个模型输入输出价格为 0,不设总量封顶,不依赖注册赠送,任何账号任何时候调用都不扣费。这类通常是厂商的轻量级模型,目的是把开发者留在自家生态里。它的稳定性最高,因为定价是写在模型页面上的公开事实,而不是一次营销活动。

第二类:新用户注册赠送额度。 本质是一笔预付的代金,用完即止。它的坑在于:数额经常调整、不同渠道说法不一、而且往往绑定特定模型或有效期。你在网上看到的赠送数字,很可能是别人半年前注册时看到的。

第三类:订阅套餐内含的用量。 按月付费换取一段时间内的调用配额,常见于面向编程场景的订阅制产品。这类严格说不是免费,只是把成本从”按 token 计”换成了”按月计”,两种计费口径之间没法直接横向比价,得先换算到同一个单位再比。

分类做对了,后面所有判断都会顺很多。

一个真能确认的长期免费样本:智谱的 Flash 系列

前面说过我不发对照表,但有必要给一个”什么叫可确认的免费”的具体样子。智谱开放平台的文本 Flash 系列,是我在官方文档页面上逐条核实过的例子:

  • GLM-4.7-Flash:官方文档明确标注免费,上下文窗口 200K,最大输出 128K。
  • GLM-4-Flash-250414:官方文档原文称其为”智谱 AI 首个免费大模型 API”,上下文窗口 128K。
  • GLM-4.5-Flash:同样是免费档,但已于 2026-01-30 下线,请求会自动路由到 GLM-4.7-Flash。

第三条特别值得注意,它恰好说明了免费档并非永恒不变:模型会退役,会被继任者替换。智谱这次的处理方式算是比较体面的——不是直接报错,而是自动路由到新模型。但你不能指望每家平台都这么做,所以代码里模型名最好抽成配置项,别硬编码在业务逻辑里。

这里必须补一句限定:“免费”指的是 token 不计费,不等于无限制。 免费档通常有并发数、每分钟请求数之类的速率约束,智谱官方页面上我没有核实到这些限制的具体数字,所以这里不给数。你要做的是自己压测一遍,测出实际能承受的并发,再决定它能不能扛住你的业务。

同一平台上付费档的参考坐标,我只引用能核实到官方原文的那一条:GLM-4.5 的官方文档写的是输入 0.8 元/百万 tokens、输出 2 元/百万 tokens。至于 GLM-4.6、GLM-4.7、GLM-5 系列的具体单价,网上流传的数字我没有在官方文档正文里找到逐字对应的表述,具体价格请以 bigmodel.cn 的官方定价页面为准。这不是我藏着不说,而是那类数字一旦写错,你按它算出来的预算就是错的。

想看这家平台完整的接入步骤和计费口径,可以配合读 智谱 GLM API 怎么接入智谱 GLM API 怎么收费 这两篇。

免费模型怎么跑通:先用它做链路验证

免费档最实在的用途,其实不是省钱,而是在不花一分钱的前提下把整条调用链路走通。鉴权对不对、网络通不通、返回格式解析得对不对,这些问题用免费模型验证完,再切到付费模型跑正式任务,能省掉大量试错成本。

智谱这边提供了 OpenAI 兼容层,如果你项目里已经在用 openai 这个包,改两处就能跑:

from openai import OpenAI

client = OpenAI(
    api_key="your-zhipuai-api-key",   # 建议用 os.getenv("ZAI_API_KEY") 读取
    base_url="https://open.bigmodel.cn/api/paas/v4/"
)

completion = client.chat.completions.create(
    model="glm-4.7-flash",            # 免费模型,先用它验证链路
    messages=[{"role": "user", "content": "你好,请自我介绍一下。"}]
)
print(completion.choices[0].message.content)

官方也提供原生 SDK,pip install zhipuai 之后用 ZhipuAI(api_key=...) 初始化,调用写法与上面基本一致。两条路选一条顺手的就行,核心对话能力没有区别。密钥建议存进环境变量(官方文档示例用的变量名是 ZAI_API_KEY),别硬编码进仓库。

链路跑通之后,把 model 换成付费模型再跑一遍,这时候如果报错,就能确定问题出在模型可用性或权限上,而不是你的代码——排查范围一下子缩小了一半。

“注册送额度”为什么不该写进技术方案

这是本文最想强调的一条。以智谱为例,网上关于新用户赠送额度的说法至少有两种互相打架的版本,数额差得不小,而且都标注着”政策可能随时调整”。我没能在官方页面上核实到任何一个版本的原文,所以这篇文章里一个数字都不给。

判断赠送额度真实性的唯一可靠办法,是自己注册一个账号,去控制台的用量页面看当前实际显示的数字。 别信任何二手转述,包括这篇文章。

更重要的是使用姿势:即使你确实拿到了一笔可观的赠送额度,也该把它当成”试用期的润滑剂”,而不是成本模型的一部分。做预算的时候,按付费单价算;额度用完前,链路要能平滑切换。具体做法很简单——把模型名和 API Key 都做成配置,额度告急时改配置而不是改代码。

免费档的真实代价,得心里有数

免费不是没有成本,只是成本换了个形式。有三笔账要提前算清楚:

能力上限。 免费档基本都是轻量模型,复杂推理、长链路工具调用、代码生成这类任务上,跟旗舰模型的差距是实打实的。用它做意图分类、文本清洗、格式转换这类结构化任务,性价比很高;用它扛核心业务逻辑,多半要返工。

速率限制。 前面提过,这是免费档最容易被忽略的硬约束。开发环境一个人调用感觉不到,一上线并发起来就开始排队甚至报 429。上线前一定要按预期峰值压一遍。

数据条款。 免费服务的数据使用条款通常和付费档不完全一样,是否会被用于模型训练、日志保留多久,这些得自己去读服务协议。涉及用户隐私数据或商业敏感信息的场景,这条比省下的那点钱重要得多。

海外平台的免费额度:先解决能不能合规访问

盘点免费 API 时,绕不开一个前置问题:OpenAI、Google Gemini、Anthropic 这些海外平台,官方并不支持中国大陆直连。 这是准入层面的限制,不是”网速慢”这种技术问题。所以它们哪怕真的有免费额度,对国内开发者来说也不构成一个可以直接写进方案的选项。

市面上确实存在第三方中转和聚合平台,声称能提供转发服务。客观说这类服务是存在的,但合法性、计费透明度、数据经过第三方之后的安全性都需要你自己核实和承担风险,这篇不做背书,也不推荐任何具体渠道。如果你的业务对稳定性和合规性有要求,把海外平台的免费额度纳入成本模型之前,先想清楚这条链路能不能长期站得住。

相比之下,国内平台的免费档在可达性上没有这个问题,这也是它们对国内开发者更实用的原因之一。

一套可以自己跑的核价流程

与其记别人的数字,不如养成自己查的习惯。下面这五步,花二十分钟就能对任何一家平台做一次可靠的判断:

  1. 打开官方模型清单页,找到”是否免费”这一列。写在模型页面上的免费,才是第一类免费。搜索引擎摘要和第三方文章都不算数。
  2. 注意计费单位。 有的平台按”每千 tokens”展示,有的按”每百万 tokens”,两者差一千倍。横评之前先统一到同一个单位,方向千万别搞反。
  3. 注册账号,去控制台看实际额度。 赠送多少、有没有有效期、绑定哪些模型,账户页面显示的才是当下的事实。
  4. 用免费模型跑一次最小调用,顺手压测并发。 既验证链路,也摸清速率天花板。
  5. 按付费单价算一遍预算。 假设赠送额度不存在,看这个方案的月成本你是否接受。接受就上,不接受就换模型或者换平台。

顺带提一个压成本的公开机制:智谱官方文档提到 Batch API(批量接口)只需五折费用。如果你的任务本来就是离线批处理性质、对实时性没要求,把它挪到批量接口上是笔很划算的账。这类折扣机制在做成本估算时经常被漏掉。

想横向看国内几家的价格结构,可以再读 国产大模型 API 价格对比;如果你找的是免费的成品工具而不是 API,完全免费且不限次数的 AI 工具大全 更对口。

什么情况下别碰免费档

诚实说一下不适用场景,免得你用错地方:

  • 核心业务的主力推理。能力差距摆在那里,别为了省钱牺牲效果。
  • 对可用性有 SLA 承诺的服务。免费档通常不在服务等级保障范围内,出问题你没有申诉的立场。
  • 高并发的 C 端产品。速率限制会先于你的服务器成为瓶颈。
  • 处理敏感数据的链路。先把数据条款读明白,再谈省钱。

反过来,免费档最合适的位置是:本地开发调试、学习和练手、离线批量的轻任务、以及生产链路里那些不需要强推理能力的预处理环节。放对位置,它是真的好用。

小结

免费大模型 API 这件事,关键不在于谁家给得多,而在于你分不分得清”长期免费档""注册赠送额度""订阅套餐内含用量”这三样东西。只有写在官方模型清单里、标价为 0 的那一类,才值得进你的架构图;赠送额度当试用期福利,做预算时直接假设它不存在。智谱的 Flash 系列是个可以拿来对照的样本,它同时也用 GLM-4.5-Flash 下线这件事提醒你,免费档一样会退役,模型名务必做成配置项。海外平台的免费额度在国内还要先过访问这一关,别把它当成默认可选项。最后,别记数字,记流程——官方页面、注册实测、按付费价算预算,这三步永远不会过期。

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。