智谱 GLM API 怎么接入?密钥申请、SDK 调用与免费额度

2026-07-07

数据截至 2026-07,价格与限额以各官网为准。

智谱 GLM API 接入门槛不高:去开放平台注册建一个密钥,选 OpenAI 兼容模式或官方 SDK 都能十几行代码跑通;真正值得先弄明白的是两件事——它的模型迭代速度比大多数同类服务快得多,命名很容易记混,以及有三款 Flash 模型是长期免费的,新手完全可以先白嫖跑通链路,不用一上来就绑卡付费。

如果你是从 Claude、GPT 那条路子过来的,会发现 GLM 的接入流程整体很熟悉——因为它本身就做了 OpenAI 兼容层,改几个参数基本能直接套用你已有的调用代码。但命名和免费档这两块,智谱有自己的一套规则,不提前弄清楚容易走弯路。这篇按真实接入顺序讲一遍。

第一步:去开放平台申请密钥

智谱的开放平台官网有两个域名并存:bigmodel.cnopen.bigmodel.cn,指向同一个平台,从哪个进都行,不用纠结哪个是”正版”。官方文档站是独立的 docs.bigmodel.cn,接入过程中大部分时间你会在这个文档站和控制台之间来回切换。

注册登录后,进入用户中心的 API Keys(密钥管理)页面创建密钥。和很多平台一样,密钥一旦生成建议当场复制保存好,别只是瞄一眼就关掉弹窗——这是几乎所有 API 平台的通病,GLM 也不例外。

拿到密钥之后,官方推荐的做法是把它放进环境变量 ZAI_API_KEY 里,代码里用 os.getenv("ZAI_API_KEY") 读取,而不是直接硬编码在脚本里、更不要提交进 Git 仓库。这个习惯不管接哪家 API 都该养成,泄露一次密钥被盗刷的教训在各家社区里都不少见。

一个新手容易疑惑的点:GLM 官方文档里同时出现 GLM-4.x 和 GLM-5.x 两条系列,别以为哪个是”测试版”哪个是”正式版”——按 2026-07 核实时的情况,线上主力已经是 GLM-5 系列,但 4.x 系列(尤其是 4.5、4.7)仍然在售、仍然是很多场景下的高性价比选择,不是被淘汰的老版本。挑型号时别只看数字大小,具体上下文窗口、输出上限、是否免费,得去官方模型概览页对着查,这篇后面也会给一份能核实到的清单。

第二步:两种最小调用方式,任选一种先跑通

GLM 的接入有两条路:一是走 OpenAI 兼容层,二是装官方原生的 zhipuai SDK。两条路殊途同归,选哪个看你项目里已经用惯了哪套调用习惯。

方式一:OpenAI 兼容层。如果你的项目已经在用 openai 这个 Python 包调别的模型,接 GLM 只需要换 base_urlapi_key,业务代码基本不用动:

# pip install --upgrade "openai>=1.0"
from openai import OpenAI

client = OpenAI(
    api_key="your-zhipuai-api-key",   # 或 os.getenv("ZAI_API_KEY")
    base_url="https://open.bigmodel.cn/api/paas/v4/"
)

completion = client.chat.completions.create(
    model="glm-4.7",  # 按需替换为 glm-4.7-flash(免费)/ glm-5.2 等
    messages=[
        {"role": "user", "content": "你好,请自我介绍一下。"}
    ]
)
print(completion.choices[0].message.content)

方式二:官方原生 zhipuai SDK。如果你不需要迁移别家代码、想直接用官方封装,装 zhipuai 包更省心:

# pip install zhipuai
from zhipuai import ZhipuAI

client = ZhipuAI(api_key="your-zhipuai-api-key")

response = client.chat.completions.create(
    model="glm-4.7-flash",  # 免费模型,适合先跑通链路
    messages=[
        {"role": "user", "content": "你好,请自我介绍一下。"}
    ]
)
print(response.choices[0].message.content)

两种方式的调用结构长得几乎一样,都是 chat.completions.create 这套 OpenAI 风格接口,取返回值也都是 choices[0].message.content,没有 Claude 那种”内容是块数组要遍历取 text 类型”的额外心智负担,上手成本确实低。

这里额外提一句:网上有教程提到编程工具(比如接 Claude Code、Cline 这类客户端)场景下有个专用的 base_url https://open.bigmodel.cn/api/coding/paas/v4,但这条信息目前只在第三方教程里出现,官方 introduction 文档没有逐字给出这个地址,如果你是要接编程工具场景,建议先去官方文档站核实一遍再用,别直接照抄网上的截图。

免费模型:能不能真的白嫖跑通

这是 GLM 接入里一个挺友好的点:官方长期提供免费的 Flash 系列文本模型,不是那种”注册赠送额度用完就收费”的套路,而是这几款模型本身就一直不要钱。

目前可以确认长期免费的是三款:GLM-4-Flash-250414(官方文档原话是”智谱AI首个免费大模型API”)、GLM-4.7-Flash,以及曾经免费的 GLM-4.5-Flash——不过要注意,GLM-4.5-Flash 已经在 2026-01-30 下线,现在请求打过去会自动路由到 GLM-4.7-Flash,如果你的代码里还硬编码着 glm-4.5-flash 这个模型名,不会报错,但实际跑的已经是新模型了,建议直接改成 glm-4.7-flash 更清楚。

免费档的限制不在 token 计费上,而在并发和速率限制上——官方文档没有把具体的 RPM/TPM 数字摆出来给我核实到,所以这里不瞎猜一个数字,你可以在自己账号里实测感受,或者直接去文档站查当次的限速说明。

至于”新用户注册送多少 token”这件事,网上流传的说法不太一致:有说法是”注册即送 2000 万 token,永久有效”,也有说法是”送 1200 万(GLM-4.5)+ 500 万(GLM-4.7)“,这两种口径都来自第三方汇总文章,没能在官方页面上逐字核实到,而且都标注是 2026 年早些时候的数据,政策随时可能调整。稳妥的做法是:别把这类赠送额度当成能长期依赖的免费资源去做产品规划,真正靠谱、能长期免费用的,是上面提到的那三款 Flash 模型本身——它们不依赖”新用户福利”,任何时候注册都一样能免费调。具体你账号里现在实际有多少赠送额度,登录后台看一眼最准。

选型速览:先看规格,价格放到下一篇

接入阶段不建议你一上来就纠结价格,先把规格对齐了——上下文窗口够不够长、最大输出够不够用、是不是免费档,这三件事决定了你能不能先跑起来。按官方模型概览页能核实到的规格,挑几个常用型号列一下:

模型 ID上下文窗口最大输出是否免费
glm-5.21M tokens128K tokens
glm-4.7200K tokens128K tokens
glm-4.6200K tokens128K tokens
glm-4.5128K tokens96K tokens
glm-4.7-flash200K tokens128K tokens
glm-4-flash-250414128K tokens官方未展示具体数字

能看出一个规律:越新的系列上下文窗口越大,glm-5.2 已经到了 1M tokens 这个级别,和长文档、长对话场景更契合;但如果你只是想先跑通一个demo、验证账号和网络链路通不通,直接用免费的 glm-4.7-flash 就够了,不用一上来就选最新最贵的旗舰型号。等真到了要为生产环境选型、算成本的阶段,再翻下一篇计费文章,把每个型号的单价核对清楚。

顺带一提,智谱官方对 Batch(批量)接口有五折优惠,如果你的场景是离线批处理而不是实时对话,这条值得记一下,具体怎么用、能省多少,同样放在计费那篇里展开讲更合适。

常见坑 / 注意

  • 模型命名容易记混:GLM-4.x 和 GLM-5.x 同时在售,别以为数字小的就是旧版被淘汰,挑型号前先去官方模型概览页确认具体规格。
  • 免费模型名字要对齐glm-4.5-flash 已下线自动路由到 glm-4.7-flash,代码里建议直接换成新名字,别留着旧名字心里没底。
  • 编程专用 base_url 未官方逐字核实:网上教程提到的 .../api/coding/paas/v4 目前只在第三方资料里见到,接编程工具场景前建议自己去官方文档站核实一遍。
  • 密钥只显示一次:和几乎所有平台一样,建好当场存好,别关了弹窗才想起来复制。
  • 别硬编码密钥:放环境变量 ZAI_API_KEY 里,官方推荐这个变量名。
  • 新用户赠送额度别当刚需依赖:说法不一还可能调整,登录后台看账户页实际数字最准,长期能稳定免费用的是三款 Flash 模型本身。

接下来看什么

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。