GLM 编程套餐常见问题逐条拆解:额度、扣费与报错
数据截至 2026-08,价格与限额以各官网为准。本文只讲计费与接入机制,不列具体价格数字。
GLM 编程套餐的绝大多数「问题」其实不是故障,而是三件事没对上:套餐额度只在官方指定的工具与产品环境里生效、只在配置了编程专用 Base URL 的前提下生效、并且额度按「短周期 + 周周期」两层限额滚动刷新。只要有一条没满足,请求要么落到账号余额上、要么直接报余额不足。 官方常见问题页把「为什么购买了编码套餐还报错 1113 余额不足」放在「使用问题」一节的头一条,它的三个成因全部指向配置而不是账户。另外还有几个动作是不可逆的:订阅一经购买不支持退款、再次购买或升级不会在原套餐上叠加时间、账号共享会被风控处置。这篇按真实排查顺序把官方文档里的说法逐条摊开。
买了套餐还报余额不足,先查这三件事
官方常见问题页对「为什么购买了编码套餐还报错 1113 余额不足 / 为什么还扣账号余额」给出的答案是:可能是没有满足 GLM Coding Plan 的使用条件,具体列了三条。
第一条,套餐仅限在官方支持的指定工具与产品环境中使用。官方在「接入工具」页维护了一份适用工具清单,分成 Coding Agent 工具和通用 Agent 工具两类,不在清单里的工具用同一把 Key 调过去,是不走套餐额度的。
第二条,必须配置特定的 Base URL 才能使用。这一条最容易栽,因为不同工具的地址不一样,官方常见问题页里是这么分的:Claude Code 里填 https://open.bigmodel.cn/api/anthropic;Cherry Studio 里填 https://open.bigmodel.cn/api/coding/paas/v4/;除这两者之外的工具填 https://open.bigmodel.cn/api/coding/paas/v4。官方「接入工具」页则按协议给了另一张对照:Anthropic Message 协议走 https://open.bigmodel.cn/api/anthropic,OpenAI Chat Completion 协议走 https://open.bigmodel.cn/api/coding/paas/v4,OpenAI Response 协议走 https://open.bigmodel.cn/api/v1。官方在这里专门加了警告:错误配置端点将导致无法使用 GLM Coding Plan 套餐额度。
这里要按住一个很自然、但会把人带沟里的推断:不能靠「路径里有没有 coding 这一段」来判断走不走套餐。上面那张协议对照表里,Anthropic Message 协议的地址和 OpenAI Response 协议的地址都不含 coding,却都是官方列出的编程端点。官方在这件事上只给了一句结论——错误配置端点将导致无法使用套餐额度——并没有给出任何可以自己推演的路径规则。所以判据只有一条:你的工具走哪个协议,就照官方对照表把那一行的地址原样填进去,别按感觉改写,也别把常见问题页的工具口径和接入工具页的协议口径混着用。「Key 是对的、模型名是对的、请求也成功了、就是在扣钱」这种情况,八成不是 Key 的问题,是地址填得对不对的问题。相关的接入细节可以对照智谱 GLM API 接入步骤那篇一起看。
第三条,官网体验中心不支持使用编码套餐。也就是说在网页端的体验页面里跑对话,不会走套餐额度。
额度按什么周期算,用完之后会发生什么
官方对「套餐的用量额度大概是多少」的回答里,重点不是数值而是机制:套餐采用每 5 小时限额加每周限额的使用机制,两层同时生效,可以在控制台的用量统计页查看当前的额度消耗情况与剩余额度。具体额度数值分个人版与团队版两套说明,官方要求以订阅页与用量说明页展示为准。
这两层限额的刷新方式在官方用量说明里写得更细:短周期额度采用动态刷新机制,额度在请求消耗满一个周期之后刷新重置;周额度自套餐下单时起算,以七天为一个周期刷新。这意味着你的「周一」不一定是自然周一,而是从下单时刻起算的,跨月对账时尤其容易对不齐。
更重要的是额度耗尽之后的行为。官方明确回答过:套餐额度耗尽后,系统不会继续消耗你的其他资源包或账户余额,需要等待下一个周期恢复额度。额度打光就停在那里,不会顺势去啃你的资源包和现金余额,代价是被硬性挡住一段时间。
但这条结论不要无条件套到团队套餐上。团队文档里另有一句例外:团队管理员可以提前开启超额按量付费功能,开启之后席位超出用量额度仍可继续使用服务,并根据实际超出部分按量计费,等下一个重置周期开始再回到套餐内额度。换句话说,「不会额外扣钱」是默认状态,不是一道谁都关不掉的闸——管理员把那个开关打开,成本行为就变了,团队里的人往往还不知道。想在被挡住或者被计费之前提前有感知,可以参考API 成本监控该盯哪些指标里的做法,把用量统计页纳入日常巡检。
积分怎么扣:抵扣系数与时段
新版套餐是以 Token 消耗为基础的积分制,额度不是按「问了几次」扣的。官方用量说明给出的算法是:模型消耗的积分数,由输入 Token 乘 Input 抵扣系数、缓存命中 Token 乘 Cached Input 抵扣系数、输出 Token 乘 Output 抵扣系数三项相加,再按官方给的公式换算得到。
这个公式里藏着三个实际影响成本的变量。一是模型:官方为每个可用模型分别列出了各自的三个抵扣系数,换模型就等于换了一整套系数。二是输出:同一个模型的 Output 抵扣系数明显高于 Input,所以让模型少说废话、别整段重复贴代码,比省输入更划算。三是缓存:命中缓存的那部分 Token 走的是 Cached Input 系数,官方把它单列出来,说明命中率会直接改变积分消耗速度。具体系数以官方用量说明当前版本为准。
时段是另一层。用量说明写明,非高峰时段内的模型调用按低于基础积分的比例抵扣,高峰时段被定义为工作日的一个固定时间窗,具体时间窗与抵扣比例见官方用量说明。套餐改版公告里另外补充了一条:周末全天按非高峰时段抵扣额度。
这里要专门区分一套很容易被拿混的口径。「GLM-4.7 全天按基础系数消耗、GLM-5.3 与 GLM-5-Turbo 作为高阶模型在高峰时段按更高系数消耗」这个说法确实来自官方,但它出现在改版公告的「历史套餐用量说明备查」小节里,对应的是 2026 年 7 月 30 日套餐改版之前的历史版本套餐,不是当前新版积分套餐的规则。在当前用量说明里,时段规则对所有模型一视同仁,模型之间的差别只体现在那三个抵扣系数上。要判断自己该按哪套口径算账,先回控制台确认套餐类型,识别方法官方在改版公告里给了对照表,本文后面那节会讲。
所以「我今天没多干活,额度怎么掉这么快」这类疑问,排查顺序是:先看用的是哪个模型、输出有没有失控、缓存有没有被打断,再看请求是不是集中落在了高峰时段,最后才怀疑计费本身。
哪些场景根本不算在套餐里
这是官方单独列出来的一条:套餐额度有应用场景限制。原文的表述是,GLM Coding Plan 仅限在官方支持的指定工具与产品环境中使用,在规定工具之外调用 API,不可享用 Coding 套餐的额度;如果需要在自建应用、网站、机器人、SaaS 产品等场景中通过 API 集成模型能力,应当使用智谱提供的标准 API 服务,并按对应协议计费。
这条划的是产品边界,不是技术边界。用编程套餐的 Key 去驱动一个自研的客服机器人,技术上大概率能跑通,但它不在授权范围里。想清楚这一点,很多「怎么把套餐额度用到我的产品上」的问题就不必再问了。
还有一个层级差别值得注意:官方把适用工具分成两类,并说明大部分用户是在 Coding Agent 场景使用,平台优先保障编程任务请求;对于清单里的通用 Agent 工具,采用次级调度与尽力交付策略,Coding Agent 任务享有资源抢占优先权,高负载下通用 Agent 工具的任务会自动触发包括动态排队、限流在内的公平使用策略。也就是说,同样是清单内的合规工具,拿套餐跑通用助手类任务,排队体验和跑编程任务不是一回事。
自带的 MCP 工具要不要额外付费
官方常见问题页里关于 MCP 的三问三答很干脆。
哪些套餐等级支持视觉理解、联网搜索、网页读取和开源仓库 MCP 工具?答案是所有等级的套餐都支持——不存在低档位买不到这几个工具的情况。
这些 MCP 的调用额度是多少?官方的回答是模型与 MCP 共享套餐调用额度,具体看用量说明。这句话的实际含义是:MCP 调用不是免费附赠的,它和模型调用吃的是同一个池子。一个把联网搜索和网页读取当默认动作的工作流,会额外占掉本该留给模型的额度。
好在这部分消耗是能单独看清楚的。用量说明给 MCP 单列了一条计算口径:MCP 消耗积分数=调用次数 × Output 抵扣系数。注意它按调用次数算,不按 Token 算——也就是说,一次搜索不管返回多少内容,扣的积分是固定的,频繁地小步搜索比一次搜到位更费额度。官方还在提示里写明,可以在财务的费用明细里查询具体消耗的不同价格类型的 Token 数与工具调用次数。所以怀疑额度被 MCP 吃掉的时候,去费用明细看工具调用次数这一项,比在工具日志里翻要直接得多。
能不能用别的方式调用这几个 MCP 工具?官方说明除套餐包外暂未提供其他调用这些 MCP 工具的接入方案;如果你调用的是其他类似的 MCP 工具,使用过程中产生的计费问题不属于此套餐的范畴。
订阅、升级、续费:几个不可逆的动作
扣费顺序官方写得很明确,按这个次序依次尝试:优先使用账号内的赠金余额,赠金不足则使用现金余额,两者都不足再从绑定的第三方支付方式(如微信、支付宝)扣款。所以「我明明有赠金怎么还从微信扣了」通常意味着赠金已经用完了。
取消自动续费在套餐概览页面操作,官方要求必须在下一个扣费日之前提前一定天数取消,具体提前量以官方常见问题页当前版本为准。取消之后当前周期继续有效,到期后不再续费——不是立即失效。
退款政策没有回旋余地:订阅服务一经购买即视为确认,不支持退款,即使没用完费用也无法退回。官方给的建议是按使用需求选择合适的订阅档位和周期。
升级的路径是在订阅管理中选择「升级」,支付差额后立即生效,官方给的步骤是打开套餐计划页、点击订阅升级、选择目标套餐、支付差额、新套餐立即生效。
这里有一条必须先知道再动手的规则:再次购买或升级编码套餐,不会在之前套餐的基础上叠加时间。官方原文是,再次购买或升级时会把之前的套餐作废,之前套餐未使用的时间会作为现有套餐的剩余价值计算到这次购买中。换句话说,剩余时间会被换算成价值计入新单,而不是排队接在后面。如果你原本打算「趁活动再囤一个周期」,这个机制和预期是相反的。
怎么确认这一笔到底扣的是谁
官方给了一个具体的核对入口:在费用明细页的「抵扣资源包」列表项里,可以查看这笔消耗是不是用编码套餐抵扣的。
这是排查扣费争议最直接的手段,比在工具里看日志靠谱。搭配前面的 Base URL 检查,基本能定位问题:如果抵扣资源包一栏显示的不是编码套餐,那就是请求根本没走编程端点,回去改地址。日常还应该把 Key 的归属理清楚,官方特别提示团队套餐的 Key 与平台其他 API Key 不通用,要用团队额度就必须用团队套餐的 Key。Key 的管理习惯可以参考API Key 安全管理清单。
判断自己在用哪一代套餐也有明确方法:官方改版公告里给了识别表,个人套餐在套餐概览页会显示「历史版本 V1」或「历史版本 V2」,团队套餐在我的套餐页显示「团队套餐」,没有生效套餐则说明已到期或尚未订阅。新版套餐改成了以 Token 消耗为基础的积分制,和历史版本的差别在于额度计算方式,官方说明其他权益如支持的模型保持一致。
账号共享这条线不要试
官方对「我可以与他人共享一个订阅套餐吗」的回答是不可以:套餐为订阅人专享使用,若因账号共享导致多人共用同一套餐,平台可能视为不当使用,并在必要时对订阅权益做出相应限制,严重时会影响账号的正常使用。
使用须知页写得更硬:违反订阅及自动续费协议可能触发风控,会被限流、冻结,多次违规可能被封禁账号;如果命中风控策略,可以在控制台的套餐概览页查看风控提示并发起申诉。官方还专门解释了永久封禁的适用范围——属于平台最高等级处置,会在证据充分、风险特征明确,并确认账号存在倒卖、中转、套利等严重违规行为时执行,不会因单一指标触发,会结合人工复核。
这段说明里还有一句容易被跳过的:官方明确表示不会公开披露完整的判定逻辑或后台日志,理由是风控证据涉及平台风控机制和用户隐私细节;对处置结果有异议只能通过官方客服渠道提交申诉,由平台基于后台记录和风控证据复核。也就是说,你没办法拿一份「怎样算合规」的完整清单去反推边界,能做的只有守住写在明面上的那几条:不共享账号、只在指定工具与产品环境里用、不碰协议里列出的违规行为。
真要多人一起用,官方给的路径是团队套餐。但别把它想成「一个大池子大家分」——团队文档写得很清楚,套餐用量是按照席位单独限制的,某个席位超过额度,限制周期内这个席位就无法使用模型,直到下一个重置周期开始。团队版真正统一起来的是管理和账单:席位与角色权限统一管理、按成员与时间周期追踪用量、企业账单统一归集与集中开票;额度本身仍然是一人一份。理解这一点,才不会在「买了团队版为什么某个人还是被限住」这种问题上绕圈子。
套餐到期之后还能不能用资源包
官方的回答分两种情况:在 Claude Code 中暂不支持使用其他资源包;在其他编码工具中,把 Base URL 设置为 https://open.bigmodel.cn/api/paas/v4 即可使用资源包进行调用。官方同时建议,由于 Coding Agent 场景的资源消耗较高,编码套餐提供更高的权益额度与更稳定的使用体验,建议优先购买编码套餐。
留意这里出现的又一个地址:https://open.bigmodel.cn/api/paas/v4 是平台标准 API 服务的地址,套餐到期后在 Claude Code 之外的工具里换成它,就能接着用资源包调用。把前面这几个地址放在一起看,逻辑就清楚了——地址决定这次请求从哪个口子扣,Key 只决定你是谁。所以换工具、换协议、套餐到期这三种时刻,第一件要做的事都是回官方对照表核一遍地址,而不是重新生成 Key。
最后:模型支持范围与一条自检顺序
官方明确所有套餐均支持 GLM-5.3、GLM-5-Turbo、GLM-4.7;套餐体验卡支持的模型范围要窄一些,官方列的是 GLM-5.3 和 GLM-4.7。具体的模型清单以官方文档当前版本为准,切换方法官方另有专页说明。
真正遇到问题时,按这个顺序自检最省时间:先看工具在不在官方适用清单里,再看 Base URL 是不是编程专用地址,然后去费用明细的抵扣资源包一栏确认扣的是谁,最后才去用量统计页看是不是撞上了周期限额、或者请求集中落在了高峰时段。四步走完还定位不到,再去看具体的报错码,这部分可以对照GLM API 报错排查。
最容易栽的坑其实是第二步和第五步之间的空白地带:请求成功、结果正常、什么错都不报,钱却从账户余额里走了。这种「静默不走套餐」的情况没有任何提示,只能靠费用明细自己发现。新配一个工具之后,跑几次就去账单里核一眼,是个成本很低的好习惯。