DeepSeek 有没有免费额度?先把三个口径分清楚

2026-07-28

数据截至 2026-07,价格与限额以各官网为准。

问”DeepSeek 有没有免费额度”,多半会得到互相矛盾的答案,原因不是信息封锁,而是提问的人和回答的人说的压根不是同一件事:有人说的是网页和 App 里聊天不花钱,有人说的是调 API 时账户里有没有一笔赠款,还有人说的是第三方聚合平台注册送的体验金。这三个口径的钱包完全不是同一个。就官方定价文档能确认的部分而言,DeepSeek API 是一套明码标价的按量计费服务,真正让很多人产生”几乎不要钱”错觉的,是它的单价和缓存命中折扣,而不是赠送。

一个常见误解:网页能免费聊,API 就该免费调

这是最普遍的混淆。你在 DeepSeek 的对话产品里提问不掏钱,是消费级产品的运营策略;而 API 是给开发者用的另一条产品线,每一次请求按 token 计费,两者账目独立。同理,你在别的应用(某个笔记软件、某个浏览器插件)里”免费用到了 DeepSeek 模型”,掏钱的是那个应用的开发者,不是你,也不代表你自己拿到了额度。

所以在动手前,先把问题改写成一个能回答的形式:我打算调 API,那么第一次请求之前需要先充多少钱? 这个问题的答案在你登录 platform.deepseek.com 后的账户页上,一眼就能看到当前余额和是否有可用赠款,比在网上翻半年前的教程可靠得多。关于新用户是否赠送额度、赠多少、有效期多久这类说法,各处流传的版本很不一致,也没有在可核实的官方定价页面上找到稳定条目,请以你注册当时官网和控制台的说明为准,别拿别人截图当依据。

官方定价页上能确认的东西:一张单价表

抛开赠不赠送,先把真实价目看清楚。当前的主力是 V4 系列,分 Flash 和 Pro 两档:

模型输入·缓存命中输入·缓存未命中输出
deepseek-v4-flash0.02 元/百万 tokens1 元/百万 tokens2 元/百万 tokens
deepseek-v4-pro0.025 元/百万 tokens3 元/百万 tokens6 元/百万 tokens

两个模型的上下文窗口都是 1M tokens,最大输出 384K tokens;并发上限官方文档标注为 flash 2500、pro 500。

这里有个容易踩的坑:中文定价页只写人民币,英文定价页只写美元,两个页面并没有给出同一处的双币种对照。网上流传的换算数字都是二手推算,写进预算表容易失真。引用哪个页面就用哪个币种,别自己拿汇率换完再当成官方口径去跟同事对账。

“几乎免费”的真正来源:缓存命中

看上面那张表,flash 的缓存命中价是 0.02 元/百万 token,未命中是 1 元/百万 token——命中价大约只有未命中价的百分之二,降幅约九成八;pro 那一档差距更大,命中价约为未命中价的 0.83%。这才是很多人喊”便宜到不像话”的实际来源。

这套机制叫上下文硬盘缓存,几个关键点值得记住:

  • 默认对所有用户开启,不用改代码。你不需要额外申请或加参数。
  • 命中情况写在返回里。API 返回的 usage 字段中,prompt_cache_hit_tokens 是命中的输入 token 数,prompt_cache_miss_tokens 是没命中的。想知道自己有没有吃到折扣,看这两个数就行,不要靠感觉。
  • 只匹配输入的前缀。系统在多次请求之间检测相同前缀并持久化;输出部分仍然要模型实打实算出来,不受缓存影响,随机性也照旧受 temperature 之类参数控制。
  • 尽力而为,不保证命中。官方明确写的是 best-effort,别把成本模型建立在”一定会命中”的假设上。
  • 闲置会被清掉。不再使用的缓存通常在数小时到数天内自动清除,官方原文的措辞是”usually within a few hours to a few days”。
  • 存储本身不额外收费

落到写法上,能省钱的做法很朴素:把不变的部分(系统提示、长文档、few-shot 示例、工具定义)固定放在消息序列的最前面,把每次都变的用户输入放在最后。前缀一旦变动,那处之后就接不上了。很多人系统提示里塞了时间戳或随机 ID,等于每次请求都亲手把缓存打掉,账单翻几倍还找不到原因。

想低成本试一试,其实不用等赠送

与其纠结有没有免费额度,不如直接估一下最小验证要花多少钱。假设你用 flash 做一次普通对话,输入 2000 token、输出 800 token,全部按未命中价算:输入 2000 ÷ 1,000,000 × 1 元 = 0.002 元,输出 800 ÷ 1,000,000 × 2 元 = 0.0016 元,合计约 0.0036 元。跑 1000 次也就三块多。这个量级下,“先充一点钱把链路跑通”通常比花两小时找免费渠道更省时间。

真正该省的是无效消耗,具体做法:

  1. 第一次只发一句”你好”,确认鉴权、网络、模型名三件事都对,别一上来就灌长文档。
  2. 在开发阶段固定用 flash。调试期你验证的是链路和 prompt 结构,不是模型上限,等结构稳定了再考虑要不要换 pro。
  3. 每次调用后打印 usage。把输入、输出、缓存命中三个数记进日志,跑上几十次你就有了真实的单次成本,估算比拍脑袋准得多。
  4. 给自己设一个用量告警,尤其是带循环、带重试的脚本,一个死循环烧掉的钱比省下来的多。

抄旧教程的最大风险:模型名已经换代

不少讲”免费试用”的旧文里,示例代码写的还是 deepseek-chatdeepseek-reasoner。官方文档已经明确这两个旧模型名在 2026/07/24 15:59 UTC 弃用,兼容期内它们分别对应 deepseek-v4-flash 的非思考模式与思考模式。新接入的人请直接写 deepseek-v4-flashdeepseek-v4-pro,别再沿用旧名字,否则很可能撞上模型不存在类的报错,还会误以为是”额度没开通”。

最小调用本身没什么难度,Base URL 是 https://api.deepseek.com,兼容 OpenAI SDK 的请求格式:

# pip3 install openai
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ.get('DEEPSEEK_API_KEY'),
    base_url="https://api.deepseek.com")

response = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[
        {"role": "system", "content": "You are a helpful assistant"},
        {"role": "user", "content": "Hello"},
    ],
    stream=False,
)

print(response.choices[0].message.content)

密钥在 https://platform.deepseek.com/api_keys 创建和管理,放进环境变量,别硬编码、别提交进仓库。官方文档同时给了 curl、Python、Node.js 三种示例,核心都是换 base_url 加自己的 key,其余用法与标准 Chat Completions 一致。

关于价格可能变动,说句实话

网上有报道称 DeepSeek 计划在 V4 正式版上线后引入分时段的峰谷定价,也就是工作时段单价更高。这一条截至核实时并未在官方定价页面上看到正式公示,属于未核实信息,官方也可能已经调整,请以你查看当时的官网页面为准。之所以专门提一句,是因为如果你正在做一份要给别人看的成本测算,最好把”单价可能分时段浮动”当成一个风险项写进去,而不是默认全天一个价。

同样的态度也适用于额度类信息:这类运营策略变动比技术文档快得多,任何一篇文章(包括这篇)都只能告诉你怎么去核实,不能替你锁定当时的数字。

第三方平台送的额度,是另一回事

有些聚合平台、云服务商会以”注册送体验金""免费调用 DeepSeek”作为拉新方式。客观说这类渠道确实存在,但要拎清楚三点:钱是那个平台出的,不是 DeepSeek 官方给你的;模型是不是官方同版本、有没有做量化或改配置,你很难验证;额度用完之后的单价、计费口径、数据处理方式,都要看那家平台自己的条款。这篇不做推荐也不做贬低,只提醒一句:用来做小实验没问题,把生产环境架在一个随时可能改规则的中转层上,风险要自己扛。如果你的应用会长期跑,直接走官方接口、账目清清楚楚,反而是更省心的选择。

常见坑速查

  • 别把网页版免费当成 API 免费,两条产品线各算各的账。
  • 中英文定价页币种不互通,引用哪页就用哪页的币种,不要自行换算后当官方数据。
  • 缓存命中默认开启,但只匹配输入前缀,系统提示里塞时间戳等于自己关掉折扣。
  • 缓存是尽力而为,成本估算别按 100% 命中来做。
  • deepseek-chat / deepseek-reasoner 已到弃用节点,新代码直接用 V4 系列模型名。
  • 想确认自己有没有额度,看控制台账户页,别信别人的旧截图。

小结

DeepSeek API 是明码标价的按量计费服务,“免费”这个词在不同人嘴里指的是完全不同的三件事,先分清口径再讨论才有意义。官方定价文档里能稳定确认的是 V4 系列的单价表和缓存命中折扣,赠送额度这类运营条款请以你注册当时控制台显示的为准。真正能把账单压下去的杠杆是缓存命中和模型选型,不是找赠款。花几块钱把链路跑通、把 usage 打进日志,比花半天找免费渠道更值。定价策略变动较快,写进方案前二次核实官网当前页面。

接下来看什么

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。