DeepSeek API 免费额度的四个来源:注册赠送、错峰折扣、上下文缓存与本地部署

场景与需求:先分清三件不同的事

搜”DeepSeek API 免费额度”的人,通常想弄清的是三件混在一起的事:

  1. 白送的体验金:注册 API 开放平台送不送、送多少、能用多久;
  2. 零成本用法的上限:不充值的前提下,DeepSeek 能用到什么程度;
  3. 开源权重自跑的成本:自己找台机器跑 DeepSeek 开源模型,是不是真的”免费”。

我的场景是前两件的组合:几个自动化脚本和一个低流量工具站要接大模型能力,做摘要、分类、代码问答,月预算希望压到两位数(元)量级。对这种用量,“免费额度能撑多久”直接决定要不要充值、什么时候充值。

先把最容易混的两个入口分开:

  • 网页版 chat.deepseek.com:对话界面,国内直连、注册即用,人工聊天本身不收费(入口与功能见DeepSeek 网页版入口与功能速览);
  • API 开放平台 platform.deepseek.com:给程序调用用的,按 token 计费,预付费充值。

很多人的真实需求只是”免费跟 DeepSeek 聊天”——那答案很直接:网页版就是零成本,不用碰 API。需要程序化调用,才继续往下看。

候选方案:不花钱或接近不花钱的四条路

方案成本结构上手门槛关键不确定性
官方注册赠送额度送一笔带有效期的体验金注册即可当前是否还有、金额多少【待补:注册后控制台】
官方错峰折扣不是免费,是降价当前时段与折扣比例【待补:官网价格页】
本地部署蒸馏版一次性硬件 + 电费装 Ollama、要有显卡7B/8B 量化约需 6~8 GB 显存,能力弱于满血
第三方渠道赠送云厂商托管、聚合网关的新客额度多注册一个平台各家活动随时间变【待补:当期活动页】

四条路对应四种人。赠送额度适合”先试水”;错峰折扣适合”用量固定、时间不敏感”的跑批任务;本地部署适合”数据不能出门”或”调用量大到按 token 计费不划算”的场景(部署步骤见DeepSeek 本地部署:显存要求与 Ollama 方案);第三方渠道适合”本来就要在云上开发票”的团队。

顺手把官方 API 的调用形态贴出来。它是 OpenAI 兼容接口,把地址指到 https://api.deepseek.com、模型名用 deepseek-chat(通用对话,对应 V3 系)或 deepseek-reasoner(推理模型,对应 R1 系)就能跑:

curl https://api.deepseek.com/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $DEEPSEEK_API_KEY" \
  -d '{
    "model": "deepseek-chat",
    "messages": [
      {"role": "user", "content": "用一句话解释什么是 token"}
    ]
  }'

测算模型与假设

计费规则里属于通识的部分先摆出来:

  • 按 token 计量,价目以每 100 万 tokens 为单位,输入、输出分开计价,输出单价通常高于输入;
  • 官方文档给过的粗略换算:1 个中文字符约 0.6 个 token(以官方最新口径为准);
  • 两个模型名对应两条价目:deepseek-chat 是通用对话模型,deepseek-reasoner 会额外产出思考过程的 tokens,后者的输出消耗更大;
  • 重复前缀(比如固定的 system prompt)可能命中上下文缓存而降价,当前折扣口径【待补:官网缓存计费说明】。

再假设一套轻量个人用量(示例数字,发布前替换成控制台的真实值):

假设项取值
日均请求数50 次
平均输入600 字 ≈ 360 tokens
平均输出200 字 ≈ 120 tokens
模型选择全部走 deepseek-chat,0% 走 reasoner

把账算成可复算的公式:

单次成本 = 输入 tokens × 输入单价/100万 + 输出 tokens × 输出单价/100万
日成本   = 单次成本 × 日均请求数
赠送额度可撑天数 ≈ 赠送金额 ÷ 日成本
月成本   = 日成本 × 30

按上表代入:每天约 1.8 万输入 tokens(360 × 50)加 0.6 万输出 tokens(120 × 50),合计 2.4 万 tokens,一个月约 72 万 tokens。把当前牌价填进公式(【待补:官网价格页】),月成本和赠送额度的可撑天数立刻出结果。

测算结果表

方案前置成本每月 72 万 tokens 的费用结论
网页版人工对话0 元0 元只是人工聊天就直接用网页,无需 API
官方注册赠送额度0 元(若当前发放)额度内为 0,耗尽后按牌价【待补:官网价格页】先跑起来再决定充不充
官方按量付费充值一笔按牌价折算【待补:官网价格页】轻量用量的绝对金额通常不大
官方错峰跑批同上跑批部分按折扣价【待补:当前折扣比例】时间不敏感的批任务往低峰挪
本地 7B/8B 蒸馏一张 6~8 GB 显存的显卡电费零 token 费用,能力打折

两点说明:72 万 tokens 是上述假设用量乘 30 天推出来的,不是实测值;表里所有涉及当前价格的格子都留了待补位,因为 API 牌价和活动政策历史上有过多次调整,写死任何数字都会过期。

决策框架

按两个维度决策:调用是人工发起还是程序发起,以及用量大小

你的情况建议
只是人工聊天、查资料网页版,到此为止,不用充值
低频脚本,先试水注册 API 平台看赠送额度,撑到用完再决定
用量稳定上量直接按量付费:固定 system prompt 吃缓存,批任务挪错峰
预算极度敏感、能接受打折的能力本地部署蒸馏版,一步到位零 token 费用
团队、要发票、要合规云厂商托管或官方企业渠道,优先级高于薅赠额

一个常见误判:把”免费”当成选 API 渠道的首要标准。对低频个人用量,免费额度的绝对金额本来就小——月成本不高时,赠送也省不了多少;真正拉开差距的是缓存、错峰和模型选型这三个杠杆,计费细节在DeepSeek API 价格与计费详解里展开过。真正该薅”免费”羊毛的场景只有两个:验证阶段不想充钱,以及用量大到本地部署的边际成本为零。

我的最终选择

我的组合拳是四步:

  1. 日常问答与写作走网页版,零成本,把 API 额度留给程序;
  2. 注册 API 平台后先看赠送额度的有无与金额(【待补:注册后实测】),够脚本跑一阵就不急着充;
  3. 真要充值,充最小额度起步,配合固定前缀吃上下文缓存;夜间批任务统一挪到错峰时段(【待补:当前错峰时段】);
  4. 家里 8 GB 显存的显卡留一个 deepseek-r1:7b 本地兜底,断网、隐私敏感的任务走本地。

从创建 Key 到第一句对话五分钟能走完,接入步骤见DeepSeek API 接入教程

相关阅读