跳到正文
deepseekprice

社区自建的非官方站点,与 DeepSeek 官方无关。

DeepSeek 空闲时段

请求只要不落在最忙的那几个小时之内,DeepSeek 价格就便宜一半。官方按北京时间划窗口,所以这个折扣落到每个读者本地的几点,都不一样。

当前计费状态

正在读你的时钟… ¥27.00 每百万输出 tokens(此刻)

DeepSeek 按 UTC 计费,所以打折窗口落在每个人本地的几点都不一样。开启 JavaScript 就能看到你这边此刻是哪一档。

--:--:--

后切换档位

高峰输出
¥27.00/百万
空闲输出
¥13.50/百万

你这边的今天

UTC UTC+00:00
00:0006:0012:0018:0024:00
  • 高峰 09:00 – 12:00 北京时间
  • 高峰 14:00 – 18:00 北京时间
  • 空闲 其余全部时间

每天有 17 小时按半价计费。跟的是 UTC 时钟,不看你本地几点——把批量任务往后挪两小时,常常是最省钱的一招。

官方时间窗

下面这两段是高峰时段,其余时间(一天里的 17 小时)都按空闲价结算。

高峰

  • 09:00 – 12:00 北京时间 (01:00 – 04:00 UTC)
  • 14:00 – 18:00 北京时间 (06:00 – 10:00 UTC)

输出按每百万 tokens ¥27.00 结算。

空闲

其余全部时间 · 每天 17 小时

输出按每百万 tokens ¥13.50 结算。

各城市对照的高峰时段

每段高峰窗口在当地的起止时间。标 +1 或 −1 的表示这段跨过了当地的午夜。有夏令时的城市一年会挪两次一小时,而 UTC 那边的窗口纹丝不动。

DeepSeek 高峰时段换算到各主要城市的当地时间。
城市 高峰 01:00–04:00 UTC 高峰 06:00–10:00 UTC
北京 / 上海 Asia/Shanghai 09:00 – 12:00 14:00 – 18:00
东京 Asia/Tokyo 10:00 – 13:00 15:00 – 19:00
洛杉矶 America/Los_Angeles 18:00 −1 – 21:00 −1 23:00 −1 – 03:00
纽约 America/New_York 21:00 −1 – 00:00 02:00 – 06:00
圣保罗 America/Sao_Paulo 22:00 −1 – 01:00 03:00 – 07:00
伦敦 Europe/London 02:00 – 05:00 07:00 – 11:00
柏林 Europe/Berlin 03:00 – 06:00 08:00 – 12:00
迪拜 Asia/Dubai 05:00 – 08:00 10:00 – 14:00
班加罗尔 Asia/Kolkata 06:30 – 09:30 11:30 – 15:30
悉尼 Australia/Sydney 11:00 – 14:00 16:00 – 20:00

这张表按 北京时间 2026 年 8 月 17 日 00:00 那天算的。上面那块实时面板永远按你浏览器自己的时区和当前夏令时状态走。

怎么把折扣吃满

把批量任务挪走

评测、批量分类、夜间汇总这类活对延迟根本不敏感。把它们排进空闲时段,一行代码不改,账单直接砍半。

定时任务按 UTC 写

按本地时间写的 cron,一到夏令时切换就会飘出折扣窗口。把定时钉在 UTC 上,全年都对得齐。

当心临界点

计费认的是请求到达 DeepSeek 的那一刻。窗口快关的时候起一个长任务,很可能收尾时已经跨到贵的那一边了。

关于空闲时段

高峰时段和空闲时段分别是几点到几点?

官方按北京时间划:09:00–12:00、14:00–18:00 是高峰时段,其余时间都算空闲——一天里有 17 小时走的是半价。

对国内用户来说这个排法不太友好。朝九晚五的八小时里有 6 小时压在高峰上,只有午休前后那段是便宜的;真正连成片的空闲时段要等到下班以后,从 18:00 开始能连着走 15 小时。

同一套时间窗对美洲那边是反过来的——高峰全落在他们的后半夜,整个白天上班时间都在空闲时段里。同样一份活,时差本身就是价格差。

空闲时段能便宜多少?

官方说的是:空闲时段价格是高峰时段的一半,输入输出都一样。DeepSeek V4-Pro 的输出,就是从每百万 ¥27.00 降到 ¥13.50。

要看清这个“一半”是相对谁的一半:它是新价高峰的一半,不是退回旧价格。空闲时段的输出仍然是调价前的 2.3×。

算哪一档看请求到达 DeepSeek 的时间。能等的批量任务是最容易吃满这个折扣的——挪几个小时,不改一行代码。

写入缓存要另外收钱吗?

不收。缓存是自动的,也没有单独的写入费——你要么按命中价结算,要么按未命中价,没有第三项。

这不是细节,是和一部分同行的实质差别。Anthropic 写提示词缓存要额外加钱,得靠后面读回来的次数把这笔钱赚回来才划算。DeepSeek 这边第一次请求就按未命中价走,本来也要付这个钱。

代价是没有任何承诺。官方明说缓存是尽力而为,没人再用的条目几小时到几天就清掉了。

V4-Pro 和 V4-Flash 差在哪?

上下文都是 1M tokens,最大输出长度也一样。差别在价格,还有一次能开多少路:DeepSeek V4-Pro 允许 500 路并发,DeepSeek V4-Flash 是 2,500 路。

DeepSeek V4-Flash 高峰时段输出每百万 ¥9.00,DeepSeek V4-Pro 是 ¥27.00。两个模型同一天切新卡,高峰时段也完全一样。

实际用下来,V4-Flash 真比 V4-Pro 省钱吗?

价目表上输出差 3.0×。账单未必认这个数——单价只是一半的答案,另一半是模型为了把活干完要烧多少 token,而小模型未必烧得更少。有一份公开的实测拿两个模型跑了三个真实编码任务,结论是便宜的那个活干得还更好,但多花的 token 把两边账单拉平了。

还有个因素通常比选模型影响更大:推理强度。本站那份实测里,生成的 token 有 73.6% 是思考 token——响应里看不见,但按输出价全额计费,而输出是整张卡上最贵的一档。

所以既别看折扣标题,也别看跑分表。拿你自己的活在两边各跑一遍,比总 token 数而不是比单价,顺便看看推理强度是不是一直开在最高档。

涨完之后还比 Claude、OpenAI、Gemini 便宜吗?

多数场景还是便宜,但差距比以前小了;再把缓存命中算进去,和各家便宜档位的距离会进一步缩。

到底怎么比,取决于你自己的输入输出配比和命中率——计算器就是干这个的:把你的用量同时套到所有价目表上,而不是对着一个未必符合你情况的标题数字下结论。