DeepSeek 空闲时段
请求只要不落在最忙的那几个小时之内,DeepSeek 价格就便宜一半。官方按北京时间划窗口,所以这个折扣落到每个读者本地的几点,都不一样。
当前计费状态
DeepSeek 按 UTC 计费,所以打折窗口落在每个人本地的几点都不一样。开启 JavaScript 就能看到你这边此刻是哪一档。
--:--:--
后切换档位
- 高峰输出
- ¥27.00/百万
- 空闲输出
- ¥13.50/百万
你这边的今天
UTC UTC+00:00- 高峰 09:00 – 12:00 北京时间
- 高峰 14:00 – 18:00 北京时间
- 空闲 其余全部时间
每天有 17 小时按半价计费。跟的是 UTC 时钟,不看你本地几点——把批量任务往后挪两小时,常常是最省钱的一招。
官方时间窗
下面这两段是高峰时段,其余时间(一天里的 17 小时)都按空闲价结算。
高峰
- 09:00 – 12:00 北京时间 (01:00 – 04:00 UTC)
- 14:00 – 18:00 北京时间 (06:00 – 10:00 UTC)
输出按每百万 tokens ¥27.00 结算。
空闲
其余全部时间 · 每天 17 小时
输出按每百万 tokens ¥13.50 结算。
各城市对照的高峰时段
每段高峰窗口在当地的起止时间。标 +1 或 −1 的表示这段跨过了当地的午夜。有夏令时的城市一年会挪两次一小时,而 UTC 那边的窗口纹丝不动。
| 城市 | 高峰 01:00–04:00 UTC | 高峰 06:00–10:00 UTC |
|---|---|---|
| 北京 / 上海 Asia/Shanghai | 09:00 – 12:00 | 14:00 – 18:00 |
| 东京 Asia/Tokyo | 10:00 – 13:00 | 15:00 – 19:00 |
| 洛杉矶 America/Los_Angeles | 18:00 −1 – 21:00 −1 | 23:00 −1 – 03:00 |
| 纽约 America/New_York | 21:00 −1 – 00:00 | 02:00 – 06:00 |
| 圣保罗 America/Sao_Paulo | 22:00 −1 – 01:00 | 03:00 – 07:00 |
| 伦敦 Europe/London | 02:00 – 05:00 | 07:00 – 11:00 |
| 柏林 Europe/Berlin | 03:00 – 06:00 | 08:00 – 12:00 |
| 迪拜 Asia/Dubai | 05:00 – 08:00 | 10:00 – 14:00 |
| 班加罗尔 Asia/Kolkata | 06:30 – 09:30 | 11:30 – 15:30 |
| 悉尼 Australia/Sydney | 11:00 – 14:00 | 16:00 – 20:00 |
这张表按 北京时间 2026 年 8 月 17 日 00:00 那天算的。上面那块实时面板永远按你浏览器自己的时区和当前夏令时状态走。
怎么把折扣吃满
把批量任务挪走
评测、批量分类、夜间汇总这类活对延迟根本不敏感。把它们排进空闲时段,一行代码不改,账单直接砍半。
定时任务按 UTC 写
按本地时间写的 cron,一到夏令时切换就会飘出折扣窗口。把定时钉在 UTC 上,全年都对得齐。
当心临界点
计费认的是请求到达 DeepSeek 的那一刻。窗口快关的时候起一个长任务,很可能收尾时已经跨到贵的那一边了。
关于空闲时段
高峰时段和空闲时段分别是几点到几点?
官方按北京时间划:09:00–12:00、14:00–18:00 是高峰时段,其余时间都算空闲——一天里有 17 小时走的是半价。
对国内用户来说这个排法不太友好。朝九晚五的八小时里有 6 小时压在高峰上,只有午休前后那段是便宜的;真正连成片的空闲时段要等到下班以后,从 18:00 开始能连着走 15 小时。
同一套时间窗对美洲那边是反过来的——高峰全落在他们的后半夜,整个白天上班时间都在空闲时段里。同样一份活,时差本身就是价格差。
空闲时段能便宜多少?
官方说的是:空闲时段价格是高峰时段的一半,输入输出都一样。DeepSeek V4-Pro 的输出,就是从每百万 ¥27.00 降到 ¥13.50。
要看清这个“一半”是相对谁的一半:它是新价高峰的一半,不是退回旧价格。空闲时段的输出仍然是调价前的 2.3×。
算哪一档看请求到达 DeepSeek 的时间。能等的批量任务是最容易吃满这个折扣的——挪几个小时,不改一行代码。
写入缓存要另外收钱吗?
不收。缓存是自动的,也没有单独的写入费——你要么按命中价结算,要么按未命中价,没有第三项。
这不是细节,是和一部分同行的实质差别。Anthropic 写提示词缓存要额外加钱,得靠后面读回来的次数把这笔钱赚回来才划算。DeepSeek 这边第一次请求就按未命中价走,本来也要付这个钱。
代价是没有任何承诺。官方明说缓存是尽力而为,没人再用的条目几小时到几天就清掉了。
V4-Pro 和 V4-Flash 差在哪?
上下文都是 1M tokens,最大输出长度也一样。差别在价格,还有一次能开多少路:DeepSeek V4-Pro 允许 500 路并发,DeepSeek V4-Flash 是 2,500 路。
DeepSeek V4-Flash 高峰时段输出每百万 ¥9.00,DeepSeek V4-Pro 是 ¥27.00。两个模型同一天切新卡,高峰时段也完全一样。
实际用下来,V4-Flash 真比 V4-Pro 省钱吗?
价目表上输出差 3.0×。账单未必认这个数——单价只是一半的答案,另一半是模型为了把活干完要烧多少 token,而小模型未必烧得更少。有一份公开的实测拿两个模型跑了三个真实编码任务,结论是便宜的那个活干得还更好,但多花的 token 把两边账单拉平了。
还有个因素通常比选模型影响更大:推理强度。本站那份实测里,生成的 token 有 73.6% 是思考 token——响应里看不见,但按输出价全额计费,而输出是整张卡上最贵的一档。
所以既别看折扣标题,也别看跑分表。拿你自己的活在两边各跑一遍,比总 token 数而不是比单价,顺便看看推理强度是不是一直开在最高档。
涨完之后还比 Claude、OpenAI、Gemini 便宜吗?
多数场景还是便宜,但差距比以前小了;再把缓存命中算进去,和各家便宜档位的距离会进一步缩。
到底怎么比,取决于你自己的输入输出配比和命中率——计算器就是干这个的:把你的用量同时套到所有价目表上,而不是对着一个未必符合你情况的标题数字下结论。