DeepSeek V4搞了个峰谷电价:白天用AI翻倍,晚上用打骨折

算法老KAgent 2026-07-20 16:24:44 2阅读 举报

先说结论:DeepSeek V4今天正式上线了,但重点不是参数,而是它搞了个行业首创的"峰谷计价"。用大白话说就是:工作日白天用AI价格翻倍,晚上和周末便宜到几乎不要钱。这是我见过最"电力公司"的大模型定价策略。

峰谷计价到底怎么算的

简单拆一下。DeepSeek把一天24小时分成了两档:高峰时段是工作日早上9点到12点、下午2点到6点,这7个小时API调用价格翻倍。其他时间——晚上、凌晨、周末、节假日——维持原价。

具体数字:Pro版输出平时6块钱每百万token,高峰12块。Flash轻量版平时2块,高峰4块。更骚的是缓存命中价,只要0.025元每百万token,基本等于不要钱。

作为对比:GPT-5.6 Sol输出约204元每百万token,Claude Opus 4.8约170元。DeepSeek高峰价12块,只有GPT的5.7%。这个价差已经不是"便宜"能形容的了。

为什么搞这个?因为白天算力不够用了

做过大模型API调用的都知道一个痛点:工作日白天所有人都在用,服务器压力爆表,延迟飙升;到了凌晨两点,服务器闲得发慌,算力白白浪费。

DeepSeek这次学的是电力行业的"削峰填谷"逻辑。用价格杠杆把批量任务——数据标注、文档解析、模型微调、离线推理——赶到夜间低谷。白天高峰只保留必须实时响应的交互任务,比如客服Agent、代码Copilot。

说白了:不是想多赚你的钱,是想让你换个时间来用,把算力利用率拉满。

缓存命中才是真省钱大招

很多人只盯着峰谷价格看,其实这轮更新最狠的是缓存命中机制。Pro版缓存命中输入只要0.025元,是未命中价格3元的120分之一。也就是说,只要你的System Prompt和长上下文不变,重复调用的成本可以忽略不计。

实操建议很简单:把固定的System Prompt放进缓存,高频知识库检索命中率能做到99%以上。一个做客服Agent的团队算过账,优化缓存策略后,月度API成本砍了七成。

性能怎么样?我在灰度跑了三天

先说跑分:V4 Pro在SWE-bench上80.6%,只比Claude Opus 4.6的80.8%低0.2个百分点。编码能力追近GPT-5.6 Sol,Agent能力和3D、SVG生成有肉眼可见的提升。

实测体验:用V4 Pro生成一个带UI界面、物理碰撞、计分系统的3D交互游戏,花了大约0.7元。同样的需求扔给Claude,费用至少翻十倍。但要注意,V4在长文本深度检索、高阶逻辑推理上确实还差Opus一截,那种需要反复推敲的重度科研任务,还是得用海外旗舰。

Flash版日常写文案、做数据分析、画简单SVG,跟Pro版差异不大,普通用户感知不出来。建议日常高频调用用Flash,复杂开发切Pro。

这件事意味着什么

峰谷计价这个事本身,比V4的跑分更有行业意义。它标志着大模型API从"统一定价"进入了"精细化运营"阶段。以前所有模型都是不管什么时候用、不管服务器多忙,价格都一样。这导致白天拥堵、夜里空转,算力浪费严重。

用价格杠杆分流,是成熟基础设施的标配,电力、网络、云计算都这么干。大模型现在也开始走这条路,说明行业从"卷参数"转向了"卷效率"。

我判断接下来半年,国内主流大模型厂商大概率会跟进分时计费。到那时候,开发者比拼的不再是选哪个模型,而是怎么调度任务时间、怎么优化缓存策略。这比单纯比跑分有意思多了。

一个字:跑起来,实测才有发言权。

版权声明:
作者:算法老K
链接:https://www.aiddithome.com/p/42614bfefd0db.html
来源:Agent
文章版权归作者所有,未经允许请勿转载,若此文章存在违规行为,您可以点击 “举报”


登录 后发表评论
5条评论
工具猎人
1楼 · 18小时前

用了一个月V4预览版,确实便宜得离谱。我们团队把凌晨批量推理全切过去了,月度账单从八千多降到不到两千。峰谷计价对我们这种做数据处理的简直是福利。

硅谷子
2楼 · 18小时前

峰谷定价这事,本质上说明大模型API正在变成和水电一样的基础设施。能按需定价、按负载定价,是行业成熟的标志,不是涨价。

AI搞钱研究所
3楼 · 18小时前

算了一笔账:同级别性能,DeepSeek V4价格只有GPT的十七分之一。如果你是做AI应用的创业团队,这个成本差直接决定能不能活到下个月。

熵熵
4楼 · 18小时前

白天翻倍晚上打骨折?这跟我们家楼下的菜市场一个套路诶? 不过缓存命中0.025元确实香,四舍五入等于不要钱。

栗子同学
5楼 · 18小时前

作为一个小白,我只知道晚上用DeepSeek写周报便宜一半。打工人狂喜。