深析DeepSeek新规:调休日全按低谷价,9月到10月初API超长优惠
根据DeepSeek此前公布的峰谷定价机制,工作日高峰时段(9:00-12:00、14:00-18:00)价格为低谷时段的两倍,而周末全天统一按低谷价计费。此次补充说明进一步堵上了调休日算工作日还是周末的模糊地带,明确只要是周末,就按空闲价执行。
在调休上班的那一天, API的价格竟然算是处于低价阶段了, 而在此后的接下来的十天时间里, 基本上全都是呈现出对折那种价格的形态。
调休周末算低价了
在9月19日的时候, 官方发布了一份关于峰谷时间点的补充说明, 这里面的核心意思只有一句, 就是说只要碰到了周末的情况, 那无论这天是不是因为调休需要正常上班, 所有的时间段全部都要按照空闲时段的费率来执行, 那么针对9月20日和10月10日这几天来说, 开发者是不需要多支付任何费用的。
之前有一个界限不太清楚的问题, 关于调休日是按照正常工作日来计算, 还是按照休息日来进行计算, 一直都缺乏权威的明确说法。
本次规则已经得到了严格的锁定与确定, 明确休假日等同于周末期间进行认定, 彻底消除了所谓的“尽管需要上班出勤, 但是在价格结算时却被视为非旺季”的那种存在争议性的操作空间, 通过减少相互间的推诿扯皮现象, 最终实现了节省开支的目的。
十月前有个超长优惠窗口
把日历调出来算一遍账, 从9月20日起至10月10日为止。因为包含中秋节假期的三日、国庆节假期的七日、还有两个补班的周末。所以加起来超过十天全是空闲时价。平时工作日高峰期的价格翻了一倍。这十天的密集度是全年最集中的一个。
对于那些对日调用量非常大的中小企业以及小型团队而言, 这十天的时间间隔, 在实质上就等同于额外赋予了他们将近一半的预算额度。
他们现在完全可以在这个窗口期内开展运行测试、执行批量任务处理以及进行数据清洗等一系列工作操作, 如果选择不在此时立即启动这些工作流程去落实, 那么就必须耐心等待到十月十一号这一天当相关服务价格重新恢复原有的水平之后方可再行安排和进行处理。

V4模型把性价比又拉了一截
在9月10号这一天, 发布了V4这一版本。该版本采用了552B参数的MoE架构。其设计呈现出非对称的特点。在进行输入的环节时, 只激活了8B的参数。在进行输出的环节时, 激活了16B的参数。
经过了多项基准测试的验证。结果显示, 其表现反超了自家原本的旗舰V4Pro。与此同时, 其定价却被挂在了名为Flash的档位上。这相当于用户可以用低价的方式, 就买到了原本属于旗舰级别的能力。
在空闲时段的情况下, 缓存的命中输入部分, 其费用仅需0.02元来对应每一百万Token, 而输出的部分则为4元来对应每一百万Token。如果把这种价格水平放到去年来看的话, 它基本上就是处于在涨价发生之前的那种状态。
有相关的开发者直接在微信群里直接发表了言论, 他认为这种感觉好像直接回到了涨价之前的那个阶段之中, 这一说法从目前的角度来看, 是丝毫不显得夸张的。
高峰和低谷差价到底多大
峰谷收费的机制原本就不是什么新颖的事物, 在工作日的上午九点至十二点这个时间段里, 以及在下午十四点至十八点这个时间段里, 价格都是会直接翻倍的, 而到了周末的全天都会实行统一的标准低谷价, 这次所发布的补充说明其实是为了把“如果因为调休而导致的放假安排究竟应当归属于工作日还是周末”这一情况给彻底地交代清楚, 其核心意思就是只要是在周末, 就完全按照周末的规则来执行和处理。
我们来算一笔账, 如果一天能够调用500万个Token的话, 在高峰时段所花费的费用是20块钱, 而在低谷时段只需要花费10块钱,那么十天下来, 差价就能差出一千多块。对于那些日调用量达到上千万的团队来说, 这个差价的数额更是不用多说了, 甚至能够节省出一轮的开发人力成本。
谁最该抓住这十天
第一类人, 是那些在跑批量推理方面的, 算是中小型的开发者群体, 这类人群平时的花销预算总是挺紧张的, 所以就趁着价格低的时候, 赶紧把积攒没干完的任务全清掉。
第二类人, 是做大模型应用这一块的产品团队, 他们趁着V4的性能特别强, 而且价格还不贵, 就把线上的服务都切换过去, 以此来压低成本, 这么一比,确实比去用那个旗舰级别的模型要划算得多。
第三类人群是做数据标注以及批量内容生成业务的团队。因为国庆期间用户侧的流量本来就低, 所以正好可以利用这段时间来做数据扩充和模型微调的工作。可是一但过了十月十一号这一天以后, 价格就又回到正常的节奏了, 如果在这个时候再进行这批任务的话, 成本就会变得比较昂贵。
别光看价格还得看缓存命中
0.02元每百万Token的输入价格有一个前提条件, 那就是缓存命中。如果用户的prompt每次都发生改变, 会导致缓存命中率难以提升。在这种情况下, 实际使用成本会逐渐逼近正常的输入价格水平。因此在进行批量任务运行之前, 务必先将prompt的复用率做好优化处理。
还有一点需要特别留意, 就是V4模型采用的是非对称架构, 这种架构使得输出的每一个token的成本, 要比输入的每一个token的成本高出整整一倍。所以, 如果你的应用场景是像生成整篇文章这样需要产生超长输出内容的任务, 那么最终产生的实际费用, 会比起只用输入的费用的整体要高出来许多。
因此在进行成本核算、计算经济账务的时候, 切不可以仅仅去关注单纯的输入部分的价位, 而是应当必须要把那部分输出的成本也一并纳入到计算的范围之内去充分考虑。
你在这十天之内, 究竟是打算去运行哪一些特定的任务呢? 请你走到评论区的界面里面来, 和大家聊一聊你所准备做的事情同时, 请你顺手点击一下收藏按钮就好以此, 在十月之前的这一个时间点上来提醒自己, 并且要重新回来进行使用这一功能。