
基础技术研究有限公司(DeepSeek)发布通知,“计划近期整体上调DeepSeek API服务的定价,预计涨幅较大,请合理安排您的使用。具体方案以正式通知为准。”这并非DeepSeek史上首次提价,但却是首次预告提价。记者采访多位业内人士了解到,本次预告提价可能与DeepSeek算力紧张、资本开支加大有关,也可能与近期热传的“DeepSeek斩杀线”有关,通过提价来缓解生态压力,拓宽行业发展空间。
DeepSeek一直以平价著称,其单位定价和任务开支均有显著优势。此前,DeepSeek在和投资人沟通时提及,API的定价逻辑是“十个月收回设备的成本”;由于定价足够低,“在这个价格区间,用户的需求是没有弹性的”,即使价格再抬高一倍或者再降价,词元的消耗量区别都不大。
“本次涨价的主要原因就是算力不足”,市场研究机构AI超维度分析师告诉记者,因为DeepSeek需要把算力腾出来做新实验。
此前,DeepSeek就对投资人表示,由于算力紧缺,虽然也能训练大模型,但是“在训练之前,没法做充分的研究。”
充分的研究可以在同等算力下加大释放大模型的能力。7月31日,DeepSeek发布经过重新后训练的DeepSeek-V4-Flash-0731(简称V4-Flash-0731),在参数、架构不变的情况下,效能提升明显。
AI超维度分析师说,过去两年,大模型训练正在从单一的预训练过程转向多阶段流程,包括基础预训练、中训练和后训练。中训练通常用于加入更高质量的代码、数学、长上下文和智能体数据,数据规模有时可达到万亿词元,因此仍会消耗大量算力。后训练的数据量通常小于全量预训练,但技术和系统复杂度更高。特别是在智能体和推理模型中,大量算力会用于生成轨迹、环境交互、强化学习和反复评测,其算力需求也在快速上升。
大模型评测机构SuperClUE显示,在智能体终端编程中文测评中,V4-Flash-0731以0.64元/题的代价取得46.46分,展现出突出的成本效率,虽然得分排名第三,但单位成本只有前两名的1/30和1/36。该评测的每道题目均需大模型经历50到110轮的多轮对话交互,完整运行时长约为半小时至一个半小时,在此过程中逐步完成编程任务的分析、修改与验证。
对此,SuperClUE创始人徐亮表示,DeepSeek系列虽然终端编码能力有一些差距但性价比突出,若大规模批量测评,该轻量化模型可大幅压缩算力开支,高精度专项抽检才适合选用其他高价长文本旗舰模型。
由于V4-Flash-0731表现亮眼,其全球调用量快速增长。AI平台OpenRouter数据显示,从7月31日至8月5日,V4-Flash-0731的日调用量从1170亿词元猛增至近1.26万亿词元,推动同期DeepSeek的词元日调用量从1.64万亿增至2.59万亿,增幅达57%。
因为V4-Flash-0731此前价格不变、性能暴涨,市场上再提“DeepSeek斩杀线”。
AI评测机构ArtificialAnalysis研究发现,对比128款主流模型,V4-Flash-0731的智能指数50分,单次任务成本约3美分。以此为参照,很多价格更贵的大模型表现反而更差,因此V4-Flash-0731便成新一代“斩杀线%的大模型产品都落在了这条“斩杀线”以下,有被快速替代的风险。
一位业内人士告诉记者,虽然大模型竞争的终局不会有很多厂商,但目前还在早期发展阶段,大量资本正涌入这个赛道,过高“斩杀线”可能会带来一些系统性风险。因此 DeepSeek 本次发布涨价预告,除对冲自身算力成本压力外,更核心的价值在于拓宽全行业市场容量与容错缓冲空间。