
【TechWeb】8月4日消息,7月31日,DeepSeek正式开放V4-Flash正式版API公测。短短一周之内,这款国产大模型便在全球AI开发者市场掀起了一场风暴。
更令人瞩目的是,OpenCode平台的数据显示,仅8月1日一天,DeepSeek V4 Flash在其平台上的Token处理量就达到了8万亿,其中5万亿为免费试用额度,3万亿为付费调用。
综合测算,上周全球AI大模型总调用量为56.8万亿Token,中国AI大模型周调用量达28.13万亿Token,已连续十四周超过美国,稳居全球首位。在全球十大热门模型榜单中,中国模型占据了九个席位。
DeepSeek-V4-Flash正式版与预览版模型结构、参数规模完全一致,采用MoE架构,总参数量2840亿,实际激活参数约130亿,支持100万Token上下文窗口。底层基座未做改动,仅完成新一轮后训练优化。
DeepSeek V4-Flash正式版上线后,海外开发者社区的反应堪称热烈。X平台上,有开发者直言“马斯克需要亲自试试V4 Flash。它就像魔法一样”。随后,网友发现埃隆·马斯克真的关注了DeepSeek官方账号。这一细节迅速引爆海外社区讨论,有人调侃“下一代编程模型可能会基于DeepSeek构建”,更有网友直接调侃Grok:“你的爹要给你买个小弟弟吗?”
玩笑背后是真实的市场转向。据报道,DeepSeek的访问流量中,美国、欧洲开发者占比接近半数,大量Agent自动化项目、代码辅助工具、长文本处理应用主动将默认模型切换至DeepSeek。多名海外AI初创创始人在X平台公开复盘,团队全线迁移至DeepSeek之后,月度推理成本下降60%至85%。对于尚未盈利、现金流紧绷的小微AI公司,这样的成本差异足以决定项目能否继续。
行业分析认为,DeepSeek在全球开发者市场划出的是一条清晰的“斩杀线”,不是单纯的性能分水岭,而是性能与价格的平衡临界值:同一能力梯队中,定价显著高于DeepSeek的模型将持续流失中小开发者;性能弱于DeepSeek、成本却更高的产品,生存空间将快速萎缩。很长一段时间,全球大模型市场规则由硅谷巨头书写,OpenAI、Anthropic、谷歌划定性能标尺并牢牢掌控定价话语权。如今,这条“斩杀线”正由中国AI划定。
与此同时,海外闭源头部模型的市场份额持续收缩,Claude主流版本、Gemini旗舰模型调用增速持续放缓。OpenAI也感受到了压力,GPT-5.6 Luna上线不到三周便宣布价格下调80%。有分析指出,中国开源模型快速迭代,模型差距不断缩小,价格差距却逐渐拉大,美国头部模型也不得不重新思考性价比。
从7月31日API公测到8月3日登顶全球调用量榜首,DeepSeek-V4-Flash仅用了不到一周时间。这款不堆参数、不靠发布会PPT的“小杯”模型,正在用实打实的调用量改写全球AI市场的竞争规则。
每日头条、业界资讯、热点资讯、八卦爆料,全天跟踪微博播报。各种爆料、内幕、花边、资讯一网打尽。百万互联网粉丝互动参与,TechWeb官方微博期待您的关注。