北京时间8月3日,海外开发者开源项目团队OpenCode发文称,其平台上DeepSeek V4 Flash的调用量大幅飙升,单日处理达8T(万亿)Token。其中5T为免费试用额度消耗,3T为开发者通过OpenCode平台付费使用。
与此同时,模型API分发平台OpenRouter最新数据显示,上周(7月27日至8月2日)DeepSeek V4 Flash以7.22万亿Token的周调用量位居第一。
OpenRouter与OpenCode同为模型调用平台,但定位不同。前者是全场景通用API聚合网关,模型库较全,面向各类AI应用开发;后者本体是面向程序员的终端AI编程工具,附带的Zen、OpenCode Go网关仅聚焦代码开发场景,基于使用需求精选适配模型,模型池高度精简集中。
两个平台的数据共同说明:DeepSeek V4 Flash正式版上线后,为平台带来了显著的调用量与用户规模提升。OpenCode CEO Jay(贾亚库马尔)8月1日发文称,DeepSeek V4 Flash上线后使用量单日增长了30%,OpenCode Go的新订阅用户也增长了30%。
有趣的是,在评论区,OpenAI核心产品与平台负责人Tibo(蒂博·索蒂奥)打起了OpenAI GPT-5.6产品家族里轻量经济型模型Luna的广告。但开发者并未买账,评论区有开发者直言:“我们希望得到DeepSeek的价格。”
这一幕恰恰折射出近期开闭源模型竞争的激烈程度。7月31日,OpenAI宣布GPT-5.6 Luna降价80%,输出价格从每百万Token 6美元直接砍到1.2美元,输入价格从1美元降至0.2美元。紧接着当日晚些时候,DeepSeek V4 Flash正式版API上线公测。
DeepSeek-V4-Flash正式版采用MoE架构,总参数规模达到284B(激活13B),支持最长100万Token上下文,支持非思考与思考模式切换。其模型结构、尺寸均与预览版保持一致,仅重新进行了后训练。在Artificial Analysis智能指数中,DeepSeek V4 Flash获得50分,仅比GPT-5.6 Luna的51分低1分。
在成本端,即使OpenAI已将GPT-5.6 Luna价格下调80%,DeepSeek V4 Flash在其自有API上的单任务成本仍比前者低约60%。关键原因是DeepSeek提供了约98%的缓存命中(输入内容与服务器上已有的计算记录匹配上,提升计算效率)折扣——即命中缓存的Token仅按标价2%计费,远超业内普遍的90%折扣水平。定价方面,DeepSeek-V4-Flash输入命中缓存仅0.2元/百万Token,未命中输入1元/百万Token,输出2元/百万Token。
相近定位却更具性价比的优势,正是近期海外对开闭源模型争议的核心。分析认为,OpenAI面临多重竞争压力——中国开源模型快速迭代,模型差距不断缩小,这使得美国头部模型也不得不重新思考性价比。
DeepSeek-V4-Flash正式版上线不到一周,便在两大平台交出单日8T、周调用7.22T的成绩单。当OpenAI以更低价格仍无法在成本与用户心智方面取胜时,国产开源模型将传统性价比概念带入新的竞争阶段。