海外模型调用市场近期因两款大模型的竞争引发关注。开源模型DeepSeek V4 Flash与闭源模型OpenAI GPT-5.6 Luna的角力,正通过两大平台的数据对比显现出行业格局变化。模型API分发平台OpenRouter公布的周度数据显示,7月27日至8月2日期间,DeepSeek V4 Flash以7.22万亿Token的调用量登顶榜首,而同期OpenCode平台单日处理量更突破8万亿Token,其中免费试用与付费使用量分别达5万亿和3万亿。
两大平台定位差异显著却形成互补。OpenRouter作为全场景通用API聚合平台,模型库覆盖多领域应用开发需求;而以程序员群体为核心的OpenCode,其终端工具附带的Zen、OpenCode Go网关专注代码开发场景,模型池经过针对性筛选。这种差异化定位下,DeepSeek V4 Flash在两个平台均取得突破性表现,印证了其技术适配性与市场接受度。OpenCode首席执行官贾亚库马尔披露,该模型上线后平台单日使用量增长30%,付费订阅用户同步提升三成。
价格战成为这场竞争的显性特征。OpenAI在7月31日宣布将GPT-5.6 Luna的输出价格从每百万Token6美元直降至1.2美元,输入价格从1美元压至0.2美元,降幅达80%。然而DeepSeek通过技术创新构建了新的成本优势:其自有API采用98%的缓存命中折扣机制,命中缓存的Token仅按标价2%计费,输入命中缓存价格低至0.2元/百万Token,未命中输入1元/百万Token,输出2元/百万Token。即便面对降价后的Luna,DeepSeek单任务成本仍低约60%。
技术参数对比显示两者性能接近。DeepSeek V4 Flash采用混合专家(MoE)架构,总参数规模2840亿(激活130亿),支持百万Token级上下文窗口与非思考/思考模式切换。该模型在Artificial Analysis智能指数中获得50分,与GPT-5.6 Luna的51分仅差1分。值得注意的是,DeepSeek V4 Flash正式版与预览版保持相同模型结构,仅通过后训练优化性能,这种迭代策略使其能快速响应市场需求。
开发者社区的反馈折射出市场选择倾向。当OpenAI核心产品负责人蒂博·索蒂奥在评论区推广Luna时,开发者群体直接表达对DeepSeek定价模式的期待。这种态度转变与国产开源模型的快速迭代密切相关——中国团队在模型效率提升与成本控制方面的突破,正在迫使美国头部企业重新审视技术商业化路径。数据显示,DeepSeek V4 Flash正式版上线首周即创造行业纪录,这种市场表现预示着开源生态与闭源体系的竞争将进入新的维度。