ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

90万亿Token才花了92万美元 DeepSeek V4 Flash火到掉线

时间:2026-08-04 21:22:55来源:快科技编辑:快讯

8月4日消息,DeepSeek V4 Flash不是当前最强的大模型,但绝对是国内外最火的,0731正式版升级之后性能更是猛增,这几天用量已经爆了,甚至开始出现服务掉线。

OpenCode日前宣称,DeepSeek V4 Flash在8月1日那一天就曝出了8万亿Token的用量,但这可不是他们的全部,实际上4月份预览版发布之后,DeepSeek V4 Flash就一直是他们用量较大的主力模型之一。

仅仅是6月10日到现在的8月4日,DeepSeek V4 Flash在OpenCode上的总用量就达到了90万亿Token,但这么恐怖的用量并没有花多少成本,因为它实在太便宜了,成本才92万美元,1亿Token综合下来只要1.02美元。

在API收费上,OpenAI及Anthropic的标准都是DeepSeek V4 Flash的几十倍,Fable 5这种级别的大模型费用甚至要100倍以上,OpenCode上的用户要是用这两家的大模型搞开发,那成本涨个30-50倍是正常的。

DeepSeek V4 Flash最近几天实在是太火了,用量大到官方服务器已经撑不住了,这两天有网友就发现会出现503报错了,提示服务器过于繁忙。

这个时候DeepSeek官方也没办法了,甚至建议用户去使用别家的大模型,切换到其他大模型服务商。

只不过用户恐怕是愿意切换的,因为其他家大模型价格贵不少不说,性能打得过0731正式版的也没几个。

就算是其他服务商也部署了DeepSeek V4 Flash 0731正式版,但API收费也做不到DeepSeek这么便宜,国内的其他几家大模型平台缓存命中费用是官方定价的10倍,而V4 Flash的缓存命中率超高,经常在90%以上,意味着换了平台成本也会大增。

联想到此前爆出的梁文锋投资会议上的演讲中提到的一件事,他表示团队并没有在C端花太多力气去获客或刻意维护,但用户却“赶都赶不走”,表现出极强的认可度与留存率——现在能理解了吧,DeepSeek在低成本上是有技术的,其他家不一定能做到。

更多热门内容
谷歌押注机器人大脑赛道,蚂蚁灵波“具身原生”已落地药房抢先机
我认为,蚂蚁灵波最前置的一步就在这里:它把跨本体、空间理解和动作反馈放进了同一套机器人大脑中。 在整套具身原生路线中,空间智能只是一块拼图,但它很能说明蚂蚁灵波的思路:从物理世界里最具体的问题入手,把那些不…

2026-08-04

Qwen3.8-Max发布,国产模型混战下阿里如何突围生态与成本双关?
两款模型的参照意义不同:Kimi K3是同期发布的同级旗舰,用来回答“千问掉队了吗”;DeepSeekV4的Pro版尚未发布,目前只有轻量化的V4 Flash有公开成绩,它要回答的是,Qwen3.8-Max…

2026-08-04

Anthropic与谷歌云达成2000亿美元长期合作,为AI大模型发展筑牢算力根基
【2026年8月4日 科技快报】AI企业Anthropic官方官宣,与Google Cloud达成史上规模顶尖的长期算力战略合作协议,未来五年将投入2000亿美元采购谷歌云算力资源,全面保障Claude系列大…

2026-08-04

小红书或投150亿在内蒙古建数据中心 布局AI算力应对业务增长需求
总部位于上海的小红书,据传正在考虑投资约150亿元,在内蒙古建设一座大型数据中心,以满足人工智能业务增长带来的算力需求。 此外,小红书还在与国内数据中心运营商世纪互联洽谈合作,目标是在2027年第一季度交付。…

2026-08-04