ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

字节跳动发力AI领域:训练10万亿参数超大模型,欲超越美国顶尖水平

时间:2026-08-07 14:16:38来源:互联网编辑:快讯

据英国《金融时报》消息,字节跳动正秘密推进一项规模庞大的AI模型训练计划,其参数量级可能直逼美国顶尖实验室Anthropic的旗舰产品Mythos系统。这一动向被视为中国科技企业在人工智能领域加速追赶全球领先者的关键信号。

三位不愿具名的知情人士透露,字节跳动正在开发的超大型模型参数量最高可达10万亿级别,目前尚处于早期训练阶段。若按当前规划推进,该模型规模将超过国内已发布的最大模型——月之暗面Kimi K3的三倍以上。此前《晚点 LatePost》也曾报道字节跳动讨论过超5万亿参数的模型开发计划,但此次披露的规模上限远超预期。

训练进程显示,该模型目前处于预训练阶段,通常需要3-6个月完成基础能力构建。知情人士强调,最终参数规模可能根据训练效果动态调整,需待项目后期才能确定。这种"边训练边优化"的模式在超大规模模型开发中较为常见,旨在平衡计算资源消耗与模型性能。

对比国际竞争格局,Anthropic虽未公开Mythos系统具体参数,但行业估算其最新版本Mythos 5约含8万亿参数,另一型号Fable 5则约5万亿参数。值得注意的是,参数规模并非决定模型能力的唯一因素,数据质量、训练架构等要素同样关键。字节跳动此次选择直接冲击10万亿参数量级,被解读为试图在基础能力层面建立代际优势。

国内大模型竞争格局正发生微妙变化。阿里Qwen 3.8-Max以2.4万亿参数领跑,月之暗面K3以2.8万亿参数紧随其后。字节跳动若成功推出超5万亿参数模型,将重新定义国内技术天花板。但多位专家提醒,超大规模模型面临算力消耗、能源效率、商业落地等多重挑战,最终能否形成实际竞争力仍有待观察。

行业观察人士指出,字节跳动此次高调布局AI底层技术,反映出中国科技企业战略重心的转变。从应用层创新转向基础模型研发,这种转变既源于国际竞争压力,也体现了对AI技术长期价值的判断。随着训练进程推进,全球AI领域的军备竞赛可能进入新的量级阶段。

更多热门内容
效力谷歌27年首席科学家迪恩携手团队创立新企,借AI推动科学发现提速
IT之家 8 月 7 日消息,科技媒体 TechCrunch 昨日(8 月 6 日)发布博文,报道称在本轮谷歌母公司 Alphabet 旗下AI 公司 DeepMind 重组中,谷歌首席科学家杰夫 · 迪恩…

2026-08-07

马斯克预言AI将取代源代码引热议:行业大佬激辩未来编程新形态
就在刚刚,马斯克在 X 上甩出一条暴论:代码正在变成下一个汇编,下一步是彻底摒弃它,让 AI 直接生成二进制! 而这正是 Douma 那个「半个世纪前的类比」最薄弱的地方:一个是翻译官,忠实、准确、零发挥;…

2026-08-07

字节押注超5万亿参数大模型:张一鸣力挺创新,拒绝蒸馏与短期热点裹挟
过去半年,Seed的多模态模型取得了显著成绩:今年 2 月上线的视频生成模型 Seedance2.0和图片生成模型Seedream 5.0Lite声量一度超过业内其他同类模型,迅速引发关注。据The in…

2026-08-07

AI存储新变革:从“堆算力”到“协同数据路径”的存储范式升级
更值得AI SSD产业关注的是,Mooncake当前官方文档已经把DRAM与SSD/NVMe明确纳入多级缓存,并给出从内存向本地SSD卸载的路径,即将从内存淘汰的对象可在后台进入SSD,内存未命中时再从SS…

2026-08-07