字节跳动正酝酿一项重大技术突破——计划研发参数规模突破5万亿的大语言模型。若项目顺利推进,这一模型将超越当前国内已知参数规模最大的阿里通义千问Qwen3.8-Max(2.4万亿参数)和月之暗面Kimi K3(2.8万亿参数),成为国内人工智能领域的新标杆。不过,该计划仍处于早期筹备阶段,最终能否落地尚未明确。
据内部消息,项目将由字节跳动Seed Foundation负责人项亮牵头,联合大语言模型预训练数据负责人沈科共同推进。为支撑这一超大规模模型的研发,Seed团队已启动组织架构调整,包括重新划分研发职责、优化资源分配等措施,以确保训练所需的技术架构和算力支持。
核心团队成员背景深厚:项亮拥有中国科学技术大学本科学位和中国科学院自动化研究所博士学位,2016年加入字节后主导过机器学习中台AML团队建设,并担任豆包大模型Foundation团队负责人;沈科则毕业于清华大学计算机系,2018年入职字节,目前专注大语言模型预训练数据体系搭建。两人均出身于字节核心的“搜索-广告-推荐”技术体系,在算法优化和数据处理领域经验丰富。
当前,全球人工智能竞争已进入白热化阶段。国内外头部企业纷纷通过扩大模型参数规模、争夺优质训练数据、升级算力基础设施等方式构建技术壁垒。字节此次布局标志着国内大模型竞争从应用层创新向底层能力建设的深度延伸,超大规模模型研发正成为探索通用人工智能(AGI)的关键路径。

