ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

字节押注超5万亿参数大模型,张一鸣:聚焦智能上限,拒绝短期技术捷径

时间:2026-08-07 15:53:36来源:互联网编辑:快讯

字节跳动正酝酿一场大模型领域的“豪赌”。据内部人士透露,该公司正在讨论训练一个参数规模超过5万亿的超大模型,远超国内同行阿里Qwen 3.8-Max的2.4万亿和月之暗面K3的2.8万亿。若计划落地,这将成为国内参数规模最大的模型。尽管项目仍处于早期阶段,但已引发行业广泛关注。

新模型将由Seed Foundation负责人项亮主导,大语言模型预训练数据负责人沈科配合推进。两人均是字节跳动AI体系的核心成员,出身于“搜广推”技术背景。项亮拥有中科院自动化所博士学历,2016年加入字节后主导过机器学习中台建设;沈科则是2018年清华毕业后入职,现负责LLM预训练数据工作。为支撑项目,Seed团队正在进行组织架构调整,重新划分职责边界。

这场激进扩张的背后,是字节在大模型领域的焦虑与野心。今年2月,Seed 2.0模型发布后市场反响平平,而同期智谱开源的GLM-5被视为国内首个达到Anthropic Opus系列水平的模型;7月月之暗面发布的Kimi K3更是在多项评测中逼近海外闭源旗舰。这种落差促使字节改变策略——与其在现有赛道追赶,不如通过参数规模实现弯道超车。一位接近Seed的人士直言:“这像一场赌博。”

两周前,字节跳动创始人张一鸣罕见现身Seed全员会,为团队注入强心剂。他明确表示可接受模型短期落后,但要求以“智能上限”为目标,力争跻身世界第一梯队。针对技术路线,张一鸣反对通过模型蒸馏复制竞争对手能力,强调要从底层构建AGI壁垒。他特别表扬了视频生成模型Seedance的技术独特性,鼓励团队走出差异化道路。在资源整合上,他要求将火山引擎、飞书和豆包的算力数据向编程方向倾斜,但同时提醒“编程只是热点之一”。

为补足编程短板,字节采取激进措施:张一鸣亲自出面挖角DeepSeek核心研究员郭达雅,将所有Coding相关研发资源划归其管理。阿里千问团队也同步加大投入,形成双雄争霸格局。在数据积累方面,字节推动内部业务线全面采用自研模型开发,试图通过真实场景反馈构建数据壁垒。尽管内部曾激烈讨论蒸馏路线的可行性,但张一鸣在全员会上明确否决,宁可承受短期技术落后也不走捷径。

字节的“大力出奇迹”策略在AI领域延续。公司拥有国内最庞大的算力储备和顶尖人才库,2025年视频生成模型Seedance2.0通过极致预训练实现技术突破,成为全球首个完整采用MoE架构的视频模型。这种成功模式正被复制到语言模型领域——当行业普遍认为DiT架构扩张空间有限时,Seed选择逆势加大投入,试图通过参数规模碾压实现超车。不过,语言模型的工程复杂度远超视频生成,涉及算法创新、数据处理和跨部门协作等多重挑战。

内部变革已在悄然发生。字节高层正推动取消AI领域的赛马机制,集中资源攻关关键方向。Seed团队尝试打破部门壁垒,促进算法、工程和业务人员的深度协作。有离职员工评价:“字节文化不适合从0到1的创新,但擅长在明确方向下集中资源解题。”随着5万亿参数模型的讨论升温,这家以激进著称的公司再次站在技术赌桌前,等待下一个“奇迹”的降临。

更多热门内容