ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

英伟达Blackwell GB300再突破:MoE预训练达1648 TFLOPs 性能跃升

时间:2026-07-22 23:10:49来源:快讯编辑:快讯

英伟达在最新发布的博文中宣布,其Blackwell架构的GB300 GPU在混合专家模型(MoE)预训练领域创造了新的世界纪录,单GPU算力达到1648 TFLOPs(每秒万亿次浮点运算)。这一突破标志着英伟达在高效能计算领域再次取得重大进展,为大规模语言模型的训练提供了更强大的硬件支持。

MoE是一种创新的机器学习架构,通过将大型模型拆分为多个小型“专家”子网络,仅在需要时激活部分子网络进行推理或训练。这种设计显著降低了计算成本,同时保持了模型的规模和性能,尤其适用于大语言模型的开发。英伟达此次利用256块GB300 GPU预训练了6710亿参数的DeepSeek-v3模型,展示了其硬件在处理超大规模模型时的卓越效率。

与上一代GB200 GPU每秒606 TFLOPs的性能相比,GB300实现了近3倍的算力提升。这一飞跃得益于英伟达在过去六个月中进行的超过25万种配置模拟和140万小时的优化测试。通过这些努力,团队为Blackwell架构开发了38项关键优化方案,显著提升了系统在复杂任务中的表现。

在性能对比方面,GB300 NVL72系统相较于2025年11月的测试结果(1088 TFLOPs)提升了50%。这一进步不仅减少了完成相同训练任务所需的GPU数量,还降低了整体能耗和成本,为科研机构和企业提供了更具竞争力的解决方案。英伟达表示,将继续推动硬件与算法的协同创新,以满足人工智能领域日益增长的计算需求。

更多热门内容
安谋科技发布“周易”X3-Pro架构 牵头发起AIOS联盟拓展端侧AI生态版图
一位接近安谋科技的市场人士表示,此次发布的核心意图是向外界表明,安谋科技不再只是一家IP授权公司,而是要参与定义端侧AI的计算标准和软件生态。 端侧AI不是云端AI的缩小版,基于这一原则,安谋科技推出周易X…

2026-07-22

OpenAI推出Presence:助力企业高效部署AI智能体,加速转型软件服务赛道
IT之家 7 月 22 日消息,OpenAI 推出了一款全新产品,希望借此进一步摆脱竞争日益激烈的大模型市场,向企业软件领域扩张。OpenAI不再要求企业自行搭建 AI 智能体系统,而是将部署 AI 所需的…

2026-07-22

三菱电机携手索尼半导体,共筑制造业AI视觉传感器合资新篇章
月 22 日消息,三菱电机 (Mitsubishi Electric) 与索尼半导体解决方案 (Sony SemiconductorSolutions) 当地时间今日宣布已就共同设立一家名为 Advance…

2026-07-22

16岁加拿大少年研发仿生海龟机器人 助力环保AI检测微塑料显成效
凭借一套水下三维全息成像相机,以及自己训练的 AI 模型 —— 能够识别水体中的微小塑料颗粒,并将这些设备安装到自主海龟机器人上,巴兹在2026 年 Regeneron 国际科学与工程大奖赛(Regene…

2026-07-22