ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

中外AI对决 国产三强只能争夺全球第五

时间:2026-05-28 12:49:06来源:快科技编辑:快讯

5月28日消息,SuperCLUE最新中文大模型测评结果出炉,全球第一梯队被海外模型牢牢占据,国产表现最好的三款模型,只能在全球第五名的位置上激烈竞争。

本次测评覆盖21款国内外主流模型,测评集包括六大任务:数学推理、科学推理、代码生成、智能体(任务规划)、精确指令遵循、幻觉控制,共492题。

Gemini、GPT-5.5、Claude-Opus、Gemini-Flash四款海外模型稳居前四,形成难以撼动的第一梯队。

DeepSeek-V4-Pro、Qwen3.7-Max、豆包Seed 2.0 Pro三款国产模型分数非常接近,组成国内第一梯队,全球排名集中在第五位附近,成为国产第一集团。

虽然整体仍有差距,但国产模型进步很明显。代码生成项目中,Qwen3.7-Max得分仅次于海外头部模型,差距不到2分。数学推理、科学推理等项目,国产模型也多次冲进全球前列。

性价比方面,国产模型优势突出,多款产品进入高性价比区间,用更低成本实现接近头部的效果。推理效能上,海外模型仍垄断高效能区,国产模型多处在中低区间,还有提升空间。

整体来看,国产大模型正在快速追赶,但全球第一梯队的格局暂时没变。

更多热门内容
清华等多校联手:打破AI“自我确认陷阱”,让智能体真正学会“吃一堑长一智”
提炼经验的AI没有参与任务执行,它不会因为某条行动记录是自己产生的而对它有偏袒,也不会因为自己在某个地方失败了就不愿意承认那是错误。研究团队在论文中坦诚指出了几个值得关注的潜在问题:如果多个不同的AI恰好都存…

2026-06-28

2026企业级智能体开发平台怎么选?四大主流平台深度对比助决策
依据这一评价模型,本文选取市面上4款具备代表性的企业级智能体开发框架,围绕“产品定位-核心优势-适配场景-技术特征”的规范化范式进行深度剖析,以保证对比视角的同一性与逻辑对等。只有将底层算力、模型能力与具体…

2026-06-28

吉翼智能8个月完成技术攻坚:具身机器人进厂,开启智能质检新篇章
发布会首次亮出吉翼双机器人矩阵与自研Z—1具身大模型——后者在Robocasa开源评测中以80.0%的平均得分位列榜首。 从全球汽车零部件供应链的深度参与者,到具身智能赛道的实战派,吉翼智能正以“真实产品、真…

2026-06-28

览邦Watch Ultra深度评测:多场景适配的智能手表新标杆
在智能穿戴设备市场蓬勃发展的当下,智能手表已不再仅仅是看时间的工具,它承载着独立通信、健康监测、娱乐等诸多功能。 综上所述,览邦Watch Ultra在外观设计、核心功能、性能配置、续航能力等方面都有着出色的…

2026-06-28