ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

GPT-6 Astra崭露锋芒:攻克5道Erdős数学难题 展现强大AI实力

时间:2026-09-05 13:22:58来源:互联网编辑:快讯

近日,人工智能领域迎来重大突破,OpenAI正式发布了其迄今为止功能最为强大的生成式AI模型——GPT-6 Astra。官方宣称,该模型在全球范围内具备最高的智能水平,同时在对齐效果方面也达到了最优状态,成为AI技术发展历程中的又一里程碑。

GPT-6 Astra的训练工作在美国德克萨斯州的Stargate超级计算基地完成,这一过程动用了超过10万张GPU进行预训练。值得注意的是,这是OpenAI首次大规模采用前代模型参与监督训练的旗舰产品,为模型的性能提升奠定了坚实基础。

在衡量AI模型数学能力的权威测试中,GPT-6 Astra展现出了惊人的实力。Epoch AI与曼彻斯特大学联合发布的FrontierMath Erdős(FME)基准测试论文显示,GPT-6 Astra成为唯一在测试中交出有效答卷的大模型。该测试包含68道人类尚未解决的Erdős数学难题,这些题目以开放性和高难度著称,旨在全面评估AI模型的数学推理能力。

在严苛的测试条件下,GPT-6 Astra一举攻克了5道长期未解的数学猜想,而其他参与测试的主流AI模型,如GPT-5.6、Claude Fable 5.1等,均未能取得任何分数。这一成绩不仅彰显了GPT-6 Astra在数学领域的卓越能力,也为其在AI领域的地位增添了重要砝码。

测试过程中,所有模型均面临相同的挑战:没有标准答案的开放难题、要求输出Lean形式化证明、由内核自动核验对错,以及统一的预算和限时条件。在这样的公平环境下,GPT-6 Astra在标准测试环节成功解决了2道题目,并在放宽算力预算的追加实验中再攻克3道,其中包括Erdős在18岁时提出的解离集猜想,以及极值图论中著名的Erdős-Sós猜想。这些题目数十年来一直困扰着无数顶尖数学家,GPT-6 Astra的突破无疑为数学研究带来了新的希望。

GPT-6 Astra在解题过程中展现出了多样化的能力,既有通过构造反例推翻旧猜想的案例,也有完整证明新命题的成果。这些成就不仅体现了模型在数学推理方面的深度,也展示了其在创新思考方面的潜力。然而,这一过程也消耗了巨大的算力资源。据统计,GPT-6 Astra完成五道题目的尝试合计消耗了超过22万美元的算力,其中标准基准测试本身花费了约2万美元。尽管如此,按照300美元一次、3%的成功率计算,解出一道重要开放问题的期望成本仍约为1万美元,这在一定程度上反映了高阶数学研究的昂贵成本。

尽管GPT-6 Astra在数学测试中取得了显著成绩,但也有论文指出其存在的局限性。例如,模型可能想出正确的解题思路,却无法将其转换为Lean形式证明;基准测试主要考察解题能力,而数学研究同样重视提出新问题的能力。在68道难题中,仍有63道未被解开,这表明即使对于GPT-6 Astra这样的先进模型,全面攻克高阶数学仍是一个遥远的目标。

更多热门内容