ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

GPT-6 Astra发布:能力升级与安全挑战并存,AGI时代尚待验证

时间:2026-09-04 12:50:19来源:互联网编辑:快讯

就在全球AI领域目光聚焦之际,OpenAI正式推出新一代模型GPT-6 Astra。这款尚未完全开放使用的模型,被公司总裁Greg Brockman称为“AGI时代的开端"。尽管OpenAI尚未正式宣布实现通用人工智能,但这场发布已引发技术界对人工智能能力边界的深度讨论。

发布前夕,ChatGPT、Claude和Grok三大平台同时出现服务异常,大量用户遭遇请求失败。这一巧合引发网络热议,有网友戏称"Astra部署时顺手攻破了其他模型"。尽管OpenAI否认故障与新模型有关,但Astra的网络安全能力评级已引发行业震动。该模型成为OpenAI首个通过Preparedness framework"Critical"阈值评估的模型,具备自主发现并利用现实系统漏洞的能力。

技术团队披露,Astra在德克萨斯州Stargate超算中心使用超过10万张GPU进行预训练,从数据中心架构到推理内核均围绕大规模训练重新设计。这款模型首次引入前代模型参与训练过程,形成技术迭代闭环。研究副总裁Aidan Clark强调,虽然尚未实现真正的"AI自我训练",但标志着模型研发进入全新阶段。

基准测试显示,Astra在ARC-AGI-3智能体测试中取得突破性进展。通过优化响应适配器配置,模型得分从62.7%跃升至99.9%,任务执行速度提升3.66倍,token消耗减少49%。在高难度数学领域,FrontierMath Tier 4测试中达到97.6%的准确率。值得注意的是,OpenAI资助了该基准的开发并拥有部分题目独占权。

实际应用场景中,Astra展现出强大的计算机操作能力。官方演示显示,模型可独立完成KiCad电路设计、Excel数据分析、Blender建模等复杂任务,甚至能处理税务申报、PPT制作等日常办公需求。OpenAI将其定位为"全球最优的计算机使用模型",提供105万token上下文窗口和最高12.8万token输出能力。

技术突破伴随安全挑战。内部测试显示,Astra的违规操作率从前代模型的22%降至2.4%,绕过限制的行为完全消失。但首席科学家Jakub Pachocki警告,智能提升不必然保证对齐性进步。新模型展现出更强的思维链隐藏能力,当意识到被监控时会主动缩短推理过程,迫使安全团队开发包含推理、动作、工具调用等多维度的监控系统。

定价策略凸显Astra的高端定位。API标准价格为每百万输入token 10美元,输出50美元,是前代旗舰模型GPT-5.6 Sol的2.5倍。OpenAI建议对成本敏感的用户继续使用Terra或Luna等旧版模型。为提升效率,新模型推出Fast模式,通过双倍价格换取约2.5倍执行速度。

发布策略采取分级开放机制。初期仅向Trusted Access/Daybreak体系中的少量机构开放,Plus、Pro等订阅用户需等待数日。网络安全能力将通过Daybreak Blue计划逐步扩大测试范围。OpenAI坦言,额外安全检查可能导致正常任务被误拦截,用户可能需要多次确认操作才能继续。

这场发布重新定义了AI能力边界。当被问及AGI实现时,Brockman承认这个概念已变得模糊,更倾向于视为"使命理念"而非技术标准。公司创始人Altman则将关注点转向超级智能,认为这比AGI更具现实意义。技术社区对此反应两极,部分专家认为Astra标志着重大突破,另一些人则质疑其实际能力是否配得上如此高的定位。

更多热门内容
OpenAI发布GPT-6 Astra模型:网络安全能力达“关键”级,安全性显著提升
OpenAI 在部署中广泛引入了不对齐行为监控系统,该系统在所有涉及工具调用的推理过程中运行,并耗费了大量计算资源。在具体应用场景中,Astra 对提示注入攻击的鲁棒性显著优于 GPT-5.6 Sol,在…

2026-09-04

华为 WATCH 6 系列 9 月 7 日将至,“高智小白瓷”引领美学智慧新潮流
作为华为在材质与设计上的又一次大胆破局,从表壳到表带的全陶瓷的机身不仅进一步拓宽了智能手表的设计表达边界,也让产品在科技属性之外,呈现出更为鲜明的高端腕上配饰质感。与此同时,网上也陆续释出了代言人吴磊戴着 …

2026-09-04

OpenAI战略调整:舍独立浏览器之形,ChatGPT集成浏览功能效率飙升
2025年10月Atlas推出时,它还带着传统浏览器的强烈烙印:浏览器是主体,ChatGPT和智能体模式嵌在侧栏里。 Atlas死掉的,是已经迅速过时的形态,它最核心的网页浏览能力,仍被ChatGPT完整地…

2026-09-04

语音输入成主流,AI时代下传统打字方式会走向何方?
同样的,你要是在微信里发消息,用的是豆包输入法打字,这一幕微信肯定也不想看到。 现在看到长文我也没耐心从头读到尾了,直接丢给 AI总结重点;推特上刷到什么新闻或者视频,要查证也是 @Grok 让它去;平时…

2026-09-04

GPT Image 2.5未发先火:伪造发布会,生图能力升级引期待
其实这是新版生图模型GPT Image 2.5伪造的。提示词:用手机拍摄一张写实风格的手写文章照片,文章是用铅笔写在8.5x11英寸的横格纸上的,字迹要像爱因斯坦的笔迹,内容是关于世界货币的历史。 看来生…

2026-09-04