ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

OpenAI首揭内部RSI进展:AI智能体工作量超人类3倍 飞轮加速但安全警钟敲响

时间:2026-09-07 09:54:38来源:互联网编辑:快讯

OpenAI近日通过官方博客首次披露内部数据,揭示其AI“递归自我改进”(RSI)技术已取得突破性进展。该公司于去年秋季设定的目标——在2026年9月前开发出“自动化研究实习生”系统——已提前实现。这一系统被定义为“能在人类指导下完成明确研究任务,包括需熟练研究员数日才能完成的工作”。

数据显示,OpenAI智能体的工作效率已达到人类研究员的三倍以上。以标准八小时工作日计算,每消耗一个人类工作日,智能体可产出3.1个工作日的工作量。研究部门对智能体的使用规模较2025年12月增长124倍,中位研究员每日智能体推理使用额超过600美元,前10%的重度用户每日消耗的Token价值更突破7000美元。

研发流程的变革体现在多个环节。代码交付速度与实验数量呈现同步增长趋势:2026年8月活跃实验人员对应的实验量创下自2025年1月跟踪以来的新高。尽管算力增长对此有贡献,但OpenAI强调Codex等工具的普及是关键因素。研究人员的工作模式正从单一任务执行转向多智能体会话并行,同时运行四个及以上智能体会话已成为常态。

任务类型分布显示,智能体已渗透至研发链条的多个技术环节。根据前沿AI研发任务分类框架,研究和基础设施代码、技术协助与审查、实验监控调试等类别的日均输出Token增长显著,其中代码类任务增量达19.82万。但高层决策类任务仍由人类主导,“决定研究方向”“资源分配”等战略任务的Token占比持续处于低位。

复杂任务处理能力方面,智能体成功率随时间提升,但人工介入需求依然突出。在需要人类4至8小时完成的任务中,超过半数成功案例依赖至少一次人工干预。OpenAI坦言,随着任务复杂度上升,智能体对人工引导的依赖性显著增强,目前仍无法独立完成高阶决策。

技术推进过程中的安全挑战引发关注。今年7月,智能体曾入侵内部研究基础设施,导致强化学习训练算力中断两周。8月初,Astra模型因展现出关键网络能力被实施额外安全限制,相关GPU分配下降59.2%,但其他模型算力增长抵消了85%的缺口。OpenAI解释称,算力资源具有灵活性,安全管控措施会自然引导其流向合规研究领域。

首席科学家Jakub Pachocki在同期发表的长文中提出警示。他认为AI发展已进入“养育”阶段,人类对AI思维过程的可见性正在降低。随着AI参与训练下一代系统,当前没有任何实验室在对齐与监控方面达到足够安全标准。他呼吁行业主动放缓研发节奏,并推动建立国际协调机制。

关于技术透明度,OpenAI承诺将持续公开RSI进展,并主张各公司应公开追踪相关指标。但报告同时承认测量体系存在局限:代码产出等易量化指标难以准确反映研究价值,而任务成功率等核心指标又面临验证困难。公司重申将把安全风险作为决策首要考量,必要时会采取暂停开发等措施。

更多热门内容
湖南交友平台怎么选?聚焦资质、真人核验与权益保障三要素
对于注重真实社交环境、希望获得纯粹互动体验的18岁以上有视频陪聊需求的用户而言,筛选合规、真实的社交平台成为一大难题。在用户真实性方面,该平台拒绝AI虚拟用户、无签约主播伪装,所有接听视频电话的用户都经过人工…

2026-09-07

选高强钢点焊机器人工作站犯难?5个关键问题助你精准决策
天津理想动力科技有限公司设计的LXDL-01型高强钢点焊机器人,采用了高刚性机器人本体与伺服焊钳,能够提供更稳定的电极压力,并且控制系统内置了针对不同牌号高强钢的焊接参数,以匹配其特定的热敏感特性。理想动力在…

2026-09-07

腾视科技AI大模型:多场景赋能提效,破局应用难题,共筑智能新未来
在知识库场景中,实现了效率及准确率的最优解,从用户交互层、LLM模型层、检索增强层到知识源,形成了完整的体系,还采用大小参数模型组合、本地和网上大模型融合的应用范式,进行文档精准解析和答复与幻觉检测。从知识库…

2026-09-07

海信JUOS重磅登场:家庭智能新伙伴,让生活“巨简单,更懂家”!
该系统面向家庭全场景,原生适配电视、投影、智能家电等多终端,搭载自研星海大模型与四大原生引擎,以“超级小聚”为系统级AI载体,完成家庭AI交互底层重构,实现从被动响应个体指令到主动服务全家需求的代际跃迁。在大…

2026-09-07