ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

OpenAI首个“去英伟达化”实验模型退役 模型迭代加速步入新阶段

时间:2026-09-13 02:07:01来源:互联网编辑:快讯

OpenAI近日宣布,其于今年早些时候推出的实验性编程模型GPT-5.3-Codex-Spark即将停止服务。这款模型自2月12日以研究预览形式上线以来,仅维持了不足八个月的运营周期,成为该公司探索非英伟达芯片推理路线后首个被淘汰的产品。

作为一款专为实时交互编程设计的轻量化模型,Spark的核心优势在于其硬件架构。该模型运行于Cerebras公司研发的WSE-3晶圆级处理器,通过将数万个计算核心与片上内存集成在单块晶圆上,显著减少了传统GPU架构中数据在计算单元与外部存储间频繁传输带来的延迟。这种设计使其在代码编辑、局部修改等场景中表现出色,尤其适合需要快速响应的编程任务。

OpenAI与Cerebras的合作始于2026年1月,双方签署了为期多年的算力供应协议。根据披露信息,OpenAI计划部署总功率达750兆瓦的Cerebras推理集群,相关投资超过200亿美元,算力资源将在2028年前逐步投入使用。这一举措被业界视为OpenAI降低对单一GPU供应商依赖、构建多元化算力体系的重要战略转型。

尽管在硬件层面具有创新性,Spark的用户反馈却呈现明显分化。部分开发者称赞其在代码重构等重复性工作中展现出"惊人的速度",但更多用户指出模型存在严重缺陷。有开发者直言:"这可能是个有趣的玩具,但作为生产工具完全不合格。"这种评价差异与其定位密切相关——作为ChatGPT Pro用户专属功能,Spark仅支持Codex客户端、命令行工具和VS Code插件等有限场景。

技术演进的速度很快削弱了Spark的竞争优势。8月份推出的GPT-5.6 SolUltrafast模式同样基于Cerebras架构,但采用了完整的GPT-5.6 Sol模型而非压缩版本,在保持750 token/s输出速度的同时,提供了更全面的编程能力。这种"既要速度又要智能"的技术突破,使得专门为速度优化的小模型失去了存在价值。

从行业视角观察,Spark的退役标志着大模型发展进入新阶段。传统上以半年到数年为周期的迭代模式正在被颠覆,取而代之的是更接近互联网产品的快速实验机制:针对特定场景开发专用模型,验证技术可行性后将成功经验整合到主力模型中,最终快速淘汰过渡性产品。这种转变反映了AI领域对技术落地效率和商业可持续性的更高要求。

Cerebras公司对这种趋势给出了技术层面的解释:过去AI产品必须在响应速度和模型规模间做出妥协,但新一代硬件架构正在打破这种限制。通过优化数据流动路径和计算单元利用率,开发者可以同时获得高性能与低延迟,这为模型设计提供了更大的灵活性空间。

更多热门内容
天津大学携手凌波智芯 共筑AI算力互联新引擎 突破十万卡集群瓶颈
凌波智芯创始人、天津大学教授李文信介绍,联合实验室将充分发挥天津大学在计算机与网络通信领域的科研和人才优势,整合凌波智芯在算力网络研发及产业化方面的资源,围绕网卡芯片架构设计、先进拥塞流控算法、超高并发处理算…

2026-09-13

外滩大会聚焦具身智能:回应“泡沫论”,共探“ChatGPT时刻”与未来走向
多位嘉宾认为,当前具身智能的“泡沫感”更多来自产业阶段、估值与商业价值之间的错配,行业仍处在“黎明前期”;与此同时,具身智能的关键能力已经开始出现,但距离真正形成规模化生产力仍有距离,系统工程、算力和数据仍是…

2026-09-13

OpenAI Astra需求激增致系统承压 暂停专业版新用户注册服务
A:因为最新模型Astra需求量前所未有,给公司基础设施系统带来了巨大压力,专业版套餐对系统的负担最大,所以公司暂时关闭了该服务层级的新用户注册功能。 A:Astra于9月3日发布,在AI推理、编程和计算机…

2026-09-13

合肥落地全国首个5G-A具身智能样板点 专属通信套餐助力机器人产业升级
在实际落地方面,针对园区智能巡检、远程设备操控、实景数据采集、多机协同作业等复杂高需求场景,“具身翼联”打造了专属网络传输“VIP通道”,可有效规避网络拥堵、数据延迟、指令卡顿等问题,为具身智能产业规模化商…

2026-09-13

2026外滩大会直击:机器人“真上岗” AI新经济加速融入现实生活
券商中国记者在现场观察到,从入场开始,AI就已经在“工作”:手机“碰一下”可完成入场核验并唤起展会AI助手;走进展馆,机器人在药房、工厂和洗衣房里干活的场景被复刻在眼前,智能体已经实现替人处理咖啡、出行、求…

2026-09-13