AI领域即将迎来新一轮激烈竞争,OpenAI与Anthropic两大巨头正紧锣密鼓筹备新模型发布,试图在预训练规模和技术突破上占据先机。据多方消息,OpenAI原计划本月发布的10万亿参数模型Astra(即GPT-6)虽因安全审查短暂暂停,但最终仍将在8月登场,其参数规模较GPT-4的1.8万亿实现跨越式增长,被业界视为逻辑推理与泛化能力“质变”的关键节点。
这场对决的另一方,Anthropic计划在同期推出Fable 5.1,定价与前代持平,直接对标Astra。这一策略被解读为“田忌赛马”——通过保留Opus 5的部分性能,将Fable 5.1作为“伏兵”截击对手。两家公司的竞争焦点已从单纯的参数规模扩展至预训练架构、上下文长度等核心技术维度。例如,Astra的上下文窗口可能扩展至150万token,而Fable系列此前已展示出多模态交互的潜力。
OpenAI的野心不止于此。年底前,代号“Doug”的终极模型将亮相,其算力底座或采用英伟达尚未全面量产的Vera Rubin芯片。据内部人士透露,Doug的预训练规模远超现有模型,甚至被形容为“让Fable显得像原始产物”。这一项目被视为OpenAI突破“预训练瓶颈”的标志性成果——自2024年5月发布GPT-4o后,该公司长期未完成全规模预训练,后续模型均基于旧架构迭代,而Doug可能标志着其重新掌握技术主导权。
技术突破的背后是算力与工程能力的较量。为支撑Doug的训练,OpenAI需解决万卡级集群的稳定性问题,并克服性能退化难题。此前,Orion等项目因表现不及预期被降级,凸显预训练的复杂性。而SemiAnalysis等机构强调,Scaling Laws(规模法则)在推理阶段已验证有效,Doug若能成功,将证明该法则在预训练领域同样适用,即“只要算力和数据足够,模型性能仍可指数级提升”。
行业格局因这场竞争加速重塑。谷歌近期遭遇人才流失危机,其AI部门核心成员集体出走创业,DeepMind创始人哈萨比斯也退居幕后,导致Alphabet股价单日暴跌超4%。曾经与OpenAI、Anthropic并称“三巨头”的谷歌,如今已明显掉队,AI赛道逐渐形成双雄争霸的局面。OpenAI手握Astra与Doug两张王牌,Anthropic则以Fable系列构建多层次防线,两者的博弈将决定未来两年大模型技术的演进方向。
值得注意的是,预训练规模的扩张正引发对算力成本与能源消耗的担忧。若Doug的参数规模达数十万亿级,其训练所需的电力与硬件资源将远超以往。如何在性能提升与可持续性之间取得平衡,将成为行业面临的长期挑战。与此同时,监管机构对AI安全性的审查日益严格,Astra的发布延迟已折射出这一矛盾——技术突破的速度能否跟上伦理框架的完善,仍是未知数。