ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

智谱GLM-5.1开源发布:突破8小时持续工作,国产大模型价格性能双提升

时间:2026-04-08 14:12:10来源:互联网编辑:快讯

智谱近日正式推出并开源其最新旗舰模型GLM-5.1,这一消息引发二级市场强烈反应。港股开盘后,智谱股价迅速攀升,最高涨幅接近18%,触及925港元关口,截至当日收盘仍保持13.48%的涨幅。作为全球首个在真实工程场景中验证8小时持续工作能力的开源模型,GLM-5.1突破了传统大模型以分钟级交互为主的局限,标志着AI模型从短时任务处理向长程自主工作的范式转变。

该模型的核心突破在于其长程任务处理能力。在单次任务中,GLM-5.1可连续工作超8小时,期间自主完成规划、执行、测试、策略调整及错误修复等全流程,最终交付符合工程标准的完整成果。这种能力使其区别于现有模型,更接近人类工程师的"实验-分析-优化"闭环思维。智谱方面强调,模型在GPU内核优化等复杂场景中已展现出端到端自主工作能力,显著降低了对专家经验的依赖。

技术验证数据显示,GLM-5.1在KernelBench Level 3基准测试中表现卓越。面对50个真实机器学习计算负载,该模型在24小时不间断迭代中完成多轮编译-测试-分析-重写循环,最终实现3.6倍几何平均加速比,较传统torch.compile模式提升141%。这一成果证明AI模型已具备从代码生成向系统级优化的能力跃迁,为高性能计算领域突破工程效率瓶颈提供了新路径。

在代码能力维度,GLM-5.1继续保持行业领先地位。其在SWE-bench Pro、Terminal-Bench、NL2Repo三大权威基准测试中取得综合平均分全球第三、国产第一、开源第一的佳绩。特别在SWE-bench Pro真实软件开发测试中,该模型首次超越海外头部模型Opus 4.6,刷新全球最佳纪录。这些突破使GLM-5.1成为首个在核心场景实现与海外顶尖模型性能对齐的国产大模型。

市场策略方面,智谱同步调整了GLM-5.1的定价体系。模型聚合平台OpenRouter数据显示,其Coding场景缓存命中Token价格上调10%,已接近Anthropic旗下Claude Sonnet4.6水平。这一调整标志着国产大模型从价格战转向价值竞争的转折点——一年前行业普遍通过降价90%争夺市场,如今已具备以性能溢价锚定国际基准的实力。

尽管取得突破,智谱坦言长程任务处理仍面临多重技术挑战。包括如何缓解复杂任务中的上下文焦虑、如何维持数千次工具调用后的执行一致性、如何突破局部最优解陷阱,以及在缺乏明确数值指标的任务中建立可靠自评估机制等。公司表示,GLM-5.1是该技术路线的重要里程碑,未来将持续优化模型的有效工作时长与自主进化能力。

更多热门内容
DeepSeek V4正式版7月中旬上线 峰谷定价机制保障高优先级业务稳定性
IT时代网6月29日消息,DeepSeek发送给用户的升级提醒邮件显示,DeepSeekV4正式版计划于7月中旬正式上线,预计将带来更多功能优化和性能提升。 此前4月上线的V4预览版提供Pro与Flash…

2026-06-30

OpenAI携手Work Louder推Codex联名键盘 7月15日上线赋能AI开发新体验
月 30 日消息,OpenAI 开发者官方账号今天(6 月 30 日)在 X 平台发布推文,预告将和 Work Louder 公司合作,于 7月 15 日上线 Codex 品牌的专用输入设备。 OpenAI…

2026-06-30

国产大模型智算新篇:“众智”研讨会启幕 共探协同发展新路径
本次会议以开放共赢、基准共建、生态共谋为主线,设置“众智”国模国芯协同测试验证服务平台启动、AISHPerf软硬件基准工具开源与开放原子开源基金会捐赠、词元专项工作组成立、智能算力适配行业应用联合实验室签约等…

2026-06-30

豆包回应“灰测社交功能”传闻:与飞书协同办公 无社交功能规划
6月29日,有社媒消息称,豆包开始灰测社交功能,相关界面显示,在豆包App上出现了即时通信对话页面。 当日,豆包相关负责人回复新黄河大鱼财经记者表示,在企业办公场景,豆包是和飞书有一些协同的尝试,未来也会合作…

2026-06-30

AGI时代将至?OpenAI首席研究官:模型自我研究已非科幻桥段
【新智元导读】OpenAI首席研究官Mark Chen释放了一个强烈信号:OpenAI 并不认为scaling laws已经失效,恰恰相反,预训练、数据工程、推理训练和更长任务链条,仍是通向AGI的主干道路…

2026-06-30

成都制造企业大模型本地化部署:数据治理为基,选型避坑指南
许多成都企业在从试点走向规模化落地的过程中,最常遇到的问题包括:买了算力但找不到合适的场景、数据断点导致RAG知识库效果差、AI智能体与业务系统权限无法打通。企业在决策时,核心关注点应依次为:数据打通与治理能…

2026-06-30

大模型告别资本狂热时代:垂直深耕细分赛道,构建产业生态成破局关键
2026 年市场出现明显分化,大量缺乏落地场景、仅依靠通用基座讲故事的中小模型企业持续收缩,头部厂商也不再盲目堆砌参数,行业重心从技术竞赛转向产业价值落地,深耕垂直细分赛道成为所有科技企业的破局核心。未来市场…

2026-06-30

国产大模型智算协同新篇开启 “众智”平台助力芯模适配升级
本次会议以开放共赢、基准共建、生态共谋为主线,设置“众智”国模国芯协同测试验证服务平台启动、AISHPerf软硬件基准工具开源与开放原子开源基金会捐赠、词元专项工作组成立、智能算力适配行业应用联合实验室签约等…

2026-06-30

OpenAI首席研究官放话:AGI将至,模型自我研究不再是科幻桥段
【新智元导读】OpenAI首席研究官Mark Chen释放了一个强烈信号:OpenAI 并不认为scaling laws已经失效,恰恰相反,预训练、数据工程、推理训练和更长任务链条,仍是通向AGI的主干道路…

2026-06-30