ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

谷歌Gemini 3.6 Flash遭吐槽:性能不佳,3.5 Pro延期,AGI之路何去何从?

时间:2026-07-22 17:15:34来源:互联网编辑:快讯

谷歌最新发布的Gemini 3.6 Flash模型在开发者社区引发强烈争议,这款被寄予厚望的AI产品在前端界面生成和空间推理能力测试中表现惨淡,甚至被用户称为"谷歌史上最差模型"。实测数据显示,该模型在前端代码生成任务中完全无法投入实用,输出的界面代码存在逻辑错乱、组件嵌套混乱等严重缺陷,与meta的Muse Spark 1.1等竞品形成鲜明对比。

空间推理测试结果同样令人失望。开发者通过视频逐帧分析发现,Gemini 3.6 Flash在基础位置关系判断和方向识别任务中频繁出错,准确率较前代3.5 Flash明显下降。即便开启高性能模式,模型在CursorBench等基准测试中的表现仍落后于Cursor Composer 2.5等开源方案。更令人质疑的是,该模型宣称的知识截止日期为2026年3月,但实际对2025年后的事件几乎一无所知,知识库更新存在重大缺陷。

在第三方综合评估平台Artificial Analysis的测评中,Gemini 3.6 Flash的得分与3.5 Flash持平,显著落后于meta Spark 1.1、GLM-5.2等12款主流模型。谷歌官方发布的测试报告也承认,新模型在代码任务处理上被多个竞品超越,仅在视觉和上下文理解等特定场景保持优势。这种"偏科"表现引发开发者强烈不满,有用户讽刺称:"快速生成错误答案等于用更高效率浪费用户时间。"

同期发布的Gemini 3.5 Flash-Lite主打高速输出,每秒可生成350个token,但实际测试显示其错误率与速度成正比增长。更争议的是,该版本定价较同类产品高出23%,形成"价格更贵、效果更差"的尴尬局面。网络安全专项模型Gemini 3.5 Flash Cyber的发布也未能挽回口碑,开发者指出其威胁检测逻辑存在明显漏洞,在红队测试中多次误报关键漏洞。

面对铺天盖地的质疑,谷歌在发布公告中透露,原定推出的Gemini 3.5 Pro因技术瓶颈延期交付,而下一代Gemini 4已启动"谷歌史上最大规模"的预训练项目。据内部人士透露,3.5 Pro开发进度严重滞后,团队不得不临时调整路线图,将资源集中投入4.0版本的预训练。这种"跳过完善当前版本、直接押注下一代"的策略,被开发者批评为典型的"版本号游戏"。

行业观察家指出,谷歌此次模型发布暴露出深层战略困境。在算力资源紧张的背景下,强行推出未达商用标准的产品,既损害开发者信任,又消耗宝贵算力资源。有开发者在社交平台发起联名信,要求谷歌暂停"为了财报数字牺牲模型质量"的开发模式,将资源集中用于解决现有模型的知识更新、逻辑推理等核心问题。这场风波持续发酵,引发业界对AI大模型开发伦理的广泛讨论。

更多热门内容