ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

谷歌Gemini 3.8 Flash发布:性能跃升成本优化,网络安全领域表现亮眼

时间:2026-09-03 14:19:46来源:互联网编辑:快讯

谷歌公司近日宣布推出新一代人工智能模型Gemini 3.8 Flash,这是该系列三个月内的第三次重大升级。新模型在软件工程、智能体任务处理和专业领域复杂推理方面展现出显著优势,性能表现可与成本更高的前沿大模型相媲美。

在软件工程领域,Gemini 3.8 Flash在DeepSWE v1.1基准测试中表现突出,能够自主解决复杂工程问题。测试数据显示,该模型在处理长周期软件工程任务时,性能优于多数参数量更大的模型,而计算成本仅为同类产品的几分之一。这种效率提升得益于模型在执行任务时表现出更强的钻研精神,能够自主增加推理步骤并迭代调用工具。

专业领域测试同样验证了新模型的实力。在量化金融领域的Vals金融智能体V2测试和法律领域的Harvey法律智能体基准测试中,Gemini 3.8 Flash的表现均超越前代模型及其他主流产品。该模型在HLE-Verified多步推理基准测试中取得54.9%的分数,证明其具备处理STEM、人文社科等多领域复杂任务的能力。

谷歌工程师透露,性能提升的核心在于模型设计思路的革新。Gemini 3.8 Flash在面对复杂任务时,会主动增加计算资源投入,有时甚至需要消耗更多token来确保输出质量。这种设计在高算力模式下尤为明显,虽然会增加短期成本,但能显著提升结果准确性。

定价策略延续了谷歌的优惠传统。新模型输入token每百万收费0.75美元,输出token每百万收费3.75美元,该优惠价格将持续至年底。用户可通过Google AI Pro、Ultra订阅服务在Gemini应用、搜索AI模式及谷歌表格的Gemini组件中使用该模型,开发者则可通过Google Antigravity、AI Studio和Gemini API进行调用。

同步推出的Gemini 3.8 Flash Cyber版本专为网络安全设计,将通过Fairwind计划向特定测试机构开放。该模型在自主漏洞挖掘方面达到行业领先水平,Chrome安全团队测试显示,其生成的漏洞补丁数量是其他主流商业模型的2.6倍。在Wiz公司的渗透测试中,该模型的召回率比同类产品高出7.5%至9.7%,而成本仅为对手的五分之一到二分之一。

实际应用案例进一步证明其价值。谷歌云漏洞研究团队利用该模型在两小时内发现一处关键底层漏洞,而传统方法通常需要数月时间。这种效率提升有望彻底改变网络安全领域的漏洞发现与修复流程。

更多热门内容