【CNMO 科技消息】谷歌近日正式发布 Gemini 3.8 Flash,这是该公司在短短六周内推出的第三款 Flash 系列模型。与此前版本不同,此次发布包含两个变体:面向通用场景的 Gemini 3.8 Flash 和专攻网络安全的 Gemini 3.8 Flash Cyber,分别定位为谷歌 " 最智能的主力工作模型 " 和 " 最强网络安全模型 "。

Gemini 3.8 Flash
从性能表现来看,Gemini 3.8 Flash 在多个基准测试中展现出超越更大规模模型的能力。在衡量自主解决复杂工程问题能力的 DeepSWE v1.1 测试中,该模型得分 73.7%,略低于 Claude Opus 5 的 74%,但明显优于 Gemini 3.7 Flash、Claude Sonnet 5、GPT-5.6 Sol 和 GPT-5.6 Terra 等竞品。此外,在 Vals Finance Agent v2 金融分析、Harvey 法律智能体基准、CharXiv Reasoning 信息综合、Terminal-bench 2.1 终端编码以及 LVBench 长视频理解等多项测试中,Gemini 3.8 Flash 同样领先于上述对手。
谷歌解释称,3.8 Flash 之所以表现更优,是因为该模型 " 工作更努力 "。面对复杂任务时,它会主动执行额外的推理步骤以提升输出质量,当然这也意味着在某些情况下会消耗更多 token。定价方面,Gemini 3.8 Flash 目前处于首发优惠期,输入 token 价格为每百万 0.75 美元,输出 token 为每百万 3.75 美元,后续将上调至 1.50 美元和 7.50 美元。即便如此,其价格仍低于 Claude Opus 5 和 GPT-5.6 Sol 等同类产品。
Gemini 3.8 Flash Cyber 则是一款更为特殊的模型,目前仅通过谷歌新设立的 Fairwind 计划向特定用户开放,包括可信政府机构、关键基础设施运营商以及软件维护人员。在 C/C++ 漏洞检测的行业标准测试中,该模型得分 86.2%,超过前代 Gemini 3.5 Flash Cyber 以及 Mythos 5、GPT-5.5-Cyber 等更大规模的模型。在覆盖 20 多种编程语言的真实漏洞发现场景中,其成功率达到 71%,大幅高于 Gemini 3.7 Flash 的 58.9% 和 Gemini 3.5 Flash Cyber 的 46.6%。
该网络安全模型的另一大亮点在于自动化补丁生成能力。据谷歌公布的数据,Gemini 3.8 Flash Cyber 为 Chrome 浏览器漏洞生成的正确补丁数量,是 " 规模大得多的最佳商用模型 " 的 2.6 倍。对于普通用户而言,虽然不会直接与这一模型交互,但其在防御端和开发端的改进将间接提升日常使用的技术产品的安全性。
目前,Gemini 3.8 Flash 已向开发者、企业客户以及 Google AI Pro 和 Ultra 订阅用户开放。Gemini 3.8 Flash Cyber 的访问权限则仅限于 Fairwind 计划成员。


登录后才可以发布评论哦
打开小程序可以发布评论哦