快科技 9 月 3 日消息,谷歌 Gemini Flash 模型大力出奇迹,刚刚发布的 Gemini 3.8 Flash 很亮眼,多项性能超过了当前的旗舰大模型 Opus5。
作为御三家 AI 巨头之一,谷歌今年在 AI 大模型上掉队明显,Gemini 3.5 Pro 的多次跳票打击了大家对它的信心,索性就暂时放弃了 Pro 市场,专攻廉价快速模型的 Flash 系列升级倒是很快,最近一路从 3.5 升级到了 Gemini 3.8 Flash,而且性能越来越猛。
这次的 Gemini 3.8 Flash 依然保持了低价优势,输入 0.75 美元 / 百万 token,输出 3.75 美元 / 百万 token,上下文 100 万,输出上限 6.5 万,不过价格优惠只到 12 月 31 日,2027 年 1 月 1 日起翻倍。
与 Opus5 相比,目前 Gemini 3.8 Flash 整体价位只有后者的 15% 左右,也就是跑 Opus5 的任务能跑 7 次 Gemini 3.8 Flash,再加上多模态的优势,很适合干一些杂活,效率高,费用低。

但是 Gemini 3.8 Flash 的性能可不弱,14 组基准评测中拿下 8 个第一,DeepSWE v1.1 从 65.3% 提升到 71.0%,整体性能接近 Opus 5 的 74.0%。
Terminal-bench 2.1 这样的测试中达到 89.4%,略高于 Opus 5 的 89.1% 以及 GPT-5.6 Sol 的 88.8%,表现达到了顶级大模型的水平。
另外在金融 Agent、法律 Agent、复杂图表推理和长视频理解上也拿到最高分。
当然也有差的地方,Terminal-bench 4.0 只有 19.1%,相比之下 Opus 5 达到了 51.8%,而 OSWorld-2.0 也只有 59.0%,大幅落后于 Opus 5 的 75.4%。
另外值得说明的是,Gemini 3.8 Flash 虽然上下文窗口是 100 万,但输出只给 64K token,这点上很小气,也注定了它不太可能胜任大型任务。
目前 Gemini 3.8 Flash 已通过 Gemini 应用、AI Studio 和 Gemini API 等渠道分发。

【本文结束】如需转载请务必注明出处:快科技
责任编辑:宪瑞


登录后才可以发布评论哦
打开小程序可以发布评论哦