
智东西
编译 | 杨京丽
编辑 | 李水青
智东西 8 月 14 日消息,今日,谷歌发布 Gemini 3.7 Flash,这是谷歌迄今面向编程和 Agent 场景能力最强的 Flash 系列主力模型。

谷歌发布 Gemini 3.7 Flash(图源:X)
距离 Gemini 3.6 Flash 发布仅过去三周,新模型在编程、网页开发、复杂文档处理和企业自动化等任务上均有提升,其中 DeepSWE v1.1 成绩从 49.0% 升至 65.3%,与 Claude Sonnet 5 和 GPT-5.6 Terra 得分近似;AutomationBench 成绩从 17.0% 升至 30.4%。
目前,在第三方模型测评机构 Artificial Analysis 上,Gemini 3.7 Flash(high)在 Intelligence Index 中取得 56 分,与GPT-5.6 Terra(max)、GPT-5.5 ( xhigh ) 、Grok 4.5(high)、Claude Sonnet 5(max)得分相近。

Gemini 3.7 Flash 测评情况(图源:Artificial Analysis)
价格方面,2026 年年底前,Gemini 3.7 Flash 每百万输入 Token 的价格为 0.75 美元(约合人民币 5.06 元),每百万输出 Token 价格为 3.75 美元(约合人民币 25.28 元),均为Gemini 3.6 Flash 最初价格的一半。2027 年 1 月 1 日起,两项价格将分别恢复至 1.50 美元(约合人民币 10.11 元)和 7.50 美元(约合人民币 50.55 元)。
除了向开发者和企业开放,Gemini 3.7 Flash 还将成为谷歌个人 AI Agent Gemini Spark 的新底座,帮助用户跨 Gmail、Google 日历、Google 文档等应用执行多步骤任务。
一、编程任务提升明显,知识密集型领域准确性提高
与 Gemini 3.6 Flash 相比,Gemini 3.7 Flash 在排查故障、解决问题等编程任务上的表现明显提升。其首次生成结果的准确率更高,生成可直接用于生产环境的程序时也有更好表现。
在 FrontierCode 1.1 Main 测试中,Gemini 3.7 Flash 得分为 43.6%,与 Claude Sonnet 5 和 GPT-5.6 Terra 得分近似,领先 Gemini 3.6 Flash 的 34.4%;在 DeepSWE v1.1 测试中,Gemini 3.7 Flash 的成绩为 65.3%,略低于 GPT-5.6 Terra 的 69.6%。

Gemini 3.7 Flash 的编程能力(图源:谷歌)
网页开发方面,Gemini 3.7 Flash 能用更少的提示,生成实用性更强的页面布局和功能较完整的应用。在根据截图、图片或完整设计系统生成 UI(交互界面)时,新模型对参考设计的遵循和还原能力也有所提升。
在 Arena.ai 的 WebDev Arena 测试中,Gemini 3.7 Flash 的 Elo 得分为 1588,领先 Claude Sonnet 5、GPT-5.6 Terra 和 Muse Spark 1.2。

Gemini 3.7 Flash 的网页开发能力(图源:谷歌)
在金融、法律和生物科学等知识密集型领域,Gemini 3.7 Flash 的推理能力和准确性同样有所提高。在用于测试复杂文档处理能力的 GDP.pdf 基准中,新模型取得 34.0% 的成绩,高于上一代的 22.0%;在企业工作流测试 AutomationBench 中,其成绩由 17.0% 升至 30.4%。

Gemini 3.7 Flash 的复杂文档处理能力及企业工作能力(图源:谷歌)
谷歌还展示了多项应用案例:Gemini 3.7 Flash 配合 Nano Banana,可以根据一段文本提示,生成画面精致、可玩性高的 3D 游戏。
3D 游戏案例(图源:谷歌)
模型还可以调用子 Agent,配合 Gemini Omni 生成带有交互式组件的落地网页。
交互网页案例(图源:谷歌)
二、执行多步骤任务更稳,年内半价优惠
谷歌称,与 Gemini 3.6 Flash 相比,Gemini 3.7 Flash 能够更好地适应任务执行过程中遇到的障碍,在必要时确认用户意图,并更严格地遵循指令。
新模型会投入更多计算完成多步骤规划和工具调用,更有条理的执行方式可以减少工程工作流中的人工监督和重复尝试。
2026 年年底前,Gemini 3.7 Flash 每百万输入 Token 的价格为 0.75 美元(约合人民币 5.06 元),每百万输出 Token 的价格为 3.75 美元(约合人民币 25.28 元)。
谷歌称,早期客户反馈认为,Gemini 3.7 Flash 在保持较低成本的同时,性能和准确性均明显优于 Gemini 3.6 Flash。
Databricks AI 研究经理伊万 · 周(Ivan Zhou)说:" 过去,要规模化地从复杂的企业数据中获得高质量答案,成本一直很高,Gemini 3.7 Flash 等模型正在改变这一状况。通过 Databricks AI Gateway 接入 Gemini 3.7 Flash 后,企业能以更低成本预测营收、识别关键客户并制定投资决策。"
三、Gemini Spark 换用新模型,可跨 Workspace 执行任务
谷歌同步宣布,Gemini Spark 从发布当日起开始使用 Gemini 3.7 Flash。Spark 是谷歌在 I/O 大会上推出的个人 AI Agent,能够全天候运行,并在用户指示和监督下代为执行任务。
换用新模型后,Spark 将增强对 Google Workspace 应用的工具调用能力,重点改善需要多项技能配合的复杂工作流。用户可以让它整合不同文件中的信息、起草邮件、更新项目状态文档,并把初步想法转化为具体操作。
目前,Spark 面向 160 多个国家和地区的 Google AI Pro 及 Ultra 订阅用户提供。
个人用户则可以在支持 Gemini Spark 的国家和地区,通过 Google AI Pro 或 Ultra 订阅使用 Gemini 3.7 Flash;开发者可通过 Google Antigravity、Gemini API、Google AI Studio 和 Android Studio 使用新模型;企业客户则可从 Gemini Enterprise Agent Platform 及 Gemini Enterprise 应用接入。
结语:月活突破 10 亿,Gemini 更新提速
近期,Gemini 应用月活跃用户突破 10 亿。短短三周内连发两代 Flash 模型、限时降低调用价格,并将新模型接入 Gemini Spark,反映出谷歌正在加快 Gemini 模型的迭代,并继续拓展其在 Agent 和 Workspace 工作流中的应用。
产品提速的同时,谷歌 AI 团队上周经历了重要人事调整:德米斯 · 哈萨比斯卸任谷歌 DeepMind CEO,转任董事长;杰夫 · 迪恩等 4 名核心 AI 人员离职创业。未来,Gemini 能否在组织调整中保持模型迭代速度,并将性能、成本和产品入口优势转化为稳定的 Agent 体验,值得持续关注。
来源:谷歌


登录后才可以发布评论哦
打开小程序可以发布评论哦