快科技 7 月 23 日消息,当地时间 7 月 21 日,谷歌旗下 DeepMind 对外推出三款全新 Gemini 轻量化模型,包含 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 以及行业专用模型 Gemini 3.5 Flash Cyber。
与此同时,旗舰模型 Gemini 3.5 Pro 依然没有露面成为此次焦点。
而据第三方评测榜单数据显示,谷歌当前主力 Gemini 系列综合实力已经跌至全球榜单十名以外,在头部大模型竞速赛道中显现压力。
据官方披露信息,三款新模型定位清晰,主要面向规模化商用场景。
其中 Gemini 3.6 Flash 是主力模型,与上一代相比能使用更少的 token,在相同成本下提供更高质量的工作;而 Gemini 3.5 Flash-Lite 则是快速、成本效益高的选项,适用于日常任务,如处理文档和搜索;Gemini 3.5 Flash Cyber 是一种网络安全模型,专为发现和修补关键软件漏洞而构建。
但根据评测来看,此次谷歌的新模型在智能上并不出色,AI 模型评测平台 Arena.ai 的研究显示,Gemini 3.6 Flash 在前端代码竞技场中以 1537 分排名第 12 位。

而国内月之暗面最新发布的 Kimi K3 以 1677 分位列榜首,智谱 GLM-5.2 位列第四,Anthropic 的 Claude 和 OpenAI 的 GPT 的多款系列产品位居前列。

第三方评测机构 Artificial Analysis 给出的结论是,Gemini 3.6 Flash 在智能方面较 3.5 Flash 没有提升,智能指数得分 50,但任务效率有所提高,Gemini 3.6 Flash 的平均每任务时间为 1.3 分钟,较上一代减少超过 50%,同时每任务成本略有降低。
这意味着,谷歌优化的更多是速度和成本,而不是模型能力本身。
而除了排行榜,开发者社区的反馈同样出现明显分化,不少开发者用谷歌新模型做任务时未看到很好的表现:" 前端能力糟糕、空间推理也很差,我安慰自己这其实不是在高思考水平上运行的,但我不确定。"
有开发者评论道:" 谷歌就像龟兔赛跑里的兔子,领先一段时间后就开始睡觉。" 也有人直言,Gemini 团队需要引入真正关心交付前沿模型的人。

【本文结束】如需转载请务必注明出处:快科技
责任编辑:哈尔


登录后才可以发布评论哦
打开小程序可以发布评论哦