科技日报 7小时前
智谱发布新一代基座模型!多项基准测试中取得开源第一
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

8 月 14 日,智谱正式发布新一代基座模型 GLM-5.3。智谱方面表示,该模型通过后训练提高了模型的智能上限,具体表现为数十倍的长程任务环境、更丰富多样的环境类型,以及超长的后训练时间。

根据智谱官方技术报告,GLM-5.3 在包括 Terminal Bench 3.0、Agents'Last Exam(CLI)在内的公开基准测试中取得开源第一。

此次升级的意义不只在编程。随着大模型应用走向真实软件工程,行业竞争正在从 " 模型能不能写代码 " 进入 " 模型能不能完成复杂任务 "。网络安全成为这一能力演进的重要方向。网络安全要求模型进一步理解复杂系统,包括程序逻辑、协议规则、权限边界和攻击路径,是代码能力向更高阶任务的延伸。

在 CyberGym 漏洞推理评测中,GLM-5.3 得分为 84.5%,高于 GLM-5.2 的 77.2%。

据了解,模型发布前两周,智谱联合安全团队开展测试,发现 2404 个潜在漏洞,其中 1088 个为中高危漏洞。其中,研究人员借助 GLM-5.3 发现了潜伏 40 余年的 DNS 协议级风险,攻击者仅需少量特殊请求即可将服务器压力最高放大近 8 万倍,潜在影响超过 1000 万处公网 DNS 服务。这意味着,模型能力正在从 Benchmark 测试走向真实专业工作流。

对于基础模型公司而言,下一阶段竞争不仅是模型能力竞争,更是高价值场景竞争。Coding Agent、安全审计、企业服务等方向,都可能成为模型商业化的重要入口。据了解,GLM-5.3 将接入 ZCode、Trae、WorkBuddy、Qoder、CawPaw 和 OpenCode 等平台,API 随后上线,并计划开放完整模型权重。

此外,针对 GLM-5.3,团队构建了迄今为止最稳健的风险审查系统。智谱方面表示,随着 GLM-5.3 的发布及开源,安全防御能力将不再是少数机构的特权,而是全球开发者都能平等获得和共同完善的公共能力。

编辑:王璠

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

开源 网络安全 编程 审计 潜伏
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论