本报记者 梁傲男
8 月 14 日,北京智谱华章科技股份有限公司(以下简称 " 智谱 ")发布新一代基座模型 GLM-5.3。与 GLM-5.2 相比,其基座模型没变,但大大提高了模型的智能上界:GLM-5.3 拥有数十倍的长程任务环境、更丰富多样的环境类型、超长的后训练时间。
整体来看,GLM-5.3 在复杂软件工程、终端操作和更广泛的真实世界智能体任务上均取得进步。
随着大模型应用走向真实软件工程,行业竞争正在从 " 模型能不能写代码 " 转向 " 模型能不能完成复杂任务 "。其中,网络安全成为这一能力演进的重要方向。网络安全要求模型进一步理解复杂系统,包括程序逻辑、协议规则、权限边界和攻击路径,是代码能力向更高阶任务的延伸。
安全投入历来是企业 IT 预算中最刚性的支出项之一。对模型厂商而言,这更是一个付费意愿极为强烈的市场。
记者了解到,在模型发布前两周,智谱联合国内头部安全团队开展测试,发现 2404 个潜在漏洞,包括 1088 个中高危漏洞。其中,研究人员借助 GLM-5.3 发现了潜伏 40 余年的 DNS 协议级风险,攻击者仅需少量特殊请求即可将服务器压力最高放大近 8 万倍,潜在影响超过 1000 万处公网 DNS 服务。这意味着,模型能力正在从基准测试走向真实专业工作流。
" 大模型参与安全研究的价值,在于帮助防守者抢在攻击者之前发现问题、推动修复,把潜在威胁化解在造成实际损害之前。" 智谱方面对《证券日报》记者表示,随着模型能力不断增强,安全也不能只是能力之外的一道 " 补丁 ",而应成为基础模型技术演进本身的一部分。模型能力越强,安全约束也必须越稳固,前沿 AI 应更多被用于发现风险、保护数字基础设施和服务社会公共利益。
在业内看来,对于基础模型公司而言,安全审计、企业服务等方向均有望成为商业化变现的重要入口。据了解,GLM-5.3 将陆续接入 ZCode、Trae、WorkBuddy、Qoder 及 OpenCode 等平台,其 API(应用程序编程接口)亦将于近期上线,并计划向社区开放完整模型权重,进一步推动国产大模型在真实战场中的落地与迭代。
中国电子商务专家服务中心副主任郭涛在接受《证券日报》记者采访时表示,国产大模型的竞争已走过单纯参数比拼的 " 上半场 ",正进入能力验证与商业价值落地的 " 下半场 "。这一阶段的显著特征,是模型厂商从代码生成、逻辑推理等基础能力维度的角逐,升级为面向高价值、高复杂度场景的系统化能力比拼。


登录后才可以发布评论哦
打开小程序可以发布评论哦