没有一家模型厂商最近能够放松警惕。前后大概不到 48 小时,DeepSeek 和智谱相继更新了自己的模型进展。先是 DeepSeek 于 8 月 12 日晚将 API 文档更新为 DeepSeek-V4-Pro 正式版,又于 13 日对官宣内容进行了回撤和重新发布,但调整期间保留 API 服务;再是 8 月 14 日,智谱 GLM-5.3 正式发布。抛开 DeepSeek 回撤和重新发布不谈,其 API 文档更新为 DeepSeek-V4-Pro 正式版,智谱 GLM-5.3 正式发布。在 Agent 相关评测集中,其总体成绩与 Kimi K3、Opus 4.8 和 Fable 5 在同一水平线上。
智谱 GLM-5.3 则继续强调编程能力。该模型与前代 GLM-5.2 使用完全相同的基座模型,主要通过后训练提升性能,利用强化学习(基于 IndexShare、SAO 以及新一代 Slime 框架)扩展了长程任务环境和训练时长。从评测集表现来看,GLM-5.3 的部分能力接近 Fable 5 和 GPT-5.6 Sol,并在展示出来的多个榜单中成绩超过了 Kimi K3,但在聚焦长程软件工程与持续代码修改能力的 DeepSWE v1.1 上仍然不及 K3。


登录后才可以发布评论哦
打开小程序可以发布评论哦