快科技 9 月 17 日消息,新一代大模型开始转向 RSI 自我递归升级,国内的大模型公司智谱今天也宣布这方面的进展,GLM-5.3 Flash 在两周时间内自我优化大幅提升了国产 AI 芯片的性能。
GLM-5.3 Flash 是智谱前不久才发布的多模态大模型,跟 GLM-5.3 相比速度快得多,而且是首次使用了全国产芯片部署,多达 10 万块国产 AI 芯片使得单位 Token 推理成本较年初下降 80%。
不仅硬件上有所突破,智谱这次还首次看到了 RSI 自我递归能力上的早期迹象,创始人唐杰表示 GLM-5.3 开始帮助优化 GLM-5.3-Flash 在国产芯片上的部署。

根据他公布的信息,一个由 GLM-5.3 驱动的 Infra Agent 用两周时间,帮助 GLM-5.3-Flash 在国产加速卡上第一次跑通,到承载全部线上流量,端到端吞吐提升至 3.2 倍。
他提到 GLM-5.3 驱动的 Infra Agent 解决了三个关键问题:修复 KDA 精度漂移,将 KV 传输开销从 30% 以上降至 1% 以内,并通过重构 Decode 算子获得 1.71 倍加速。
详细技术细节可以参考智谱官方发布的技术报告。
这还只是智谱在 RSI 方向的一次探索,此前的财报会议上唐杰还确认了下一代大模型 GLM-6 要做到 fully self-training(完全自训练),从预训练到中训练、再到后训练,都可以完全自己训练自己,并且做自我进化。
这是一个很大的挑战,最大的问题在于:模型能自己判断 " 什么时候停止、什么时候纠正自己 " ——这是最大的难题,而不是简单地 " 把模型训大、直接往下做 ",所以未来模型会作为一个重点来研究。

【本文结束】如需转载请务必注明出处:快科技
责任编辑:宪瑞


登录后才可以发布评论哦
打开小程序可以发布评论哦