2026-09-18 14:45 出处 / 作者:PConline 原创整合编辑:科仔播报
【太平洋科技快讯】据智谱官方消息,9 月 18 日,GLM-5.3-FlashX 模型正式上线,最高推理速度可达 200 tokens/s。

上个月,智谱推出的模型 GLM-5.3-Flash,曾以 "Ox Alpha" 代号面向全球开发者测试 ( 详情可查看此前太平洋科技的报道内容:《智谱发布并开源 GLM-5.3-Flash,牛来模型真实身份揭晓》 ) ,收获海内外开发者较多认可,接口调用规模持续走高。GLM-5.3-Flash 在同规格模型当中保持不错的能力表现,同时拥有较高性价比。
伴随业务需求快速上涨,智谱依托 10 万张国产芯片构建的推理算力底座,持续加大基础设施投入,同时开展推理层面的深度优化工作。
今日,智谱正式推出新模型 GLM-5.3-FlashX,API 接口已经全面对外开放,面向企业以及开发者提供响应速度更佳的大模型服务。新模型在原有基础之上完成速度升级,在模型能力、访问速率、服务定价维度形成综合竞争实力。据介绍,GLM-5.3-FlashX 推理速度相比 GLM-5.3-Flash 提升 5 倍,定价上调至原版本的 2.5 倍。


登录后才可以发布评论哦
打开小程序可以发布评论哦