太平洋电脑网 21小时前
智谱发布GLM-5.3-FlashX模型,推理速度最高可达200 tokens/s
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

2026-09-18 14:45 出处 / 作者:PConline 原创整合编辑:科仔播报

【太平洋科技快讯】据智谱官方消息,9 月 18 日,GLM-5.3-FlashX 模型正式上线,最高推理速度可达 200 tokens/s。

上个月,智谱推出的模型 GLM-5.3-Flash,曾以 "Ox Alpha" 代号面向全球开发者测试 ( 详情可查看此前太平洋科技的报道内容:《智谱发布并开源 GLM-5.3-Flash,牛来模型真实身份揭晓》 ) ,收获海内外开发者较多认可,接口调用规模持续走高。GLM-5.3-Flash 在同规格模型当中保持不错的能力表现,同时拥有较高性价比。

伴随业务需求快速上涨,智谱依托 10 万张国产芯片构建的推理算力底座,持续加大基础设施投入,同时开展推理层面的深度优化工作。

今日,智谱正式推出新模型 GLM-5.3-FlashX,API 接口已经全面对外开放,面向企业以及开发者提供响应速度更佳的大模型服务。新模型在原有基础之上完成速度升级,在模型能力、访问速率、服务定价维度形成综合竞争实力。据介绍,GLM-5.3-FlashX 推理速度相比 GLM-5.3-Flash 提升 5 倍,定价上调至原版本的 2.5 倍。

智客推

智客推

ZAKER 智客推 GEO | AI 时代的品牌认知解决方案

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

对外开放 基础设施 芯片 开源
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论