智谱GLM-5.3-FlashX上线:最高200 tokens/s

PChome | 编辑: 邸天宇 2026-09-18 14:30:10

PChome 9月18日消息,智谱正式推出GLM-5.3-FlashX升级模型,该版本最高推理速度可达200 tokens/s,面向企业及开发者群体提供更高效流畅的模型使用体验。

PChome 9月18日消息,智谱正式推出GLM-5.3-FlashX升级模型,该版本最高推理速度可达200 tokens/s,面向企业及开发者群体提供更高效流畅的模型使用体验。

据了解,GLM-5.3-Flash此前曾以“Ox Alpha”之名面向全球开发者推出,上线后获得海内外开发者的广泛认可,模型调用量持续攀升。面对快速增长的使用需求,智谱以10万张国产芯片提供的推理算力为基础,进一步加大基础设施侧的投入力度,开展针对性推理优化工作,本次GLM-5.3-FlashX即是相关优化落地后的升级版本。

官方信息显示,GLM-5.3-Flash长期保持同尺寸级别模型中的最强智能水平,且具备极高性价比,本次速度层面的升级,将推动该产品进一步形成智能、价格、速度三个维度的全面竞争力。目前GLM-5.3-FlashX API已正式上线,开发者调用该模型时使用的Model Key为GLM-5.3-FlashX。

说明:所有图文均来自网络,版权归原作者所有,如果侵犯您的权益,请联系我们删除。

每日精选

首页 手机 数码相机 笔记本 游戏 DIY硬件 硬件外设 办公中心 数字家电 平板电脑