智谱发布GLM-5.3-Flash:与Opus 4.8得分持平

PChome | 编辑: 邸天宇 2026-08-27 12:05:56

智谱正式上线并开源GLM-5.3-Flash(320B-A18B),该模型正是此前在OpenCode、OpenRouter平台匿名测试、被中文社区称作“牛来”的Ox-Alpha,也是GLM-5系列首款原生多模态大模型。

PChome 8月27日消息,智谱正式上线并开源GLM-5.3-Flash(320B-A18B),该模型正是此前在OpenCode、OpenRouter平台匿名测试、被中文社区称作“牛来”的Ox-Alpha,也是GLM-5系列首款原生多模态大模型。

评测数据显示,其在Artificial Analysis综合智能指数中获得57分,与Anthropic旗下Claude Opus 4.8最高档得分持平,跻身全球前沿模型梯队。在智谱自研的Z.ai Code Bench max effort测试中,该模型得分29.0,与Opus 4.8的29.5分差距不足1分。

技术层面,GLM-5.3-Flash总参数320B、激活参数仅18B,基于30T Token多模态语料预训练,是首个采用稀疏注意力与线性注意力混合架构的开源前沿模型,引入流形约束超连接技术提升缩放能力。对比GLM-5.3,其单Token注意力计算量降低3.01倍,KV缓存体积减少4.44倍,支持1M上下文窗口,权重以MIT协议开放,上线即登陆Hugging Face。

成本是本次发布的核心亮点:该模型API常规定价为GLM-5.3的十分之一,限时折扣期可低至二十分之一;按完成同一任务测算,使用成本约为Claude Opus 4.8的四十分之一。

据披露,匿名测试期间Ox-Alpha曾创下双平台调用量新高,全部流量均由国产芯片集群承载。智谱基于SGLang打造专用推理引擎,经张量并行、量化等系列优化,端到端服务性能较初始基线提升3倍,硬件效率接近主流英伟达GPU水平。目前模型已接入Z.ai、智谱清言、ZCode等平台,同步开放BigModel与Z.ai双通道API。

说明:所有图文均来自网络,版权归原作者所有,如果侵犯您的权益,请联系我们删除。

每日精选

首页 手机 数码相机 笔记本 游戏 DIY硬件 硬件外设 办公中心 数字家电 平板电脑