智谱发布GLM-5.3:编程能力最强的开源模型

PChome | 编辑: 邸天宇 2026-08-14 14:19:20

智谱正式发布新一代旗舰模型GLM-5.3。最令业界意外的是,新模型的基座与GLM-5.2完全一致,所有性能跃升全部来自后训练阶段的Scaling——数十倍规模的长程任务环境、更丰富的环境类型

PChome 8月14日消息,智谱正式发布新一代旗舰模型GLM-5.3。最令业界意外的是,新模型的基座与GLM-5.2完全一致,所有性能跃升全部来自后训练阶段的Scaling——数十倍规模的长程任务环境、更丰富的环境类型,加上超长的强化学习训练时间。智谱坦言,这个基座的智能上界“远未开发到位"。

回报立竿见影。在智谱内部编程体感评测中,GLM-5.3较前代提升50%,坐上“编程能力最强开源模型"的席位。公开基准上同样势头凶猛:Terminal-Bench 3.0从4.6分跃至28.3分,DeepSWE v1.1从46.2分升至66.9分,Agents' Last Exam从23.8分提到28.5分,前两项均拿下开源第一。在智谱自研的Z.ai Code Bench上,GLM-5.3以31.4%的准确率超过Claude Opus 4.8最高档的29.5%,且单项任务平均仅消耗约5万tokens,而Opus 4.8需要12万——用更短的执行路径完成了更复杂的任务。

更值得关注的是,随着后训练规模扩大,GLM-5.3在网络安全方向涌现出超预期能力。智谱联合清华、奇安信、腾讯玄武等团队,累计在269个项目中发现2436个漏洞,其中1097个为中高危,最早的可追溯至约45年前,预估经济价值达3000万元。为此,智谱同步启动“开源的盾"计划,面向重点开源项目提供免费持续安全审计,并将代码审计能力集成进ZCode。

GLM-5.3即日起上线ZCode、AutoClaw及GLM Coding Plan,并向Trae、扣子、CodeBuddy、Qoder等编码平台开放抢先体验;API将很快上线,完整模型权重将于两周内开源,智谱表示需在此之前完成安全评估与模型加固,以限制潜在攻击能力、保留防御价值。

说明:所有图文均来自网络,版权归原作者所有,如果侵犯您的权益,请联系我们删除。

每日精选

首页 手机 数码相机 笔记本 游戏 DIY硬件 硬件外设 办公中心 数字家电 平板电脑