PChome 8月10日消息,Arena平台发布了最新一周的AI大模型盲测排名。国产模型不再是某个方向的“偏科生”,而是在综合能力、写代码、前端开发、生图、视频等多个领域同时冲进了全球前列。
PChome 8月10日消息,Arena平台发布了最新一周的AI大模型盲测排名。这份榜单最值得关注的是——国产模型不再是某个方向的“偏科生”,而是在综合能力、写代码、前端开发、生图、视频等多个领域同时冲进了全球前列。阿里Qwen3.8-Max第一次上榜就拿下了综合榜第6名,得分和排在第5名的Claude Opus 4.6几乎一样。Meta的Muse-Spark-1.2排在第4,但更让人意外的是,综合榜前10名的分数咬得非常紧——差一分排名就可能差出去好几名。

写代码方面,Anthropic的模型还是包揽前三,但月之暗面Kimi-K3-Max升到了第6,阿里Qwen3.8-Max第一次上榜就排到了第8。前端开发领域更有看头——Kimi-K3-Max稳居第2,阿里Qwen3.8-Max拿到第4。智能体方面,Kimi K3也稳在第5名。生图榜单上,阿里的Qwen-Image-3.0-Pro和字节跳动的Seedream-5.0-Pro分别排第7和第8。视频领域,字节跳动的Dreamina-Seedance-2.0-720p保持第2,MiniMax的新模型Minimax-H3第一次上榜就冲到第4,阿里Happyhorse-1.0排第5——前五名里国产占了三个。

从综合到代码、前端、生图、视频,国产大模型正在多个方向上同时逼近全球第一梯队。以前总有人说国产模型“单项能打、综合不行”,但这期榜单的信号很清晰:国产AI的追赶,已经从“能不能上榜”变成了“能占几个席位”。当开发者们用真实投票把国产模型送进一个又一个榜单前列时,这场竞赛的格局正在被改写。