当2nm和5GHz沦为配角:骁龙双旗舰与300亿模型的端侧豪赌

PChome | 编辑: 潘玮哲 2026-09-23 14:41:29原创

夏威夷时间9月22日,2026骁龙峰会。高通发布了第六代骁龙8超级至尊版和第六代骁龙8至尊版,双旗舰同发,本身就是新闻。但作为看了十几年骁龙这个山头起落的行业观察者,我更在意另一件事。

PChome报道,夏威夷时间9月22日,2026骁龙峰会。高通发布了第六代骁龙8超级至尊版和第六代骁龙8至尊版,双旗舰同发,本身就是新闻。但作为看了十几年骁龙这个山头起落的行业观察者,我更在意另一件事:这场发布会上,主频、制程这些曾经最能点燃全场的数字,第一次成了配角。站在台上唱主角的,是AI算力。

这不是一次普通的产品迭代。这是一个行业的换道时刻。

回望骁龙十五年:参数表的主角换了一轮又一轮

把骁龙处理器的升级史拉成一条时间轴,主角换了一轮又一轮。

最早大家拼核心数量。从单核到双核、四核、八核,"核多就强"一度是消费者最朴素的认知,厂商海报上的核心数印得比品牌名还大。直到有人发现八核里有四个在"摸鱼",这场竞赛才冷静下来。接着拼主频,从1GHz一路狂奔到3GHz、4GHz,GHz是当年发布会PPT上最大的字号。后来人们意识到频率拉得越高,发热和功耗越失控,"跑分没输过、体验没赢过"的段子就是那个时代的注脚。

再后来是制程。28nm、14nm、7nm、5nm、3nm,每一代制程跃进,都意味着能在同样的面积里塞进更多晶体管。"几纳米"一度成了大众判断手机档次的快捷方式。中间还穿插过连接能力之争,3G、4G、5G,基带支持的频段和"全网通"三个字,都曾值过真金白银。

发现规律了吗?每隔几年,参数表的主角就换一轮,因为旧维度的提升总会撞上边际效应递减这堵墙。这一次,轮到主频和制程让位了。

别误会,第六代骁龙8超级至尊版的底子依然豪华:2纳米制程、定制Oryon CPU峰值频率拉到5GHz、全新Adreno GPU、LPDDR6内存。但这些数字在今年的叙事里只是基础设施。高通真正想让你记住的,是Hexagon NPU为Transformer负载专门加入的Element Accelerator、扩容50%的共享内存、面向AI负载的Adreno Matrix Cores——每一个都指向同一件事:让大模型在手机上跑得动、跑得快、跑得久。

芯片的评价体系正在从"每秒多少亿次运算"切换到"每秒多少个Token"。

双旗舰同发:不是产品线扩充,是防守反击

先说产品策略。高通技术公司高级副总裁兼手机业务总经理Chris Patrick称,发布"两款而非一款"的全新旗舰平台是"重要里程碑"。这话听着喜庆,放在行业格局里看,更像是被竞争逼出来的应对。

过去两年,安卓旗舰芯片早已不是高通一家独大:联发科持续以性价比上探旗舰档,苹果A系列在自研路上越跑越远。高通被夹在中间——往上,需要一颗不计成本秀肌肉的超旗舰撑住技术声望;往下,需要一颗规格体面、成本可控的旗舰保住出货基本盘。超级至尊版和至尊版,恰好各守一端。两款平台同属2纳米世代,共享Oryon CPU、Adreno GPU、Hexagon NPU的核心架构,差异在于性能释放的档位。

对OEM厂商而言,这是实打实的灵活性。小米集团合伙人、总裁卢伟冰的表态很直白:两款平台让小米"能为更广泛的用户带来量身定制的差异化旗舰体验"。翻译过来,标准版用至尊版控成本,Pro/Ultra用超级至尊版堆料。Motorola首次在旗舰系列中采用超级至尊版,多半也是看中"一步到位上顶配"的营销价值。

一颗芯片通吃整个旗舰市场的时代,结束了。

云端AI的原罪:没有网络,一切都不存在

要理解高通为什么把全部筹码押向端侧,得先看清当下AI体验的尴尬。

今天绝大多数手机AI功能——语音助手、文生图、AI修图、大模型问答——本质都是"云端套壳":你说一句话,数据打包上传服务器,算完再传回来。这个模式的毛病是结构性的。首先是时延,网络往返加排队,响应速度永远隔着一层玻璃,你问得越复杂等得越久,"智能"的体验被网络质量绑架。然后是隐私,这是最根本的原罪:你的邮件、聊天记录、日程、照片,只要上云,就存在被截获、被滥用、被拿去训练的可能,即便厂商承诺脱敏,传输和存储的每一个环节都是潜在的泄露风险点。对个人如此,对企业更是合规红线。最后是离线,没有网络一切归零,飞机上、地库里、信号盲区,再强的云端大模型也是一块砖。

端侧AI不是新概念,行业喊了很多年,但过去始终停留在"能跑"而不是"能用"——小模型能力不够,大模型塞不进去。瓶颈从来不在算力,而在内存:几十亿上百亿参数的模型,运行内存需求轻松超过手机的物理上限。

所以这届峰会我真正在意的发布,不是芯片,是那个四方合作演示。


真正的主菜:300亿参数MoE模型,第一次完整跑进手机

高通联合阶跃、无量火、江波龙,基于第六代骁龙8超级至尊版,把阶跃StepEdge-Omni 30B-MoE(混合专家)模型完整部署到了端侧——300亿参数,全程本地运行,不碰云端。这是目前市面上最大规模的手机端侧模型,也是首个在新平台跑通验证的MoE模型。

这件事的技术含金量,藏在四家的分工里。阶跃的MoE架构天然按任务激活部分专家模块,比每次推理激活全部参数的稠密模型省算力;无量火的自研Ember推理引擎跨CPU/GPU/NPU异构调度,不改模型结构、不损失精度,运行内存需求比行业常规方案减少超过50%;江波龙的端侧AI存储方案让模型权重从闪存高效加载,存算协同缓解内存持续占用压力;高通出平台和完整软件栈。一环扣一环,没有一个是多余的。

交出的成绩是:预填充吞吐超330 Token/s(比纯NPU方案提升超30%),解码吞吐超28 Token/s,首个词元实现毫秒级生成——比调用云端API快数倍到数十倍。现场演示里,这个端侧智能体助手完成了从邮件理解、行程规划、日历同步,到航班酒店推荐、行程分享、邮件草拟的全链路自主办公,全程本地完成。

换句话说,手机第一次有能力在物理层面兑现"私人助理"的承诺——你的数据不出设备,响应还比云端快。当然,冷水也要泼:演示基于高通参考设计,量产机的散热、功耗、存储占用能否平衡,要等真机上市检验。

换道之后:两个判断么

基于这届峰会释放的信号,我愿意立字为据,说两个判断。

旗舰机的营销话术会在一年内换血。"安兔兔跑分""几纳米工艺"会让位于"本地能跑多大参数的模型""每秒多少Token""首词元延迟几毫秒",就像当年核心数和GHz登上海报一样,AI算力指标会成为新的消费者认知入口——哪怕多数人一开始并不懂Token是什么。

另一个判断关于格局。高通+阶跃+无量火+江波龙的四方模式已经打了个样:芯片厂出算力、模型厂出算法、引擎厂出优化、存储厂出方案。未来两年,没有绑定端侧模型方案的手机品牌会在AI叙事上掉队,而没有登上旗舰芯片平台的模型公司会失去最重要的落地入口。字节跳动不做手机,却把豆包手机助手送进了骁龙生态的合作伙伴名单——AI公司正在绕开硬件门槛,直接卡位下一代交互入口,这场卡位战才刚开始。至于端云之争,我倾向认为端云混合只是过渡——邮件、日程、聊天记录、健康数据这些Agent最需要理解、也最不能出事的场景,会率先完成端侧化;云端继续承担超大规模训练和通用问答,但"懂你的那个AI"必须长在本地。

结语

高通总裁兼CEO安蒙说"智能体时代已经到来",高通传播副总裁Clare Conley写道,行业正在"从与工具交互,迈向与系统协作"。这些判断我基本认同,但要补一句:智能体时代真正到来的标志,不是芯片能跑多大的模型,而是普通人愿不愿意每天让AI替自己回邮件、订机票、安排日程。这考验的不只是算力,还有信任与习惯。

从拼核心数到拼主频,从拼制程到拼基带,骁龙的每一次换道都重新定义了手机的竞争规则。这一次,赌注下在AI算力上,赌的是人与设备关系的重构。考卷已经发下,iQOO 16、红魔12 Pro+和小米、荣耀的新旗舰们,会替整个行业写下第一行的答案。

相关阅读

每日精选

点击查看更多

首页 手机 数码相机 笔记本 游戏 DIY硬件 硬件外设 办公中心 数字家电 平板电脑