PChome 8月27日消息,阿里千问团队与千问办公团队联合宣布,Qwen3.8-Flash模型正式首发上线千问办公,并同步推出“标准模式"。
PChome 8月27日消息,阿里千问团队与千问办公团队联合宣布,Qwen3.8-Flash模型正式首发上线千问办公,并同步推出“标准模式"。自此,用户在处理日常办公任务时,不必再为调用次数和Token消耗精打细算——智能体真正步入“量大管饱"的阶段。

Qwen3.8-Flash采用全新的多模态混合专家架构,总参数达到千亿级,却仅激活其中60亿参数,在性能评测中超越Claude Opus 4.6。千问大模型团队与办公团队针对多步规划、工具选择、上下文压缩等典型办公场景做了专项调优,配合定制Harness架构,让模型与Agent深度协同。
效果直接体现在用户侧:在真实办公场景测试中,标准模式单任务生成速度提升约100%,Token消耗平均减少75%。据官方披露,95%的日常办公任务可通过标准模式完成,仅5%的复杂任务才需切换到高级模式。

这背后是智能密度与工程优化的双重突破。长期以来,高性能意味着高成本和高延迟,低成本又往往要以牺牲智能为代价,三者构成难以兼得的“不可能三角"。Qwen3.8-Flash与千问办公的双向优化,正在拆掉这道墙。
对行业而言,信号更为清晰:当单次调用的门槛大幅降低,企业用户的理性选择不再是缩减AI预算,而是把Agent铺进每一个尚未被自动化的办公环节。推理需求的结构,也正从集中式训练向海量、高并发的调用侧迁移。Agent告别Token焦虑,“量大管饱"的时代,由此开场。