彭博研报:DeepSeek V4.1 Flash带动中美顶尖模型跑分差距缩至3%

PChome | 编辑: 吉如雅 2026-10-05 22:33:46

据彭博行业研究高级分析师罗伯特·利亚在近期研报中表示:“在DeepSeek于9月发布V4.1 Flash之后,中国顶尖模型在基准测试得分上,仅落后美国竞争对手3%"。

PChome 10月5日消息,据彭博行业研究高级分析师罗伯特·利亚在近期研报中表示:“在DeepSeek于9月发布V4.1 Flash之后,中国顶尖模型在基准测试得分上,仅落后美国竞争对手3%"。据他的分析,这个差距相比5月时的约9%,以及今年早些时候一度高达15%,有了明显收缩。

他给出的具体依据是LiveBench基准,DeepSeek V4.1 Flash在9月的LiveBench全球排名中位列第六,这是自2025年DeepSeek凭推理模型R1做出突破以来,排名最高的中国模型。当时DeepSeek最近一次的LiveBench得分为81.1分,低于Anthropic最高的83.4分。正因如此,利亚认为DeepSeek模型的表现“已经可以和Anthropic、OpenAI那些领先的AI系统相提并论”,并且这种持续的性能进步,意味着中国竞争者有望进一步扩大市场份额。

据公开资料,DeepSeek V4.1 Flash模型正式发布于2026年9月10日。 据DeepSeek官方对外信息,V4.1 Flash是它全新模型结构系列中尺寸最小的产品,具备原生多模态视觉理解能力,官方给出的设计目标是更高的能力上限、更快的推理速度、更大的吞吐,以及能够扩展到更大参数规模。它已经同步上线DeepSeek API,API定价有所下调、采用峰谷分时计费,并且腾讯(WorkBuddy、CodeBuddy)和OpenCode作为官方合作伙伴已全量接入,模型也在HuggingFace上开源。

此外,利亚还点出了中国模型的优势来源,AI专业能力的持续深化,以及研究人员针对国产硬件做模型优化的能力。他也由此延伸出一个产业与政策层面的判断,这些进展“进一步让人质疑美国在AI领域的科技主导地位能否长期维持”,也让外界对美国限制技术出口做法的有效性提出疑问。

彭博行业研究总体的说法是,过去几个月,随着DeepSeek等中国AI实验室不断进步,美国AI公司相对中国同行的性能领先优势“急剧缩小、降到历史最低水平”,这让美国的科技主导地位面临威胁。但分析师也表示,LiveBench评出的前15个模型中,其实只有3个来自中国,“无论模型在排行榜上排第几,变现都可能很困难”。

总结来看,DeepSeek V4.1 Flash的发布是确定的官方进展,而“3%差距”是市场观察者对“中美顶尖大模型差距在快速缩小”这一趋势的量化描述。

说明:所有图文均来自网络,版权归原作者所有,如果侵犯您的权益,请联系我们删除。

每日精选

首页 手机 数码相机 笔记本 游戏 DIY硬件 硬件外设 办公中心 数字家电 平板电脑