《晚点LatePost》报道,字节跳动正在讨论训练一个参数规模超5万亿的模型,它超过阿里的Qwen 3.8-Max(2.4万亿参数)和月之暗面的K3(2.8万亿参数),也是目前国内已知参数规模最大的模型。目前计划仍处于早期阶段。
PChome 8月7日消息,据《晚点LatePost》报道,字节跳动正在讨论训练一个参数规模超5万亿的模型,它超过阿里的Qwen 3.8-Max(2.4万亿参数)和月之暗面的K3(2.8万亿参数),也是目前国内已知参数规模最大的模型。目前该计划仍处于早期阶段。

报道称,新模型将由Seed Foundation负责人项亮主导,与大语言模型预训练数据负责人沈科合作。二人均是字节跳动AI及大模型研发体系内的核心骨干,并出自字节的“搜广推”体系。为此,Seed正在重新梳理组织,划分职责,分配资源。

针对字节讨论训练超5万亿参数模型的原因,报道援引接近Seed人士消息称,Seed团队认为,与其在现有尺寸上继续追赶其他大模型,不如把参数规模一次推到同行的数倍,争取领先位置。