8月6日,据《晚点LatePost》报道,字节跳动正在讨论训练一个参数规模超5万亿的超大模型。
5万亿是什么概念?超过阿里Qwen3.8-Max的2.4万亿和月之暗面K3的2.8万亿之和。如果落地,这将是国内已知参数规模最大的模型。新模型由Seed Foundation负责人项亮牵头,与大语言模型预训练数据负责人沈科共同推进。Seed团队正重新梳理组织、划分职责、分配资源。
字节的算力底牌有多厚?
截至今年6月,豆包大模型日均Token调用量达180万亿,字节大模型业务年化收入已达40亿美元。支撑这些数字的,是字节在算力基础设施上的持续重仓。训练5万亿参数的模型,对算力的要求远超现有任何国产模型——这不仅是模型竞赛,更是算力竞赛。
从DeepSeek的1.6万亿到Kimi K3的2.8万亿,再到Qwen3.8的2.4万亿,国产大模型的参数纪录在短短几个月内被反复刷新。字节的5万亿计划,直接把这个数字推到了另一个量级。
一位业内人士分析,字节此举意味着国内大模型正从“应用层优势”向“底层模型参数规模”发起全面冲击。国内大模型“参数竞赛”进入5万亿量级时代,与海外模型的差距正在进一步收敛。
当然,5万亿仍处于早期讨论阶段。更大的模型不等于更好的模型——训练效率、推理成本、实际能力,才是真正的考验。但字节敢讨论5万亿,至少说明了一件事:中国AI的算力天花板,还远没到顶。
A5创业网 版权所有