字节跳动内部讨论训练5-10万亿参数大模型,张一鸣严禁蒸馏

AI资讯 2026-08-09 09:41

2026年8月7日,多家媒体报道字节跳动在大模型领域的最新战略动向。据悉,字节内部正在讨论训练一个参数规模超过5万亿的大模型,甚至有激进方案提出要达到10万亿参数,这将远超阿里Qwen 3.8-Max的2.4万亿和月之暗面K3的2.8万亿。

在近期全员会上,CEO梁汝波公开承认公司与海外顶尖水平的差距正在拉大。创始人张一鸣对此做出明确指示:严禁使用模型蒸馏技术,要求团队必须走"一次跳到同行数倍规模"的硬核路线。目前,字节Seed 2.1模型在SuperCLUE榜单上排名第三,落后于阿里和月之暗面。

专业解读:字节跳动的策略反映了国内大厂在AI军备竞赛中的焦虑与决心。拒绝蒸馏、追求极致参数规模,意味着字节试图通过"大力出奇迹"来弥补算法或数据上的潜在短板。然而,10万亿参数的训练对算力集群和能源消耗是巨大考验,这也将倒逼国产算力基础设施的进一步升级。

返回列表

联系客服

微信:leyistar
QQ: 330168885