强化学习之父 Sutton 最新访谈:合成数据是巨大错误,大模型只完成 1/4 智能

AI资讯 2026-08-23 16:10

主体内容:红杉资本播客《Training Data》发布对强化学习奠基人、2024 年图灵奖得主 Rich Sutton 的对谈。他指出合成数据是“巨大错误”,当前大模型主要依赖预训练与后训练,上线后参数不再更新,只完成约四分之一的智能,持续学习是行业待突破的基础问题。

专家独家分析:作为强化学习旗手,Sutton 的“持续学习”主张与近期“告别合成数据内卷”的行业反思共振。其指向在于下一代模型架构须从静态训练转向“部署后自学习”——这意味着模型工程栈、算力调度与数据策略都要重新设计,把“持续学习能力”列为新模型的硬指标。


关注小程序免费看电子书(资讯详情)
返回列表

联系客服

微信:leyistar
QQ: 330168885