主体内容:据澎湃科技不完全统计,截至 2026 年 8 月 20 日,全球各类具身大模型榜单已超过 20 个,其中由中国高校、科研机构或企业牵头联合发布的评测至少超过 11 个。尽管评测数量快速增长,但行业一直缺乏统一的评测标准。专家独家分析:评测标准缺位会扭曲研发方向与采购决策:企业可能针对榜单“刷分”而非解决真实场景问题。谁主导“标尺”谁就掌握产业话语权,具身评测有望成为继语言模型基准测试后的新争夺点,建议关注工信部或行业协会牵头制定统一标准的可能性。 返回列表 上一篇 下一篇