国际投行高盛发布权威研究报告,对AI算力长期需求进行量化推演。报告指出,智能体工作流具有极高的计算密集型特征,单次用户请求往往触发十至二十次顺序模型调用,导致每个任务消耗的Token量是传统聊天机器人的五至三十倍。基于此模型,高盛预测至二零三零年全球每月Token总消耗量将飙升至十万二万亿级别,较二零二六年增长二十四倍。特别是全天候运行的在线智能体,单日Token消耗可能突破十万大关,这对底层GPU集群规模与光模块带宽提出了前所未有的扩容要求。
关键要点
- 智能体单次请求触发多次顺序调用,Token消耗激增
- 二零三零年全球月度Token消耗量预计增长二十四倍
- 全天候在线智能体单日消耗破十万逼格底层算力扩容