谷歌在其最新发布的Gemini 1.5 Pro模型中首次集成动态稀疏计算引擎。该技术可根据输入内容自动筛选活跃神经元子集,实现按需分配算力资源。实测数据显示,在处理视频分析与复杂文档比对任务时,模型吞吐量提升近两倍,而GPU显存占用显著减少。此举不仅缓解了云端推理的资源压力,也为大规模实时AI服务提供了更具经济可行性的技术路径,受到云计算厂商的高度关注。 关键要点首创动态稀疏激活技术实现按需算力分配单次推理成本与能耗直降约百分之五十视频分析与文档比对任务吞吐量翻倍 返回列表 上一篇 下一篇