腾讯桌面智能体Marvis在经历四个月快速迭代后正式升级为AI管家。此次升级重构了底层推理引擎,将高频交互请求移至轻量级本地NPU处理,而复杂的文件检索、跨软件调度与历史数据分析则交由云端异步算力集群完成。这种前后端算力协同架构不仅将响应延迟压缩至毫秒级,还有效控制了用户侧的电池损耗。该设计代表了消费级AI应用从堆砌参数向精细化算力调度的务实转变,优化了用户体验与硬件续航的平衡。
关键要点
- 重构推理引擎实现高频交互本地NPU处理与云端异步协同
- 前后端算力调度将响应延迟压缩至毫秒级并降低功耗
- 消费级AI应用从堆砌参数转向精细化算力调度务实路线