独立算法实验室Tibo近日公布了一项突破性推理模型优化成果。该技术通过重构注意力机制与稀疏激活策略,成功在极低的浮点运算强度下达成与前代旗舰模型相当的性能表现。实测表明,新架构可将单次推理能耗降低超过40%,同时缩短模型微调周期近一半。这一能效突破直击当前AI产业的最大痛点,即高昂的算力租赁与维护成本。随着该技术逐步开源或授权商用,中小型企业将迎来更低门槛的大模型接入窗口,进一步加速AI应用的普惠化进程。 关键要点重构注意力机制实现超低能耗单次推理成本降低超百分之四十大幅降低企业接入门槛 返回列表 上一篇 下一篇