近日,深度求索正式开源V4.1-Flash模型。该模型采用全新架构设计,参数量大幅精简,但原生集成多模态视觉解析模块。官方数据显示,其推理速度较上一代提升逾百分之四十,吞吐量显著优化,且支持无缝向更大参数模型扩展。此举标志着轻量模型在兼顾性能、速度与成本方面取得突破,将有效降低企业部署门槛,推动多模态AI在移动端及物联网设备的规模化应用。评测显示其在基准测试中表现接近前沿水平,具体商业价值待市场验证。
关键要点
- 原生支持视觉理解,打破文本局限
- 推理速度提升百分之四十,吞吐量大幅优化
- 支持平滑扩展至更大参数规模