谷歌于当地时间周三正式推送Gemini 3.8 Flash极速版,内部代号Skimaki。该版本针对代码补全、多轮对话与长文本摘要进行了底层架构优化,推理吞吐量较前代提升百分之四十,同时保持极低延迟响应。目前该模型已优先向ChatGPT Work、Codex及企业API用户开放,旨在抢占实时编程辅助与客服自动化市场。业内认为此举将进一步加剧主流大模型在效率维度的军备竞赛。 关键要点推理吞吐量提升百分之四十且延迟显著降低优先开放企业级API以抢占实时编程市场底层架构重构支撑高频并发调用场景 返回列表 上一篇 下一篇