阿里云通义千问今日密集发布Qwen-Audio-3.1系列语音大模型,一次性推出五款覆盖自动语音识别、音频理解、语音合成、创作及实时交互的全栈产品。其中TTS-Next具备一次生成语音、音效与环境声的能力,完美支持复杂多角色对话场景。在商业化层面,千问同步实施大幅降价,语音合成API价格下调约七成,实时语音交互降幅达百分之八十五,自动语音识别更是暴跌百分之九十五。全栈模型与极致性价比的结合,正迅速重塑数字人客服、智能车载及内容创作市场的服务标准。
关键要点
- 五款音频模型覆盖识别、合成与交互全链路应用场景
- TTS-Next实现单指令生成多角色对话及复杂环境音效
- 核心API接口价格平均下调百分之七十至九十五