阿里Qwen音频模型降价,语音识别最高降95%
语音API价格继续下探,ASR降幅最大;新模型能力均为Qwen自报,采购成本可按新价重算。
原始事件 2026-09-23
阿里Qwen发布Audio 3.1系列五款音频模型,同时下调语音API价格:TTS约降70%,Realtime约降85%,ASR最高降95%。
新系列覆盖语音识别、语音合成和实时交互。官方称ASR改进多语言与方言识别并自动清理口头语,TTS-Next用扩散方法一次生成语音与音效,实时模型支持边说边听、即时打断。
以上能力描述均为Qwen自报口径,据The Decoder报道,来源为官方博客与X公告,尚无独立评测。做语音应用的成本假设可按新价重算。