|
阿里千问正式推出Qwen-Audio-3.1全系列五款语音大模型,覆盖语音识别、合成、实时交互、音频创作、音频理解五大核心场景。全线模型同步降价,其中ASR服务价格直降95%,TTS、实时交互版本分别下调70%、85%。 技术上,核心ASR版本首字响应仅160毫秒,支持30种语言加16种中文方言分角色转写,公开测试集平均字错误率低至4.55%。这背后全双工实时交互版本支持随时插话打断,目前已经接入千问办公等Agent,以及多款AI眼镜智能硬件,直接把语音大模型的商用门槛打穿。 |
AI INSIGHT
阿里千问新推五款语音大模型 ASR价格直降95%
AI 摘要
阿里千问正式推出Qwen-Audio-3.1全系列五款语音大模型,覆盖语音识别、合成、实时交互、音频创作、音频理解五大核心场景。全线模型同步降价,其中ASR服务价格直降95%,TTS、实时交互版本分别下调70%、85%。技术上,核心ASR版本首字响应仅160毫秒,支持30种语言加16种中文方言分角色转写,公开测试集平均字错误率低至4.55%。这背后全双工实时交互版本支持随时插话打断