阿里发布 Qwen-Audio-3.0-ASR-Flash 语音识别大模型,让 AI 更好听懂专业词汇
7 月 31 日
阿里巴巴发布语音识别大模型 Qwen-Audio-3.0-ASR-Flash,该模型在上下文一致性、行业词识别、热词定制化方面优化,具备语音润色及结构化文本输出能力,其依托多行业高质量词库提升专业词识别率,医疗场景听中率达 95.36%。Qwen-Audio-ASR-Flash 系列已在会议纪要整理等多场景验证,曾以 1.7% 错字率获 AI 评测平台全球第一。目前 Qwen-Audio-3.0-ASR 通过阿里云百炼平台开放调用,含语音识别、离线文件转写、实时语音识别三个版本。
体验专业版特色功能,拓展更丰富、更全面的相关内容。