Qwen 发布 Audio-3.0-ASR-Flash

主打上下文一致性、领域术语识别、自定义热词,以及将语音润色输出为结构化文本等能力。内部测试显示,该模型医学术语召回率达 95.36%,工业术语召回率达 93.24%。

模型提供三种部署形态:实时流式识别(Streaming)、录制文件转录(Filetrans)和非实时识别,均已通过阿里云模型服务上线。

上一篇:

下一篇:

发表回复

登录后才能评论
分享本页
返回顶部
🍁
🔈Hi,朋友。欢迎来到 木木的博客小站