• 回答数

    0

  • 浏览数

    1

  • 收藏数

    0

作者:admin 发表于 6 小时前
跳转到指定楼层
AI 总结
• 7 月 31 日阿里巴巴发布语音识别大模型 Qwen-Audio-3.0-ASR-Flash,重点优化行业词识别与热词定制化能力。
• 新模型在医疗场景的专业词听中率突破 95.36%,曾在 AI 评测平台以 1.7% 错字率拿下全球第一。
• 该模型具备语音润色能力可直接输出结构化文本,已在会议纪要、实时字幕及智能客服等场景得到验证。
• Qwen-Audio-3.0-ASR 系列现已通过阿里云

IT之家 7 月 31 日消息,阿里巴巴今日发布语音识别大模型 Qwen-Audio-3.0-ASR-Flash 。简单来说,就是让 AI 更好地听懂专业词汇。

Qwen-Audio-3.0-ASR-Flash 主要在上下文一致性、行业词识别和热词定制化三个维度做了系统性的优化,同时让模型具备语音润色能力,可直接输出结构化文本。

研究团队持续从医疗、IT 编程、股票、社会名人等领域里挖掘专业词汇,建成了覆盖多行业的高质量词库,加强模型对专业术语和冷门词的识别。

在最新的行业词汇内部评测中,新模型对各行业专业词的“听中率”都有明显提升, 其中医疗场景更是突破了 95.36% 。



目前,Qwen-Audio-ASR-Flash 系列已经在会议纪要整理、实时字幕、教育录播、智能客服等场景里得到验证,曾在 AI 评测平台 Artificial Analysis 上, 以 1.7% 的错字率拿下全球第一 。

Qwen-Audio-3.0-ASR—— 现已通过阿里云百炼平台开放调用,提供三个版本:



Qwen-Audio-3.0-ASR-Flash:语音识别,最长 5 分钟



Qwen-Audio-3.0-ASR-Filetrans :离线文件转写



Qwen-Audio-3.0-ASR-Streaming :实时语音识别

IT之家附 Qwen-Audio-3.0-ASR-Flash 体验地址如下:

Qwen-Audio-3.0-ASR-Flash:

https://help.aliyun.com/zh/model-studio/non-real-time-speech-recognition-for-fun-asr-flash

Qwen-Audio-3.0-ASR-Flash-Filetrans :

https://help.aliyun.com/zh/model-studio/fun-asr-recorded-speech-recognition-http-api

Qwen-Audio-3.0-ASR-Flash-Streaming :

https://help.aliyun.com/zh/model-studio/fun-asr-realtime-websocket-api

[来源链接] https://www.ithome.com/0/984/044.htm
分享:
回复

使用道具

成为第一个回答人

高级模式 评论
您需要登录后才可以回帖 登录 | 立即注册
⚠️

AI客服助手

×
AI
您好!我是AI客服助手,有什么可以帮助您的吗?

请先登录后使用AI客服助手

立即登录
内容由非常AI大模型生成,仅供参考,相关风险需自行承担。

赚钱

会员VIP

留言板

商务合作

联系电话:17308937318

QQ邮箱

QQ:118275

邮箱:118275@qq.com

友情链接