Qwen-Audio-3.0系列语音模型正式上线千问AI平台
TL;DR · AI 摘要
阿里云推出Qwen-Audio-3.0语音模型系列,获全球三大赛道冠军,支持多语种与实时交互,开发者可订阅Token Plan使用。
核心要点
- Qwen-Audio-3.0-ASR在Artificial Analysis评测中获语音识别全球第一
- Token Plan个人版Lite套餐每月39元含2500Credits
- 模型已应用于千问App、千问办公等产品
结构提纲
按章节快速跳转。
- §模型发布
宣布Qwen-Audio-3.0系列模型正式上线千问AI平台
- ·技术亮点
模型包含ASR/TTS/Realtime三大子模型,支持多语种与实时交互
- ›评测成绩
在Artificial Analysis评测中获得语音识别、实时交互、语音合成三赛道全球第一
- ·应用场景
已应用于千问App、千问办公、Qoder等产品
- §平台更新
千问AI平台同步上线Qwen3.8-Max、Wan3.0等多模态模型
- ·订阅服务
推出Token Plan限时优惠,包含个人版与团队版套餐
思维导图
用一张图看清主题之间的关系。
查看大纲文本(无障碍 / 无 JS 友好)
- Qwen-Audio-3.0系列模型
- 模型组成
- ASR语音识别
- TTS语音合成
- Realtime实时交互
- 核心能力
- 多语种支持
- 情绪控制
- 实时对话
- 商业应用
- Token Plan订阅
- 千问App集成
金句 / Highlights
值得收藏与分享的关键句。
Qwen-Audio-3.0-Realtime支持端到端语音理解与对话,可边听边说、随时打断追问
Qwen-Audio-3.0-TTS支持多语种、多方言,可控制情绪、语气与节奏
个人版Lite套餐每月39元,Standard套餐为Lite的4倍用量
刚刚,Qwen-Audio-3.0系列语音模型正式上线千问AI平台。开发者可以通过API服务调用模型能力,也可以订阅Token Plan使用。
Qwen-Audio-3.0系列模型是阿里巴巴推出的自研语音模型,包括语音识别大模型Qwen-Audio-3.0-ASR、语音合成大模型Qwen-Audio-3.0-TTS、实时语音交互对话模型Qwen-Audio-3.0-Realtime。
在全球权威AI评测平台Artificial Analysis今年7月的语音排行榜上,该模型斩获语音识别(ASR)、实时交互(RealTime)和语音合成(TTS)三个赛道的全球第一,拿下“大满贯”。
其中,Qwen-Audio-3.0-ASR将语音转为文字,支持复杂语境和专业领域识别;Qwen-Audio-3.0-TTS将文字转为语音,支持多语种、多方言,可控制情绪、语气与节奏;Qwen-Audio-3.0-Realtime支持端到端语音理解与对话,可边听边说、随时打断追问,并支持工具调用。目前该系列模型已在千问App、千问办公、Qoder等产品中应用。
千问AI平台近期密集上线了多款主力模型,包括阿里巴巴新一代基座大模型Qwen3.8-Max、图像生成模型Qwen-image 3.0 pro、全新一代视频生成模型Wan3.0,以及Kimi K3等模型,从文本、代码到语音、图像和视频,开发者可以在一个平台调用不同模态的模型能力。
Token Plan订阅服务限时优惠:
个人版:
Lite 39元/月(每7天2500Credits),Standard 139元/月(4倍Lite用量),Pro 499元/月(16倍Lite用量)
团队版:
标准席位50元/席位/月(降至7.6折),高级席位550元/席位/月(降至7.9折),尊享席位1398元/席位/月
千问 AI 平台-为 Agent 而生,驱动 AI 生产力
扫描下方二维码,直达千问 AI 平台体验
点击阅读原文即可体验!