阿里云开发者

Qwen-Audio-3.0系列语音模型正式上线千问AI平台

8.5内容质量
Qwen-Audio-3.0系列语音模型正式上线千问AI平台

TL;DR · AI 摘要

阿里云推出Qwen-Audio-3.0语音模型系列,获全球三大赛道冠军,支持多语种与实时交互,开发者可订阅Token Plan使用。

核心要点

  • Qwen-Audio-3.0-ASR在Artificial Analysis评测中获语音识别全球第一
  • Token Plan个人版Lite套餐每月39元含2500Credits
  • 模型已应用于千问App、千问办公等产品

结构提纲

按章节快速跳转。

  1. 宣布Qwen-Audio-3.0系列模型正式上线千问AI平台

  2. 模型包含ASR/TTS/Realtime三大子模型,支持多语种与实时交互

  3. Artificial Analysis评测中获得语音识别、实时交互、语音合成三赛道全球第一

  4. 已应用于千问App、千问办公、Qoder等产品

  5. 千问AI平台同步上线Qwen3.8-Max、Wan3.0等多模态模型

  6. 推出Token Plan限时优惠,包含个人版与团队版套餐

思维导图

用一张图看清主题之间的关系。

查看大纲文本(无障碍 / 无 JS 友好)
  • Qwen-Audio-3.0系列模型
    • 模型组成
      • ASR语音识别
      • TTS语音合成
      • Realtime实时交互
    • 核心能力
      • 多语种支持
      • 情绪控制
      • 实时对话
    • 商业应用
      • Token Plan订阅
      • 千问App集成

金句 / Highlights

值得收藏与分享的关键句。

#语音模型#阿里云#AI平台#ASR#TTS
打开原文

刚刚,Qwen-Audio-3.0系列语音模型正式上线千问AI平台。开发者可以通过API服务调用模型能力,也可以订阅Token Plan使用。

Image 1: 图片
Image 1: 图片

Qwen-Audio-3.0系列模型是阿里巴巴推出的自研语音模型,包括语音识别大模型Qwen-Audio-3.0-ASR、语音合成大模型Qwen-Audio-3.0-TTS、实时语音交互对话模型Qwen-Audio-3.0-Realtime。

在全球权威AI评测平台Artificial Analysis今年7月的语音排行榜上,该模型斩获语音识别(ASR)、实时交互(RealTime)和语音合成(TTS)三个赛道的全球第一,拿下“大满贯”。

其中,Qwen-Audio-3.0-ASR将语音转为文字,支持复杂语境和专业领域识别;Qwen-Audio-3.0-TTS将文字转为语音,支持多语种、多方言,可控制情绪、语气与节奏;Qwen-Audio-3.0-Realtime支持端到端语音理解与对话,可边听边说、随时打断追问,并支持工具调用。目前该系列模型已在千问App、千问办公、Qoder等产品中应用。

千问AI平台近期密集上线了多款主力模型,包括阿里巴巴新一代基座大模型Qwen3.8-Max、图像生成模型Qwen-image 3.0 pro、全新一代视频生成模型Wan3.0,以及Kimi K3等模型,从文本、代码到语音、图像和视频,开发者可以在一个平台调用不同模态的模型能力。

Token Plan订阅服务限时优惠:

个人版:

Lite 39元/月(每7天2500Credits),Standard 139元/月(4倍Lite用量),Pro 499元/月(16倍Lite用量)

团队版:

标准席位50元/席位/月(降至7.6折),高级席位550元/席位/月(降至7.9折),尊享席位1398元/席位/月

千问 AI 平台-为 Agent 而生,驱动 AI 生产力

扫描下方二维码,直达千问 AI 平台体验

Image 2: Image点击阅读原文即可体验!