OpenRouter(@OpenRouterAI)

Qwen-Audio-3.0-TTS Flash: optimized for low-latency, real-time interaction, with voice cloning built...

6.5内容质量

TL;DR · AI 摘要

Qwen-Audio-3.0-TTS Flash模型支持16种语言实时交互,内置语音克隆功能可处理不完美参考音频。

核心要点

  • Qwen-Audio-3.0-TTS Flash支持16种语言的文本转语音
  • 模型可处理自然语言指令中的[gasp]、[giggles]等情感标记
  • 语音克隆功能支持不完美参考音频的语音合成

结构提纲

按章节快速跳转。

  1. 宣布Qwen-Audio-3.0-TTS Flash和Plus模型上线OpenRouter

  2. 支持16种语言和自然语言指令解析

  3. 内置语音克隆功能可处理不完美参考音频

  4. 适用于需要实时语音交互的AI产品开发

思维导图

用一张图看清主题之间的关系。

查看大纲文本(无障碍 / 无 JS 友好)
  • Qwen-Audio-3.0-TTS
    • 模型版本
      • Flash
      • Plus
    • 核心能力
      • 16种语言支持
      • 情感指令解析
      • 语音克隆

金句 / Highlights

值得收藏与分享的关键句。

#TTS模型#语音克隆#OpenRouter#多语言支持
打开原文

OpenRouter on X: "Qwen-Audio-3.0-TTS Flash: optimized for low-latency, real-time interaction, with voice cloning built to handle imperfect reference audio. https://t.co/lZJ8s58ho9" / X

OpenRouter

@OpenRouter

7h

Two new

@

Alibaba_Qwen

text-to-speech models are live on OpenRouter. Qwen-Audio-3.0-TTS Flash and Plus speak across 16 languages, follow natural-language direction, and bring scripts to life with inline cues like [gasp], [giggles], and [angry]. More on each below ↓

4

2

62

6.1K