文本转语音 (千问 TTS)

qwen3-tts-flash / qwen3-tts-instruct-flash 多语言多音色文本转语音, 同步返回 audio bytes

POST /v1/audio/speech

Auth: {'type': 'bearer', 'prefix': 'sk-', 'description': 'API Key, `Authorization: Bearer sk-xxx`'}

千问 TTS 文本转语音 — `qwen3-tts-flash` (基础) / `qwen3-tts-instruct-flash` (支持指令控制情感/语速). ## 特点 - 多语言: 中文 / 英文 / 日文 / 等 - 音色: `Cherry` (默认) / `Ethan` / 等 - 输出格式: `mp3` (默认) / `wav` PCM 16-bit 24kHz mono - 同步返回 audio bytes (跟 OpenAI tts-1 兼容, 已有 OpenAI SDK 项目无缝切换)

Request body

modelstringrequiredTTS 模型. `qwen3-tts-flash` 基础版; `qwen3-tts-instruct-flash` 支持 `instructions` 控制情感/语速
inputstringrequired待合成的文本. 中英混合 OK. 按字符数计费
voicestring音色名. Aliyun 系: `Cherry` (默认) / `Ethan` / 其他. 不传或传 OpenAI 风格 (alloy/echo/...) 会 fallback 到 `Cherry`
response_formatstring音频格式. `qwen3-tts-flash` 接受 `mp3`/`wav`; `qwen3-tts-instruct-flash` 上游不接受此字段, 默认输出 `wav`
instructionsstring(仅 `qwen3-tts-instruct-flash`) 自然语言指令, 控制语气/语速/情感
speednumber(OpenAI 兼容字段) Aliyun 系不生效, 改用 `instructions` 描述

Responses

Example

curl -X POST https://api.router.ai/v1/audio/speech \
  -H 'Authorization: Bearer sk-xxx' \
  -H 'Content-Type: application/json' \
  -d '{
    "model": "qwen3-tts-flash",
    "input": "你好世界",
    "voice": "Cherry",
    "response_format": "mp3"
  }' \
  --output speech.mp3

API reference