文本轉語音 (千問 TTS)

qwen3-tts-flash / qwen3-tts-instruct-flash 多語言多音色文本轉語音, 同步返回 audio bytes

POST /v1/audio/speech

鉴权: {'type': 'bearer', 'prefix': 'sk-', 'description': 'API Key, `Authorization: Bearer sk-xxx`'}

千問 TTS 文本轉語音 — `qwen3-tts-flash` (基礎) / `qwen3-tts-instruct-flash` (支援指令控制情感/語速). ## 特點 - 多語言: 中文 / 英文 / 日文 / 等 - 音色: `Cherry` (預設) / `Ethan` / 等 - 輸出格式: `mp3` (預設) / `wav` PCM 16-bit 24kHz mono - 同步返回 audio bytes (跟 OpenAI tts-1 相容, 已有 OpenAI SDK 專案無縫切換)

请求体

modelstringrequiredTTS 模型. `qwen3-tts-flash` 基礎版; `qwen3-tts-instruct-flash` 支援 `instructions` 控制情感/語速
inputstringrequired待合成的文本. 中英混合 OK. 按字元數計費
voicestring音色名. Aliyun 系: `Cherry` (預設) / `Ethan` / 其他. 不傳或傳 OpenAI 風格 (alloy/echo/...) 會 fallback 到 `Cherry`
response_formatstring音訊格式. `qwen3-tts-flash` 接受 `mp3`/`wav`; `qwen3-tts-instruct-flash` 上游不接受此欄位, 預設輸出 `wav`
instructionsstring(僅 `qwen3-tts-instruct-flash`) 自然語言指令, 控制語氣/語速/情感
speednumber(OpenAI 相容欄位) Aliyun 系不生效, 改用 `instructions` 描述

响应

调用示例

curl -X POST https://api.router.ai/v1/audio/speech \
  -H 'Authorization: Bearer sk-xxx' \
  -H 'Content-Type: application/json' \
  -d '{
    "model": "qwen3-tts-flash",
    "input": "你好世界",
    "voice": "Cherry",
    "response_format": "mp3"
  }' \
  --output speech.mp3

API 文件