qwen3-tts-flash / qwen3-tts-instruct-flash 多語言多音色文本轉語音, 同步返回 audio bytes
POST /v1/audio/speech
鉴权: {'type': 'bearer', 'prefix': 'sk-', 'description': 'API Key, `Authorization: Bearer sk-xxx`'}
千問 TTS 文本轉語音 — `qwen3-tts-flash` (基礎) / `qwen3-tts-instruct-flash` (支援指令控制情感/語速). ## 特點 - 多語言: 中文 / 英文 / 日文 / 等 - 音色: `Cherry` (預設) / `Ethan` / 等 - 輸出格式: `mp3` (預設) / `wav` PCM 16-bit 24kHz mono - 同步返回 audio bytes (跟 OpenAI tts-1 相容, 已有 OpenAI SDK 專案無縫切換)
model | string | required | TTS 模型. `qwen3-tts-flash` 基礎版; `qwen3-tts-instruct-flash` 支援 `instructions` 控制情感/語速 |
input | string | required | 待合成的文本. 中英混合 OK. 按字元數計費 |
voice | string | 音色名. Aliyun 系: `Cherry` (預設) / `Ethan` / 其他. 不傳或傳 OpenAI 風格 (alloy/echo/...) 會 fallback 到 `Cherry` | |
response_format | string | 音訊格式. `qwen3-tts-flash` 接受 `mp3`/`wav`; `qwen3-tts-instruct-flash` 上游不接受此欄位, 預設輸出 `wav` | |
instructions | string | (僅 `qwen3-tts-instruct-flash`) 自然語言指令, 控制語氣/語速/情感 | |
speed | number | (OpenAI 相容欄位) Aliyun 系不生效, 改用 `instructions` 描述 |
200 — 成功返回音訊二進位制流400 — 參數錯誤 (model 不支援 / voice 不存在 / input 為空 等), 透傳上游 error 原文curl -X POST https://api.router.ai/v1/audio/speech \
-H 'Authorization: Bearer sk-xxx' \
-H 'Content-Type: application/json' \
-d '{
"model": "qwen3-tts-flash",
"input": "你好世界",
"voice": "Cherry",
"response_format": "mp3"
}' \
--output speech.mp3