阿里巴巴
语音合成
调用阿里 qwen3-tts-instruct-flash 生成语音。
响应约定:
- 非流式返回阿里官方 JSON 响应;
- 流式返回
text/event-stream,透传阿里 SSE 数据。
POST
授权
在请求头中传入 Authorization: Bearer <token>。
请求头
阿里官方 HTTP 流式开关。传 enable 时返回 text/event-stream。
可用选项:
enable 请求体
application/json
模型名称,可用选项:qwen3-tts-instruct-flash。
可用选项:
qwen3-tts-instruct-flash 要合成的文本。该字段支持多语种输入。
使用的音色。参见支持的系统音色。
可用选项:
Cherry, Serena, Ethan, Chelsie, Momo, Vivian, Moon, Maia, Kai, Nofish, Bella, Eldric Sage, Mia, Mochi, Bellona, Vincent, Bunny, Neil, Elias, Arthur, Nini, Seren, Pip, Stella 设置指令,参见指令控制。
默认值:无,不设置时不生效。 最大长度:1600 Token。 支持语言:仅支持中文和英文。 适用范围:该功能仅适用于千问3-TTS-Instruct-Flash-Realtime 系列模型。
对 instructions 进行语义优化,以提升语音合成的自然度和表现力。
默认值:false。
行为说明:当设置为 true 时,系统将对 instructions 的内容进行语义增强与重写,生成更适合语音合成的内部指令。
推荐在追求高品质、精细化语音表达时开启。
依赖 instructions 参数。若 instructions 为空,此参数不生效。
适用范围:该功能仅适用于千问3-TTS-Instruct-Flash 系列模型。
合成音频的语种。默认为 Auto。
Auto:适用于文本包含多种语言或语种不确定的场景。模型自动为不同语言片段匹配发音,但无法保证完全精准。- 指定语种:适用于单一语种文本。指定具体语种能显著提升合成质量,效果通常优于
Auto。
可用选项:
Auto, Chinese, English, German, Italian, Portuguese, Spanish, Japanese, Korean, French, Russian 响应
调用成功。非流式时返回阿里官方 JSON;流式时返回阿里 SSE 数据。