Qwen Audio 3.0 TTS Plus API 接口、参数 & 代码示例

qwen/qwen-audio-3.0-tts-plus

Qwen Audio 3.0 TTS Plus 是面向高质量语音生成场景打造的高性能语音合成大模型。相比前一版本,此模型支持更多小语种和中文方言,显著提升方言发音的正宗程度,并增强了 free-style 指令遵循能力和细粒度标签控制能力,可更准确地控制情绪、语气、角色、语速、音量和合成风格。

模型 ID
qwen/qwen-audio-3.0-tts-plus
模型系列
Qwen
更新日期
模型能力
语音合成
模型价格(每千字符)
¥ 16
默认音色
longanlingxin
默认音频格式
mp3

Qwen Audio 3.0 TTS Plus 模型介绍:

Qwen Audio 3.0 TTS Plus 是通义实验室(阿里云千问大模型家族)推出的新一代高质量语音合成(TTS)大模型

该模型面向高质量生成与专业创作场景,主打超高音色还原度自然的情感表达以及精细化的控制能力


核心定位与技术特点:

维度 qwen-audio-3.0-tts-plus 特性规格
主要定位 面向影视配音、有声书、严肃内容创作等高质量生成场景
音频采样率 48kHz 高采样率输出(达到录音棚/影视配音级音质)
单次合成时长 支持单次长文本合成最高 3 分钟
多语言支持 支持 16 种语言(含中、英、日、韩、德、阿拉伯、越南、马来、菲律宾等)
方言覆盖 支持粤语、四川话、重庆话、东北话、陕西话、上海话、云南话等 20 种方言
榜单表现 在权威评测榜单 Artificial Analysis 语音合成大模型排名中登顶

核心亮点与能力提升:

  • 自然语言指令控制(Free-style Prompting): 支持通过自然语言指令直接控制语音的语气、情绪和朗读节奏(例如:“用极度悲伤且带哽咽的语气说”、“用兴奋激昂的语气,语速加快”),让 AI 语音跨入“戏剧表演”时代。
  • 精细化标签控制: 允许在文本中精准插入情绪、笑声、停顿、重音等细粒度标签(Tag Control),实现行云流水般的对话与表达。
  • 复杂声学鲁棒性: 在克隆或参考音频环境较差(如背景噪音、低质量录音)的情况下,模型依然能稳定提取音色特征并生成清晰干净的语音。
  • 开箱即用精品音色库: 内置丰富的角色和高品质基础音色,同时支持高质量的声音复刻与声音定制。

与 sibling 模型 Flash 的对比:

同系列发布了两个版本,可根据场景灵活选择:

  • qwen-audio-3.0-tts-plus:强调音质极佳、表达细腻、高采样率,适合生成录音棚级别的音频文件(如有声故事、播客、视频配音)。
  • qwen-audio-3.0-tts-flash:强调超低延迟(首包约 300ms),专门面向实时语音对话、AI 助手等端到端交互场景。

API 接口地址:

https://wcode.net/api/gpt/v1/audio/speech

此 API 接口兼容 OpenAI 的 Text-to-Speech 接口规范,可直接使用 OpenAI 的 SDK 来调用。仅需替换以下配置即可:

  1. base_url 替换为 https://wcode.net/api/gpt/v1
  2. api_key 替换为从 https://platform.wcode.net 获取到的 API Key

具体可参考下方的各编程语言代码示例中的 OpenAI SDK 调用示例。

请求方法:

POST

各编程语言代码示例:

# TODO: 以下代码中的 API_KEY 需要替换,获取 API Key 入口:https://platform.wcode.net
# 响应为音频二进制,可使用 --output speech.mp3 保存文件
curl --request POST 'https://wcode.net/api/gpt/v1/audio/speech' \
--header 'Content-Type: application/json' \
--header 'Authorization: Bearer API_KEY' \
--output speech.mp3 \
--data '{
    "model": "qwen/qwen-audio-3.0-tts-plus",
    "input": "你好,今天天气怎么样。",
    "voice": "longanlingxin",
    "response_format": "mp3"
}'
import Foundation

let headers = [
  "Authorization": "Bearer API_KEY",  // TODO: 这里的 API_KEY 需要替换,获取 API Key 入口:https://platform.wcode.net
  "content-type": "application/json"
]
let parameters = [
  "model": "qwen/qwen-audio-3.0-tts-plus",
  "input": "你好,今天天气怎么样。",
  "voice": "longanlingxin",
  "response_format": "mp3"
] as [String : Any]

let postData = JSONSerialization.data(withJSONObject: parameters, options: [])

let request = NSMutableURLRequest(url: NSURL(string: "https://wcode.net/api/gpt/v1/audio/speech")! as URL,
                                        cachePolicy: .useProtocolCachePolicy,
                                    timeoutInterval: 60.0)
request.httpMethod = "POST"
request.allHTTPHeaderFields = headers
request.httpBody = postData as Data

let session = URLSession.shared
let dataTask = session.dataTask(with: request as URLRequest, completionHandler: { (data, response, error) -> Void in
  if (error != nil) {
    print(error as Any)
  } else if let data = data {
    try? data.write(to: URL(fileURLWithPath: "speech.mp3"))
  }
})

dataTask.resume()
import 'dart:convert';
import 'dart:io';
import 'package:http/http.dart' as http;

Future<void> main() async {
  var headers = {
    'Content-Type': 'application/json',
    'Authorization': 'Bearer API_KEY'  // TODO: 这里的 API_KEY 需要替换,获取 API Key 入口:https://platform.wcode.net
  };
  var request = http.Request('POST', Uri.parse('https://wcode.net/api/gpt/v1/audio/speech'));
  request.body = json.encode({
    "model": "qwen/qwen-audio-3.0-tts-plus",
    "input": "你好,今天天气怎么样。",
    "voice": "longanlingxin",
    "response_format": "mp3"
  });
  request.headers.addAll(headers);

  http.StreamedResponse response = await request.send();

  if (response.statusCode == 200) {
    var bytes = await response.stream.toBytes();
    File('speech.mp3').writeAsBytesSync(bytes);
  }
  else {
    print(response.reasonPhrase);
  }
}
require 'uri'
require 'net/http'

url = URI("https://wcode.net/api/gpt/v1/audio/speech")

http = Net::HTTP.new(url.host, url.port)
http.use_ssl = true

request = Net::HTTP::Post.new(url)
request["Authorization"] = 'Bearer API_KEY'  # TODO: 这里的 API_KEY 需要替换,获取 API Key 入口:https://platform.wcode.net
request["content-type"] = 'application/json'
request.body = "{\"model\":\"qwen/qwen-audio-3.0-tts-plus\",\"input\":\"你好,今天天气怎么样。\",\"voice\":\"longanlingxin\",\"response_format\":\"mp3\"}"

response = http.request(request)
File.write("speech.mp3", response.body) if response.is_a?(Net::HTTPSuccess)
use serde_json::json;
use reqwest;
use std::fs;

#[tokio::main]
pub async fn main() {
  let url = "https://wcode.net/api/gpt/v1/audio/speech";

  let payload = json!({
    "model": "qwen/qwen-audio-3.0-tts-plus",
    "input": "你好,今天天气怎么样。",
    "voice": "longanlingxin",
    "response_format": "mp3"
  });

  let mut headers = reqwest::header::HeaderMap::new();
  headers.insert("Authorization", "Bearer API_KEY".parse().unwrap());  // TODO: 这里的 API_KEY 需要替换,获取 API Key 入口:https://platform.wcode.net
  headers.insert("content-type", "application/json".parse().unwrap());

  let client = reqwest::Client::new();
  let response = client.post(url)
    .headers(headers)
    .json(&payload)
    .send()
    .await
    .unwrap();

  let audio_bytes = response.bytes().await.unwrap();
  fs::write("speech.mp3", audio_bytes).unwrap();
}
#include <stdio.h>
#include <curl/curl.h>

static size_t write_callback(void *contents, size_t size, size_t nmemb, void *userp) {
  return fwrite(contents, size, nmemb, (FILE *)userp);
}

CURL *hnd = curl_easy_init();

curl_easy_setopt(hnd, CURLOPT_CUSTOMREQUEST, "POST");
curl_easy_setopt(hnd, CURLOPT_URL, "https://wcode.net/api/gpt/v1/audio/speech");

struct curl_slist *headers = NULL;
headers = curl_slist_append(headers, "Authorization: Bearer API_KEY");  // TODO: 这里的 API_KEY 需要替换,获取 API Key 入口:https://platform.wcode.net
headers = curl_slist_append(headers, "content-type: application/json");
curl_easy_setopt(hnd, CURLOPT_HTTPHEADER, headers);

curl_easy_setopt(hnd, CURLOPT_POSTFIELDS, "{\"model\":\"qwen/qwen-audio-3.0-tts-plus\",\"input\":\"你好,今天天气怎么样。\",\"voice\":\"longanlingxin\",\"response_format\":\"mp3\"}");

FILE *fp = fopen("speech.mp3", "wb");
curl_easy_setopt(hnd, CURLOPT_WRITEFUNCTION, write_callback);
curl_easy_setopt(hnd, CURLOPT_WRITEDATA, fp);

CURLcode ret = curl_easy_perform(hnd);

fclose(fp);
curl_easy_cleanup(hnd);
curl_slist_free_all(headers);
package main

import (
  "fmt"
  "os"
  "strings"
  "net/http"
  "io"
)

func main() {
  url := "https://wcode.net/api/gpt/v1/audio/speech"

  payload := strings.NewReader("{\"model\":\"qwen/qwen-audio-3.0-tts-plus\",\"input\":\"你好,今天天气怎么样。\",\"voice\":\"longanlingxin\",\"response_format\":\"mp3\"}")

  req, _ := http.NewRequest("POST", url, payload)

  req.Header.Add("Authorization", "Bearer API_KEY")  // TODO: 这里的 API_KEY 需要替换,获取 API Key 入口:https://platform.wcode.net
  req.Header.Add("content-type", "application/json")

  res, _ := http.DefaultClient.Do(req)

  defer res.Body.Close()
  body, _ := io.ReadAll(res.Body)

  os.WriteFile("speech.mp3", body, 0644)
  fmt.Println(res.Status)
}
using System.Net.Http.Headers;


var client = new HttpClient();

var request = new HttpRequestMessage(HttpMethod.Post, "https://wcode.net/api/gpt/v1/audio/speech");

request.Headers.Add("Authorization", "Bearer API_KEY");  // TODO: 这里的 API_KEY 需要替换,获取 API Key 入口:https://platform.wcode.net

request.Content = new StringContent("{\"model\":\"qwen/qwen-audio-3.0-tts-plus\",\"input\":\"你好,今天天气怎么样。\",\"voice\":\"longanlingxin\",\"response_format\":\"mp3\"}", null, "application/json");

var response = await client.SendAsync(request);

response.EnsureSuccessStatusCode();

await File.WriteAllBytesAsync("speech.mp3", await response.Content.ReadAsByteArrayAsync());
var client = new RestClient("https://wcode.net/api/gpt/v1/audio/speech");

var request = new RestRequest("", Method.Post);

request.AddHeader("Authorization", "Bearer API_KEY");  // TODO: 这里的 API_KEY 需要替换,获取 API Key 入口:https://platform.wcode.net

request.AddHeader("content-type", "application/json");

request.AddParameter("application/json", "{\"model\":\"qwen/qwen-audio-3.0-tts-plus\",\"input\":\"你好,今天天气怎么样。\",\"voice\":\"longanlingxin\",\"response_format\":\"mp3\"}", ParameterType.RequestBody);

var response = client.Execute(request);

if (response.IsSuccessful && response.RawBytes != null)
    await File.WriteAllBytesAsync("speech.mp3", response.RawBytes);
const axios = require('axios');
const fs = require('fs');

let data = JSON.stringify({
  "model": "qwen/qwen-audio-3.0-tts-plus",
  "input": "你好,今天天气怎么样。",
  "voice": "longanlingxin",
  "response_format": "mp3"
});

let config = {
  method: 'post',
  maxBodyLength: Infinity,
  url: 'https://wcode.net/api/gpt/v1/audio/speech',
  responseType: 'arraybuffer',
  headers: {
    'Content-Type': 'application/json',
    'Authorization': 'Bearer API_KEY'  // TODO: 这里的 API_KEY 需要替换,获取 API Key 入口:https://platform.wcode.net
  },
  data : data
};

axios.request(config).then((response) => {
  fs.writeFileSync('speech.mp3', response.data);
}).catch((error) => {
  console.log(error);
});
import java.nio.file.Files;
import java.nio.file.Path;

OkHttpClient client = new OkHttpClient();

MediaType mediaType = MediaType.parse("application/json");

RequestBody body = RequestBody.create(mediaType, "{\"model\":\"qwen/qwen-audio-3.0-tts-plus\",\"input\":\"你好,今天天气怎么样。\",\"voice\":\"longanlingxin\",\"response_format\":\"mp3\"}");

Request request = new Request.Builder()
  .url("https://wcode.net/api/gpt/v1/audio/speech")
  .post(body)
  .addHeader("Authorization", "Bearer API_KEY")  // TODO: 这里的 API_KEY 需要替换,获取 API Key 入口:https://platform.wcode.net
  .addHeader("content-type", "application/json")
  .build();

try (Response response = client.newCall(request).execute()) {
  if (response.isSuccessful() && response.body() != null) {
    Files.write(Path.of("speech.mp3"), response.body().bytes());
  }
}
$client = new \GuzzleHttp\Client();

$headers = [
  'Content-Type' => 'application/json',
  'Authorization' => 'Bearer API_KEY',  // TODO: 这里的 API_KEY 需要替换,获取 API Key 入口:https://platform.wcode.net
];

$body = '{
  "model": "qwen/qwen-audio-3.0-tts-plus",
  "input": "你好,今天天气怎么样。",
  "voice": "longanlingxin",
  "response_format": "mp3"
}';

$request = new \GuzzleHttp\Psr7\Request('POST', 'https://wcode.net/api/gpt/v1/audio/speech', $headers, $body);

$response = $client->sendAsync($request)->wait();

file_put_contents('speech.mp3', $response->getBody()->getContents());
$curl = curl_init();

curl_setopt_array($curl, [
  CURLOPT_URL => "https://wcode.net/api/gpt/v1/audio/speech",
  CURLOPT_RETURNTRANSFER => true,
  CURLOPT_ENCODING => "",
  CURLOPT_MAXREDIRS => 5,
  CURLOPT_TIMEOUT => 300,
  CURLOPT_CUSTOMREQUEST => "POST",
  CURLOPT_POSTFIELDS => json_encode([
    'model' => 'qwen/qwen-audio-3.0-tts-plus',
    'input' => '你好,今天天气怎么样。',
    'voice' => 'longanlingxin',
    'response_format' => 'mp3',
  ]),
  CURLOPT_HTTPHEADER => [
    "Authorization: Bearer API_KEY",  // TODO: 这里的 API_KEY 需要替换,获取 API Key 入口:https://platform.wcode.net
    "content-type: application/json",
  ],
]);

$response = curl_exec($curl);
$error = curl_error($curl);

curl_close($curl);

if ($error) {
  echo "cURL Error #:" . $error;
} else {
  file_put_contents('speech.mp3', $response);
}
import requests

url = "https://wcode.net/api/gpt/v1/audio/speech"

payload = {
  "model": "qwen/qwen-audio-3.0-tts-plus",
  "input": "你好,今天天气怎么样。",
  "voice": "longanlingxin",
  "response_format": "mp3"
}

headers = {
  "Authorization": "Bearer API_KEY",  # TODO: 这里的 API_KEY 需要替换,获取 API Key 入口:https://platform.wcode.net
  "content-type": "application/json"
}

response = requests.post(url, json=payload, headers=headers)

with open("speech.mp3", "wb") as f:
  f.write(response.content)
from openai import OpenAI

client = OpenAI(
  base_url="https://wcode.net/api/gpt/v1",
  api_key="API_KEY"  # TODO: 这里的 API_KEY 需要替换,获取 API Key 入口:https://platform.wcode.net
)

response = client.audio.speech.create(
  model="qwen/qwen-audio-3.0-tts-plus",
  input="你好,今天天气怎么样。",
  voice="longanlingxin",
  response_format="mp3",
)

response.write_to_file("speech.mp3")

请求参数:

重要提示:由于模型架构不同,部分参数可能仅适用于特定的模型。

model(模型 ID)

  • 参数:model

  • 必选string

语音合成模型 ID。调用时使用模型详情页的模型 ID。

input(输入文本)

  • 参数:input

  • 必选string

需要进行语音合成的文本内容。

bit_rate(比特率)

  • 参数:bit_rate

  • 可选,integer,6 到 510

  • 默认:32

指定 Opus 编码的比特率(kbps)。

仅当 response_formatopus 时生效。

sample_rate(采样率)

  • 参数:sample_rate

  • 可选,integer

  • 取值范围:8000 | 16000 | 22050 | 24000 | 44100 | 48000

  • 默认:22050

指定返回音频的采样率(Hz)。

voice(音色)

  • 参数:voice

  • 可选,string

  • 默认:longanlingxin

语音合成所使用的音色 ID。

Qwen-Audio-TTS 音色列表:https://help.aliyun.com/zh/model-studio/qwen-audio-tts-voice-list

stream(流式响应)

  • 参数:stream

  • 可选,boolean

  • 取值范围:true | false

  • 默认:false

是否以流式方式返回音频数据。

当前接口暂不支持流式响应;请勿设置 stream: true,否则将返回错误。

seed(随机种子)

  • 参数:seed

  • 可选,integer,0 到 65535

  • 默认:0

控制合成结果的随机性;相同 seed 与参数组合可复现相同音频。

volume(音量)

  • 参数:volume

  • 可选,integer,0 到 100

  • 默认:50

控制合成语音的音量大小。

pitch(音调)

  • 参数:pitch

  • 可选,float,0.5 到 2.0

  • 默认:1.0

控制合成语音的音调。

speed(语速)

  • 参数:speed

  • 可选,float,0.5 到 2.0

  • 默认:1.0

控制合成语音的语速。

response_format(音频格式)

  • 参数:response_format

  • 可选,string

  • 取值范围:mp3 | pcm | wav | opus

  • 默认:mp3

指定返回音频的编码格式。


以上文档为标准版 API 接口文档,可直接用于项目开发和系统调用。如果标准版 API 接口无法满足您的需求,需要定制开发 API 接口,请联系我们的 IT 技术支持工程师:

(沟通需求✅ → 确认技术方案✅ → 沟通费用与工期✅ → 开发&测试✅ → 验收交付✅ → 维护升级✅)

最受关注模型

DeepSeek V4 Pro

文本生成、深度思考

DeepSeek V4 Flash

文本生成、深度思考

XiaoMi MiMo V2.5 Pro

文本生成、深度思考

Tencent Hunyuan Hy3 Preview

文本生成、深度思考

XiaoMi MiMo V2.5

文本生成、深度思考

最新发布模型

Qwen Audio 3.0 TTS Flash

语音合成

Qwen3.7 Text Embedding

文本向量化

Qwen Audio 3.0 TTS Plus

语音合成

Kimi K3

文本生成、深度思考、工具调用

KAT Coder Pro V2.5

文本生成、代码补全

向量化模型

Qwen3.7 Text Embedding

文本向量化

GLM Embedding 3

文本向量化

Qwen3 Embedding 8B

文本嵌入、文本向量化

Doubao Embedding Large Text 250515

文本向量化

Qwen Text Embedding V4

文本向量化

语音识别模型

MiMo V2.5 ASR

音频识别

Fun ASR Flash

语音识别、方言识别

Qwen3 ASR Flash

语音识别

GLM ASR 2512

语音识别

语音合成模型

Qwen Audio 3.0 TTS Plus

语音合成

Qwen Audio 3.0 TTS Flash

语音合成

CosyVoice V3 Plus

语音合成

CosyVoice V3 Flash

语音合成

GLM TTS

语音合成