Qwen3.5 122B A10B API 接口、参数 & 代码示例

qwen3.5-122b-a10b

Qwen3.5 系列 122B-A10B 原生视觉语言模型，基于混合架构设计，融合了线性注意力机制与稀疏混合专家模型，实现了更高的推理效率。该模型的综合表现仅次于 Qwen3.5-397B-A17B，文本能力显著优于 Qwen3-235B-2507，视觉能力优于 Qwen3-VL-235B。

模型 ID: qwen3.5-122b-a10b
模型系列: Qwen
更新日期: 2026-02-24
模型能力: 深度思考、视觉理解、文本生成
上下文长度: 256 K
模型价格（每 1000 tokens 输入）: ¥ 0.00085
模型价格（每 1000 tokens 输出）: ¥ 0.0065
模型价格（每 1000 tokens 输入）: ¥ 0.0021
模型价格（每 1000 tokens 输出）: ¥ 0.0165

Qwen3.5 122B A10B 模型介绍：

类型：Causal Language Model with Vision Encoder
训练阶段：Pre-training & Post-training
语言模型
- 参数量：122B in total and 10B activated
- 隐藏层维度：3072
- 词元嵌入维度：248320 (Padded)
- 层数：48
- 隐藏层布局：16 × (3 × (Gated DeltaNet → MoE) → 1 × (Gated Attention → MoE))
- 门控 DeltaNet：
  - 线性注意力头数：64 for V and 16 for QK
  - 注意力头维度：128
- 门控注意力：
  - 注意力头数：32 for Q and 2 for KV
  - 注意力头维度：256
  - 旋转位置嵌入维度：64
- 混合专家模块
  - 专家数量：256
  - 激活专家数：8 Routed + 1 Shared
  - 专家中间维度：1024
- 语言模型输出维度：248320 (Padded)
- MTP：trained with multi-steps
上下文长度：262,144 natively and extensible up to 1,010,000 tokens.

全新升级的 Qwen3.5 在多模态学习、架构效率、强化学习规模化以及全球可访问性等领域实现突破性整合，为开发者和企业用户带来前所未有的能力与效率提升，标志着我们在AI技术演进中迈出了关键一步。

Qwen3.5 核心亮点

Qwen3.5 系列模型具备以下技术突破：

统一视觉语言基础模型：通过对多模态token进行早期融合训练，在推理能力、代码生成、智能体任务及视觉理解等基准测试中，实现与Qwen3模型跨代际的性能持平，并全面超越Qwen3-VL系列。
高效混合架构：创新采用门控Delta网络与稀疏混合专家模型相结合的设计，在保持低延迟和低成本的前提下，实现高吞吐量推理。
可扩展的强化学习泛化能力：在百万级智能体环境中开展规模化强化学习训练，通过逐步复杂化的任务分布设计，显著增强模型在真实场景中的适应能力。
全球语言覆盖：支持语种扩展至201种语言及方言，深度融合区域文化与语言细微差异，助力实现包容性的全球化部署。
新一代训练基础设施：实现接近100%的多模态训练效率（相比纯文本训练），并搭载异步强化学习框架，支持超大规模智能体架构与环境协同调度。

基准测试结果

API 接口地址：

Chat Completions API:

https://wcode.net/api/gpt/v1/chat/completions
Responses API（部分模型可能不支持此API）:

https://wcode.net/api/gpt/v1/responses
Anthropic API:

https://wcode.net/api/anthropic/v1/messages

此 API 接口兼容 OpenAI 的 API 接口规范，可直接使用 OpenAI 的 SDK 来调用各个模型。仅需替换以下配置即可：

base_url 替换为 https://wcode.net/api/gpt/v1

api_key 替换为从 https://platform.wcode.net 获取到的 API Key

具体可参考下方的各编程语言代码示例中的 OpenAI SDK 调用示例。

此模型支持 Anthropic / Claude 的 API 接口规范，可直接使用 Anthropic 的 SDK 来调用此模型。仅需替换以下配置即可：

ANTHROPIC_BASE_URL 替换为 https://wcode.net/api/anthropic

ANTHROPIC_API_KEY（或 ANTHROPIC_AUTH_TOKEN）替换为从 https://platform.wcode.net 获取到的 API Key

ANTHROPIC_MODEL（或model）替换为 qwen3.5-122b-a10b

请求方法：

POST

各编程语言代码示例：

# TODO: 以下代码中的 API_KEY 需要替换，获取 API Key 入口：https://platform.wcode.net

curl --request POST 'https://wcode.net/api/gpt/v1/chat/completions' \
--header 'Content-Type: application/json' \
--header 'Authorization: Bearer API_KEY' \
--data '{
    "model": "qwen3.5-122b-a10b",
    "messages": [
        {
            "role": "user",
            "content": "你好"
        }
    ]
}'

import Foundation

let headers = [
  "Authorization": "Bearer API_KEY",  // TODO: 这里的 API_KEY 需要替换，获取 API Key 入口：https://platform.wcode.net
  "content-type": "application/json"
]
let parameters = [
  "model": "qwen3.5-122b-a10b",
  "messages": [
    [
      "role": "user",
      "content": "你好"
    ]
  ]
] as [String : Any]

let postData = JSONSerialization.data(withJSONObject: parameters, options: [])

let request = NSMutableURLRequest(url: NSURL(string: "https://wcode.net/api/gpt/v1/chat/completions")! as URL,
                                        cachePolicy: .useProtocolCachePolicy,
                                    timeoutInterval: 60.0)
request.httpMethod = "POST"
request.allHTTPHeaderFields = headers
request.httpBody = postData as Data

let session = URLSession.shared
let dataTask = session.dataTask(with: request as URLRequest, completionHandler: { (data, response, error) -> Void in
  if (error != nil) {
    print(error as Any)
  } else {
    let httpResponse = response as? HTTPURLResponse
    print(httpResponse)
  }
})

dataTask.resume()

var headers = {
  'Content-Type': 'application/json',
  'Authorization': 'Bearer API_KEY'  // TODO: 这里的 API_KEY 需要替换，获取 API Key 入口：https://platform.wcode.net
};
var request = http.Request('POST', Uri.parse('https://wcode.net/api/gpt/v1/chat/completions'));
request.body = json.encode({
  "model": "qwen3.5-122b-a10b",
  "messages": [
    {
      "role": "user",
      "content": "你好"
    }
  ]
});
request.headers.addAll(headers);

http.StreamedResponse response = await request.send();

if (response.statusCode == 200) {
  print(await response.stream.bytesToString());
}
else {
  print(response.reasonPhrase);
}

require 'uri'
require 'net/http'

url = URI("https://wcode.net/api/gpt/v1/chat/completions")

http = Net::HTTP.new(url.host, url.port)
http.use_ssl = true

request = Net::HTTP::Post.new(url)
request["Authorization"] = 'Bearer API_KEY'  # TODO: 这里的 API_KEY 需要替换，获取 API Key 入口：https://platform.wcode.net
request["content-type"] = 'application/json'
request.body = "{\"model\":\"qwen3.5-122b-a10b\",\"messages\":[{\"role\":\"user\",\"content\":\"你好\"}]}"

response = http.request(request)
puts response.read_body

use serde_json::json;
use reqwest;

#[tokio::main]
pub async fn main() {
  let url = "https://wcode.net/api/gpt/v1/chat/completions";

  let payload = json!({
    "model": "qwen3.5-122b-a10b",
    "messages": (
      json!({
        "role": "user",
        "content": "你好"
      })
    )
  });

  let mut headers = reqwest::header::HeaderMap::new();
  headers.insert("Authorization", "Bearer API_KEY".parse().unwrap());  // TODO: 这里的 API_KEY 需要替换，获取 API Key 入口：https://platform.wcode.net
  headers.insert("content-type", "application/json".parse().unwrap());

  let client = reqwest::Client::new();
  let response = client.post(url)
    .headers(headers)
    .json(&payload)
    .send()
    .await;

  let results = response.unwrap()
    .json::<serde_json::Value>()
    .await
    .unwrap();

  dbg!(results);
}

CURL *hnd = curl_easy_init();

curl_easy_setopt(hnd, CURLOPT_CUSTOMREQUEST, "POST");
curl_easy_setopt(hnd, CURLOPT_URL, "https://wcode.net/api/gpt/v1/chat/completions");

struct curl_slist *headers = NULL;
headers = curl_slist_append(headers, "Authorization: Bearer API_KEY");  // TODO: 这里的 API_KEY 需要替换，获取 API Key 入口：https://platform.wcode.net
headers = curl_slist_append(headers, "content-type: application/json");
curl_easy_setopt(hnd, CURLOPT_HTTPHEADER, headers);

curl_easy_setopt(hnd, CURLOPT_POSTFIELDS, "{\"model\":\"qwen3.5-122b-a10b\",\"messages\":[{\"role\":\"user\",\"content\":\"你好\"}]}");

CURLcode ret = curl_easy_perform(hnd);

package main

import (
  "fmt"
  "strings"
  "net/http"
  "io"
)

func main() {
  url := "https://wcode.net/api/gpt/v1/chat/completions"

  payload := strings.NewReader("{\"model\":\"qwen3.5-122b-a10b\",\"messages\":[{\"role\":\"user\",\"content\":\"你好\"}]}")

  req, _ := http.NewRequest("POST", url, payload)

  req.Header.Add("Authorization", "Bearer API_KEY")  // TODO: 这里的 API_KEY 需要替换，获取 API Key 入口：https://platform.wcode.net
  req.Header.Add("content-type", "application/json")

  res, _ := http.DefaultClient.Do(req)

  defer res.Body.Close()
  body, _ := io.ReadAll(res.Body)

  fmt.Println(res)
  fmt.Println(string(body))
}

using System.Net.Http.Headers;


var client = new HttpClient();

var request = new HttpRequestMessage(HttpMethod.Post, "https://wcode.net/api/gpt/v1/chat/completions");

request.Headers.Add("Authorization", "Bearer API_KEY");  // TODO: 这里的 API_KEY 需要替换，获取 API Key 入口：https://platform.wcode.net

request.Content = new StringContent("{\"model\":\"qwen3.5-122b-a10b\",\"messages\":[{\"role\":\"user\",\"content\":\"你好\"}]}", null, "application/json");

var response = await client.SendAsync(request);

response.EnsureSuccessStatusCode();

Console.WriteLine(await response.Content.ReadAsStringAsync());

var client = new RestClient("https://wcode.net/api/gpt/v1/chat/completions");

var request = new RestRequest("", Method.Post);

request.AddHeader("Authorization", "Bearer API_KEY");  // TODO: 这里的 API_KEY 需要替换，获取 API Key 入口：https://platform.wcode.net

request.AddHeader("content-type", "application/json");

request.AddParameter("application/json", "{\"model\":\"qwen3.5-122b-a10b\",\"messages\":[{\"role\":\"user\",\"content\":\"你好\"}]}", ParameterType.RequestBody);

var response = client.Execute(request);

const axios = require('axios');

let data = JSON.stringify({
  "model": "qwen3.5-122b-a10b",
  "messages": [
    {
      "role": "user",
      "content": "你好"
    }
  ]
});

let config = {
  method: 'post',
  maxBodyLength: Infinity,
  url: 'https://wcode.net/api/gpt/v1/chat/completions',
  headers: {
    'Content-Type': 'application/json',
    'Authorization': 'Bearer API_KEY'  // TODO: 这里的 API_KEY 需要替换，获取 API Key 入口：https://platform.wcode.net
  },
  data : data
};

axios.request(config).then((response) => {
  console.log(JSON.stringify(response.data));
}).catch((error) => {
  console.log(error);
});

OkHttpClient client = new OkHttpClient();

MediaType mediaType = MediaType.parse("application/json");

RequestBody body = RequestBody.create(mediaType, "{\"model\":\"qwen3.5-122b-a10b\",\"messages\":[{\"role\":\"user\",\"content\":\"你好\"}]}");

Request request = new Request.Builder()
  .url("https://wcode.net/api/gpt/v1/chat/completions")
  .post(body)
  .addHeader("Authorization", "Bearer API_KEY")  // TODO: 这里的 API_KEY 需要替换，获取 API Key 入口：https://platform.wcode.net
  .addHeader("content-type", "application/json")
  .build();

Response response = client.newCall(request).execute();

$client = new \GuzzleHttp\Client();

$headers = [
  'Content-Type' => 'application/json',
  'Authorization' => 'Bearer API_KEY',  // TODO: 这里的 API_KEY 需要替换，获取 API Key 入口：https://platform.wcode.net
];

$body = '{
  "model": "qwen3.5-122b-a10b",
  "messages": [
    {
      "role": "user",
      "content": "你好"
    }
  ]
}';

$request = new \GuzzleHttp\Psr7\Request('POST', 'https://wcode.net/api/gpt/v1/chat/completions', $headers, $body);

$response = $client->sendAsync($request)->wait();

echo $response->getBody();

$curl = curl_init();

curl_setopt_array($curl, [
  CURLOPT_URL => "https://wcode.net/api/gpt/v1/chat/completions",
  CURLOPT_RETURNTRANSFER => true,
  CURLOPT_ENCODING => "",
  CURLOPT_MAXREDIRS => 5,
  CURLOPT_TIMEOUT => 300,
  CURLOPT_CUSTOMREQUEST => "POST",
  CURLOPT_POSTFIELDS => json_encode([
    'model' => 'qwen3.5-122b-a10b',
    'messages' => [
      [
        'role' => 'user',
        'content' => '你好'
      ]
    ]
  ]),
  CURLOPT_HTTPHEADER => [
    "Authorization: Bearer API_KEY",  // TODO: 这里的 API_KEY 需要替换，获取 API Key 入口：https://platform.wcode.net
    "content-type: application/json",
  ],
]);

$response = curl_exec($curl);
$error = curl_error($curl);

curl_close($curl);

if ($error) {
  echo "cURL Error #:" . $error;
} else {
  echo $response;
}

import requests
import json

url = "https://wcode.net/api/gpt/v1/chat/completions"

payload = {
  "model": "qwen3.5-122b-a10b",
  "messages": [
    {
      "role": "user",
      "content": "你好"
    }
  ]
}

headers = {
  "Authorization": "Bearer API_KEY",  # TODO: 这里的 API_KEY 需要替换，获取 API Key 入口：https://platform.wcode.net
  "content-type": "application/json"
}

response = requests.post(url, json=payload, headers=headers)

print(json.dumps(response.json(), indent=4, ensure_ascii=False))

from openai import OpenAI

client = OpenAI(
  base_url="https://wcode.net/api/gpt/v1",
  api_key="API_KEY"  # TODO: 这里的 API_KEY 需要替换，获取 API Key 入口：https://platform.wcode.net
)

completion = client.chat.completions.create(
  model="qwen3.5-122b-a10b",
  messages=[
    {
      "role": "user",
      "content": "你好"
    }
  ]
)

print(completion.choices[0].message.content)

各 AI 产品/工具/第三方应用接入示例：

配置 Hermes Agent 使用 Qwen3.5 122B A10B 模型：

注意事项：以下配置中的 <API_KEY> 需要替换为从 https://platform.wcode.net 获取（创建）的 API Key

方式一：交互式配置

在命令行输入 hermes model，然后选择 Custom endpoint 选项，根据交互式命令引导，分别配置以下信息：

API base URL：https://wcode.net/api/gpt/v1
API Key：<API_KEY>
Model：qwen3.5-122b-a10b

方式二：手动配置

修改 config.yaml（通常位于~/.hermes/config.yaml）

model:
  default: "qwen3.5-122b-a10b"
  provider: custom
  base_url: "https://wcode.net/api/gpt/v1"
  api_key: "<API_KEY>"
  context_length: 256000

配置完成后，就可以开始使用 Hermes Agent ~

配置 Roo Code 使用 Qwen3.5 122B A10B 模型：

注意事项：以下配置中的 <API_KEY> 需要替换为从 https://platform.wcode.net 获取（创建）的 API Key

API Provider：OpenAI Compatible
Base URL：https://wcode.net/api/gpt/v1
API Key：<API_KEY>
Model：qwen3.5-122b-a10b

配置完成后，就可以开始使用 Roo Code ~

配置 Kilo Code 使用 Qwen3.5 122B A10B 模型：

注意事项：以下配置中的 <API_KEY> 需要替换为从 https://platform.wcode.net 获取（创建）的 API Key

选择 Use your own API key，然后配置以下信息：

API Provider：OpenAI Compatible
Base URL：https://wcode.net/api/gpt/v1
API Key：<API_KEY>
Model：qwen3.5-122b-a10b

配置完成后，就可以开始使用 Kilo Code ~

配置 Cline 使用 Qwen3.5 122B A10B 模型：

注意事项：以下配置中的 <API_KEY> 需要替换为从 https://platform.wcode.net 获取（创建）的 API Key

API Provider：OpenAI Compatible
Base URL：https://wcode.net/api/gpt/v1
API Key：<API_KEY>
Model ID：qwen3.5-122b-a10b

配置完成后，就可以开始使用 Cline ~

注：以下安装和配置过程以 Ubuntu Server 24.04 (root 用户) + Node 22 安装 OpenClaw 🦞 2026.3.8 为例

安装 🦞 OpenClaw（龙虾），步骤如下：

命令行执行 npm install -g openclaw@latest
命令行执行 openclaw onboard --install-daemon
I understand this is personal-by-default and shared/multi-user use requires lock-down. Continue? 选择 yes
Onboarding mode 选择 QuickStart
Model/auth provider 选择 Skip for now
Default model 选择 Keep current (default: ...)
Select channel (QuickStart) 选择 Skip for now
Web search 选择 Skip for now
Configure skills now? (recommended) 选择 No
Enable hooks? （这是一个多选，按空格键可选中选项）按空格键选中 📝 command-logger 和 💾 session-memory 这两个选项，然后按回车键进入下一步
(如有) How do you want to hatch your bot? 选择 Hatch in TUI (recommended)

配置 🦞 OpenClaw（龙虾）使用 Qwen3.5 122B A10B 模型：

注意事项：以下配置中的 <API_KEY> 需要替换为从 https://platform.wcode.net 获取（创建）的 API Key

推荐方式：修改 openclaw.json（通常位于~/.openclaw/openclaw.json）

找到openclaw.json的第一层级的models和agents属性（如果没有则在第一层级添加models和agents属性），改为如下配置：

{
  ...其他配置,

  "models": {
      "mode": "merge",
      "providers": {
          "wcode": {
              "baseUrl": "https://wcode.net/api/gpt/v1",
              "apiKey": "<API_KEY>",
              "api": "openai-completions",
              "models": [
                  {
                      "id": "qwen3.5-122b-a10b",
                      "name": "Qwen3.5 122B A10B",
                      "reasoning": false,
                      "input": ["text"],
                      "contextWindow": 256000,
                      "maxTokens": 64000
                  }
              ]
          }
      }
  },
  "agents": {
      "defaults": {
         "model": {
             "primary": "wcode/qwen3.5-122b-a10b"
         }
      }
  },

  ...其他配置
}

完成以上配置后，

执行以下命令，即可通过命令行的方式开始对话：

openclaw tui

执行以下命令，即可通过 Web 界面的方式开始对话：

openclaw dashboard

配置 OpenCode 使用 Qwen3.5 122B A10B 模型：

推荐方式：修改 opencode.json（通常位于~/.config/opencode/opencode.json）

注意事项：以下配置中的 <API_KEY> 需要替换为从 https://platform.wcode.net 获取的 API Key

配置如下：

{
  "$schema": "https://opencode.ai/config.json",
  "provider": {
    "myprovider": {
      "npm": "@ai-sdk/openai-compatible",
      "name": "wcode",
      "options": {
        "baseURL": "https://wcode.net/api/gpt/v1",
        "apiKey": "<API_KEY>"
      },
      "models": {
        "qwen3.5-122b-a10b": {
          "name": "Qwen3.5 122B A10B"
        }
      }
    }
  }
}

完成以上配置后，执行以下命令，即可启动 OpenCode：

opencode

输入 /models，选择配置的 qwen3.5-122b-a10b 模型并在 OpenCode 中使用。

API 响应示例（curl）：

{
    "choices": [
        {
            "message": {
                "content": "你好！我是**Qwen3.5**，是通义千问系列中最新推出的模型版本。你提到的\"122B A10B\"可能来自其他模型的参数描述，但作为 Qwen3.5，我并未公开具体参数量级，而是专注于提供**高效、实用且全面**的智能服务。  \n\n### 我能为你做什么？\n- **超长上下文**：原生支持 256K tokens，轻松处理整本小说、百页报告或小时级会议记录。  \n- **精准推理与分析**：无论是数学计算、逻辑推导，还是科研论文的深度解读，都能结构化拆解关键信息。  \n- **多语言 & 跨模态**：覆盖全球 100+ 语言，支持图片/表格/PDF 的 OCR 识别与内容生成。  \n- **代码全栈赋能**：从创意到可运行的前端页面，或直接生成 Python 脚本自动化任务。  \n- **智能体协同**：自主规划多步骤任务（如订机票 + 查天气 + 整理行程），甚至操作手机 APP 完成复杂流程。  \n\n如果你有具体需求（比如写代码、分析数据、创作故事），欢迎直接告诉我！我会用最新能力为你定制解决方案~ ✨",
                "reasoning_content": "首先，我需要识别用户的问题。我是 Qwen3.5，\n\n接下来，我要回顾我的能力。根据背景信息，Qwen3.5 是通义千问系列的最新模型，具备以下特点：\n- 上下文窗口：256K tokens，支持长文档、视频等长内容处理。\n- 知识截止时间：2026 年。\n- 语言支持：超过 100 种语言。\n- OCR 能力：高精度文本识别，支持复杂场景。\n- 推理能力：强化数学、逻辑推理，支持多步骤任务拆解。\n- 代码能力：全栈支持，生成、调试、优化代码，甚至将创意转化为可运行前端页面。\n- 智能体规划：自主搜索、调用工具、跨设备操作，理解 GUI 界面。\n- 人类对齐优化：在对话、角色扮演、指令遵循方面更自然流畅。\n- 专业领域支持：医疗、法律、金融等领域的专业服务。\n- 视觉深度解析：从简单识别到深度分析图表、公式、科学图示，梳理因果关系。\n\n需要注意的是，用户提到的\"122B A10B\"可能是对参数量或其他技术参数的误解。我应该礼貌地纠正这一点，说明自己是 Qwen3.5，没有公开具体的参数量级（如 122B），同时强调我的能力和优势。\n\n另外，用户可能希望了解我在特定任务中的表现，比如写作、编程、数据分析等。因此，在介绍时应突出这些应用场景，让用户清楚我能如何帮助他们。\n\n还要注意语气友好、专业，避免使用过于技术化的术语，确保用户容易理解。同时，保持回答简洁，不要堆砌太多信息，重点突出关键能力。\n\n最后，检查是否有需要澄清的误解，比如是否与其他模型混淆，或者是否有特定的功能需求。确保回答准确，符合事实，不夸大或误导。",
                "role": "assistant"
            },
            "finish_reason": "stop",
            "index": 0,
            "logprobs": null
        }
    ],
    "object": "chat.completion",
    "usage": {
        "prompt_tokens": 30,
        "completion_tokens": 724,
        "total_tokens": 754,
        "completion_tokens_details": {
            "reasoning_tokens": 452,
            "text_tokens": 724
        },
        "prompt_tokens_details": {
            "text_tokens": 30
        }
    },
    "created": 1772031270,
    "system_fingerprint": null,
    "model": "qwen3.5-122b-a10b",
    "id": "chatcmpl-t1772031262s377re25af0c212565d7d3351fbe9"
}

请求参数：

messages（对话消息）
model（模型 ID）
top_k（Top-K）
top_a（Top-A）
max_tokens（最大 tokens 数）
logprobs（对数概率）
tools（工具）
verbosity（冗长程度）
logit_bias（Logit Bias）
stream（流式输出）
repetition_penalty（重复惩罚）
seed（种子）
min_p（Min-P）
parallel_tool_calls（并行工具调用）
reasoning（思考模式推理程度）
frequency_penalty（频率惩罚）
top_p（Top-P）
tool_choice（工具选择）
stop（停止）
thinking（思考模式）
- thinking.type（思考类型）
structured_outputs（结构化输出）
temperature（温度）
reasoning_effort（推理强度）
top_logprobs（最高对数概率）
response_format（响应格式）
presence_penalty（存在惩罚）

重要提示：由于模型架构不同，部分参数可能仅适用于特定的模型。

messages（对话消息）

参数：messages
必选，object

对话消息列表，包含当前对话的完整上下文信息。每条消息都有特定的角色和内容，模型会根据这些消息生成回复。消息按时间顺序排列，支持三种角色：system（系统消息，用于设定 AI 的行为和角色）、user（用户消息，来自用户的输入）、assistant（助手消息，来自 AI 的回复）。普通对话模型主要支持纯文本内容。

messages 格式请参考代码示例。注意：不能只包含系统消息或助手消息。

model（模型 ID）

参数：model
必选，string

调用时使用的模型 ID。请使用模型详情页展示的模型 ID。

top_k（Top-K）

参数：top_k
可选，int，>= 0
默认：0

top_k 会限制模型在每一步对 token 的选择，使其从较小的集合中进行选择。值为 1 表示模型将始终选择最有可能的下一个 token，从而得到可预测的结果。

top_a（Top-A）

参数：top_a
可选，float，0.0 到 1.0
默认：0.0

top_a 仅考虑概率“足够高”的 top tokens，该概率基于最可能的 token 概率。可以将其视为一个动态的 Top-P。较低的 Top-A 值会根据概率最高的 token 集中选择，但范围会更窄。较高的 Top-A 值不一定会影响输出的创造性，但会根据最大概率优化过滤过程。

max_tokens（最大 tokens 数）

参数：max_tokens
可选，int，>= 1

max_tokens 可设定模型在响应中可以生成的 token 数量的上限。模型不会生成超过此限制的 token。其最大值等于上下文长度减去 prompt 长度。

logprobs（对数概率）

参数：logprobs
可选，boolean

logprobs 设置是否返回输出 token 的对数概率。如果为 true，则返回每个输出 token 的对数概率。

tools（工具）

参数：tools
可选，array

工具调用参数，遵循 OpenAI 的工具调用请求格式。对于非 OpenAI 提供者，会相应地进行转换。

verbosity（冗长程度）

参数：verbosity
可选，string
取值范围：low | medium | high
默认：medium

控制模型响应的冗长程度和长度。较低的值会生成更简洁的回答，而较高的值会生成更详细、更全面的回答。

logit_bias（Logit Bias）

参数：logit_bias
可选，object

logit_bias 是一个可选参数，用于修改指定 token 在模型生成输出中出现的可能性。

stream（流式输出）

参数：stream
可选，boolean
取值范围：true | false
默认：false

是否开启流式输出。设为 true 时，模型以 SSE 形式逐块返回生成内容；设为 false 时，等待完整响应后一次性返回。

repetition_penalty（重复惩罚）

参数：repetition_penalty
可选，float，0.0 至 2.0
默认：1.0

repetition_penalty 有助于减少输入中标记的重复。较高的值会降低模型重复标记的可能性，但过高的值会使输出不够连贯（通常会出现缺少小词的连续句子）。标记惩罚会根据原始标记的概率进行调整。

seed（种子）

参数：seed
可选，int

如果指定了 seed 参数，推理将确定性地进行采样，即使用相同种子和参数的重复请求应该返回相同的结果。某些模型无法保证确定性。

min_p（Min-P）

参数：min_p
可选，float，0.0 至 1.0
默认：0.0

min_p 表示某个 token 被考虑的最小概率，该概率是相对于最可能的 token 的概率而言的。如果 min_p 设置为 0.1，则意味着它只允许概率至少为最佳选项十分之一的 token 被考虑。

parallel_tool_calls（并行工具调用）

参数：parallel_tool_calls
可选，boolean
默认：true

是否在使用工具时启用并行函数调用。如果为 true，模型可以同时调用多个函数。如果为 false，函数将按顺序依次调用。

reasoning（思考模式推理程度）

参数：reasoning
可选，object
默认：-

reasoning 参数整合了用于控制不同模型间推理强度的设置：

"effort": "xhigh" - 分配最大比例的 token 用于推理（约占 max_tokens 的 95%）
"effort": "high" - 分配较大比例的 token 用于推理（约占 max_tokens 的 80%）
"effort": "medium" - 分配中等比例的 token 用于推理（约占 max_tokens 的 50%）
"effort": "low" - 分配较小比例的 token 用于推理（约占 max_tokens 的 20%）
"effort": "minimal" - 分配更小比例的 token 用于推理（约占 max_tokens 的 10%）
"effort": "none" - 完全禁用推理

curl 代码示例：

# TODO 1: 以下代码中的 API_KEY 需要替换，获取 API Key 入口：https://platform.wcode.net
# TODO 2: 以下代码中的 MODEL_ID 需要替换，模型列表：https://wcode.net/models

curl --request POST 'https://wcode.net/api/gpt/v1/chat/completions' \
--header 'Content-Type: application/json' \
--header 'Authorization: Bearer API_KEY' \
--data '{
    "model": "MODEL_ID",
    "messages": [
        {
            "role": "user",
            "content": "你好"
        }
    ],
    "reasoning": {
        "effort": "high"
    }
}'

Python OpenAI SDK 代码示例：

from openai import OpenAI

client = OpenAI(
  base_url="https://wcode.net/api/gpt/v1",
  api_key="API_KEY"                             # TODO: 这里的 API_KEY 需要替换，获取 API Key 入口：https://platform.wcode.net
)

completion = client.chat.completions.create(
  model="MODEL_ID",                             # TODO: 这里的 MODEL_ID 需要替换，模型列表：https://wcode.net/models
  messages=[
    {
      "role": "user",
      "content": "天空为什么是蓝色的？"
    }
  ],
  extra_body={
    "reasoning": {
      "effort": "high"
    }
  }
)

print(completion.choices[0].message.content)

frequency_penalty（频率惩罚）

参数：frequency_penalty
可选，float，-2.0 至 2.0
默认：0.0

frequency_penalty 可根据词条在输入中出现的频率来控制其重复使用。它会尝试减少那些在输入中出现频率较高的词条的使用频率，这与它们出现的频率成正比。词条惩罚会随着出现次数的增加而增加。负值将鼓励词条重复使用。

top_p（Top-P）

参数：top_p
可选，float，0.0 至 1.0
默认：1.0

top_p 参数控制模型在生成文本时的候选词选择范围。具体来说，模型会生成一组候选 token，然后从累积概率达到或超过 p 的 token 中随机选择一个作为输出。通过这种方式，top_p 能够在保证生成内容的多样性的同时，考虑到概率分布的合理性。

由于 temperature 与 top_p 均可以控制生成文本的多样性，因此建议您只设置其中一个值。

tool_choice（工具选择）

参数：tool_choice
可选，string | object
默认：auto

工具调用策略。

"none"：禁止模型调用工具。
"auto"：自动判断是否调用（默认）。
"required"：强制模型必须调用一个或多个工具。
{"type": "function", "function": {"name": "my_function"}}：指定特定工具会强制模型调用该工具。

stop（停止）

参数：stop
可选，array

如果模型遇到 stop 数组中指定的任意 token，则立即停止生成。

thinking（思考模式）

参数：thinking
可选，object
默认：{"type": "enabled"}

用于控制模型的思考模式。以 object 形式传入，通过 type 字段指定模型在回答前是否进行内部推理，以及具体推理策略。

示例

"thinking": {
    "type": "enabled"
}

thinking.type（思考类型）

参数：thinking.type
必选，string
取值范围：adaptive | disabled
默认：adaptive

指定 thinking 对象的 type 字段，控制思考策略。

adaptive：自适应（默认），模型自主判断是否需要思考。
disabled：关闭思考，直接回答。

structured_outputs（结构化输出）

参数：structured_outputs
可选，boolean

指示模型是否能够使用 response_format 中的 json_schema 返回结构化输出。

temperature（温度）

参数：temperature
可选，float，0.0 到 2.0
默认：1.0

此设置影响模型回复的多样性。较低的值会使回复更可预测、更常见；较高的值会鼓励更具多样性且较不常见的回复。当设置为 0 时，模型对相同输入将尽可能的给出相同的回复。

reasoning_effort（推理强度）

参数：reasoning_effort
可选，string
取值范围：high | max
默认：high

控制模型的推理强度。

top_logprobs（最高对数概率）

参数：top_logprobs
可选，int，0 至 20

top_logprobs 是一个介于 0 和 20 之间的整数，指定在每个 token 位置要返回的最可能 token 的数量，每个 token 都会带有相应的对数概率。如果使用此参数，则必须将 logprobs 设置为 true。

response_format（响应格式）

参数：response_format
可选，object

response_format 强制模型产出特定的输出格式。将其设置为 { "type": "json_object" } 可启用 JSON 模式，保证模型生成的消息为有效的 JSON。

注意：使用 JSON 模式时，应同时通过 system 或 user 提示词指示模型生成 JSON。

presence_penalty（存在惩罚）

参数：presence_penalty
可选，float，-2.0 至 2.0
默认：0.0

presence_penalty 调整模型重复输入中已使用的特定标记的频率。值越高，重复的可能性就越小，负值则相反。标记惩罚不会随着出现次数而变化。负值会鼓励标记重用。

以上文档为标准版 API 接口文档，可直接用于项目开发和系统调用。如果标准版 API 接口无法满足您的需求，需要定制开发 API 接口，请联系我们的 IT 技术支持工程师：

（沟通需求✅ → 确认技术方案✅ → 沟通费用与工期✅ → 开发&测试✅ → 验收交付✅ → 维护升级✅）

最受关注模型

2026-06-27

向量化模型

2026-04-20

语音识别模型

2026-07-08

语音合成模型

2026-06-28

Qwen3.5 122B A10B API 接口、参数 & 代码示例

Qwen3.5 122B A10B 模型介绍：

API 接口地址：

Chat Completions API:

Responses API（部分模型可能不支持此API）:

Anthropic API:

请求方法：

各编程语言代码示例：

各 AI 产品/工具/第三方应用接入示例：

API 响应示例（curl）：

请求参数：

🔗messages（对话消息）

🔗model（模型 ID）

🔗top_k（Top-K）

🔗top_a（Top-A）

🔗max_tokens（最大 tokens 数）

🔗logprobs（对数概率）

🔗tools（工具）

🔗verbosity（冗长程度）

🔗logit_bias（Logit Bias）

🔗stream（流式输出）

🔗repetition_penalty（重复惩罚）

🔗seed（种子）

🔗min_p（Min-P）

🔗parallel_tool_calls（并行工具调用）

🔗reasoning（思考模式推理程度）

🔗frequency_penalty（频率惩罚）

🔗top_p（Top-P）

🔗tool_choice（工具选择）

🔗stop（停止）

🔗thinking（思考模式）

🔗thinking.type（思考类型）

🔗structured_outputs（结构化输出）

🔗temperature（温度）

🔗reasoning_effort（推理强度）

🔗top_logprobs（最高对数概率）

🔗response_format（响应格式）

🔗presence_penalty（存在惩罚）

最受关注模型

DeepSeek V4 Pro

DeepSeek V4 Flash

XiaoMi MiMo V2.5 Pro

Tencent Hunyuan Hy3 Preview

XiaoMi MiMo V2.5

最新发布模型

Kimi K3

KAT Coder Pro V2.5

Doubao Seedream 5.0 Pro

Qwen3 Rerank

Tongyi GTE Rerank V2

向量化模型

GLM Embedding 3

Qwen3 Embedding 8B

Doubao Embedding Large Text 250515

Qwen Text Embedding V4

Qwen Text Embedding V1

语音识别模型

MiMo V2.5 ASR

Fun ASR Flash

Qwen3 ASR Flash

GLM ASR 2512

语音合成模型

CosyVoice V3 Plus

CosyVoice V3 Flash

GLM TTS

messages（对话消息）

model（模型 ID）

top_k（Top-K）

top_a（Top-A）

max_tokens（最大 tokens 数）

logprobs（对数概率）

tools（工具）

verbosity（冗长程度）

logit_bias（Logit Bias）

stream（流式输出）

repetition_penalty（重复惩罚）

seed（种子）

min_p（Min-P）

parallel_tool_calls（并行工具调用）

reasoning（思考模式推理程度）

frequency_penalty（频率惩罚）

top_p（Top-P）

tool_choice（工具选择）

stop（停止）

thinking（思考模式）

thinking.type（思考类型）

structured_outputs（结构化输出）

temperature（温度）

reasoning_effort（推理强度）

top_logprobs（最高对数概率）

response_format（响应格式）

presence_penalty（存在惩罚）