筛选

模型系列
模型类型
排序
可输入类型
可输出类型
模型能力

模型列表

共 180 个模型

Hunyuan Turbos Vision 20250619

Hunyuan Turbos Vision 采用混元 MOE 结构,是混元最新多模态模型,支持多语种作答,中英文能力均衡。

图片识别

输入:¥ 0.0035 / 千 tokens

输出:¥ 0.01015 / 千 tokens

Doubao Seed 1.6 多模态模型

Doubao-Seed-1.6 全新多模态模型,同时支持auto/thinking/non-thinking三种思考模式。 non-thinking模式下,模型效果对比Doubao-1.5-pro/250115大幅提升。支持 256k 上下文窗口,输出长度支持最大 64k tokens。

多模态、深度思考、图片理解

Doubao Seed 1.6 Flash 多模态模型

Doubao-Seed-1.6-flash推理速度极致的多模态深度思考模型,TPOT仅需10ms; 同时支持文本和视觉理解,文本理解能力超过上一代lite,视觉理解比肩友商pro系列模型。支持 256k 上下文窗口,输出长度支持最大 64k tokens。

多模态、深度思考、图片理解

Qwen Text Embedding V4

Qwen Text Embedding V4 是通义实验室基于 Qwen3 训练的多语言文本统一向量模型,相较 V3 版本在文本检索、聚类、分类性能大幅提升;在 MTEB 多语言、中英、Code 检索等评测任务上效果提升 15%~40%;支持 64~2048 维用户自定义向量维度。

文本向量化

输入:¥ 0.0007 / 千 tokens

输出:¥ 0 / 千 tokens

Doubao Embedding Large Text 250515

Doubao Embedding Large Text 250515 相比 Doubao Embedding 拥有更大的模型参数量,中英文 Retrieval 效果领先。主要面向向量检索的使用场景,支持中、英双语。

文本向量化

输入:¥ 0.0009 / 千 tokens

输出:¥ 0 / 千 tokens

Qwen3 14B

Qwen3-14B 是 Qwen3 系列中的一个密集型自回归语言模型,拥有 14.8B 参数(约 148 亿),旨在同时支持复杂推理与高效对话。它能够在用于数学、编程和逻辑推理等任务的“思考”模式与用于通用会话的“非思考”模式之间无缝切换。该模型经过微调以适应指令跟随、代理工具使用、创意写作以及覆盖 100+ 种语言与方言的多语种任务。它原生支持 32K token 的上下文,并可通过基于 YaRN 的伸缩扩展至 131K token。

文本生成

输入:¥ 0.0008 / 千 tokens

输出:¥ 0.003 / 千 tokens

Qwen3 235B A22B

Qwen3-235B-A22B 是 Qwen 开发的一个专家混合(Mixture-of-Experts,MoE)模型,拥有 2350 亿参数,每次前向计算激活 220 亿参数。它支持在用于复杂推理、数学与代码任务的“思考”模式与用于提高通用会话效率的“非思考”模式之间无缝切换。该模型展现出强大的推理能力、多语种支持(覆盖 100+ 种语言与方言)、高级指令跟随能力以及代理工具调用能力。它原生支持 32K token 的上下文窗口,并可通过基于 YaRN 的伸缩扩展至 131K token。

文本生成

输入:¥ 0.0025 / 千 tokens

输出:¥ 0.00675 / 千 tokens

Qwen3 30B A3B

Qwen3 是 Qwen 大规模语言模型系列的最新一代,结合了密集(dense)与专家混合(Mixture-of-Experts,MoE)架构,擅长推理、多语言支持与高级代理化任务。它能够在用于复杂推理的“思考”模式与用于高效对话的“非思考”模式之间无缝切换,确保多场景下的灵活且高质量表现。Qwen3 在数学、编码、常识推理、创意写作和交互式对话能力上显著超越了 QwQ 与 Qwen2.5 等此前模型。Qwen3-30B-A3B 变体包含 305 亿参数(每次前向计算激活 33 亿)、48 层、128 个专家(每个任务激活 8 个),并通过 YaRN 支持高达 131K token 的上下文,在开源模型中树立了新的标杆。

文本生成

输入:¥ 0.0012 / 千 tokens

输出:¥ 0.00375 / 千 tokens

Qwen3 32B

Qwen3-32B 是 Qwen3 系列中的一个密集型自回归语言模型,拥有 32.8B 参数(约 328 亿),针对复杂推理与高效对话进行了优化。它能够在用于数学、编码和逻辑推理等任务的“思考”模式与用于更快速的通用会话的“非思考”模式之间无缝切换。该模型在指令跟随、代理工具使用、创意写作以及覆盖 100+ 种语言与方言的多语种任务上表现强劲。它原生支持 32K token 的上下文,并可通过基于 YaRN 的伸缩扩展至 131K token。

文本生成

输入:¥ 0.0012 / 千 tokens

输出:¥ 0.0045 / 千 tokens

Qwen3 8B

Qwen3-8B 是 Qwen3 系列中的密集型 82 亿参数因果语言模型,专为高强度推理任务与高效对话场景打造。该模型支持在数学运算、编程及逻辑推理所需的"思维"模式与通用对话的"非思维"模式间无缝切换,经过精细调优可胜任指令跟随、智能体集成、创意写作以及覆盖 100 多种语言和方言的多语言应用。此模型原生支持 32K token 的上下文窗口。

文本生成

输入:¥ 0.0005 / 千 tokens

输出:¥ 0.004 / 千 tokens

豆包 1.5 UI TARS

UI-TARS 是一款原生面向图形界面交互(GUI)的Agent模型。通过感知、推理和行动等类人的能力,与 GUI 进行无缝交互。

GUI Agent 模型、图形界面交互、图片理解

输入:¥ 0.00375 / 千 tokens

输出:¥ 0.0125 / 千 tokens

ERNIE 4.5 Turbo 32K

文本创作、知识问答等能力提升显著。输出长度及整句时延相较ERNIE 4.5有所增加。

文本生成

输入:¥ 0.0009 / 千 tokens

输出:¥ 0.0035 / 千 tokens

ERNIE 4.5 Turbo VL 32K

图片理解、创作、翻译、代码等能力显著提升,首次支持32K上下文长度,首Token时延显著降低。

图片理解

输入:¥ 0.0035 / 千 tokens

输出:¥ 0.01 / 千 tokens

ERNIE X1 Turbo 32K

文心大模型X1具备更强的理解、规划、反思、进化能力。作为能力更全面的深度思考模型,文心X1兼备准确、创意和文采,在中文知识问答、文学创作、文稿写作、日常对话、逻辑推理、复杂计算及工具调用等方面表现尤为出色。

深度思考、文本生成

输入:¥ 0.0012 / 千 tokens

输出:¥ 0.0045 / 千 tokens

Hunyuan-Turbos-Vision 视觉大模型

此模型适用于图文理解场景,是基于混元最新 turbos 的新一代视觉语言旗舰大模型,聚焦图文理解相关任务,包括基于图片的实体识别、知识问答、文案创作、拍照解题等方面,相比前一代模型全面提升。

图片理解

输入:¥ 0.0035 / 千 tokens

输出:¥ 0.01015 / 千 tokens

Qwen2.5 VL 32B Instruct

Qwen2.5-VL-32B 是一款通过强化学习微调的多模态视觉语言模型,其数学推理能力、结构化输出和视觉问题解决能力显著增强。该模型在视觉分析任务中表现卓越,包括图像中的物体识别、文本解析以及长视频中的精确事件定位。在 MMMU、MathVista 和 VideoMME 等多模态基准测试中展现出顶尖性能,同时在 MMLU 文本理解、数学问题求解和代码生成等基于文本的任务中保持强大的推理能力与输出清晰度。

图片理解

输入:¥ 0.0025 / 千 tokens

输出:¥ 0.0075 / 千 tokens

通义千问-Plus-Character

通义千问系列角色扮演模型,本模型是动态更新版本,模型更新会提前通知,适合拟人化的角色扮演,同时优化了限定人设指令遵循、话题推进、倾听共情等能力,支持个性化角色的深度还原。

文本生成、角色扮演

输入:¥ 0.001 / 千 tokens

输出:¥ 0.00225 / 千 tokens

Qwen-Long

Qwen-Long是在通义千问针对超长上下文处理场景的大语言模型,支持中文、英文等不同语言输入,支持最长1000万tokens(约1500万字或1.5万页文档)的超长上下文对话。

文本生成

输入:¥ 0.00055 / 千 tokens

输出:¥ 0.00225 / 千 tokens

QwQ 32B

QwQ 是 Qwen 系列的推理模型。相较于传统的指令微调模型,具备思维与推理能力的 QwQ 能在下游任务(尤其是难题处理)中实现显著增强的性能表现。QwQ-32B 作为中等参数规模的推理模型,能够与 DeepSeek-R1、o1-mini 等顶尖推理模型实现竞争性的性能表现。

文本生成

输入:¥ 0.00195 / 千 tokens

输出:¥ 0.00555 / 千 tokens

Qwen2.5 VL 72B Instruct

指令跟随、数学、解题、代码整体提升,万物识别能力提升,支持多样格式直接精准定位视觉元素,支持对长视频文件(最长10分钟)进行理解和秒级别的事件时刻定位,能理解时间先后和快慢,基于解析和定位能力支持操控OS或Mobile的Agent,关键信息抽取能力和Json格式输出能力强,此版本为72B版本,本系列能力最强的版本。

图片识别

输入:¥ 0.008 / 千 tokens

输出:¥ 0.01 / 千 tokens

最受关注模型

DeepSeek V4 Pro

文本生成、深度思考

DeepSeek V4 Flash

文本生成、深度思考

Tencent Hunyuan Hy3

文本生成、深度思考、Agent增强

GLM 5.2

深度思考、长任务能力

Qwen3.7 Plus

文本生成、深度思考、视觉理解

Doubao Seed 2.1 Pro

多模态、深度思考、图片理解

MiniMax M3

文本生成、深度思考、专业能力

Doubao Seedream 5.0 Pro

图片生成

LongCat 2.0

文本生成、深度思考

Kimi K3

文本生成、深度思考、工具调用

Embedding Models

Qwen3.7 Text Embedding

文本向量化

GLM Embedding 3

文本向量化

Qwen3 Embedding 8B

文本嵌入、文本向量化

Doubao Embedding Large Text 250515

文本向量化

Qwen Text Embedding V4

文本向量化

Qwen Text Embedding V1

文本向量化

Qwen Text Embedding V2

文本向量化

Doubao Embedding Large

文本向量化

Doubao Embedding

文本向量化

Qwen Text Embedding V3

文本向量化