筛选

模型系列
模型类型
排序
可输入类型
可输出类型
模型能力

模型列表

共 176 个模型

HY Image Lite

HY Image Lite(混元 Image Lite)是腾讯(Tencent)**推出的一款专注于**高效文生图(Text-to-Image)的轻量化 AI 图像生成模型。HY Image Lite 采用超高压缩编解码器,实现图像生成快速响应与高品质输出。

图片生成

价格: ¥ 0.12 / 张

Qwen3.8 Max

Qwen3.8 Max 是通义千问最新一代 2.4万亿参数 MoE 旗舰模型,编程与办公能力全面跃升,可自主编程,胜任法律、金融、设计等数百种专业任务,一次对话端到端交付生产级成果;原生视觉理解贯穿规划、执行与验证全流程,支持超长文档与长视频的深度语义解析;长程任务中自主规划与闭环迭代,持续进化。

深度思考、视觉理解、文本生成

输入:¥ 0.0125 / 千 tokens

输出:¥ 0.038 / 千 tokens

Qwen Image 3.0

Qwen-Image-3.0 Standard(标准版)是阿里巴巴推出的高性价比图像生成模型,专为大批量日常生成场景打造。模型支持 4.5k token 超长指令与 12 国语言原生渲染,能精准还原 10px 小字及学术论文公式,轻松胜任复杂版面生成、超写实人像与多场景界面仿真。

图片生成、长指令支持

价格: ¥ 0.2 / 张

DeepSeek V4 Pro

DeepSeek V4 Pro 是 DeepSeek V4 系列的两款强大的专家混合(Mixture-of-Experts, MoE)语言模型之一,性能比肩顶级闭源模型,Agent 能力大幅提高,且具有丰富的世界知识和世界顶级推理性能,在数学、STEM、竞赛型代码的测评中,DeepSeek V4 Pro 超越当前所有已公开评测的开源模型,取得了比肩世界顶级闭源模型的优异成绩。

文本生成、深度思考

输入:¥ 0.0032 / 千 tokens

输出:¥ 0.0065 / 千 tokens

DeepSeek V4 Flash

DeepSeek V4 Flash 是 DeepSeek V4 系列的两款强大的专家混合(Mixture-of-Experts, MoE)语言模型之一,拥有 284B 参数(13B 激活参数),支持 100 万 Tokens(1M Tokens)的上下文长度,支持非思考模式与思考模式。在 Agent 测评中,DeepSeek-V4-Flash 在简单任务上与 Pro 版本旗鼓相当,但在高难度任务上仍有差距。

文本生成、深度思考

输入:¥ 0.0011 / 千 tokens

输出:¥ 0.0021 / 千 tokens

Qwen3.7 Text Embedding

Qwen3.7 Text Embedding 是通义实验室基于 Qwen3.7 训练的多语言文本统一向量模型,相较 text-embedding-v4 版本在文本检索、聚类、分类性能大幅提升;模型在 MTEB 多语言、中英、Code 检索等评测任务上效果提升 20%;支持 256 ~ 2560 维用户自定义向量维度。

文本向量化

Qwen Audio 3.0 TTS Plus

Qwen Audio 3.0 TTS Plus 是面向高质量语音生成场景打造的高性能语音合成大模型。相比前一版本,此模型支持更多小语种和中文方言,显著提升方言发音的正宗程度,并增强了 free-style 指令遵循能力和细粒度标签控制能力,可更准确地控制情绪、语气、角色、语速、音量和合成风格。

语音合成

价格:¥ 16 / 千字符

Qwen Audio 3.0 TTS Flash

Qwen Audio 3.0 TTS Flash 是面向实时交互场景优化的高性能语音合成大模型。相比前一版本,模型支持更多小语种和中文方言,提升了方言发音的正宗程度,并增强了 free-style 指令遵循能力和细粒度标签控制能力,可更灵活地控制情绪、语气、角色、语速、音量等表达方式。

语音合成

价格:¥ 12 / 千字符

Kimi K3

Kimi K3 是月之暗面(Moonshot AI)于 2026 年 7 月 16 日正式发布的全新一代旗舰大模型。Kimi K3 是目前全球参数规模最大的开源/大权重(Open-weight)模型,其综合智能水平已逼近全球最顶尖的闭源大模型。

文本生成、深度思考、工具调用

输入:¥ 0.023 / 千 tokens

输出:¥ 0.11 / 千 tokens

KAT Coder Pro V2.5

KAT-Coder-Pro V2.5 是一款能将完整 issue 或整段业务工作流直接交给它、在真实仓库中自主定位修改并跑通全流程的旗舰级 Agentic Coding 模型,同时通过多专家融合完整延续了 V2 的前端美学生成能力。该版本在整体定位上实现了核心跨越,从传统的“辅助写代码”迈向了“自主做工程”,专门为复杂软件开发和企业级业务工作流设计。

文本生成、代码补全

输入:¥ 0.0055 / 千 tokens

输出:¥ 0.021 / 千 tokens

Doubao Seedream 5.0 Pro

Doubao Seedream 5.0 Pro 是字节跳动 Seed 团队研发的最新一代旗舰级多模态图像创作与编辑模型。Seedream 5.0 Pro 模型将图像创作推进到可控生产的新阶段,本次更新的主要亮点是编辑更可控、生产更落地、效果更自然。

图片生成

价格: >= ¥ 0.36 / 张

Zhipu Rerank

Zhipu Rerank 模型用于文本重排序,通过接收用户的查询文本(`query`)及候选文本列表(`documents`),使用模型计算候选文本与查询文本的相关性得分并返回分数。Rerank 模型适用于智能问答、信息检索、RAG知识库等场景。

文本重排序

输入:¥ 0.001 / 千 tokens

输出:¥ 0 / 千 tokens

MiMo V2.5 ASR

MiMo-V2.5-ASR 是由小米(Xiaomi)MiMo 团队开发的一款端到端(End-to-End)开源语音识别(ASR)模型。模型于2026年7月正式发布,定位为全链路语音模型的“听觉基座”,适用于应对真实世界中复杂多变的语音场景。

音频识别

价格:¥ 0.01 / 分钟

Tongyi GTE Rerank V2

Tongyi GTE Rerank V2 是由阿里巴巴通义实验室(Tongyi Lab)研发的第二代通用文本重排序(Rerank)模型。该模型广泛应用于检索增强生成(RAG)、智能客服、企业知识库以及多语言搜索等业务场景。

文本重排序

输入:¥ 0.001 / 千 tokens

输出:¥ 0 / 千 tokens

Qwen3 Rerank

Qwen3 Rerank 是通义团队构建的专门用于文本检索二次排序的模型。Qwen3 Rerank 基于 Qwen LLM 底座训练的文本排序模型,对输入的 Query 和候选 Docs 进行相关性排序,支持 100+ 语种和长文本输入,适用于文本检索、RAG 等场景,效果对齐开源 Qwen3-Rerank 系列模型

文本重排序

输入:¥ 0.0007 / 千 tokens

输出:¥ 0 / 千 tokens

Tencent Hunyuan Hy3

腾讯混元 Hy3 正式版面向真实业务场景打磨,采用 295B 总参数、21B 激活 MoE 架构,原生支持 256K 上下文,并提供了多档思考模式,兼顾极速响应、复杂推理与调用成本。Hy3 正式版重点提升了 Coding Agent、长文理解、多轮上下文承接、搜索问答与复杂任务执行能力,在减少幻觉、提升任务完成度和工程可用性方面表现更稳。

文本生成、深度思考、Agent增强

输入:¥ 0.0012 / 千 tokens

输出:¥ 0.0045 / 千 tokens

LongCat 2.0

LongCat 2.0 是美团 LongCat AI 推出的新一代万亿参数的混合专家(MoE)大语言模型,此模型专为 **Agentic Coding(智能体编程)** 场景设计,在上下文长度、专家融合架构以及国产算力适配上带来了多项行业突破。

文本生成、深度思考

输入:¥ 0.0025 / 千 tokens

输出:¥ 0.0085 / 千 tokens

Qwen Image 2.0 Pro

Qwen-Image-2.0-Pro 是通义千问推出的专业级图像生成大模型。该模型基于先进的 **MMDiT(Multi-modal Diffusion Transformer)** 架构,拥有约 20B(200亿)的参数量。它主打高精度、商业级和强可控性的文生图与图生图能力,尤其在中文语境理解和复杂排版上表现优异。

图片生成

价格: ¥ 0.55 / 张

Qwen Image 2.0

Qwen-Image-2.0 是通义千问推出的新一代多模态图像生成基础模型。该模型最大的突破在于将“图像生成”与“图像编辑”两条技术路径完美融为一体。它在架构上耦合了 Qwen3-VL 作为条件编码器(Condition Encoder),并搭配多模态扩散 Transformer(Multimodal Diffusion Transformer, MDT)进行联合建模,实现了从理解、生成到编辑的一体化。

图片生成

价格: ¥ 0.23 / 张

Doubao Seedream 5.0 Lite

Doubao Seedream 5.0 Lite(豆包图像创作模型 5.0 Lite)是字节跳动推出的一款专业级图像创作与多模态创意模型。作为 Seedream 系列的最新轻量化(Lite)迭代版本,它不仅在画面表现上继承了豆包一贯的高水准,更在实时检索、跨模态推理及一致性上实现了跨越式的升级。

图片生成

价格: ¥ 0.25 / 张

最受关注模型

DeepSeek V4 Pro

文本生成、深度思考

DeepSeek V4 Flash

文本生成、深度思考

Qwen3.7 Max

文本生成、深度思考

Tencent Hunyuan Hy3

文本生成、深度思考、Agent增强

GLM 5.2

深度思考、长任务能力

Qwen3.7 Plus

文本生成、深度思考、视觉理解

Doubao Seed 2.1 Pro

多模态、深度思考、图片理解

MiniMax M3

文本生成、深度思考、专业能力

Doubao Seedream 5.0 Pro

图片生成

LongCat 2.0

文本生成、深度思考

Embedding Models

Qwen3.7 Text Embedding

文本向量化

GLM Embedding 3

文本向量化

Qwen3 Embedding 8B

文本嵌入、文本向量化

Doubao Embedding Large Text 250515

文本向量化

Qwen Text Embedding V4

文本向量化

Qwen Text Embedding V1

文本向量化

Qwen Text Embedding V2

文本向量化

Doubao Embedding Large

文本向量化

Doubao Embedding

文本向量化

Qwen Text Embedding V3

文本向量化