筛选
模型列表
共 173 个模型
Qwen3.7 Text Embedding
Qwen3.7 Text Embedding 是通义实验室基于 Qwen3.7 训练的多语言文本统一向量模型,相较 text-embedding-v4 版本在文本检索、聚类、分类性能大幅提升;模型在 MTEB 多语言、中英、Code 检索等评测任务上效果提升 20%;支持 256 ~ 2560 维用户自定义向量维度。
文本向量化
Qwen Audio 3.0 TTS Plus
Qwen Audio 3.0 TTS Plus 是面向高质量语音生成场景打造的高性能语音合成大模型。相比前一版本,此模型支持更多小语种和中文方言,显著提升方言发音的正宗程度,并增强了 free-style 指令遵循能力和细粒度标签控制能力,可更准确地控制情绪、语气、角色、语速、音量和合成风格。
语音合成
价格:¥ 16 / 千字符
Qwen Audio 3.0 TTS Flash
Qwen Audio 3.0 TTS Flash 是面向实时交互场景优化的高性能语音合成大模型。相比前一版本,模型支持更多小语种和中文方言,提升了方言发音的正宗程度,并增强了 free-style 指令遵循能力和细粒度标签控制能力,可更灵活地控制情绪、语气、角色、语速、音量等表达方式。
语音合成
价格:¥ 12 / 千字符
Kimi K3
Kimi K3 是月之暗面(Moonshot AI)于 2026 年 7 月 16 日正式发布的全新一代旗舰大模型。Kimi K3 是目前全球参数规模最大的开源/大权重(Open-weight)模型,其综合智能水平已逼近全球最顶尖的闭源大模型。
文本生成、深度思考、工具调用
输入:¥ 0.023 / 千 tokens
输出:¥ 0.11 / 千 tokens
KAT Coder Pro V2.5
KAT-Coder-Pro V2.5 是一款能将完整 issue 或整段业务工作流直接交给它、在真实仓库中自主定位修改并跑通全流程的旗舰级 Agentic Coding 模型,同时通过多专家融合完整延续了 V2 的前端美学生成能力。该版本在整体定位上实现了核心跨越,从传统的“辅助写代码”迈向了“自主做工程”,专门为复杂软件开发和企业级业务工作流设计。
文本生成、代码补全
输入:¥ 0.0055 / 千 tokens
输出:¥ 0.021 / 千 tokens
Doubao Seedream 5.0 Pro
Doubao Seedream 5.0 Pro 是字节跳动 Seed 团队研发的最新一代旗舰级多模态图像创作与编辑模型。Seedream 5.0 Pro 模型将图像创作推进到可控生产的新阶段,本次更新的主要亮点是编辑更可控、生产更落地、效果更自然。
图片生成
价格: >= ¥ 0.36 / 张
MiMo V2.5 ASR
MiMo-V2.5-ASR 是由小米(Xiaomi)MiMo 团队开发的一款端到端(End-to-End)开源语音识别(ASR)模型。模型于2026年7月正式发布,定位为全链路语音模型的“听觉基座”,适用于应对真实世界中复杂多变的语音场景。
音频识别
价格:¥ 0.01 / 分钟
Tongyi GTE Rerank V2
Tongyi GTE Rerank V2 是由阿里巴巴通义实验室(Tongyi Lab)研发的第二代通用文本重排序(Rerank)模型。该模型广泛应用于检索增强生成(RAG)、智能客服、企业知识库以及多语言搜索等业务场景。
文本重排序
输入:¥ 0.001 / 千 tokens
输出:¥ 0 / 千 tokens
Qwen3 Rerank
Qwen3 Rerank 是通义团队构建的专门用于文本检索二次排序的模型。Qwen3 Rerank 基于 Qwen LLM 底座训练的文本排序模型,对输入的 Query 和候选 Docs 进行相关性排序,支持 100+ 语种和长文本输入,适用于文本检索、RAG 等场景,效果对齐开源 Qwen3-Rerank 系列模型
文本重排序
输入:¥ 0.0007 / 千 tokens
输出:¥ 0 / 千 tokens
Zhipu Rerank
Zhipu Rerank 模型用于文本重排序,通过接收用户的查询文本(`query`)及候选文本列表(`documents`),使用模型计算候选文本与查询文本的相关性得分并返回分数。Rerank 模型适用于智能问答、信息检索、RAG知识库等场景。
文本重排序
输入:¥ 0.001 / 千 tokens
输出:¥ 0 / 千 tokens
Tencent Hunyuan Hy3
腾讯混元 Hy3 正式版面向真实业务场景打磨,采用 295B 总参数、21B 激活 MoE 架构,原生支持 256K 上下文,并提供了多档思考模式,兼顾极速响应、复杂推理与调用成本。Hy3 正式版重点提升了 Coding Agent、长文理解、多轮上下文承接、搜索问答与复杂任务执行能力,在减少幻觉、提升任务完成度和工程可用性方面表现更稳。
文本生成、深度思考、Agent增强
输入:¥ 0.0012 / 千 tokens
输出:¥ 0.0045 / 千 tokens
LongCat 2.0
LongCat 2.0 是美团 LongCat AI 推出的新一代万亿参数的混合专家(MoE)大语言模型,此模型专为 **Agentic Coding(智能体编程)** 场景设计,在上下文长度、专家融合架构以及国产算力适配上带来了多项行业突破。
文本生成、深度思考
输入:¥ 0.0025 / 千 tokens
输出:¥ 0.0085 / 千 tokens
Doubao Seedream 5.0 Lite
Doubao Seedream 5.0 Lite(豆包图像创作模型 5.0 Lite)是字节跳动推出的一款专业级图像创作与多模态创意模型。作为 Seedream 系列的最新轻量化(Lite)迭代版本,它不仅在画面表现上继承了豆包一贯的高水准,更在实时检索、跨模态推理及一致性上实现了跨越式的升级。
图片生成
价格: ¥ 0.25 / 张
Qwen Image 2.0 Pro
Qwen-Image-2.0-Pro 是通义千问推出的专业级图像生成大模型。该模型基于先进的 **MMDiT(Multi-modal Diffusion Transformer)** 架构,拥有约 20B(200亿)的参数量。它主打高精度、商业级和强可控性的文生图与图生图能力,尤其在中文语境理解和复杂排版上表现优异。
图片生成
价格: ¥ 0.55 / 张
Qwen Image 2.0
Qwen-Image-2.0 是通义千问推出的新一代多模态图像生成基础模型。该模型最大的突破在于将“图像生成”与“图像编辑”两条技术路径完美融为一体。它在架构上耦合了 Qwen3-VL 作为条件编码器(Condition Encoder),并搭配多模态扩散 Transformer(Multimodal Diffusion Transformer, MDT)进行联合建模,实现了从理解、生成到编辑的一体化。
图片生成
价格: ¥ 0.23 / 张
GLM Image
GLM-Image 是智谱新旗舰图像生成模型, 模型全程基于国产芯片完成训练,采用独创的「自回归+扩散解码器」混合架构,兼顾全局指令理解与局部细节刻画,克服了海报、PPT、科普图等知识密集型场景生成难题,是面向以 Nano Banana Pro 为代表的新一代「认知型生成」技术范式的一次重要探索。
图片生成
价格: ¥ 0.12 / 张
CosyVoice V3 Plus
CosyVoice V3 Plus 是通义实验室推出的最新一代生成式语音合成(TTS)大模型。该模型代表了目前 CosyVoice 系列中合成效果最佳、综合能力最强的旗舰版本。
语音合成
价格:¥ 0.25 / 千字符
DeepSeek V4 Pro
DeepSeek V4 Pro 是 DeepSeek V4 系列的两款强大的专家混合(Mixture-of-Experts, MoE)语言模型之一,性能比肩顶级闭源模型,Agent 能力大幅提高,且具有丰富的世界知识和世界顶级推理性能,在数学、STEM、竞赛型代码的测评中,DeepSeek V4 Pro 超越当前所有已公开评测的开源模型,取得了比肩世界顶级闭源模型的优异成绩。
文本生成、深度思考
输入:¥ 0.0032 / 千 tokens
输出:¥ 0.0065 / 千 tokens
Qwen3 ASR Flash
Qwen3-ASR-Flash 是阿里巴巴通义千问团队推出的一款高性能语音识别(ASR,Automatic Speech Recognition)模型服务。它基于强大的 Qwen3-Omni 多模态大模型底座,并经过了数千万小时多模态语音数据的精细训练,旨在提供极其快速、精准且具备大模型理解能力的语音转文字体验。
语音识别
价格:¥ 0.02 / 分钟
DeepSeek V4 Flash
DeepSeek V4 Flash 是 DeepSeek V4 系列的两款强大的专家混合(Mixture-of-Experts, MoE)语言模型之一,拥有 284B 参数(13B 激活参数),支持 100 万 Tokens(1M Tokens)的上下文长度,支持非思考模式与思考模式。在 Agent 测评中,DeepSeek-V4-Flash 在简单任务上与 Pro 版本旗鼓相当,但在高难度任务上仍有差距。
文本生成、深度思考
输入:¥ 0.0011 / 千 tokens
输出:¥ 0.0021 / 千 tokens