筛选
模型列表
共 180 个模型
DeepSeek V4 Flash Vision Exp
DeepSeek V4 Flash Vision Exp 是 DeepSeek 推出的全新多模态视觉理解模型,这是一个实验性质的模型,可以让模型描述图片、识别截图中的文字、分析图表等。DeepSeek-V4-Flash-Vision-Exp 在各类 Agent 框架内展现出了较好的多模态适配能力,能够有效支持大家借助多样化的 Agent 工具解锁更多实用的工作场景。
图片理解、深度思考
输入:¥ 0.0015 / 千 tokens
输出:¥ 0.0045 / 千 tokens
GLM 5.3
GLM-5.3 是智谱 AI 于 2026 年 8 月 14 日公布的新一代 GLM 系列模型,定位重点是长程代码开发、Agent 工作流以及网络安全任务。GLM-5.3 通过大规模后训练和真实软件环境强化学习,让一个原有的 743B 级基础模型在代码 Agent 和网络安全任务上获得巨大能力跃升。
文本生成、深度思考、Agent 工作流
输入:¥ 0.009 / 千 tokens
输出:¥ 0.03 / 千 tokens
HY Image 3.0
Hunyuan Image 3.0(腾讯混元图像3.0)是腾讯混元大模型团队推出的一款旗舰级开源图像生成与编辑大模型。它在技术架构和生成范式上做出了重大突破,是当前开源社区中最强且规模最大的图像生成模型之一。
图片生成
价格: ¥ 0.25 / 张
Qwen3.8 2.4T A95B
Qwen3.8-2.4T-A95B 是通义千问最新旗舰系列的开源版本,2026 年 8 月发布。采用稀疏 MoE 架构,总参数 2.4 万亿,每步激活约 950 亿,配合混合注意力机制,支持 100 万 Token 上下文。核心基准:GPQA Diamond 92.6、PaperBench 93.0、OSWorld 86.1、BabyVision 82.0,CodeArena 全球第 4。
文本生成、深度思考
输入:¥ 0.013 / 千 tokens
输出:¥ 0.038 / 千 tokens
DeepSeek V4 Pro
DeepSeek V4 Pro 是 DeepSeek V4 系列的两款强大的专家混合(Mixture-of-Experts, MoE)语言模型之一,性能比肩顶级闭源模型,Agent 能力大幅提高,且具有丰富的世界知识和世界顶级推理性能,在数学、STEM、竞赛型代码的测评中,DeepSeek V4 Pro 超越当前所有已公开评测的开源模型,取得了比肩世界顶级闭源模型的优异成绩。
文本生成、深度思考
输入:¥ 0.0032 / 千 tokens
输出:¥ 0.0065 / 千 tokens
DeepSeek V4 Flash
DeepSeek V4 Flash 是 DeepSeek V4 系列的两款强大的专家混合(Mixture-of-Experts, MoE)语言模型之一,拥有 284B 参数(13B 激活参数),支持 100 万 Tokens(1M Tokens)的上下文长度,支持非思考模式与思考模式。在 Agent 测评中,DeepSeek-V4-Flash 在简单任务上与 Pro 版本旗鼓相当,但在高难度任务上仍有差距。
文本生成、深度思考
输入:¥ 0.0015 / 千 tokens
输出:¥ 0.0045 / 千 tokens
HY Image Lite
HY Image Lite(混元 Image Lite)是腾讯(Tencent)**推出的一款专注于**高效文生图(Text-to-Image)的轻量化 AI 图像生成模型。HY Image Lite 采用超高压缩编解码器,实现图像生成快速响应与高品质输出。
图片生成
价格: ¥ 0.12 / 张
Qwen3.8 Max
Qwen3.8 Max 是通义千问最新一代 2.4万亿参数 MoE 旗舰模型,编程与办公能力全面跃升,可自主编程,胜任法律、金融、设计等数百种专业任务,一次对话端到端交付生产级成果;原生视觉理解贯穿规划、执行与验证全流程,支持超长文档与长视频的深度语义解析;长程任务中自主规划与闭环迭代,持续进化。
深度思考、视觉理解、文本生成
输入:¥ 0.0125 / 千 tokens
输出:¥ 0.038 / 千 tokens
Qwen Image 3.0
Qwen-Image-3.0 Standard(标准版)是阿里巴巴推出的高性价比图像生成模型,专为大批量日常生成场景打造。模型支持 4.5k token 超长指令与 12 国语言原生渲染,能精准还原 10px 小字及学术论文公式,轻松胜任复杂版面生成、超写实人像与多场景界面仿真。
图片生成、长指令支持
价格: ¥ 0.2 / 张
Qwen Audio 3.0 TTS Flash
Qwen Audio 3.0 TTS Flash 是面向实时交互场景优化的高性能语音合成大模型。相比前一版本,模型支持更多小语种和中文方言,提升了方言发音的正宗程度,并增强了 free-style 指令遵循能力和细粒度标签控制能力,可更灵活地控制情绪、语气、角色、语速、音量等表达方式。
语音合成
价格:¥ 12 / 千字符
Qwen3.7 Text Embedding
Qwen3.7 Text Embedding 是通义实验室基于 Qwen3.7 训练的多语言文本统一向量模型,相较 text-embedding-v4 版本在文本检索、聚类、分类性能大幅提升;模型在 MTEB 多语言、中英、Code 检索等评测任务上效果提升 20%;支持 256 ~ 2560 维用户自定义向量维度。
文本向量化
Qwen Audio 3.0 TTS Plus
Qwen Audio 3.0 TTS Plus 是面向高质量语音生成场景打造的高性能语音合成大模型。相比前一版本,此模型支持更多小语种和中文方言,显著提升方言发音的正宗程度,并增强了 free-style 指令遵循能力和细粒度标签控制能力,可更准确地控制情绪、语气、角色、语速、音量和合成风格。
语音合成
价格:¥ 16 / 千字符
Kimi K3
Kimi K3 是月之暗面(Moonshot AI)于 2026 年 7 月 16 日正式发布的全新一代旗舰大模型。Kimi K3 是目前全球参数规模最大的开源/大权重(Open-weight)模型,其综合智能水平已逼近全球最顶尖的闭源大模型。
文本生成、深度思考、工具调用
输入:¥ 0.023 / 千 tokens
输出:¥ 0.11 / 千 tokens
KAT Coder Pro V2.5
KAT-Coder-Pro V2.5 是一款能将完整 issue 或整段业务工作流直接交给它、在真实仓库中自主定位修改并跑通全流程的旗舰级 Agentic Coding 模型,同时通过多专家融合完整延续了 V2 的前端美学生成能力。该版本在整体定位上实现了核心跨越,从传统的“辅助写代码”迈向了“自主做工程”,专门为复杂软件开发和企业级业务工作流设计。
文本生成、代码补全
输入:¥ 0.0055 / 千 tokens
输出:¥ 0.021 / 千 tokens
Doubao Seedream 5.0 Pro
Doubao Seedream 5.0 Pro 是字节跳动 Seed 团队研发的最新一代旗舰级多模态图像创作与编辑模型。Seedream 5.0 Pro 模型将图像创作推进到可控生产的新阶段,本次更新的主要亮点是编辑更可控、生产更落地、效果更自然。
图片生成
价格: >= ¥ 0.36 / 张
Zhipu Rerank
Zhipu Rerank 模型用于文本重排序,通过接收用户的查询文本(`query`)及候选文本列表(`documents`),使用模型计算候选文本与查询文本的相关性得分并返回分数。Rerank 模型适用于智能问答、信息检索、RAG知识库等场景。
文本重排序
输入:¥ 0.001 / 千 tokens
输出:¥ 0 / 千 tokens
Qwen3 Rerank
Qwen3 Rerank 是通义团队构建的专门用于文本检索二次排序的模型。Qwen3 Rerank 基于 Qwen LLM 底座训练的文本排序模型,对输入的 Query 和候选 Docs 进行相关性排序,支持 100+ 语种和长文本输入,适用于文本检索、RAG 等场景,效果对齐开源 Qwen3-Rerank 系列模型
文本重排序
输入:¥ 0.0007 / 千 tokens
输出:¥ 0 / 千 tokens
MiMo V2.5 ASR
MiMo-V2.5-ASR 是由小米(Xiaomi)MiMo 团队开发的一款端到端(End-to-End)开源语音识别(ASR)模型。模型于2026年7月正式发布,定位为全链路语音模型的“听觉基座”,适用于应对真实世界中复杂多变的语音场景。
音频识别
价格:¥ 0.01 / 分钟
Tongyi GTE Rerank V2
Tongyi GTE Rerank V2 是由阿里巴巴通义实验室(Tongyi Lab)研发的第二代通用文本重排序(Rerank)模型。该模型广泛应用于检索增强生成(RAG)、智能客服、企业知识库以及多语言搜索等业务场景。
文本重排序
输入:¥ 0.001 / 千 tokens
输出:¥ 0 / 千 tokens
Tencent Hunyuan Hy3
腾讯混元 Hy3 正式版面向真实业务场景打磨,采用 295B 总参数、21B 激活 MoE 架构,原生支持 256K 上下文,并提供了多档思考模式,兼顾极速响应、复杂推理与调用成本。Hy3 正式版重点提升了 Coding Agent、长文理解、多轮上下文承接、搜索问答与复杂任务执行能力,在减少幻觉、提升任务完成度和工程可用性方面表现更稳。
文本生成、深度思考、Agent增强
输入:¥ 0.0012 / 千 tokens
输出:¥ 0.0045 / 千 tokens