筛选
模型列表
共 189 个模型
XiaoMi MiMo-V2.6-Pro
MiMo-V2.6-Pro 是 Xiaomi MiMo 迄今最强大的全模态旗舰模型,面向专业、长程、复杂工作流,并兼顾科学研究、网络安全等高阶能力。MiMo-V2.6-Pro 的核心变化,并不是单纯把模型“做得更大”,而是进一步把**长上下文、全模态理解、深度推理、工具调用和强化学习**结合起来,让模型能够处理从代码工程、办公与设计,到科研、网络安全以及电脑操作等更长链路、更复杂的任务。
文本生成、深度思考
输入:¥ 0.003 / 千 tokens
输出:¥ 0.006 / 千 tokens
Xiaomi MiMo-V2.6-Flash
MiMo-V2.6-Flash 是小米发布新一代面向高频调用和规模化任务打造的高效推理模型。与定位旗舰性能的 V2.6-Pro 不同,Flash 更强调**能力、效率与成本之间的平衡**。MiMo-V2.6-Flash 保留了 MiMo-V2.6 的核心能力体系,包括原生全模态理解、深度思考、工具调用、超长上下文和 Agent 能力,同时通过更轻量的模型结构与训练策略,降低大规模实际使用时的推理成本。
文本生成、深度思考
输入:¥ 0.001 / 千 tokens
输出:¥ 0.002 / 千 tokens
HY image 3.5 preview
HY image 3.5 preview 是一款高性价比的专业级生图模型,经过数百名内部专业设计师 GSB 盲测,模型能力对比 Hy Image3.0 显著提升约30%,通过与元宝、WorkRally、OnSolo、Miora、WorkBuddy、ima等产品深度协同,大幅提升面向生活、学习和生产力等场景的效果与能力。
图片生成
价格: ¥ 0.23 / 张
GLM 5.3 FlashX
GLM-5.3-FlashX 是智谱推出的推理加速模型,为企业与开发者带来更快、更流畅的模型体验。GLM-5.3-Flash 长期保持同尺寸最强智能水平,并具备极高性价比,本次提速进一步形成智能、价格、速度的全面竞争力。
多模态、深度思考、推理优化
输入:¥ 0.002 / 千 tokens
输出:¥ 0.007 / 千 tokens
Qwen Audio 3.1 TTS Flash
Qwen-Audio-3.1-TTS-Flash 是阿里巴巴通义实验室(Qwen)推出的一款专门针对低延迟实时交互场景设计的超高性能语音合成(TTS)大模型,是上一代 Qwen-Audio-3.0-TTS-Flash 的升级版本。Flash 版本重点优化实时合成体验,适用于语音助手、实时对话、智能客服等低延迟交互场景。
语音合成
价格:¥ 12 / 千字符
DeepSeek V4.1 Flash
DeepSeek V4.1 Flash 是 DeepSeek 全新发布的低推理成本 + 高吞吐 + 高 Agent/编程能力 + 原生视觉的模型,具备原生多模态视觉理解能力。作为全新模型结构系列中的首发小尺寸版本,DeepSeek V4.1 Flash 在保持极低推理成本的同时,实现了多项综合能力超越上一代旗舰模型 V4 Pro。
文本生成、深度思考、原生视觉
输入:¥ 0.0015 / 千 tokens
输出:¥ 0.005 / 千 tokens
Tencent Hunyuan Hy4 Preview
Hy4 preview是腾讯混元发布的新一代开源旗舰大模型,总参数770B、激活49B、上下文1M,面向软件工程、办公分析、游戏开发和科学研究等真实生产力场景。Hy4 preview 在模型尺寸、上下文长度和数据规模上都做了显著扩展。预训练与后训练共同推进,智能水平再上一个台阶,稳居开源模型第一梯队。
Agent、Coding、深度思考
输入:¥ 0.006 / 千 tokens
输出:¥ 0.018 / 千 tokens
GLM 5.3 Flash
GLM-5.3-Flash 是智谱推出的 320B 参数、18B 激活的原生多模态大模型,通过混合注意力、mHC 等架构优化,把大型模型能力压缩到更低推理成本,重点强化代码生成、Agent 工作流和长上下文任务,是 GLM 系列面向实际生产部署的高性价比旗舰级模型。
多模态输入、深度思考
输入:¥ 0.0005 / 千 tokens
输出:¥ 0.0015 / 千 tokens
Qwen3.8 Flash
Qwen3.8-Flash 是千问最新推出的多模态大模型,兼具强大的理解与生成能力和出色的响应速度。模型原生支持百万级上下文窗口,能够一次性处理超长文档、代码仓库和复杂对话。在编程辅助、智能体协作、图文理解等场景中表现尤为出色——无论是自动修复代码、操作桌面应用,还是分析图表与长视频,都能给出准确、高质量的结果。
多模态、深度思考
输入:¥ 0.001 / 千 tokens
输出:¥ 0.003 / 千 tokens
DeepSeek V4 Flash Vision Exp
DeepSeek V4 Flash Vision Exp 是 DeepSeek 推出的全新多模态视觉理解模型,这是一个实验性质的模型,可以让模型描述图片、识别截图中的文字、分析图表等。DeepSeek-V4-Flash-Vision-Exp 在各类 Agent 框架内展现出了较好的多模态适配能力,能够有效支持大家借助多样化的 Agent 工具解锁更多实用的工作场景。
图片理解、深度思考
输入:¥ 0.0015 / 千 tokens
输出:¥ 0.0045 / 千 tokens
GLM 5.3
GLM-5.3 是智谱 AI 于 2026 年 8 月 14 日公布的新一代 GLM 系列模型,定位重点是长程代码开发、Agent 工作流以及网络安全任务。GLM-5.3 通过大规模后训练和真实软件环境强化学习,让一个原有的 743B 级基础模型在代码 Agent 和网络安全任务上获得巨大能力跃升。
文本生成、深度思考、Agent 工作流
输入:¥ 0.009 / 千 tokens
输出:¥ 0.03 / 千 tokens
HY Image 3.0
Hunyuan Image 3.0(腾讯混元图像3.0)是腾讯混元大模型团队推出的一款旗舰级开源图像生成与编辑大模型。它在技术架构和生成范式上做出了重大突破,是当前开源社区中最强且规模最大的图像生成模型之一。
图片生成
价格: ¥ 0.25 / 张
Qwen3.8 2.4T A95B
Qwen3.8-2.4T-A95B 是通义千问最新旗舰系列的开源版本,2026 年 8 月发布。采用稀疏 MoE 架构,总参数 2.4 万亿,每步激活约 950 亿,配合混合注意力机制,支持 100 万 Token 上下文。核心基准:GPQA Diamond 92.6、PaperBench 93.0、OSWorld 86.1、BabyVision 82.0,CodeArena 全球第 4。
文本生成、深度思考
输入:¥ 0.013 / 千 tokens
输出:¥ 0.038 / 千 tokens
DeepSeek V4 Pro
DeepSeek V4 Pro 是 DeepSeek V4 系列的两款强大的专家混合(Mixture-of-Experts, MoE)语言模型之一,性能比肩顶级闭源模型,Agent 能力大幅提高,且具有丰富的世界知识和世界顶级推理性能,在数学、STEM、竞赛型代码的测评中,DeepSeek V4 Pro 超越当前所有已公开评测的开源模型,取得了比肩世界顶级闭源模型的优异成绩。
文本生成、深度思考
输入:¥ 0.0032 / 千 tokens
输出:¥ 0.0065 / 千 tokens
DeepSeek V4 Flash
DeepSeek V4 Flash 是 DeepSeek V4 系列的两款强大的专家混合(Mixture-of-Experts, MoE)语言模型之一,拥有 284B 参数(13B 激活参数),支持 100 万 Tokens(1M Tokens)的上下文长度,支持非思考模式与思考模式。在 Agent 测评中,DeepSeek-V4-Flash 在简单任务上与 Pro 版本旗鼓相当,但在高难度任务上仍有差距。
文本生成、深度思考
输入:¥ 0.0015 / 千 tokens
输出:¥ 0.0045 / 千 tokens
HY Image Lite
HY Image Lite(混元 Image Lite)是腾讯(Tencent)**推出的一款专注于**高效文生图(Text-to-Image)的轻量化 AI 图像生成模型。HY Image Lite 采用超高压缩编解码器,实现图像生成快速响应与高品质输出。
图片生成
价格: ¥ 0.12 / 张
Qwen3.8 Max
Qwen3.8 Max 是通义千问最新一代 2.4万亿参数 MoE 旗舰模型,编程与办公能力全面跃升,可自主编程,胜任法律、金融、设计等数百种专业任务,一次对话端到端交付生产级成果;原生视觉理解贯穿规划、执行与验证全流程,支持超长文档与长视频的深度语义解析;长程任务中自主规划与闭环迭代,持续进化。
深度思考、视觉理解、文本生成
输入:¥ 0.0125 / 千 tokens
输出:¥ 0.042 / 千 tokens
Qwen Image 3.0
Qwen-Image-3.0 Standard(标准版)是阿里巴巴推出的高性价比图像生成模型,专为大批量日常生成场景打造。模型支持 4.5k token 超长指令与 12 国语言原生渲染,能精准还原 10px 小字及学术论文公式,轻松胜任复杂版面生成、超写实人像与多场景界面仿真。
图片生成、长指令支持
价格: ¥ 0.2 / 张
Qwen3.7 Text Embedding
Qwen3.7 Text Embedding 是通义实验室基于 Qwen3.7 训练的多语言文本统一向量模型,相较 text-embedding-v4 版本在文本检索、聚类、分类性能大幅提升;模型在 MTEB 多语言、中英、Code 检索等评测任务上效果提升 20%;支持 256 ~ 2560 维用户自定义向量维度。
文本向量化
Qwen Audio 3.0 TTS Flash
Qwen Audio 3.0 TTS Flash 是面向实时交互场景优化的高性能语音合成大模型。相比前一版本,模型支持更多小语种和中文方言,提升了方言发音的正宗程度,并增强了 free-style 指令遵循能力和细粒度标签控制能力,可更灵活地控制情绪、语气、角色、语速、音量等表达方式。
语音合成
价格:¥ 12 / 千字符