Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

多模态模型Mistral预览版

Robostral Navigate

Robostral Navigate 是 Mistral 于 2026 年 7 月发布的 8B 具身导航模型,使用单个 RGB 摄像头和自然语言指令控制机器人导航。

输入价格

公开资料未说明

输出价格

公开资料未说明

机器人导航具身智能视觉语言
多模态模型MiniMax稳定版

MiniMax-M3

MiniMax 当前旗舰多模态编程模型,面向代码和复杂工程任务,支持 1M 上下文。

输入价格

公开资料未说明

输出价格

公开资料未说明

代码开发Agent复杂工程任务
多模态模型Cohere稳定版

Command A+

Command A+ 是 Cohere 于 2026 年 5 月发布的开源企业模型,面向复杂推理、多模态和多语言 Agent 任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

企业部署Agent多语言
多模态模型阶跃稳定版

Step 3.7 Flash

Step 3.7 Flash 是阶跃星辰当前公开的旗舰多模态推理模型,支持图片、视频输入、推理强度调节、工具调用和 Agent 工作流。

输入价格

公开资料未说明

输出价格

公开资料未说明

推理多模态Agent
多模态模型阶跃稳定版

step-3

兼顾智能与效率的高性价比推理模型,典型应用场景有图片内容识别和提取、图片分析和推理、逻辑与数学问题回答、代码生成和补全、智能助手和日常问答、复杂问题调研和解答等。

输入价格

¥1.50 / 1M Tokens

输出价格

¥4.00 / 1M Tokens

推理图片理解深度推理
多模态模型阶跃稳定版

step-r1-v-mini

典型应用场景有图片内容识别、图片分析和推理、代码生成和补全、数学问题回答、逻辑问题解答、日常问答等。

输入价格

¥2.50 / 1M Tokens

输出价格

¥8.00 / 1M Tokens

推理图片理解代码
多模态模型Cohere稳定版

North Micro Vision Instruct

North Micro Vision Instruct 是 Cohere 于 2026 年 8 月公开的轻量多语视觉模型,适合图像理解、视觉问答和本地部署。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解多语问答轻量部署
多模态模型腾讯稳定版

UI-Mate 9B

UI-Mate 9B 是腾讯于 2026 年 8 月发布的 GUI Agent 视觉语言模型,面向桌面操作和计算机使用任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

GUI AgentComputer Use桌面自动化
多模态模型腾讯稳定版

UI-Mate 27B

UI-Mate 27B 是腾讯于 2026 年 8 月发布的 GUI Agent 视觉语言模型,面向复杂桌面操作和计算机使用任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

GUI AgentComputer Use复杂桌面自动化
多模态模型腾讯稳定版

hunyuan-t1-vision-20250916

hunyuan-t1-vision-20250916 是腾讯混元当前模型概述公开的混元多模态模型模型,归属 混元图生文 能力线,适合通过腾讯云原生 API 或混元 OpenAI 兼容入口接入。

输入价格

¥3.00 / 1M Tokens

输出价格

¥9.00 / 1M Tokens

视觉理解图文问答拍题解题
多模态模型Amazon Nova稳定版

Nova 2 Lite

Amazon Nova 2 当前公开主力多模态理解模型,支持 1M 上下文、推理和内置工具,适合新一代 Agent 工作流。

输入价格

$0.33 / 1M Tokens

输出价格

$2.75 / 1M Tokens

长上下文推理任务Agent
多模态模型NVIDIA稳定版

Cosmos 3 Nano Reasoner

Cosmos 3 Nano Reasoner 是 NVIDIA 面向视频和图像物理世界理解的视觉语言推理模型。

输入价格

公开资料未说明

输出价格

公开资料未说明

视频理解物理世界推理Physical AI
多模态模型NVIDIA稳定版

Ising Calibration 1.5 31B

NVIDIA-Ising-Calibration-1.5 是基于 Gemma 4 31B 的多模态实验校准模型,用于分析量子计算校准图表并生成结构化技术文本。

输入价格

公开资料未说明

输出价格

公开资料未说明

量子计算图表理解科研分析
多模态模型NVIDIA预览版

Nemotron 3 Nano Omni Reasoning

Nemotron 3 Nano Omni Reasoning 是 NVIDIA 面向全模态推理的模型,支持图像、视频、语音和文本理解,适合多模态 Agent 与复杂场景分析。

输入价格

公开资料未说明

输出价格

公开资料未说明

多模态推理视频理解语音理解
多模态模型NVIDIA稳定版

Nemotron-Nano-12B-v2-VL

Nemotron 视觉语言模型,支持多图与视频理解、视觉问答和摘要。

输入价格

公开资料未说明

输出价格

公开资料未说明

多图理解视频理解视觉问答
多模态模型小米稳定版

MiMo-V2.5

MiMo 当前主力全模态理解模型,支持图像、视频、音频与文本输入,并具备原生 Agent 执行能力和 1M 上下文。

输入价格

¥2.80 / 1M Tokens

输出价格

¥14.00 / 1M Tokens

多模态问答Agent内容理解
多模态模型小米即将下线

MiMo-V2-Omni

小米 MiMo 官方模型页提示 MiMo-V2 系列已于 2026 年 6 月 30 日正式下线,原模型名称已失效,应迁移到 V2.5 系列。

输入价格

¥2.80 / 1M Tokens

输出价格

¥14.00 / 1M Tokens

视觉理解语音理解多模态助手
多模态模型Microsoft稳定版

Fara1.5-4B

Fara1.5-4B 是 Microsoft Research AI Frontiers 发布的浏览器 Computer Use Agent,通过截图理解网页并输出结构化点击、输入、滚动等动作。

输入价格

公开资料未说明

输出价格

公开资料未说明

电脑操作浏览器 Agent开放权重
多模态模型Microsoft稳定版

Fara1.5-9B

Fara1.5-9B 是 Microsoft Research AI Frontiers 发布的浏览器 Computer Use Agent,通过截图理解网页并输出结构化点击、输入、滚动等动作。

输入价格

公开资料未说明

输出价格

公开资料未说明

电脑操作浏览器 Agent开放权重
多模态模型Microsoft稳定版

Fara1.5-27B

Fara1.5-27B 是 Microsoft Research AI Frontiers 发布的浏览器 Computer Use Agent,通过截图理解网页并输出结构化点击、输入、滚动等动作。

输入价格

公开资料未说明

输出价格

公开资料未说明

电脑操作浏览器 Agent开放权重