Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

多模态模型通义稳定版

Qwen3-VL-Plus

Qwen3-VL-Plus 是 Qwen 的原生视觉语言模型,支持空间推理和百万级上下文视频分析。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解视频分析空间推理
多模态模型火山稳定版

Lance

Lance 是字节跳动于 2026 年 5 月发布的统一多模态模型,覆盖图像生成、视频生成、图像编辑和视频理解。

输入价格

公开资料未说明

输出价格

公开资料未说明

统一多模态图像生成视频理解
多模态模型阶跃稳定版

step-1o-turbo-vision

典型应用场景有社媒发帖文案创作、AI问答助手、图片与视频理解等。单次请求限制输入最多50张,总大小控制在20M以内的图片,输入视频为小于128MB的MP4文件。

输入价格

¥2.50 / 1M Tokens

输出价格

¥8.00 / 1M Tokens

图片理解视频理解文本生成
多模态模型Black Forest Labs预览版

FLUX 3

FLUX 3 是 Black Forest Labs 的多模态基础模型,统一学习图像、视频和音频,并支持图像生成编辑、视频生成与原生音频。

输入价格

公开资料未说明

输出价格

公开资料未说明

视频生成图片生成原生音频
多模态模型腾讯稳定版

hunyuan-turbos-vision-video

hunyuan-turbos-vision-video 是腾讯混元当前模型概述公开的混元多模态模型模型,归属 混元视频生文 能力线,适合通过腾讯云原生 API 或混元 OpenAI 兼容入口接入。

输入价格

¥3.00 / 1M Tokens

输出价格

¥9.00 / 1M Tokens

视频理解内容审核视频问答
多模态模型NVIDIA稳定版

Cosmos 3 Nano Reasoner

Cosmos 3 Nano Reasoner 是 NVIDIA 面向视频和图像物理世界理解的视觉语言推理模型。

输入价格

公开资料未说明

输出价格

公开资料未说明

视频理解物理世界推理Physical AI
多模态模型NVIDIA预览版

Nemotron 3 Nano Omni Reasoning

Nemotron 3 Nano Omni Reasoning 是 NVIDIA 面向全模态推理的模型,支持图像、视频、语音和文本理解,适合多模态 Agent 与复杂场景分析。

输入价格

公开资料未说明

输出价格

公开资料未说明

多模态推理视频理解语音理解
多模态模型小米稳定版

MiMo-V2.5

MiMo 当前主力全模态理解模型,支持图像、视频、音频与文本输入,并具备原生 Agent 执行能力和 1M 上下文。

输入价格

¥2.80 / 1M Tokens

输出价格

¥14.00 / 1M Tokens

多模态问答Agent内容理解
多模态模型Microsoft稳定版

Mage-VL

Mage-VL 是 Microsoft 发布的高效流式多模态基础模型,面向视频理解和连续视觉语言交互。

输入价格

公开资料未说明

输出价格

公开资料未说明

视频理解流式多模态视觉语言
多模态模型Reka稳定版

Reka Edge 2

Reka Edge 2 是 Reka 当前官网列出的轻量多模态模型,面向低延迟文本、图像、视频和音频理解。

输入价格

公开资料未说明

输出价格

公开资料未说明

低延迟多模态理解成本敏感
多模态模型AllenAI稳定版

Molmo 2 4B

Ai2 当前公开的轻量 Molmo 2 多模态模型,适合图像理解、视频理解和工作站级多模态研究。

输入价格

公开资料未说明

输出价格

公开资料未说明

多模态研究工作站部署图像视频理解
多模态模型AllenAI稳定版

Molmo 2 8B

Ai2 当前公开的主力 Molmo 2 多模态模型,适合更强的视频理解、计数、跟踪和文档图像推理。

输入价格

公开资料未说明

输出价格

公开资料未说明

视频理解多模态推理开放权重主力
多模态模型AllenAI稳定版

Molmo 2-O 7B

Ai2 当前公开的 Molmo 2-O 多模态模型,适合需要完全开放语言骨干与视觉链路的研究工作流。

输入价格

公开资料未说明

输出价格

公开资料未说明

完全开放链路多模态研究视觉语言实验
已展示全部 13 个模型