Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

多模态模型腾讯稳定版

UI-Mate 27B

UI-Mate 27B 是腾讯于 2026 年 8 月发布的 GUI Agent 视觉语言模型,面向复杂桌面操作和计算机使用任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

GUI AgentComputer Use复杂桌面自动化
多模态模型Black Forest Labs预览版

FLUX 3

FLUX 3 是 Black Forest Labs 的多模态基础模型,统一学习图像、视频和音频,并支持图像生成编辑、视频生成与原生音频。

输入价格

公开资料未说明

输出价格

公开资料未说明

视频生成图片生成原生音频
多模态模型腾讯稳定版

Tencent HY Vision 1.5 Instruct

Tencent HY Vision 1.5 Instruct 是腾讯混元当前模型概述公开的混元多模态模型模型,归属 混元图生文 能力线,适合通过腾讯云原生 API 或混元 OpenAI 兼容入口接入。

输入价格

¥3.00 / 1M Tokens

输出价格

¥9.00 / 1M Tokens

视觉理解图文问答拍题解题
多模态模型腾讯稳定版

hunyuan-t1-vision-20250916

hunyuan-t1-vision-20250916 是腾讯混元当前模型概述公开的混元多模态模型模型,归属 混元图生文 能力线,适合通过腾讯云原生 API 或混元 OpenAI 兼容入口接入。

输入价格

¥3.00 / 1M Tokens

输出价格

¥9.00 / 1M Tokens

视觉理解图文问答拍题解题
多模态模型腾讯稳定版

hunyuan-turbos-vision-video

hunyuan-turbos-vision-video 是腾讯混元当前模型概述公开的混元多模态模型模型,归属 混元视频生文 能力线,适合通过腾讯云原生 API 或混元 OpenAI 兼容入口接入。

输入价格

¥3.00 / 1M Tokens

输出价格

¥9.00 / 1M Tokens

视频理解内容审核视频问答
多模态模型Amazon Nova稳定版

Nova Pro

Amazon Nova V1 主力多模态模型,强调准确率、速度与成本平衡,适合通用生产接入。

输入价格

$0.80 / 1M Tokens

输出价格

$3.20 / 1M Tokens

通用生产文档分析视觉理解
多模态模型Amazon Nova稳定版

Nova Premier

Amazon Nova V1 当前最强的理解类多模态模型,适合复杂企业任务、长上下文分析和蒸馏教师模型场景。

输入价格

$2.50 / 1M Tokens

输出价格

$12.50 / 1M Tokens

复杂分析长上下文企业 Agent
多模态模型Amazon Nova稳定版

Nova Lite

Amazon Nova V1 低成本多模态模型,主打高吞吐和快响应,适合大规模输入理解场景。

输入价格

$0.06 / 1M Tokens

输出价格

$0.24 / 1M Tokens

高并发成本敏感多模态理解
多模态模型Amazon Nova稳定版

Nova 2 Lite

Amazon Nova 2 当前公开主力多模态理解模型,支持 1M 上下文、推理和内置工具,适合新一代 Agent 工作流。

输入价格

$0.33 / 1M Tokens

输出价格

$2.75 / 1M Tokens

长上下文推理任务Agent
多模态模型NVIDIA稳定版

Nemotron OCR v2

Nemotron OCR v2 是 NVIDIA 面向复杂真实图像的多语言端到端 OCR 模型。

输入价格

公开资料未说明

输出价格

公开资料未说明

OCR文档解析多语言识别
多模态模型NVIDIA稳定版

Cosmos 3 Nano Reasoner

Cosmos 3 Nano Reasoner 是 NVIDIA 面向视频和图像物理世界理解的视觉语言推理模型。

输入价格

公开资料未说明

输出价格

公开资料未说明

视频理解物理世界推理Physical AI
多模态模型NVIDIA稳定版

Ising Calibration 1.5 31B

NVIDIA-Ising-Calibration-1.5 是基于 Gemma 4 31B 的多模态实验校准模型,用于分析量子计算校准图表并生成结构化技术文本。

输入价格

公开资料未说明

输出价格

公开资料未说明

量子计算图表理解科研分析
多模态模型NVIDIA预览版

Nemotron 3 Nano Omni Reasoning

Nemotron 3 Nano Omni Reasoning 是 NVIDIA 面向全模态推理的模型,支持图像、视频、语音和文本理解,适合多模态 Agent 与复杂场景分析。

输入价格

公开资料未说明

输出价格

公开资料未说明

多模态推理视频理解语音理解
多模态模型商汤稳定版

SenseNova Vision 7B MoT

SenseNova 统一视觉模型,覆盖视觉理解、分割、深度、法线和几何等视觉任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解图像分割深度估计
多模态模型商汤预览版

SenseNova U1

SenseNova 当前旗舰多模态模型,公开口径支持图像加文本输入,并可同时输出文本与图片。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解图文生成深度调研
多模态模型NVIDIA稳定版

Nemotron-Nano-12B-v2-VL

Nemotron 视觉语言模型,支持多图与视频理解、视觉问答和摘要。

输入价格

公开资料未说明

输出价格

公开资料未说明

多图理解视频理解视觉问答
多模态模型NVIDIA稳定版

Nemotron-3-Content-Safety

多语言、多模态内容安全模型,适合检测不安全和有毒内容。

输入价格

公开资料未说明

输出价格

公开资料未说明

多模态审核安全护栏有害内容检测
多模态模型NVIDIA稳定版

Nemotron-Parse

视觉语言文档抽取模型,适合从图像中提取文本与元数据。

输入价格

公开资料未说明

输出价格

公开资料未说明

文档解析图像取数元数据抽取
多模态模型NVIDIA稳定版

Nemotron-OCR-v1

高速高精度 OCR 模型,适合从图片和扫描文档中抽取文本、版式和结构。

输入价格

公开资料未说明

输出价格

公开资料未说明

OCR版式抽取文档智能