Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

视频生成Runway稳定版

Runway Act Two

Runway 当前公开的角色表演控制模型,可用参考视频驱动角色的表情和肢体动作。

计费价格

公开资料未说明

生成形式

character_performance

角色驱动表演迁移数字人视频
图像生成Runway稳定版

Runway Gen-4 Image

Runway 当前主力 Gen-4 图像模型,支持文本生成图像,也支持参考图驱动的图像生成。

计费价格

公开资料未说明

生成形式

text_to_image / reference_to_image

高质量图像风格控制品牌素材
图像生成Runway稳定版

Runway Gen-4 Image Turbo

Runway 当前公开的 Gen-4 Image Turbo 图像模型,主打更快出图和更低成本。

计费价格

公开资料未说明

生成形式

text_to_image / reference_to_image

高性价比图像快速出图批量素材
图像生成Ideogram稳定版

Ideogram 4.0

Ideogram 4.0 是 Ideogram 于 2026 年 6 月发布的开放权重图像基础模型,强调设计、文字排版和结构化提示能力。

计费价格

公开资料未说明

生成形式

text_to_image / style_reference / character_reference

设计向出图文字排版开放权重
图像生成Ideogram稳定版

Ideogram 3.0

Ideogram 当前最新的 3.0 图像模型,强调文字排版、海报物料和设计向图像生成能力。

计费价格

公开资料未说明

生成形式

text_to_image / style_reference / character_reference

海报字图品牌物料设计向出图
音乐生成Suno稳定版

Suno Scenes

Scenes 是 Suno 面向真实场景的配乐功能,可围绕现实拍摄场景快速生成契合氛围的音乐。

计费价格

公开资料未说明

生成模式

lyrics_to_music

短视频配乐场景氛围移动端创作
视频生成NVIDIA稳定版

Cosmos H Dreams

Cosmos H Dreams 是 NVIDIA 于 2026 年 7 月发布的交互式视频世界模型,面向医疗机器人仿真、策略评估和 Physical AI。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / video_to_video

视频世界模型机器人仿真Physical AI
多模态模型NVIDIA稳定版

Nemotron OCR v2

Nemotron OCR v2 是 NVIDIA 面向复杂真实图像的多语言端到端 OCR 模型。

输入价格

公开资料未说明

输出价格

公开资料未说明

OCR文档解析多语言识别
视频生成NVIDIA稳定版

Cosmos 3 Nano

Cosmos 3 Nano 是 NVIDIA 面向 Physical AI 的物理感知视频生成模型,支持文本或图像提示生成物理一致视频。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video

视频生成Physical AI仿真数据
多模态模型NVIDIA稳定版

Cosmos 3 Nano Reasoner

Cosmos 3 Nano Reasoner 是 NVIDIA 面向视频和图像物理世界理解的视觉语言推理模型。

输入价格

公开资料未说明

输出价格

公开资料未说明

视频理解物理世界推理Physical AI
多模态模型NVIDIA稳定版

Ising Calibration 1.5 31B

NVIDIA-Ising-Calibration-1.5 是基于 Gemma 4 31B 的多模态实验校准模型,用于分析量子计算校准图表并生成结构化技术文本。

输入价格

公开资料未说明

输出价格

公开资料未说明

量子计算图表理解科研分析
多模态模型NVIDIA预览版

Nemotron 3 Nano Omni Reasoning

Nemotron 3 Nano Omni Reasoning 是 NVIDIA 面向全模态推理的模型,支持图像、视频、语音和文本理解,适合多模态 Agent 与复杂场景分析。

输入价格

公开资料未说明

输出价格

公开资料未说明

多模态推理视频理解语音理解
图像生成商汤稳定版

SenseNova U1.5 8B MoT

SenseNova 最新原生统一多模态模型,支持图像生成、图像编辑、原生 4K、复杂布局和中英文文字渲染。

计费价格

公开资料未说明

生成形式

text_to_image / image_edit

图像生成图像编辑原生 4K
多模态模型商汤稳定版

SenseNova Vision 7B MoT

SenseNova 统一视觉模型,覆盖视觉理解、分割、深度、法线和几何等视觉任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解图像分割深度估计
多模态模型商汤预览版

SenseNova U1

SenseNova 当前旗舰多模态模型,公开口径支持图像加文本输入,并可同时输出文本与图片。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解图文生成深度调研
多模态模型NVIDIA稳定版

Nemotron-Nano-12B-v2-VL

Nemotron 视觉语言模型,支持多图与视频理解、视觉问答和摘要。

输入价格

公开资料未说明

输出价格

公开资料未说明

多图理解视频理解视觉问答
多模态模型NVIDIA稳定版

Nemotron-3-Content-Safety

多语言、多模态内容安全模型,适合检测不安全和有毒内容。

输入价格

公开资料未说明

输出价格

公开资料未说明

多模态审核安全护栏有害内容检测