Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

音乐生成Suno稳定版

Suno Custom Models

Custom Models 是 Suno v5.5 的个性化调优能力,可用自有歌曲把 v5.5 调成更接近个人风格的变体。

计费价格

公开资料未说明

生成模式

remix

个人风格调优品牌音乐创作者专属模型
音乐生成Suno稳定版

Suno My Taste

My Taste 是 Suno v5.5 的个性偏好层,用于把用户的审美偏好持续反馈到后续歌曲创作中。

计费价格

公开资料未说明

生成模式

lyrics_to_music

个性偏好长期调味个人推荐风格
语音模型NVIDIA稳定版

NemotronLabs VoiceChat 11B

NemotronLabs VoiceChat 11B 是 NVIDIA 于 2026 年 7 月发布的端到端全双工实时语音模型,支持自然轮流对话、打断和实时工具调用。

计费价格

公开资料未说明

输入形式

音频

实时语音全双工对话语音 Agent
语音模型NVIDIA稳定版

Nemotron-Labs Audex 2B

Nemotron-Labs Audex 2B 是 NVIDIA 于 2026 年 7 月发布的音频语言模型,支持语音识别、翻译、音频理解和语音生成任务。

计费价格

公开资料未说明

输入形式

音频 / 文本

音频理解语音识别语音翻译
视频生成NVIDIA稳定版

Cosmos H Dreams

Cosmos H Dreams 是 NVIDIA 于 2026 年 7 月发布的交互式视频世界模型,面向医疗机器人仿真、策略评估和 Physical AI。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / video_to_video

视频世界模型机器人仿真Physical AI
语音模型NVIDIA稳定版

Nemotron 3.5 ASR Streaming 0.6B

Nemotron 3.5 ASR Streaming 0.6B 是 NVIDIA 于 2026 年 5 月发布的多语种流式语音识别模型,面向实时转写和语音 Agent。

计费价格

公开资料未说明

输入形式

音频

流式语音识别实时转写多语种
语言模型NVIDIA稳定版

Nemotron 3.5 Lightning 30B A3B

Nemotron 3.5 Lightning 30B A3B 是 NVIDIA 面向长时 Agent 专用任务发布的高效率开放模型,支持推理、代码与工具工作流。

输入价格

公开资料未说明

输出价格

公开资料未说明

Agent代码开发开放权重
语言模型NVIDIA稳定版

Nemotron 3 Ultra 550B A55B

Nemotron 3 Ultra 是 NVIDIA 面向长流程 Agent、推理、代码和工具调用的开放权重 MoE 模型,支持百万级上下文。

输入价格

公开资料未说明

输出价格

公开资料未说明

Agent代码开发长上下文
嵌入模型NVIDIA稳定版

Nemotron 3 Embed 1B

Nemotron 3 Embed 1B 是 NVIDIA 面向语义检索、向量搜索和 RAG 的嵌入模型。

输入价格

公开资料未说明

向量维度

公开资料未说明

向量检索RAG语义搜索
多模态模型NVIDIA稳定版

Nemotron OCR v2

Nemotron OCR v2 是 NVIDIA 面向复杂真实图像的多语言端到端 OCR 模型。

输入价格

公开资料未说明

输出价格

公开资料未说明

OCR文档解析多语言识别
视频生成NVIDIA稳定版

Cosmos 3 Nano

Cosmos 3 Nano 是 NVIDIA 面向 Physical AI 的物理感知视频生成模型,支持文本或图像提示生成物理一致视频。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video

视频生成Physical AI仿真数据
多模态模型NVIDIA稳定版

Cosmos 3 Nano Reasoner

Cosmos 3 Nano Reasoner 是 NVIDIA 面向视频和图像物理世界理解的视觉语言推理模型。

输入价格

公开资料未说明

输出价格

公开资料未说明

视频理解物理世界推理Physical AI
语言模型NVIDIA稳定版

Riva Translate 4B Instruct v2

Riva Translate 4B Instruct v2 是 NVIDIA 支持 37 种语言的翻译模型,适合少样本翻译和实时应用。

输入价格

公开资料未说明

输出价格

公开资料未说明

机器翻译多语言实时翻译
多模态模型NVIDIA稳定版

Ising Calibration 1.5 31B

NVIDIA-Ising-Calibration-1.5 是基于 Gemma 4 31B 的多模态实验校准模型,用于分析量子计算校准图表并生成结构化技术文本。

输入价格

公开资料未说明

输出价格

公开资料未说明

量子计算图表理解科研分析
多模态模型NVIDIA预览版

Nemotron 3 Nano Omni Reasoning

Nemotron 3 Nano Omni Reasoning 是 NVIDIA 面向全模态推理的模型,支持图像、视频、语音和文本理解,适合多模态 Agent 与复杂场景分析。

输入价格

公开资料未说明

输出价格

公开资料未说明

多模态推理视频理解语音理解
图像生成商汤稳定版

SenseNova U1.5 8B MoT

SenseNova 最新原生统一多模态模型,支持图像生成、图像编辑、原生 4K、复杂布局和中英文文字渲染。

计费价格

公开资料未说明

生成形式

text_to_image / image_edit

图像生成图像编辑原生 4K
多模态模型商汤稳定版

SenseNova Vision 7B MoT

SenseNova 统一视觉模型,覆盖视觉理解、分割、深度、法线和几何等视觉任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解图像分割深度估计
多模态模型商汤预览版

SenseNova U1

SenseNova 当前旗舰多模态模型,公开口径支持图像加文本输入,并可同时输出文本与图片。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉理解图文生成深度调研
语言模型商汤预览版

SenseNova 6.7 Flash

SenseNova 当前轻量主力 Agent 模型,强调更好的 token 效率,适合时延和成本敏感的结构化文本任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

高吞吐结构化输出工具调用