Token导航 LogoToken导航TokenDH.com
NVIDIA / Nemotron logo
官方核验于 2026-08-22

NVIDIA / Nemotron

NVIDIA Nemotron 当前围绕 Agentic AI、推理和多模态基础模型提供模型、训练配方与 NIM API 入口,适合需要 NVIDIA 算力生态、开放模型和企业部署能力的开发团队。

官方入口原生官方接口付费入口语言模型

主分类:语言模型

适合:Agent 开发 / 推理任务 / 企业部署

付费:NVIDIA Developer / 企业合作

地区:国际可用

接入判断

按原生接口接

NVIDIA / Nemotron 适合作为官方原生入口,接入前先按文档核对鉴权方式、模型 ID 和计费口径。

协议:官方原生 API

价格:以官方价格页为准

模型:已收录 37 个

模型能力

37 个模型
语音模型实时语音全双工对话语音 Agent

NemotronLabs VoiceChat 11B

分类:语音模型 / 上下文:32.768K / 调用名:nvidia/NVIDIA-NemotronLabs-VoiceChat-11B

NemotronLabs VoiceChat 11B 是 NVIDIA 于 2026 年 7 月发布的端到端全双工实时语音模型,支持自然轮流对话、打断和实时工具调用。

语音输入语音输出realtimespeech_generationtool_use开放权重函数调用结构化输出推理
语音模型音频理解语音识别语音翻译

Nemotron-Labs Audex 2B

分类:语音模型 / 上下文:32.768K / 调用名:nvidia/Nemotron-Labs-Audex-2B

Nemotron-Labs Audex 2B 是 NVIDIA 于 2026 年 7 月发布的音频语言模型,支持语音识别、翻译、音频理解和语音生成任务。

语音输入语音输出asrtranslationspeech_generation开放权重结构化输出推理
视频生成视频世界模型机器人仿真Physical AI

Cosmos H Dreams

分类:视频生成 / 上下文:- / 调用名:nvidia/Cosmos-H-Dreams

Cosmos H Dreams 是 NVIDIA 于 2026 年 7 月发布的交互式视频世界模型,面向医疗机器人仿真、策略评估和 Physical AI。

视频生成world_modelsimulationrobotics开放权重视觉
语音模型流式语音识别实时转写多语种

Nemotron 3.5 ASR Streaming 0.6B

分类:语音模型 / 上下文:4.096K / 调用名:nvidia/nemotron-3.5-asr-streaming-0.6b

Nemotron 3.5 ASR Streaming 0.6B 是 NVIDIA 于 2026 年 5 月发布的多语种流式语音识别模型,面向实时转写和语音 Agent。

asrspeech_recognitionstreamingmultilingual开放权重结构化输出语音输入
语言模型Agent代码开发开放权重

Nemotron 3.5 Lightning 30B A3B

分类:语言模型 / 上下文:262.144K / 调用名:nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B

Nemotron 3.5 Lightning 30B A3B 是 NVIDIA 面向长时 Agent 专用任务发布的高效率开放模型,支持推理、代码与工具工作流。

推理tool_use代码开放权重长上下文函数调用结构化输出
语言模型Agent代码开发长上下文

Nemotron 3 Ultra 550B A55B

分类:语言模型 / 上下文:1M / 调用名:nvidia/NVIDIA-Nemotron-3-Ultra-253B-v1

Nemotron 3 Ultra 是 NVIDIA 面向长流程 Agent、推理、代码和工具调用的开放权重 MoE 模型,支持百万级上下文。

推理tool_use代码开放权重长上下文函数调用结构化输出
嵌入模型向量检索RAG语义搜索

Nemotron 3 Embed 1B

分类:嵌入模型 / 上下文:32.768K / 调用名:nvidia/nemotron-3-embed-1b-v2

Nemotron 3 Embed 1B 是 NVIDIA 面向语义检索、向量搜索和 RAG 的嵌入模型。

嵌入retrieval
多模态模型OCR文档解析多语言识别

Nemotron OCR v2

分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-ocr-v2

Nemotron OCR v2 是 NVIDIA 面向复杂真实图像的多语言端到端 OCR 模型。

视觉ocrdocument_understanding结构化输出
语言模型内容安全审核风险识别

Nemotron 3.5 Content Safety

分类:语言模型 / 上下文:- / 调用名:nvidia/nemotron-3.5-content-safety

Nemotron 3.5 Content Safety 是 NVIDIA 的多语言多模态内容安全分类模型。

moderation视觉multilingual结构化输出
视频生成视频生成Physical AI仿真数据

Cosmos 3 Nano

分类:视频生成 / 上下文:- / 调用名:nvidia/cosmos-3-nano

Cosmos 3 Nano 是 NVIDIA 面向 Physical AI 的物理感知视频生成模型,支持文本或图像提示生成物理一致视频。

视频生成视觉
多模态模型视频理解物理世界推理Physical AI

Cosmos 3 Nano Reasoner

分类:多模态模型 / 上下文:- / 调用名:nvidia/cosmos-3-nano-reasoner

Cosmos 3 Nano Reasoner 是 NVIDIA 面向视频和图像物理世界理解的视觉语言推理模型。

视觉video_understanding推理结构化输出
语言模型机器翻译多语言实时翻译

Riva Translate 4B Instruct v2

分类:语言模型 / 上下文:- / 调用名:nvidia/riva-translate-4b-instruct-v2

Riva Translate 4B Instruct v2 是 NVIDIA 支持 37 种语言的翻译模型,适合少样本翻译和实时应用。

translationmultilingual
多模态模型量子计算图表理解科研分析

Ising Calibration 1.5 31B

分类:多模态模型 / 上下文:- / 调用名:nvidia/ising-calibration-1.5-31b

NVIDIA-Ising-Calibration-1.5 是基于 Gemma 4 31B 的多模态实验校准模型,用于分析量子计算校准图表并生成结构化技术文本。

视觉推理结构化输出
多模态模型多模态推理视频理解语音理解

Nemotron 3 Nano Omni Reasoning

分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-3-nano-omni-30b-a3b-reasoning

Nemotron 3 Nano Omni Reasoning 是 NVIDIA 面向全模态推理的模型,支持图像、视频、语音和文本理解,适合多模态 Agent 与复杂场景分析。

推理视觉video_understanding语音输入tool_use函数调用结构化输出
语言模型推理任务Agent代码辅助

Llama-3.1-Nemotron-70B-Instruct

分类:语言模型 / 上下文:128K / 调用名:nvidia/llama-3_1-nemotron-70b-instruct

NVIDIA 当前公开的 Nemotron 文本指令模型,面向推理、编码和 Agent 类工作流。

推理代码函数调用开放权重
语言模型超长上下文复杂推理高吞吐工作流

Nemotron-3-Super-120B-A12B

分类:语言模型 / 上下文:1M / 调用名:nvidia/nemotron-3-super-120b-a12b

开放式高效率 MoE 文本模型,强调 1M 长上下文、推理、编码和工具调用。

推理代码函数调用长上下文开放权重
语言模型复杂数学科学推理高难度编码

Llama-3.1-Nemotron-Ultra-253B-v1

分类:语言模型 / 上下文:- / 调用名:nvidia/llama-3_1-nemotron-ultra-253b-v1

NVIDIA 当前公开的大参数 Nemotron 文本模型,强调复杂数学、科学推理、编码与工具调用。

推理代码函数调用开放权重
语言模型平衡型推理工具调用通用聊天

Llama-3.3-Nemotron-Super-49B-v1.5

分类:语言模型 / 上下文:- / 调用名:nvidia/llama-3_3-nemotron-super-49b-v1_5

NVIDIA 当前公开的高效率中大型 Nemotron 文本模型,强调推理、聊天和工具调用的平衡。

推理函数调用开放权重
语言模型边缘部署轻量推理代码与数学

Llama-3.1-Nemotron-Nano-4B-v1.1

分类:语言模型 / 上下文:- / 调用名:nvidia/llama-3_1-nemotron-nano-4b-v1_1

轻量 Nemotron 文本模型,适合边缘 Agent、代码、数学和工具调用场景。

推理代码函数调用开放权重
语言模型设备侧部署RAG函数调用

Nemotron-Mini-4B-Instruct

分类:语言模型 / 上下文:- / 调用名:nvidia/nemotron-mini-4b-instruct

面向设备侧和轻量部署的 SLM,适合 RAG、角色扮演与函数调用。

函数调用开放权重
语言模型高效率推理Agent轻量生产部署

NVIDIA-Nemotron-Nano-9B-v2

分类:语言模型 / 上下文:- / 调用名:nvidia/nvidia-nemotron-nano-9b-v2

高效率 Nemotron 文本模型,强调 reasoning 和 agentic tasks。

推理开放权重
语言模型长上下文高效率 MoE推理与编码

Nemotron-3-Nano-30B-A3B

分类:语言模型 / 上下文:- / 调用名:nvidia/nemotron-3-nano-30b-a3b

开放式高效率 MoE 文本模型,强调 1M 上下文、推理、编码与工具调用。

推理代码函数调用长上下文开放权重
语言模型内容审核安全护栏多语言场景

Llama-3.1-Nemotron-Safety-Guard-8B-v3

分类:语言模型 / 上下文:8.192K / 调用名:nvidia/llama-3_1-nemotron-safety-guard-8b-v3

面向 LLM 安全与内容审核的 Nemotron Guard 模型,适合多语言安全拦截。

结构化输出开放权重
语言模型策略审核推理型安全领域护栏

Nemotron-Content-Safety-Reasoning-4B

分类:语言模型 / 上下文:128K / 调用名:nvidia/nemotron-content-safety-reasoning-4b

具备推理能力的上下文安全模型,适合执行领域化策略审核。

推理结构化输出开放权重长上下文
多模态模型多图理解视频理解视觉问答

Nemotron-Nano-12B-v2-VL

分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-nano-12b-v2-vl

Nemotron 视觉语言模型,支持多图与视频理解、视觉问答和摘要。

视觉推理开放权重
多模态模型多模态审核安全护栏有害内容检测

Nemotron-3-Content-Safety

分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-3-content-safety

多语言、多模态内容安全模型,适合检测不安全和有毒内容。

视觉结构化输出
嵌入模型知识库检索多语言嵌入长文 QA

Llama-Nemotron-Embed-1B-v2

分类:嵌入模型 / 上下文:8.192K / 调用名:nvidia/llama-nemotron-embed-1b-v2

面向长文问答检索的多语言文本嵌入模型,支持 Matryoshka 动态维度。

嵌入
嵌入模型图文检索多模态 RAG文档问答

Llama-Nemotron-Embed-VL-1B-v2

分类:嵌入模型 / 上下文:8.192K / 调用名:nvidia/llama-nemotron-embed-vl-1b-v2

面向图文问答检索的多模态嵌入模型,支持文本查询与图像文档召回。

嵌入视觉
语言模型检索重排多语言搜索RAG 精排

Llama-Nemotron-Rerank-1B-v2

分类:语言模型 / 上下文:8.192K / 调用名:nvidia/llama-nemotron-rerank-1b-v2

多语言文本重排模型,适合对检索候选结果做精排。

重排
多模态模型图文重排视觉检索多模态 RAG

Llama-Nemotron-Rerank-VL-1B-v2

分类:多模态模型 / 上下文:10.24K / 调用名:nvidia/llama-nemotron-rerank-vl-1b-v2

多模态重排模型,适合图文检索和视觉检索场景的精排。

重排视觉
多模态模型文档解析图像取数元数据抽取

Nemotron-Parse

分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-parse

视觉语言文档抽取模型,适合从图像中提取文本与元数据。

视觉结构化输出
多模态模型OCR版式抽取文档智能

Nemotron-OCR-v1

分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-ocr-v1

高速高精度 OCR 模型,适合从图片和扫描文档中抽取文本、版式和结构。

视觉结构化输出
多模态模型文档结构化页面元素检测多模态 RAG

Nemotron-Page-Elements-v3

分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-page-elements-v3

文档页面元素检测模型,适合识别图表、表格和标题等页面对象。

视觉结构化输出
多模态模型表格解析结构化抽取文档处理

Nemotron-Table-Structure-v1

分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-table-structure-v1

表格结构识别模型,适合从图像中抽取行、列、单元格关系。

视觉结构化输出
多模态模型图形元素识别文档理解结构化预处理

Nemotron-Graphic-Elements-v1

分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-graphic-elements-v1

文档图形元素检测模型,适合识别图表和图形对象,服务文档理解链路。

视觉结构化输出
语音模型实时转写低延迟语音输入英文 ASR

Nemotron-ASR-Streaming

分类:语音模型 / 上下文:- / 调用名:nvidia/nemotron-asr-streaming

实时英文语音识别模型,适合低延迟流式转写。

语音输入streaming
语音模型语音助手双向语音交互英文语音对话

Nemotron-Voicechat

分类:语音模型 / 上下文:- / 调用名:nvidia/nemotron-voicechat

语音对话模型,支持用户语音输入、代理文本与语音输出,以及用户语音转写。

语音输入语音输出streaming