NemotronLabs VoiceChat 11B
分类:语音模型 / 上下文:32.768K / 调用名:nvidia/NVIDIA-NemotronLabs-VoiceChat-11B
NemotronLabs VoiceChat 11B 是 NVIDIA 于 2026 年 7 月发布的端到端全双工实时语音模型,支持自然轮流对话、打断和实时工具调用。

NVIDIA Nemotron 当前围绕 Agentic AI、推理和多模态基础模型提供模型、训练配方与 NIM API 入口,适合需要 NVIDIA 算力生态、开放模型和企业部署能力的开发团队。
主分类:语言模型
适合:Agent 开发 / 推理任务 / 企业部署
付费:NVIDIA Developer / 企业合作
地区:国际可用
接入判断
按原生接口接NVIDIA / Nemotron 适合作为官方原生入口,接入前先按文档核对鉴权方式、模型 ID 和计费口径。
协议:官方原生 API
价格:以官方价格页为准
模型:已收录 37 个
官网
nvidia.com
/en-us/ai-data-science/foundation-models/nemotron
确认品牌主页与官方公告
聊天入口
公开资料未说明
直接体验官方聊天产品
API 后台
build.nvidia.com
/
开 Key、控额度、查账单
官方文档
docs.nvidia.com
/nemotron/latest
看接入方式、模型能力和限制
价格页
公开资料未说明
核对计费口径与最新价格
分类:语音模型 / 上下文:32.768K / 调用名:nvidia/NVIDIA-NemotronLabs-VoiceChat-11B
NemotronLabs VoiceChat 11B 是 NVIDIA 于 2026 年 7 月发布的端到端全双工实时语音模型,支持自然轮流对话、打断和实时工具调用。
分类:语音模型 / 上下文:32.768K / 调用名:nvidia/Nemotron-Labs-Audex-2B
Nemotron-Labs Audex 2B 是 NVIDIA 于 2026 年 7 月发布的音频语言模型,支持语音识别、翻译、音频理解和语音生成任务。
分类:视频生成 / 上下文:- / 调用名:nvidia/Cosmos-H-Dreams
Cosmos H Dreams 是 NVIDIA 于 2026 年 7 月发布的交互式视频世界模型,面向医疗机器人仿真、策略评估和 Physical AI。
分类:语音模型 / 上下文:4.096K / 调用名:nvidia/nemotron-3.5-asr-streaming-0.6b
Nemotron 3.5 ASR Streaming 0.6B 是 NVIDIA 于 2026 年 5 月发布的多语种流式语音识别模型,面向实时转写和语音 Agent。
分类:语言模型 / 上下文:262.144K / 调用名:nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B
Nemotron 3.5 Lightning 30B A3B 是 NVIDIA 面向长时 Agent 专用任务发布的高效率开放模型,支持推理、代码与工具工作流。
分类:语言模型 / 上下文:1M / 调用名:nvidia/NVIDIA-Nemotron-3-Ultra-253B-v1
Nemotron 3 Ultra 是 NVIDIA 面向长流程 Agent、推理、代码和工具调用的开放权重 MoE 模型,支持百万级上下文。
分类:嵌入模型 / 上下文:32.768K / 调用名:nvidia/nemotron-3-embed-1b-v2
Nemotron 3 Embed 1B 是 NVIDIA 面向语义检索、向量搜索和 RAG 的嵌入模型。
分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-ocr-v2
Nemotron OCR v2 是 NVIDIA 面向复杂真实图像的多语言端到端 OCR 模型。
分类:语言模型 / 上下文:- / 调用名:nvidia/nemotron-3.5-content-safety
Nemotron 3.5 Content Safety 是 NVIDIA 的多语言多模态内容安全分类模型。
分类:视频生成 / 上下文:- / 调用名:nvidia/cosmos-3-nano
Cosmos 3 Nano 是 NVIDIA 面向 Physical AI 的物理感知视频生成模型,支持文本或图像提示生成物理一致视频。
分类:多模态模型 / 上下文:- / 调用名:nvidia/cosmos-3-nano-reasoner
Cosmos 3 Nano Reasoner 是 NVIDIA 面向视频和图像物理世界理解的视觉语言推理模型。
分类:语言模型 / 上下文:- / 调用名:nvidia/riva-translate-4b-instruct-v2
Riva Translate 4B Instruct v2 是 NVIDIA 支持 37 种语言的翻译模型,适合少样本翻译和实时应用。
分类:多模态模型 / 上下文:- / 调用名:nvidia/ising-calibration-1.5-31b
NVIDIA-Ising-Calibration-1.5 是基于 Gemma 4 31B 的多模态实验校准模型,用于分析量子计算校准图表并生成结构化技术文本。
分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-3-nano-omni-30b-a3b-reasoning
Nemotron 3 Nano Omni Reasoning 是 NVIDIA 面向全模态推理的模型,支持图像、视频、语音和文本理解,适合多模态 Agent 与复杂场景分析。
分类:语言模型 / 上下文:128K / 调用名:nvidia/llama-3_1-nemotron-70b-instruct
NVIDIA 当前公开的 Nemotron 文本指令模型,面向推理、编码和 Agent 类工作流。
分类:语言模型 / 上下文:1M / 调用名:nvidia/nemotron-3-super-120b-a12b
开放式高效率 MoE 文本模型,强调 1M 长上下文、推理、编码和工具调用。
分类:语言模型 / 上下文:- / 调用名:nvidia/llama-3_1-nemotron-ultra-253b-v1
NVIDIA 当前公开的大参数 Nemotron 文本模型,强调复杂数学、科学推理、编码与工具调用。
分类:语言模型 / 上下文:- / 调用名:nvidia/llama-3_3-nemotron-super-49b-v1_5
NVIDIA 当前公开的高效率中大型 Nemotron 文本模型,强调推理、聊天和工具调用的平衡。
分类:语言模型 / 上下文:- / 调用名:nvidia/llama-3_1-nemotron-nano-4b-v1_1
轻量 Nemotron 文本模型,适合边缘 Agent、代码、数学和工具调用场景。
分类:语言模型 / 上下文:- / 调用名:nvidia/nemotron-mini-4b-instruct
面向设备侧和轻量部署的 SLM,适合 RAG、角色扮演与函数调用。
分类:语言模型 / 上下文:- / 调用名:nvidia/nvidia-nemotron-nano-9b-v2
高效率 Nemotron 文本模型,强调 reasoning 和 agentic tasks。
分类:语言模型 / 上下文:- / 调用名:nvidia/nemotron-3-nano-30b-a3b
开放式高效率 MoE 文本模型,强调 1M 上下文、推理、编码与工具调用。
分类:语言模型 / 上下文:8.192K / 调用名:nvidia/llama-3_1-nemotron-safety-guard-8b-v3
面向 LLM 安全与内容审核的 Nemotron Guard 模型,适合多语言安全拦截。
分类:语言模型 / 上下文:128K / 调用名:nvidia/nemotron-content-safety-reasoning-4b
具备推理能力的上下文安全模型,适合执行领域化策略审核。
分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-nano-12b-v2-vl
Nemotron 视觉语言模型,支持多图与视频理解、视觉问答和摘要。
分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-3-content-safety
多语言、多模态内容安全模型,适合检测不安全和有毒内容。
分类:嵌入模型 / 上下文:8.192K / 调用名:nvidia/llama-nemotron-embed-1b-v2
面向长文问答检索的多语言文本嵌入模型,支持 Matryoshka 动态维度。
分类:嵌入模型 / 上下文:8.192K / 调用名:nvidia/llama-nemotron-embed-vl-1b-v2
面向图文问答检索的多模态嵌入模型,支持文本查询与图像文档召回。
分类:语言模型 / 上下文:8.192K / 调用名:nvidia/llama-nemotron-rerank-1b-v2
多语言文本重排模型,适合对检索候选结果做精排。
分类:多模态模型 / 上下文:10.24K / 调用名:nvidia/llama-nemotron-rerank-vl-1b-v2
多模态重排模型,适合图文检索和视觉检索场景的精排。
分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-parse
视觉语言文档抽取模型,适合从图像中提取文本与元数据。
分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-ocr-v1
高速高精度 OCR 模型,适合从图片和扫描文档中抽取文本、版式和结构。
分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-page-elements-v3
文档页面元素检测模型,适合识别图表、表格和标题等页面对象。
分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-table-structure-v1
表格结构识别模型,适合从图像中抽取行、列、单元格关系。
分类:多模态模型 / 上下文:- / 调用名:nvidia/nemotron-graphic-elements-v1
文档图形元素检测模型,适合识别图表和图形对象,服务文档理解链路。
分类:语音模型 / 上下文:- / 调用名:nvidia/nemotron-asr-streaming
实时英文语音识别模型,适合低延迟流式转写。
分类:语音模型 / 上下文:- / 调用名:nvidia/nemotron-voicechat
语音对话模型,支持用户语音输入、代理文本与语音输出,以及用户语音转写。