输入价格
$0.33 / 1M Tokens
输出价格
$2.75 / 1M Tokens
官方模型目录与价格对比
按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。
先缩小候选,再进详情页看接口、计费和能力边界。
已收录模型
1,303
覆盖厂商
63
带价格信息
355
输入价格
$0.33 / 1M Tokens
输出价格
$2.75 / 1M Tokens
计费价格
公开资料未说明
输入形式
音频 / 文本
Advanced search with enhanced search results You can use Pro Search to get enhanced search results with reasoning. An advanced search model designed for complex queries, delivering deeper content understanding with enhanced search result accuracy and 2x more search results than standard Sonar.
输入价格
公开资料未说明
输出价格
公开资料未说明
Fast answers with reliable search results A lightweight, cost-effective search model optimized for quick, grounded answers with real-time web search.
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
Advanced reasoning with enhanced multi-step analysis A high-performance reasoning model leveraging advanced multi-step Chain-of-Thought (CoT) reasoning and enhanced information retrieval for complex problem-solving.
输入价格
公开资料未说明
输出价格
公开资料未说明
Exhaustive research with expert-level insights A powerful research model capable of conducting exhaustive searches across hundreds of sources, synthesizing expert-level insights, and generating detailed reports with comprehensive analysis.
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
计费价格
公开资料未说明
生成形式
avatar_video / realtime_avatar
NemotronLabs VoiceChat 11B 是 NVIDIA 于 2026 年 7 月发布的端到端全双工实时语音模型,支持自然轮流对话、打断和实时工具调用。
计费价格
公开资料未说明
输入形式
音频
Nemotron 3.5 Lightning 30B A3B 是 NVIDIA 面向长时 Agent 专用任务发布的高效率开放模型,支持推理、代码与工具工作流。
输入价格
公开资料未说明
输出价格
公开资料未说明
Nemotron 3 Ultra 是 NVIDIA 面向长流程 Agent、推理、代码和工具调用的开放权重 MoE 模型,支持百万级上下文。
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
Riva Translate 4B Instruct v2 是 NVIDIA 支持 37 种语言的翻译模型,适合少样本翻译和实时应用。
输入价格
公开资料未说明
输出价格
公开资料未说明
NVIDIA-Ising-Calibration-1.5 是基于 Gemma 4 31B 的多模态实验校准模型,用于分析量子计算校准图表并生成结构化技术文本。
输入价格
公开资料未说明
输出价格
公开资料未说明