Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

语言模型Perplexity稳定版

PPLX Embed v1 4B

Perplexity 官方标准 embedding 模型,适合独立文本、查询和句子级语义检索。

输入价格

公开资料未说明

输出价格

公开资料未说明

语义检索RAG向量搜索
语言模型Perplexity稳定版

PPLX Context Embed v1 4B

Perplexity 官方上下文化 embedding 模型,适合共享上下文的文档分块检索。

输入价格

公开资料未说明

输出价格

公开资料未说明

文档切片检索RAG共享上下文检索
语言模型NVIDIA稳定版

Nemotron 3.5 Lightning 30B A3B

Nemotron 3.5 Lightning 30B A3B 是 NVIDIA 面向长时 Agent 专用任务发布的高效率开放模型,支持推理、代码与工具工作流。

输入价格

公开资料未说明

输出价格

公开资料未说明

Agent代码开发开放权重
语言模型NVIDIA稳定版

Nemotron 3 Ultra 550B A55B

Nemotron 3 Ultra 是 NVIDIA 面向长流程 Agent、推理、代码和工具调用的开放权重 MoE 模型,支持百万级上下文。

输入价格

公开资料未说明

输出价格

公开资料未说明

Agent代码开发长上下文
语言模型NVIDIA稳定版

Riva Translate 4B Instruct v2

Riva Translate 4B Instruct v2 是 NVIDIA 支持 37 种语言的翻译模型,适合少样本翻译和实时应用。

输入价格

公开资料未说明

输出价格

公开资料未说明

机器翻译多语言实时翻译
语言模型商汤预览版

SenseNova 6.7 Flash

SenseNova 当前轻量主力 Agent 模型,强调更好的 token 效率,适合时延和成本敏感的结构化文本任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

高吞吐结构化输出工具调用
语言模型NVIDIA稳定版

Nemotron-3-Super-120B-A12B

开放式高效率 MoE 文本模型,强调 1M 长上下文、推理、编码和工具调用。

输入价格

公开资料未说明

输出价格

公开资料未说明

超长上下文复杂推理高吞吐工作流
语言模型NVIDIA稳定版

Llama-3.1-Nemotron-Ultra-253B-v1

NVIDIA 当前公开的大参数 Nemotron 文本模型,强调复杂数学、科学推理、编码与工具调用。

输入价格

公开资料未说明

输出价格

公开资料未说明

复杂数学科学推理高难度编码
语言模型NVIDIA稳定版

Nemotron-3-Nano-30B-A3B

开放式高效率 MoE 文本模型,强调 1M 上下文、推理、编码与工具调用。

输入价格

公开资料未说明

输出价格

公开资料未说明

长上下文高效率 MoE推理与编码
语言模型小米预览版

MiMo-V2.5-Pro UltraSpeed

MiMo-V2.5-Pro UltraSpeed 是小米与 TileRT 联合发布的高速推理模式,面向低延迟 Agent 和代码场景,峰值约 1000 tokens/s。

输入价格

公开资料未说明

输出价格

公开资料未说明

高速推理代码开发Agent