Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

语言模型Perplexity稳定版

Sonar Reasoning Pro

Advanced reasoning with enhanced multi-step analysis A high-performance reasoning model leveraging advanced multi-step Chain-of-Thought (CoT) reasoning and enhanced information retrieval for complex problem-solving.

输入价格

公开资料未说明

输出价格

公开资料未说明

复杂推理多步分析研究助手
语言模型Perplexity稳定版

PPLX Embed v1 0.6B

Perplexity 官方标准 embedding 模型,适合独立文本、查询和句子级语义检索。

输入价格

公开资料未说明

输出价格

公开资料未说明

语义检索RAG向量搜索
语言模型Perplexity稳定版

PPLX Embed v1 4B

Perplexity 官方标准 embedding 模型,适合独立文本、查询和句子级语义检索。

输入价格

公开资料未说明

输出价格

公开资料未说明

语义检索RAG向量搜索
语言模型Perplexity稳定版

PPLX Context Embed v1 4B

Perplexity 官方上下文化 embedding 模型,适合共享上下文的文档分块检索。

输入价格

公开资料未说明

输出价格

公开资料未说明

文档切片检索RAG共享上下文检索
语言模型NVIDIA稳定版

Nemotron 3.5 Lightning 30B A3B

Nemotron 3.5 Lightning 30B A3B 是 NVIDIA 面向长时 Agent 专用任务发布的高效率开放模型,支持推理、代码与工具工作流。

输入价格

公开资料未说明

输出价格

公开资料未说明

Agent代码开发开放权重
语言模型NVIDIA稳定版

Nemotron 3 Ultra 550B A55B

Nemotron 3 Ultra 是 NVIDIA 面向长流程 Agent、推理、代码和工具调用的开放权重 MoE 模型,支持百万级上下文。

输入价格

公开资料未说明

输出价格

公开资料未说明

Agent代码开发长上下文
语言模型NVIDIA稳定版

Nemotron-3-Super-120B-A12B

开放式高效率 MoE 文本模型,强调 1M 长上下文、推理、编码和工具调用。

输入价格

公开资料未说明

输出价格

公开资料未说明

超长上下文复杂推理高吞吐工作流
语言模型小米预览版

MiMo-V2.5-Pro UltraSpeed

MiMo-V2.5-Pro UltraSpeed 是小米与 TileRT 联合发布的高速推理模式,面向低延迟 Agent 和代码场景,峰值约 1000 tokens/s。

输入价格

公开资料未说明

输出价格

公开资料未说明

高速推理代码开发Agent
语言模型小米稳定版

MiMo-V2.5-Pro

小米当前最强的长上下文 Agent 与软件工程模型,公开口径为 1T 总参数、42B 激活参数,并支持 1M 上下文。

输入价格

¥7.00 / 1M Tokens

输出价格

¥21.00 / 1M Tokens

复杂推理代码开发Agent
语言模型小米即将下线

MiMo-V2-Pro

小米 MiMo 官方模型页提示 MiMo-V2 系列已于 2026 年 6 月 30 日正式下线,原模型名称已失效,应迁移到 V2.5 系列。

输入价格

¥7.00 / 1M Tokens

输出价格

¥21.00 / 1M Tokens

复杂推理长文任务Agent
语言模型小米即将下线

MiMo-V2-Flash

小米 MiMo 官方模型页提示 MiMo-V2 系列已于 2026 年 6 月 30 日正式下线,原模型名称已失效,应迁移到 V2.5 系列。

输入价格

¥0.70 / 1M Tokens

输出价格

¥2.10 / 1M Tokens

低成本调用代码开发Agent
语言模型百川智能稳定版

Baichuan3-Turbo-128k

百川长上下文通用对话模型,主打 128k 上下文与结构化输出。

输入价格

公开资料未说明

输出价格

公开资料未说明

长文问答知识整理结构化输出
语言模型Microsoft稳定版

Phi-3.5-mini-instruct

Phi 3.5 轻量主力模型,兼顾中文和英文文本任务的长上下文处理。

输入价格

公开资料未说明

输出价格

公开资料未说明

长文问答轻量主力通用对话
语言模型华为盘古稳定版

Pangu-NLP-N2-32K-5.0.3.2

N2快慢思考融合版本,支持模型推理及训练。工具能力进一步加强,RAG幻觉降低。

输入价格

公开资料未说明

输出价格

公开资料未说明

RAG 问答复杂分析企业知识工作流