Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

语言模型IBM Granite稳定版

Granite 4.1 3B

Granite 4.1 3B 是 IBM 于 2026 年 4 月发布的开放权重企业文本模型,适合轻量部署、RAG 和 Agent 子任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

轻量部署RAGAgent
语言模型IBM Granite稳定版

Granite 4.1 8B

Granite 4.1 8B 是 IBM 于 2026 年 4 月发布的开放权重企业文本模型,适合通用生成、代码和企业 Agent。

输入价格

公开资料未说明

输出价格

公开资料未说明

企业问答代码开发Agent
语言模型IBM Granite稳定版

Granite 4.1 30B

Granite 4.1 30B 是 IBM 于 2026 年 4 月发布的开放权重企业旗舰文本模型,面向复杂推理、代码和长上下文 Agent。

输入价格

公开资料未说明

输出价格

公开资料未说明

复杂推理代码开发企业 Agent
语言模型IBM Granite稳定版

Granite 4.0 1B

IBM Granite 4.0 传统 dense 1B 模型,适合 Mamba2 尚未优化的边缘推理。

输入价格

公开资料未说明

输出价格

公开资料未说明

边缘部署低延迟本地推理
语言模型IBM Granite稳定版

Granite 4.0 350M

IBM Granite 4.0 超轻量 dense 模型,适合极小资源环境中的本地文本任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

边缘部署低延迟本地推理
语言模型IBM Granite稳定版

Granite 4.0 H 1B

IBM Granite 4.0 边缘侧混合模型,适合端侧和延迟敏感场景。

输入价格

公开资料未说明

输出价格

公开资料未说明

边缘部署低延迟本地推理
语言模型IBM Granite稳定版

Granite 4.0 H 350M

IBM Granite 4.0 超轻量混合模型,适合极低成本和更小设备上的本地推理。

输入价格

公开资料未说明

输出价格

公开资料未说明

边缘部署低延迟本地推理
语言模型IBM Granite稳定版

Granite 4.0 H Micro

IBM Granite 4.0 更小型的混合模型,适合函数调用和 agent 工作流中的快速子任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

边缘部署低延迟本地推理
语言模型IBM Granite稳定版

Granite 4.0 H Small

IBM Granite 4.0 当前主力企业文本模型,适合 RAG、Agent 和复杂企业工作流。

输入价格

公开资料未说明

输出价格

公开资料未说明

AgentRAG企业知识库
语言模型IBM Granite稳定版

Granite 4.0 H Tiny

IBM Granite 4.0 轻量混合模型,适合低延迟、本地化和长 prefill 场景。

输入价格

公开资料未说明

输出价格

公开资料未说明

边缘部署低延迟本地推理
语言模型IBM Granite稳定版

Granite 4.0 Micro

IBM Granite 4.0 传统 dense 轻量模型,适合 Mamba2 尚未优化的本地推理环境。

输入价格

公开资料未说明

输出价格

公开资料未说明

边缘部署低延迟本地推理
多模态模型AllenAI稳定版

MolmoAct2

MolmoAct2 是 Ai2 于 2026 年 5 月发布的视觉动作模型,面向机器人和电脑操作任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉动作机器人电脑操作
多模态模型AllenAI预览版

MolmoMotion 4B

MolmoMotion 4B 是 Ai2 于 2026 年 6 月公开的视觉语言模型,结合 RGB 观测、3D 点轨迹和自然语言动作指令,预测未来三维运动。

输入价格

公开资料未说明

输出价格

公开资料未说明

机器人3D 轨迹预测视觉语言动作
语言模型AllenAI稳定版

OLMo 3 7B Think

Ai2 当前公开的轻量 OLMo 3 推理模型,适合逐步思考、分析推断和开放推理实验。

输入价格

公开资料未说明

输出价格

公开资料未说明

推理实验逐步分析轻量部署
语言模型AllenAI稳定版

OLMo 3.1 32B Think

Ai2 当前最强的公开推理型 OLMo 3.1 模型,适合复杂分析、长链推理和强化学习研究。

输入价格

公开资料未说明

输出价格

公开资料未说明

复杂推理研究评测开放权重主力
语言模型AllenAI稳定版

Tulu 3 405B

Ai2 当前公开的最大 Tulu 3 后训练模型,适合顶级开放指令跟随研究和大模型配方复现。

输入价格

公开资料未说明

输出价格

公开资料未说明

顶级开放模型大规模后训练研究评测
多模态模型AllenAI稳定版

Molmo 2 8B

Ai2 当前公开的主力 Molmo 2 多模态模型,适合更强的视频理解、计数、跟踪和文档图像推理。

输入价格

公开资料未说明

输出价格

公开资料未说明

视频理解多模态推理开放权重主力
语言模型AI21预览版

Jamba2 3B

Jamba2 3B 是 AI21 官方公开的紧凑型 Jamba 模型,面向端侧部署、低成本推理和 Agent 系统。

输入价格

公开资料未说明

输出价格

公开资料未说明

端侧部署低成本推理Agent
语言模型Arcee AI预览版

Trinity Nano 6B

Pricing Integration List chevron-right Language Models chevron-right Trinity-Nano (6B) Trinity-Mini (26B) Trinity-Large-Preview Trinity-Large-Thinking API Reference chevron-right Your First API Call Chat Completion Usage Models Capabilities chevron-right Streaming Messages Multi-Turn Conversations Function Calling Structured Outputs Reasoning Traces Quick Deploys chevron-right Download Models arrow-up-right Hardware Prerequisites Consumer Hardware chevron-right Inference Engines chevron-right Policies chevron-right Deprecation Policy chevron-up chevron-down gitbook Powered by GitBook gitbook xmark block-quote On this page xmark xmark copy Copy chevron-down block-quote On this page block-quote Language Models Trinity-Nano (6B) Overview Trinity Nano is a 6B-parameter (1B active) sparse mixture-of-experts language model, optimized for high-efficiency inference in real-time, on-device, and embedded AI applications.

输入价格

公开资料未说明

输出价格

公开资料未说明

端侧部署低延迟轻量 Agent
语言模型Arcee AI稳定版

Trinity Mini

Pricing Integration List chevron-right Language Models chevron-right Trinity-Nano (6B) Trinity-Mini (26B) Trinity-Large-Preview Trinity-Large-Thinking API Reference chevron-right Your First API Call Chat Completion Usage Models Capabilities chevron-right Streaming Messages Multi-Turn Conversations Function Calling Structured Outputs Reasoning Traces Quick Deploys chevron-right Download Models arrow-up-right Hardware Prerequisites Consumer Hardware chevron-right Inference Engines chevron-right Policies chevron-right Deprecation Policy chevron-up chevron-down gitbook Powered by GitBook gitbook xmark block-quote On this page xmark xmark copy Copy chevron-down block-quote On this page block-quote Language Models Trinity-Mini (26B) Overview Trinity Mini is a 26B-parameter (3B active) sparse mixture-of-experts language model, engineered for efficient inference over long contexts with robust function calling and multi-step agent workflows.

输入价格

公开资料未说明

输出价格

公开资料未说明

函数调用Agent 工作流长上下文