Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

语言模型IBM Granite即将下线

Granite Guardian 3 2B

IBM 公开计费且已标记 Deprecated 的旧版 Granite Guardian 护栏模型。

输入价格

公开资料未说明

输出价格

公开资料未说明

安全护栏RAG 评估Agent 监控
语言模型IBM Granite旧版

Granite Guardian 3 8B

IBM 公开计费的 Granite Guardian 旧版护栏模型,适合模型风险评估与输出审查。

输入价格

公开资料未说明

输出价格

公开资料未说明

安全护栏RAG 评估Agent 监控
语言模型IBM Granite稳定版

Granite Guardian 3.3 8B

IBM Granite Guardian 是护栏与评审模型家族,适合越狱检测、工具调用幻觉与 RAG groundedness 判定。

输入价格

公开资料未说明

输出价格

公开资料未说明

安全护栏RAG 评估Agent 监控
语言模型AI21稳定版

Jamba Large

AI21 当前最强的长上下文 Jamba 模型,适合企业级复杂任务、知识工作流和生产环境部署。

输入价格

公开资料未说明

输出价格

公开资料未说明

长文处理企业知识库复杂工作流
语言模型AI21即将下线

Jamba Large 1.5

AI21 当前最强的长上下文 Jamba 模型,适合企业级复杂任务、知识工作流和生产环境部署。

输入价格

公开资料未说明

输出价格

公开资料未说明

长文处理企业知识库复杂工作流
语言模型AI21即将下线

Jamba Large 1.6

AI21 当前最强的长上下文 Jamba 模型,适合企业级复杂任务、知识工作流和生产环境部署。

输入价格

公开资料未说明

输出价格

公开资料未说明

长文处理企业知识库复杂工作流
语言模型AI21稳定版

Jamba Large 1.7

AI21 当前最强的长上下文 Jamba 模型,适合企业级复杂任务、知识工作流和生产环境部署。

输入价格

公开资料未说明

输出价格

公开资料未说明

长文处理企业知识库复杂工作流
语言模型AI21稳定版

Jamba Large 1.7 (2025-07)

AI21 当前最强的长上下文 Jamba 模型,适合企业级复杂任务、知识工作流和生产环境部署。

输入价格

公开资料未说明

输出价格

公开资料未说明

长文处理企业知识库复杂工作流
语言模型AI21稳定版

Jamba Mini

AI21 当前更轻量的 Jamba 模型,强调效率和可控性,适合核心企业文本流程与成本敏感工作负载。

输入价格

公开资料未说明

输出价格

公开资料未说明

批量分类企业助手成本敏感场景
语言模型AI21即将下线

Jamba Mini 1.5

AI21 当前更轻量的 Jamba 模型,强调效率和可控性,适合核心企业文本流程与成本敏感工作负载。

输入价格

公开资料未说明

输出价格

公开资料未说明

批量分类企业助手成本敏感场景
语言模型AI21即将下线

Jamba Mini 1.6

AI21 当前更轻量的 Jamba 模型,强调效率和可控性,适合核心企业文本流程与成本敏感工作负载。

输入价格

公开资料未说明

输出价格

公开资料未说明

批量分类企业助手成本敏感场景
语言模型AI21即将下线

Jamba Mini 1.7

AI21 当前更轻量的 Jamba 模型,强调效率和可控性,适合核心企业文本流程与成本敏感工作负载。

输入价格

公开资料未说明

输出价格

公开资料未说明

批量分类企业助手成本敏感场景
语言模型AI21稳定版

Jamba Mini 2

AI21 当前更轻量的 Jamba 模型,强调效率和可控性,适合核心企业文本流程与成本敏感工作负载。

输入价格

公开资料未说明

输出价格

公开资料未说明

批量分类企业助手成本敏感场景
语言模型AI21稳定版

Jamba Mini 2 (2026-01)

AI21 当前更轻量的 Jamba 模型,强调效率和可控性,适合核心企业文本流程与成本敏感工作负载。

输入价格

公开资料未说明

输出价格

公开资料未说明

批量分类企业助手成本敏感场景
语言模型AI21预览版

Jamba2 Mini

Jamba2 Mini 是 AI21 官方公开的 12B active 参数高效 Jamba 模型,面向企业核心工作流、可控生成和高性价比部署。

输入价格

公开资料未说明

输出价格

公开资料未说明

企业工作流高性价比可控生成
语言模型AI21预览版

Jamba2 3B

Jamba2 3B 是 AI21 官方公开的紧凑型 Jamba 模型,面向端侧部署、低成本推理和 Agent 系统。

输入价格

公开资料未说明

输出价格

公开资料未说明

端侧部署低成本推理Agent
语言模型Arcee AI稳定版

Trinity Large Thinking

Pricing Integration List chevron-right Language Models chevron-right Trinity-Nano (6B) Trinity-Mini (26B) Trinity-Large-Preview Trinity-Large-Thinking API Reference chevron-right Your First API Call Chat Completion Usage Models Capabilities chevron-right Streaming Messages Multi-Turn Conversations Function Calling Structured Outputs Reasoning Traces Quick Deploys chevron-right Download Models arrow-up-right Hardware Prerequisites Consumer Hardware chevron-right Inference Engines chevron-right Policies chevron-right Deprecation Policy chevron-up chevron-down gitbook Powered by GitBook gitbook xmark block-quote On this page xmark xmark copy Copy chevron-down block-quote On this page block-quote Language Models Trinity-Large-Thinking Overview Trinity-Large-Thinking is a reasoning-optimized variant of Arcee AI's Trinity-Large family — a 398B-parameter sparse Mixture-of-Experts (MoE) model with approximately 13B active parameters per token. Built on Trinity-Large-Base and post-trained with extended chain-of-thought reasoning and agentic RL, Trinity-Large-Thinking delivers state-of-the-art performance on agentic benchmarks while maintaining strong general capabilities. Trinity-Large-Thinking generates explicit reasoning traces wrapped in <think>...</think> blocks before producing its final response. This thinking process is critical to the model's performance — thinking tokens must be kept in context for multi-turn conversations and agentic loops to function correctly.

输入价格

公开资料未说明

输出价格

公开资料未说明

多步推理Reasoning TraceAgent 工作流