Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

多模态模型Anthropic即将下线

Claude 3.5 Haiku

Claude 3.5 Haiku 是 Anthropic 的轻量 Claude 模型,适合低延迟、批量处理等更看重速度和成本的场景。 当前已退役。

输入价格

$0.80 / 1M Tokens

输出价格

$4.00 / 1M Tokens

低延迟批量处理成本敏感
多模态模型Anthropic即将下线

Claude 3 Haiku

Claude 3 Haiku 是 Anthropic 的轻量 Claude 模型,适合低延迟、批量处理等更看重速度和成本的场景。 当前已进入弃用阶段。

输入价格

$0.25 / 1M Tokens

输出价格

$1.25 / 1M Tokens

低延迟批量处理成本敏感
多模态模型Anthropic即将下线

Claude 3.5 Sonnet (20240620)

Claude 3.5 Sonnet (20240620) 是 Anthropic 的均衡型 Claude 模型,适合通用助手、代码开发等通用生产工作流。 当前已退役。

输入价格

公开资料未说明

输出价格

公开资料未说明

通用助手代码开发Agent
多模态模型Anthropic即将下线

Claude 3.5 Sonnet (20241022)

Claude 3.5 Sonnet (20241022) 是 Anthropic 的均衡型 Claude 模型,适合通用助手、代码开发等通用生产工作流。 当前已退役。

输入价格

公开资料未说明

输出价格

公开资料未说明

通用助手代码开发Agent
多模态模型Anthropic即将下线

Claude 3 Opus

Claude 3 Opus 是 Anthropic 的高能力 Claude 模型,适合深度推理、代码开发等高复杂度任务。 当前已退役。

输入价格

$15.00 / 1M Tokens

输出价格

$75.00 / 1M Tokens

深度推理代码开发Agent
多模态模型Anthropic即将下线

Claude 3 Sonnet

Claude 3 Sonnet 是 Anthropic 的均衡型 Claude 模型,适合通用助手、代码开发等通用生产工作流。 当前已退役。

输入价格

公开资料未说明

输出价格

公开资料未说明

通用助手代码开发Agent
多模态模型Google稳定版

DiffusionGemma 26B A4B

DiffusionGemma 26B A4B 是 Google DeepMind 于 2026 年 6 月发布的多模态扩散语言模型,支持文本、图像和视频输入。

输入价格

公开资料未说明

输出价格

公开资料未说明

高速生成多模态理解开放权重
多模态模型Google即将下线

Gemini 3.1 Flash-Lite

Gemini 3.1 Flash-Lite 是 Google 于 2026 年 5 月发布的低延迟、多模态模型,适合成本敏感和高吞吐工作流。

输入价格

公开资料未说明

输出价格

公开资料未说明

低延迟成本敏感批量处理
多模态模型Google即将下线

Gemini 3.7 Flash

Gemini 3.7 Flash 是 Google 于 2026 年 8 月发布的快速多模态模型,适合通用助手和低延迟交互。

输入价格

公开资料未说明

输出价格

公开资料未说明

通用助手低延迟视觉理解
多模态模型Google即将下线

Gemini Robotics ER 2 streaming

Gemini Robotics ER 2 streaming 是 Google 于 2026 年 7 月发布的具身推理模型,面向机器人控制、视觉理解和实时交互。

输入价格

公开资料未说明

输出价格

公开资料未说明

具身推理机器人控制视觉理解
多模态模型Google稳定版

Gemma 4 E4B

Gemma 4 E4B 是 Gemma 4 开放权重系列的小型多模态规格,适合本地运行、代码和推理任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

本地部署代码开发开放权重
多模态模型Google稳定版

Gemma 4 12B

Gemma 4 12B 是 Google DeepMind 于 2026 年 4 月发布的统一多模态开放权重模型,适合笔记本和单机部署。

输入价格

公开资料未说明

输出价格

公开资料未说明

本地部署多模态理解代码开发
多模态模型Google稳定版

Gemma 4 31B

Gemma 4 31B 是 Gemma 4 系列的大型 Dense 开放权重规格,面向更高质量的推理、代码和多模态任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

高质量推理代码开发开放权重
多模态模型Google稳定版

Gemma 4 26B A4B

Gemma 4 26B A4B 是 Gemma 4 系列的 MoE 开放权重规格,总参数 26B、激活参数 4B,兼顾能力与推理效率。

输入价格

公开资料未说明

输出价格

公开资料未说明

高效推理本地部署开放权重
多模态模型Google稳定版

Gemini 3.6 Flash

Gemini 3.6 Flash 是 Google 的 Gemini 多模态模型,适合Agent、低延迟等通用生产工作流。

输入价格

$1.50 / 1M Tokens

输出价格

$7.50 / 1M Tokens

Agent低延迟多模态理解
多模态模型Google稳定版

Gemini 3.5 Flash

Gemini 3.5 Flash 是 Google 的 Gemini 多模态模型,适合代码开发、Agent等通用生产工作流。

输入价格

$1.50 / 1M Tokens

输出价格

$9.00 / 1M Tokens

代码开发Agent低延迟
多模态模型Google稳定版

Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite 是 Google 的 Gemini 多模态模型,适合高吞吐、低成本等通用生产工作流。

输入价格

$0.30 / 1M Tokens

输出价格

$2.50 / 1M Tokens

高吞吐低成本批量处理
多模态模型Google稳定版

Gemma 3 27B IT

Gemma 3 的 27B 指令版是 Google 当前较强的开放权重多模态模型,适合本地部署、多语言理解、视觉问答和开发类任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

本地部署视觉理解代码开发
多模态模型Google稳定版

Gemma 3 12B IT

Gemma 3 的 12B 指令版在效果和部署成本之间更均衡,适合私有化助手、视觉理解和通用开发工作流。

输入价格

公开资料未说明

输出价格

公开资料未说明

本地部署视觉理解通用助手
多模态模型Google稳定版

Gemma 3 4B IT

Gemma 3 的 4B 指令版更偏轻量部署,适合边缘设备上的视觉理解、小型助手和受资源约束的私有场景。

输入价格

公开资料未说明

输出价格

公开资料未说明

轻量部署视觉理解通用助手