Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

多模态模型Google稳定版

DiffusionGemma 26B A4B

DiffusionGemma 26B A4B 是 Google DeepMind 于 2026 年 6 月发布的多模态扩散语言模型,支持文本、图像和视频输入。

输入价格

公开资料未说明

输出价格

公开资料未说明

高速生成多模态理解开放权重
多模态模型Google即将下线

Gemini 3.1 Flash-Lite

Gemini 3.1 Flash-Lite 是 Google 于 2026 年 5 月发布的低延迟、多模态模型,适合成本敏感和高吞吐工作流。

输入价格

公开资料未说明

输出价格

公开资料未说明

低延迟成本敏感批量处理
多模态模型Google即将下线

Gemini 3.7 Flash

Gemini 3.7 Flash 是 Google 于 2026 年 8 月发布的快速多模态模型,适合通用助手和低延迟交互。

输入价格

公开资料未说明

输出价格

公开资料未说明

通用助手低延迟视觉理解
多模态模型Google即将下线

Gemini Robotics ER 2 streaming

Gemini Robotics ER 2 streaming 是 Google 于 2026 年 7 月发布的具身推理模型,面向机器人控制、视觉理解和实时交互。

输入价格

公开资料未说明

输出价格

公开资料未说明

具身推理机器人控制视觉理解
多模态模型Google稳定版

Gemma 4 E4B

Gemma 4 E4B 是 Gemma 4 开放权重系列的小型多模态规格,适合本地运行、代码和推理任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

本地部署代码开发开放权重
多模态模型Google稳定版

Gemma 4 12B

Gemma 4 12B 是 Google DeepMind 于 2026 年 4 月发布的统一多模态开放权重模型,适合笔记本和单机部署。

输入价格

公开资料未说明

输出价格

公开资料未说明

本地部署多模态理解代码开发
多模态模型Google稳定版

Gemma 4 31B

Gemma 4 31B 是 Gemma 4 系列的大型 Dense 开放权重规格,面向更高质量的推理、代码和多模态任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

高质量推理代码开发开放权重
多模态模型Google稳定版

Gemma 4 26B A4B

Gemma 4 26B A4B 是 Gemma 4 系列的 MoE 开放权重规格,总参数 26B、激活参数 4B,兼顾能力与推理效率。

输入价格

公开资料未说明

输出价格

公开资料未说明

高效推理本地部署开放权重
多模态模型Google稳定版

Gemini 3.6 Flash

Gemini 3.6 Flash 是 Google 的 Gemini 多模态模型,适合Agent、低延迟等通用生产工作流。

输入价格

$1.50 / 1M Tokens

输出价格

$7.50 / 1M Tokens

Agent低延迟多模态理解
多模态模型Google稳定版

Gemini 3.5 Flash

Gemini 3.5 Flash 是 Google 的 Gemini 多模态模型,适合代码开发、Agent等通用生产工作流。

输入价格

$1.50 / 1M Tokens

输出价格

$9.00 / 1M Tokens

代码开发Agent低延迟
多模态模型Google稳定版

Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite 是 Google 的 Gemini 多模态模型,适合高吞吐、低成本等通用生产工作流。

输入价格

$0.30 / 1M Tokens

输出价格

$2.50 / 1M Tokens

高吞吐低成本批量处理
多模态模型Google稳定版

Gemma 3 27B IT

Gemma 3 的 27B 指令版是 Google 当前较强的开放权重多模态模型,适合本地部署、多语言理解、视觉问答和开发类任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

本地部署视觉理解代码开发
多模态模型Google稳定版

Gemma 3 12B IT

Gemma 3 的 12B 指令版在效果和部署成本之间更均衡,适合私有化助手、视觉理解和通用开发工作流。

输入价格

公开资料未说明

输出价格

公开资料未说明

本地部署视觉理解通用助手
多模态模型Google稳定版

Gemma 3 4B IT

Gemma 3 的 4B 指令版更偏轻量部署,适合边缘设备上的视觉理解、小型助手和受资源约束的私有场景。

输入价格

公开资料未说明

输出价格

公开资料未说明

轻量部署视觉理解通用助手
多模态模型Google稳定版

Gemma 3n E4B IT

Gemma 3n E4B IT 是 Google 面向端侧的多模态开放模型,强调在移动设备上处理文本、图像和音频输入。

输入价格

公开资料未说明

输出价格

公开资料未说明

端侧部署语音输入视觉理解
多模态模型Google稳定版

Gemma 3n E2B IT

Gemma 3n E2B IT 是更轻量的端侧多模态开放模型,适合移动端本地助手、视觉问答和音频理解场景。

输入价格

公开资料未说明

输出价格

公开资料未说明

端侧部署轻量助手视觉理解
多模态模型Google稳定版

Gemini 2.5 Pro

Gemini 2.5 Pro 是 Google 的 Gemini 多模态模型,适合深度推理、长文问答等通用生产工作流。

输入价格

$1.25 / 1M Tokens

输出价格

$10.00 / 1M Tokens

深度推理长文问答视觉理解
多模态模型Google预览版

Deep Research preview Pro

Deep Research preview Pro 是 Google 的深度研究模型,适合深度研究、长文问答等长链路分析与研究场景。 当前仍是预览版。

输入价格

公开资料未说明

输出价格

公开资料未说明

深度研究长文问答Agent
多模态模型Google即将下线

Gemini 2.0 Flash

Gemini 2.0 Flash 是 Google 的 Gemini 多模态模型,适合通用助手、低延迟等通用生产工作流。 当前已进入弃用阶段。

输入价格

$0.10 / 1M Tokens

输出价格

$0.40 / 1M Tokens

通用助手低延迟视觉理解
多模态模型Google即将下线

Gemini 2.0 Flash-Lite

Gemini 2.0 Flash-Lite 是 Google 的 Gemini 多模态模型,适合低延迟、成本敏感等通用生产工作流。 当前已进入弃用阶段。

输入价格

$0.07 / 1M Tokens

输出价格

$0.30 / 1M Tokens

低延迟成本敏感批量处理