Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

多模态模型Google稳定版

DiffusionGemma 26B A4B

DiffusionGemma 26B A4B 是 Google DeepMind 于 2026 年 6 月发布的多模态扩散语言模型,支持文本、图像和视频输入。

输入价格

公开资料未说明

输出价格

公开资料未说明

高速生成多模态理解开放权重
视频生成Google即将下线

Gemini Omni Flash Preview

Gemini Omni Flash Preview 是 Google 于 2026 年 6 月发布的视频生成与编辑预览模型,支持文字和图片转视频,并可通过自然语言对话优化结果。当前已弃用。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / video_to_video

视频生成视频编辑多模态创作
视频生成Google预览版

Gemini Omni Flash

Gemini Omni Flash 是 Google 的视频生成与编辑预览模型,支持文字和图片转视频,并可通过对话式操作优化结果。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / video_to_video

视频生成视频编辑多模态创作
多模态模型Google即将下线

Gemini 3.1 Flash-Lite

Gemini 3.1 Flash-Lite 是 Google 于 2026 年 5 月发布的低延迟、多模态模型,适合成本敏感和高吞吐工作流。

输入价格

公开资料未说明

输出价格

公开资料未说明

低延迟成本敏感批量处理
多模态模型Google即将下线

Gemini 3.7 Flash

Gemini 3.7 Flash 是 Google 于 2026 年 8 月发布的快速多模态模型,适合通用助手和低延迟交互。

输入价格

公开资料未说明

输出价格

公开资料未说明

通用助手低延迟视觉理解
多模态模型Google即将下线

Gemini Robotics ER 2 streaming

Gemini Robotics ER 2 streaming 是 Google 于 2026 年 7 月发布的具身推理模型,面向机器人控制、视觉理解和实时交互。

输入价格

公开资料未说明

输出价格

公开资料未说明

具身推理机器人控制视觉理解
语言模型Google稳定版

Gemma 4 E2B

Gemma 4 E2B 是 Google DeepMind Gemma 4 开放权重系列的超轻量规格,适合端侧推理、实验和高效率应用。

输入价格

公开资料未说明

输出价格

公开资料未说明

端侧部署低资源推理开放权重
多模态模型Google稳定版

Gemma 4 E4B

Gemma 4 E4B 是 Gemma 4 开放权重系列的小型多模态规格,适合本地运行、代码和推理任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

本地部署代码开发开放权重
多模态模型Google稳定版

Gemma 4 12B

Gemma 4 12B 是 Google DeepMind 于 2026 年 4 月发布的统一多模态开放权重模型,适合笔记本和单机部署。

输入价格

公开资料未说明

输出价格

公开资料未说明

本地部署多模态理解代码开发
多模态模型Google稳定版

Gemma 4 31B

Gemma 4 31B 是 Gemma 4 系列的大型 Dense 开放权重规格,面向更高质量的推理、代码和多模态任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

高质量推理代码开发开放权重
多模态模型Google稳定版

Gemma 4 26B A4B

Gemma 4 26B A4B 是 Gemma 4 系列的 MoE 开放权重规格,总参数 26B、激活参数 4B,兼顾能力与推理效率。

输入价格

公开资料未说明

输出价格

公开资料未说明

高效推理本地部署开放权重
多模态模型Google稳定版

Gemini 3.6 Flash

Gemini 3.6 Flash 是 Google 的 Gemini 多模态模型,适合Agent、低延迟等通用生产工作流。

输入价格

$1.50 / 1M Tokens

输出价格

$7.50 / 1M Tokens

Agent低延迟多模态理解
多模态模型Google稳定版

Gemini 3.5 Flash

Gemini 3.5 Flash 是 Google 的 Gemini 多模态模型,适合代码开发、Agent等通用生产工作流。

输入价格

$1.50 / 1M Tokens

输出价格

$9.00 / 1M Tokens

代码开发Agent低延迟
多模态模型Google稳定版

Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite 是 Google 的 Gemini 多模态模型,适合高吞吐、低成本等通用生产工作流。

输入价格

$0.30 / 1M Tokens

输出价格

$2.50 / 1M Tokens

高吞吐低成本批量处理
语音模型Google预览版

Gemini 3.5 实时翻译

Gemini 3.5 实时翻译 是 Google 的实时语音模型,适合实时翻译、语音交互等低延迟语音交互场景。 当前仍是预览版。

计费价格

$3.50 / 1M Tokens

输入形式

音频 / 文本

实时翻译语音交互低延迟
语言模型Google即将下线

Gemini Deep Research

Gemini Deep Research 是 Google 面向自主多步骤调查的研究 Agent,可综合复杂信息并生成带引用的报告,支持协同规划、可视化、MCP 和 File Search。当前已弃用。

输入价格

公开资料未说明

输出价格

公开资料未说明

深度研究多来源分析Agent
语言模型Google预览版

Gemini Deep Research Max

Gemini Deep Research Max 是 Google 的深度研究模型,适合深度研究、多来源分析等长链路分析与研究场景。 当前仍是预览版。

输入价格

公开资料未说明

输出价格

公开资料未说明

深度研究多来源分析Agent
语言模型Google预览版

Antigravity Agent

Antigravity Agent 是 Google 的 Gemini 多模态模型,适合通用 Agent、代码执行等通用生产工作流。 当前仍是预览版。

输入价格

公开资料未说明

输出价格

公开资料未说明

通用 Agent代码执行网页自动化
多模态模型Google稳定版

Gemma 3 27B IT

Gemma 3 的 27B 指令版是 Google 当前较强的开放权重多模态模型,适合本地部署、多语言理解、视觉问答和开发类任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

本地部署视觉理解代码开发
多模态模型Google稳定版

Gemma 3 12B IT

Gemma 3 的 12B 指令版在效果和部署成本之间更均衡,适合私有化助手、视觉理解和通用开发工作流。

输入价格

公开资料未说明

输出价格

公开资料未说明

本地部署视觉理解通用助手