Token导航 LogoToken导航TokenDH.com
多模态模型Google / Gemini多模态助手即将下线

Gemini 3.1 Flash-Lite

调用名:gemini-3.1-flash-lite

Gemini 3.1 Flash-Lite 是 Google 于 2026 年 5 月发布的低延迟、多模态模型,适合成本敏感和高吞吐工作流。

1.048576M 上下文
最大输出 65,536 Tokens

适合

低延迟 / 成本敏感

多模态助手

价格

公开资料未说明

1M Tokens

输入

文本 / 图像 / 视频 / 音频

输出

文本

规格

1.048576M

输出 65,536 Tokens

低延迟成本敏感批量处理长文问答视觉理解通用助手视觉长上下文语音输入

所属厂商:Google / Gemini

详细参数

模型定位

多模态助手

适合场景

低延迟 / 成本敏感

输入价格

公开资料未说明

输出价格

公开资料未说明

上下文窗口

1.048576M

最大输出

65,536 Tokens

能力与信息

文本主能力

推理

不支持

工具调用

不支持

结构化输出

不支持

训练与版本

微调

不支持

蒸馏

不支持

多模态扩展

视觉理解

支持

语音输入

支持

语音输出

不支持

实时交互

不支持

输入与输出

输入形式

文本 / 图像 / 视频 / 音频

输出形式

文本

接入信息

知识截止

公开资料未说明

调用名

gemini-3.1-flash-lite

API 基础地址

https://generativelanguage.googleapis.com

调用协议

https/json

主接口

/v1beta/models/{model}:generateContent

发布时间

2026-05-01

价格与计费

计费摘要

输入价

公开资料未说明

输出价

公开资料未说明

缓存输入

公开资料未说明

币种

未标注

计费单位

1M Tokens

单位类型

未标注

价格说明

原始价格文案

未收录

补充说明

暂无

发布时间

2026-05-01