Gemini 2.5 Flash Live Preview
Gemini 2.5 Flash Live Preview 是 Google 的实时语音模型,适合实时语音、语音助手等低延迟语音交互场景。 当前仍是预览版。
计费价格
$0.50 / 1M Tokens
输入形式
音频 / 视频 / 文本
官方模型目录与价格对比
按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。
先缩小候选,再进详情页看接口、计费和能力边界。
已收录模型
1,303
覆盖厂商
63
带价格信息
355
Gemini 2.5 Flash Live Preview 是 Google 的实时语音模型,适合实时语音、语音助手等低延迟语音交互场景。 当前仍是预览版。
计费价格
$0.50 / 1M Tokens
输入形式
音频 / 视频 / 文本
Gemini 2.5 Flash Text-to-Speech 是 Google 的语音合成模型,适合语音合成、语音助手等语音输出场景。 当前仍是预览版。
计费价格
$0.50 / 1M Tokens
输入形式
文本
Gemini 2.5 Pro Text-to-Speech 是 Google 的语音合成模型,适合语音合成、语音助手等语音输出场景。 当前仍是预览版。
计费价格
$1.00 / 1M Tokens
输入形式
文本
Gemini 3.1 Flash Live Preview 是 Google 的实时语音模型,适合实时语音、语音助手等低延迟语音交互场景。 当前仍是预览版。
计费价格
$0.75 / 1M Tokens
输入形式
文本 / 图像 / 音频 / 视频
Gemini 3.1 Flash TTS (Text-to-Speech) Preview 是 Google 的语音合成模型,适合语音合成、语音助手等语音输出场景。 当前仍是预览版。
计费价格
$1.00 / 1M Tokens
输入形式
文本
计费价格
公开资料未说明
输入形式
音频
计费价格
公开资料未说明
输入形式
音频
Qwen3 ForcedAligner 0.6B 是 Qwen 2026 年 6 月发布的开放权重语音强制对齐模型,用于将语音与文本进行时间戳对齐。
计费价格
公开资料未说明
输入形式
音频 / 文本
Qwen3.5 LiveTranslate Flash 实时版,面向多语言实时音视频同传,支持低延迟语音交互。
计费价格
公开资料未说明
输入形式
文本 / 音频 / 视频
计费价格
公开资料未说明
输入形式
文本
计费价格
公开资料未说明
输入形式
文本
计费价格
公开资料未说明
输入形式
音频
计费价格
公开资料未说明
输入形式
文本
计费价格
$0.05 / min
输入形式
音频 / 文本
计费价格
$4.20 / 1M characters
输入形式
文本
计费价格
$0.10 / hr
输入形式
音频
计费价格
$0.20 / hr
输入形式
音频
Seed Audio 1.0 是字节跳动 Seed 团队于 2026 年 7 月发布的音频创作模型,面向全场景音频生成。官方页面暂未公开稳定 API 模型 ID。
计费价格
公开资料未说明
输入形式
文本 / 音频
计费价格
公开资料未说明
输入形式
文本
计费价格
公开资料未说明
输入形式
文本 / 音频