计费价格
公开资料未说明
输入形式
音频
官方模型目录与价格对比
按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。
先缩小候选,再进详情页看接口、计费和能力边界。
已收录模型
1,303
覆盖厂商
63
带价格信息
355
计费价格
公开资料未说明
输入形式
音频
计费价格
音频 ¥0.18 / min,视频 ¥1.20 / min
输入形式
文本 / 音频 / 视频
计费价格
¥80.00 / 1M Tokens
输入形式
文本 / 音频
Our state-of-the-art text-to-speech model with zero-shot voice cloning. Supports 9 languages, streaming with ~90ms time-to-first-audio, and no transcript required for voice prompts.
计费价格
公开资料未说明
输入形式
文本
An efficient audio input model, fine-tuned and optimized for live transcription purposes only.
计费价格
公开资料未说明
输入形式
音频
An efficient audio input model, fine-tuned and optimized for transcription purposes only.
计费价格
公开资料未说明
输入形式
音频
计费价格
公开资料未说明
输入形式
音频
An efficient audio input model, fine-tuned and optimized for transcription purposes only.
计费价格
公开资料未说明
输入形式
音频
计费价格
公开资料未说明
输入形式
音频
计费价格
公开资料未说明
输入形式
文本 / 音频
计费价格
$100 / 1M characters
输入形式
文本
计费价格
$60 / 1M characters
输入形式
文本
计费价格
$100 / 1M characters
输入形式
文本
计费价格
$60 / 1M characters
输入形式
文本
计费价格
$100 / 1M characters
输入形式
文本
计费价格
$60 / 1M characters
输入形式
文本
计费价格
$1.5 / voice
输入形式
音频
计费价格
$3 / voice
输入形式
文本
计费价格
公开资料未说明
输入形式
文本
Eleven v3 Conversational 是 ElevenLabs 面向实时对话的表现力语音模型,延迟约 280ms,支持 70 多种语言和上下文对话表达。
计费价格
公开资料未说明
输入形式
文本