Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

语音模型智谱稳定版

GLM-ASR-2512

GLM-ASR-2512 是智谱当前语音识别模型,支持多语言、行业词典和实时流式转录。

计费价格

公开资料未说明

输入形式

音频

语音识别会议转写多语言
语音模型智谱稳定版

GLM-Realtime

GLM-Realtime 是智谱当前实时音视频模型,支持语音对话、视频理解和函数调用。

计费价格

音频 ¥0.18 / min,视频 ¥1.20 / min

输入形式

文本 / 音频 / 视频

实时语音视频通话多模态交互
语音模型智谱稳定版

GLM-4-Voice

GLM-4-Voice 是智谱当前端到端语音模型,可直接理解和生成中英文语音。

计费价格

¥80.00 / 1M Tokens

输入形式

文本 / 音频

语音对话中英文语音方言风格控制
语音模型Mistral稳定版

Voxtral TTS

Our state-of-the-art text-to-speech model with zero-shot voice cloning. Supports 9 languages, streaming with ~90ms time-to-first-audio, and no transcript required for voice prompts.

计费价格

公开资料未说明

输入形式

文本

语音生成音频输出语音应用
语音模型Mistral稳定版

Voxtral Small

Our first model with audio input capabilities for instruct use cases.

计费价格

公开资料未说明

输入形式

音频

语音转写会议整理音频理解
语音模型MiniMax稳定版

MiniMax Music3

MiniMax Music3 是 MiniMax 于 2026 年 8 月公开的开放权重音乐生成模型。

计费价格

公开资料未说明

输入形式

文本 / 音频

音乐生成歌曲创作开放权重
语音模型MiniMax稳定版

MiniMax Speech 2.8 HD

MiniMax Speech 2.8 HD 是 MiniMax 当前高保真文本转语音模型,主打超拟真音质和声音标签控制。

计费价格

$100 / 1M characters

输入形式

文本

高拟真配音品牌语音多语言 TTS
语音模型MiniMax稳定版

MiniMax Speech 2.8 Turbo

MiniMax Speech 2.8 Turbo 是 MiniMax 当前更偏速度的文本转语音模型,适合低延迟语音输出。

计费价格

$60 / 1M characters

输入形式

文本

低延迟 TTS语音助手多语言播报
语音模型MiniMax稳定版

MiniMax Speech 2.6 HD

MiniMax Speech 2.6 HD 是 MiniMax 的上一代高质量 TTS 线,强调声音相似度和超高音质。

计费价格

$100 / 1M characters

输入形式

文本

高相似度复刻高质量配音多语言 TTS
语音模型MiniMax稳定版

Rapid Voice Cloning

Rapid Voice Cloning 是 MiniMax 当前公开的声音克隆能力线,适合快速创建可复用的声音资产。

计费价格

$1.5 / voice

输入形式

音频

声音复刻角色语音品牌声音
语音模型MiniMax稳定版

Voice Design

Voice Design 是 MiniMax 当前公开的声音设计能力线,适合从文本描述生成新声音角色。

计费价格

$3 / voice

输入形式

文本

声音设计角色创作品牌语音
语音模型ElevenLabs稳定版

Eleven v3

ElevenLabs 当前旗舰语音模型,主打更自然的情绪、多人对话和更丰富的角色表达。

计费价格

公开资料未说明

输入形式

文本

高质量配音多人对话角色语音
语音模型ElevenLabs稳定版

Eleven v3 Conversational

Eleven v3 Conversational 是 ElevenLabs 面向实时对话的表现力语音模型,延迟约 280ms,支持 70 多种语言和上下文对话表达。

计费价格

公开资料未说明

输入形式

文本

实时语音对话低延迟情绪表达