Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

视频生成MiniMax稳定版

MiniMax H3

MiniMax 新一代开放通用多模态视频模型,支持文生视频、图生视频、首尾帧和多模态参考。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / video_to_video

视频生成图生视频多模态参考
语音模型MiniMax稳定版

MiniMax Speech 2.8 HD

MiniMax Speech 2.8 HD 是 MiniMax 当前高保真文本转语音模型,主打超拟真音质和声音标签控制。

计费价格

$100 / 1M characters

输入形式

文本

高拟真配音品牌语音多语言 TTS
语音模型MiniMax稳定版

MiniMax Speech 2.8 Turbo

MiniMax Speech 2.8 Turbo 是 MiniMax 当前更偏速度的文本转语音模型,适合低延迟语音输出。

计费价格

$60 / 1M characters

输入形式

文本

低延迟 TTS语音助手多语言播报
语音模型MiniMax稳定版

MiniMax Speech 2.6 HD

MiniMax Speech 2.6 HD 是 MiniMax 的上一代高质量 TTS 线,强调声音相似度和超高音质。

计费价格

$100 / 1M characters

输入形式

文本

高相似度复刻高质量配音多语言 TTS
语音模型MiniMax稳定版

Rapid Voice Cloning

Rapid Voice Cloning 是 MiniMax 当前公开的声音克隆能力线,适合快速创建可复用的声音资产。

计费价格

$1.5 / voice

输入形式

音频

声音复刻角色语音品牌声音
语音模型MiniMax稳定版

Voice Design

Voice Design 是 MiniMax 当前公开的声音设计能力线,适合从文本描述生成新声音角色。

计费价格

$3 / voice

输入形式

文本

声音设计角色创作品牌语音
音乐生成MiniMax稳定版

MiniMax Music 3.0

MiniMax Music 3.0 是 MiniMax 于 2026 年 8 月公开的开放权重音乐生成模型,面向生产级音乐创作和多样化音乐生成。

计费价格

公开资料未说明

生成模式

remix

音乐生成开放权重生产级创作
音乐生成MiniMax稳定版

Music 2.6

Music 2.6 是 MiniMax 当前主力音乐生成模型,强调更完整的人声、低频表现和成品感。

计费价格

$0.15 / up to 5 minutes

生成模式

lyrics_to_music

成品歌曲人声音乐商业 Demo
音乐生成MiniMax稳定版

Music Cover

Music Cover 是 MiniMax 当前翻唱与改编能力线,支持参考音频、歌词修改和风格迁移。

计费价格

$0.15 / up to 5 minutes

生成模式

remix

翻唱改编风格迁移参考音频改写
音乐生成MiniMax稳定版

Music 2.0

Music 2.0 是 MiniMax 仍公开列出的早期文本写歌模型,适合旋律草稿和轻量创作。

计费价格

$0.03 / up to 5 minutes

生成模式

lyrics_to_music

文本写歌旋律草稿轻量创作
音乐生成MiniMax稳定版

Lyrics Generation

Lyrics Generation 是 MiniMax 当前独立计费的歌词生成能力线,适合歌曲创作前期打样和作词辅助。

计费价格

$0.01 / song

生成模式

lyrics_to_music

歌词草拟歌曲创作作词辅助
语音模型ElevenLabs稳定版

Eleven v3

ElevenLabs 当前旗舰语音模型,主打更自然的情绪、多人对话和更丰富的角色表达。

计费价格

公开资料未说明

输入形式

文本

高质量配音多人对话角色语音
语音模型ElevenLabs稳定版

Eleven v3 Conversational

Eleven v3 Conversational 是 ElevenLabs 面向实时对话的表现力语音模型,延迟约 280ms,支持 70 多种语言和上下文对话表达。

计费价格

公开资料未说明

输入形式

文本

实时语音对话低延迟情绪表达
语音模型ElevenLabs稳定版

Eleven TTV v3

ElevenLabs 当前文本设计声音模型,可根据自然语言描述生成新的声音设定。

计费价格

公开资料未说明

输入形式

文本

声音设计品牌音色角色声音
语音模型ElevenLabs稳定版

Eleven Multilingual v2

ElevenLabs 当前主力多语言文本转语音模型,兼顾自然度、稳定性和多语言覆盖。

计费价格

公开资料未说明

输入形式

文本

多语言配音语音助手通用 TTS
语音模型ElevenLabs稳定版

Eleven Flash v2.5

ElevenLabs 当前低时延文本转语音模型,适合更重视速度和成本效率的场景。

计费价格

公开资料未说明

输入形式

文本

低时延播报语音 Agent成本敏感 TTS
语音模型ElevenLabs稳定版

Eleven Flash v2

ElevenLabs 仍公开保留的上一代 Flash TTS 模型,适合维护旧链路与兼容调用。

计费价格

公开资料未说明

输入形式

文本

历史兼容低时延播报旧链路维护