Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

语音模型Deepgram旧版

Base Meeting

Legacy Models 里的 Base 会议型号,适合旧版会议转写兼容。

计费价格

公开资料未说明

输入形式

音频

历史兼容会议纪要基础转写
语音模型Deepgram旧版

Base Phonecall

Legacy Models 里的 Base 电话型号,适合旧版通话录音基础转写。

计费价格

公开资料未说明

输入形式

音频

历史兼容电话录音基础转写
语音模型Deepgram旧版

Base Finance

Legacy Models 里的 Base 金融型号,适合旧版金融转写链路兼容。

计费价格

公开资料未说明

输入形式

音频

历史兼容金融转写基础 STT
语音模型Deepgram旧版

Base Voicemail

Legacy Models 里的 Base 语音信箱型号,适合旧版留言场景兼容。

计费价格

公开资料未说明

输入形式

音频

历史兼容语音留言基础转写
语音模型Deepgram旧版

Base Video

Legacy Models 里的 Base 视频型号,适合旧版视频字幕和内容转写。

计费价格

公开资料未说明

输入形式

音频

历史兼容视频字幕基础转写
语音模型Amazon Nova稳定版

Nova Sonic

Amazon Nova V1 语音对话模型,支持实时双向流式语音理解与生成,适合语音助手和客服交互。

计费价格

公开资料未说明

输入形式

音频

语音助手实时客服双向语音
语音模型Amazon Nova稳定版

Nova 2 Sonic

Amazon Nova 2 语音对话模型,兼顾文本与语音输入输出,适合下一代语音 Agent 和低时延交互。

计费价格

公开资料未说明

输入形式

音频 / 文本

语音 Agent低时延交互多轮对话
语音模型生数科技稳定版

Vidu Audio 1.0

Vidu 当前公开的音频生成模型,支持文本生成音效或背景音乐,也可用于 Timing to Audio 能力。

计费价格

公开资料未说明

输入形式

文本

音效生成背景音乐创意音频
语音模型NVIDIA稳定版

NemotronLabs VoiceChat 11B

NemotronLabs VoiceChat 11B 是 NVIDIA 于 2026 年 7 月发布的端到端全双工实时语音模型,支持自然轮流对话、打断和实时工具调用。

计费价格

公开资料未说明

输入形式

音频

实时语音全双工对话语音 Agent
语音模型NVIDIA稳定版

Nemotron-Labs Audex 2B

Nemotron-Labs Audex 2B 是 NVIDIA 于 2026 年 7 月发布的音频语言模型,支持语音识别、翻译、音频理解和语音生成任务。

计费价格

公开资料未说明

输入形式

音频 / 文本

音频理解语音识别语音翻译
语音模型NVIDIA稳定版

Nemotron 3.5 ASR Streaming 0.6B

Nemotron 3.5 ASR Streaming 0.6B 是 NVIDIA 于 2026 年 5 月发布的多语种流式语音识别模型,面向实时转写和语音 Agent。

计费价格

公开资料未说明

输入形式

音频

流式语音识别实时转写多语种
语音模型NVIDIA预览版

Nemotron-Voicechat

语音对话模型,支持用户语音输入、代理文本与语音输出,以及用户语音转写。

计费价格

公开资料未说明

输入形式

文本 / 音频

语音助手双向语音交互英文语音对话
语音模型Stability AI稳定版

Stable Audio 3.0 Medium

Stable Audio 3.0 Medium 是 Stability AI 面向更高音乐性和更长音频生成的开放权重模型。

计费价格

公开资料未说明

输入形式

文本

音乐生成长音频开放权重
语音模型Stability AI稳定版

Stable Audio 3.0 Large

Stable Audio 3.0 Large 是 Stability AI 面向音乐平台和创意应用的高阶音频生成模型。

计费价格

公开资料未说明

输入形式

文本 / 音频

音乐生成高吞吐创意应用
语音模型Stability AI稳定版

Stable Audio 2.5

Stable Audio 2.5 是 Stability 当前公开计费的音频生成服务,支持从文本或音频样本生成音频。

计费价格

公开资料未说明

输入形式

文本 / 音频

音乐与音频生成文本转音频音频样本续写
语音模型Pika稳定版

Pika Music

Pika Music 是 Pika 于 2026 年 8 月发布的音乐生成模型,支持文字、歌词、参考音乐和创意方向生成完整歌曲。

计费价格

公开资料未说明

输入形式

文本 / 音频

音乐生成歌曲创作音频创作