Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

语音模型Cartesia稳定版

Sonic-3

Sonic-3 是 Cartesia 当前最新的流式 TTS 主力模型,强调更自然的表达、更细的情绪与速度控制,以及实时语音交互。

计费价格

公开资料未说明

输入形式

文本

实时语音 Agent电话机器人高自然度语音
语音模型Cartesia旧版

Sonic-2

Sonic-2 是 Cartesia 上一代主力流式 TTS 模型,当前仍公开提供给兼容旧链路和历史项目使用。

计费价格

公开资料未说明

输入形式

文本

旧链路兼容实时语音历史项目维护
语音模型Cartesia旧版

Sonic-Turbo

Sonic-Turbo 是 Cartesia 公开保留的更低时延老型号,适合强实时、成本更敏感的语音交互。

计费价格

公开资料未说明

输入形式

文本

极低时延语音对话成本敏感实时语音
语音模型Cartesia旧版

Sonic

Sonic 是 Cartesia 第一代流式 TTS 模型,当前仅适合老项目兼容和历史结果对照。

计费价格

公开资料未说明

输入形式

文本

历史兼容旧项目维护老链路对照
语音模型Cartesia稳定版

Ink-Whisper

Ink-Whisper 是 Cartesia 当前公开主推的语音转写模型,支持 base model 自动路由到最新快照,也支持固定快照版本。

计费价格

公开资料未说明

输入形式

音频

实时转写批量转写多语言语音识别
语音模型Cartesia稳定版

Voice Changer

Voice Changer 是 Cartesia 的语音变声工作流,可保留输入语调与节奏,只替换输出说话人的声音。

计费价格

公开资料未说明

输入形式

音频

变声配音替换保留语调
语音模型Cartesia稳定版

Infilling

Infilling 是 Cartesia 的语音补写工作流,可在已有音频上下文里插入新文本,并尽量保持音色与节奏连续。

计费价格

公开资料未说明

输入形式

音频 / 文本

语音编辑补写台词已有音频修补
语音模型AssemblyAI稳定版

Universal-3.5 Pro

Universal-3.5 Pro 是 AssemblyAI 于 2026 年 6 月发布的新一代高准确率语音识别模型,增强代码切换、说话人分离和多语言支持。

计费价格

公开资料未说明

输入形式

音频

高准确率转写说话人分离多语言录音
语音模型AssemblyAI稳定版

Universal-3.5 Pro Realtime

Universal-3.5 Pro Realtime 是 AssemblyAI 于 2026 年 6 月发布的实时语音识别模型,支持上下文感知转写和低延迟语音 Agent。

计费价格

公开资料未说明

输入形式

音频

实时转写语音 Agent低延迟交互
语音模型AssemblyAI稳定版

Universal-3 Pro

Universal-3 Pro 是 AssemblyAI 当前主力预录音语音识别模型,强调更高准确率、更强 prompting 和复杂语音内容处理。

计费价格

公开资料未说明

输入形式

音频

高准确率转写多语言录音复杂语音内容
语音模型AssemblyAI稳定版

Universal-2

Universal-2 是 AssemblyAI 公开保留的上一代预录音通用模型,适合旧链路兼容和更广语言覆盖场景。

计费价格

公开资料未说明

输入形式

音频

旧链路兼容广语言覆盖通用录音转写
语音模型AssemblyAI稳定版

Universal-3 Pro Streaming

Universal-3 Pro Streaming 是 AssemblyAI 当前高准确率实时转写主力模型,适合低延迟语音 Agent 和电话流式场景。

计费价格

公开资料未说明

输入形式

音频

实时语音 Agent电话机器人高准确率流式转写
语音模型AssemblyAI稳定版

Universal-Streaming Multilingual

Universal-Streaming Multilingual 是 AssemblyAI 面向多语种实时语音识别的流式模型,适合跨语言客服和语音助手。

计费价格

公开资料未说明

输入形式

音频

多语言实时转写跨语言客服语音助手
语音模型AssemblyAI稳定版

Universal-Streaming English

Universal-Streaming English 是 AssemblyAI 面向英语实时转写的流式模型,适合英语客服、会议和电话通话场景。

计费价格

公开资料未说明

输入形式

音频

英语实时转写客服通话会议语音
语音模型AssemblyAI稳定版

Whisper Streaming

Whisper Streaming 是 AssemblyAI 当前公开保留的流式 Whisper 路线,适合已有 Whisper 兼容心智和旧工具链衔接。

计费价格

公开资料未说明

输入形式

音频

Whisper 兼容旧工具衔接实时转写
语音模型Speechmatics稳定版

Batch STT Standard

Speechmatics 的 Batch STT Standard 面向预录音文件转写,强调更稳的成本控制和更快周转。

计费价格

公开资料未说明

输入形式

音频

预录音转写成本控制批量文件处理