Universal-3.5 Pro
Universal-3.5 Pro 是 AssemblyAI 于 2026 年 6 月发布的新一代高准确率语音识别模型,增强代码切换、说话人分离和多语言支持。
计费价格
公开资料未说明
输入形式
音频
官方模型目录与价格对比
按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。
先缩小候选,再进详情页看接口、计费和能力边界。
已收录模型
1,303
覆盖厂商
63
带价格信息
355
Universal-3.5 Pro 是 AssemblyAI 于 2026 年 6 月发布的新一代高准确率语音识别模型,增强代码切换、说话人分离和多语言支持。
计费价格
公开资料未说明
输入形式
音频
Universal-3.5 Pro Realtime 是 AssemblyAI 于 2026 年 6 月发布的实时语音识别模型,支持上下文感知转写和低延迟语音 Agent。
计费价格
公开资料未说明
输入形式
音频
Universal-3 Pro 是 AssemblyAI 当前主力预录音语音识别模型,强调更高准确率、更强 prompting 和复杂语音内容处理。
计费价格
公开资料未说明
输入形式
音频
计费价格
公开资料未说明
输入形式
音频
Universal-3 Pro Streaming 是 AssemblyAI 当前高准确率实时转写主力模型,适合低延迟语音 Agent 和电话流式场景。
计费价格
公开资料未说明
输入形式
音频
Universal-Streaming Multilingual 是 AssemblyAI 面向多语种实时语音识别的流式模型,适合跨语言客服和语音助手。
计费价格
公开资料未说明
输入形式
音频
Universal-Streaming English 是 AssemblyAI 面向英语实时转写的流式模型,适合英语客服、会议和电话通话场景。
计费价格
公开资料未说明
输入形式
音频
Whisper Streaming 是 AssemblyAI 当前公开保留的流式 Whisper 路线,适合已有 Whisper 兼容心智和旧工具链衔接。
计费价格
公开资料未说明
输入形式
音频
计费价格
公开资料未说明
输入形式
音频 / 文本
1.5B fully interleaved audio/text model for TTS, ASR, and voice chat
计费价格
公开资料未说明
输入形式
文本 / 音频
计费价格
公开资料未说明
输入形式
文本 / 音频
计费价格
公开资料未说明
输入形式
音频
Speechmatics 的 Batch STT Enhanced 是更高准确率的预录音转写口径,适合字幕、合规和高质量转写场景。
计费价格
公开资料未说明
输入形式
音频
Speechmatics 的 Realtime STT Standard 面向低延迟实时转写,适合客服、通话和在线语音交互。
计费价格
公开资料未说明
输入形式
音频
Speechmatics 的 Realtime STT Enhanced 面向更高准确率的实时语音识别,适合语音 Agent、直播和高要求电话场景。
计费价格
公开资料未说明
输入形式
音频
计费价格
公开资料未说明
输入形式
文本
Speechmatics Flow 是官方公开的 Voice Agent 工作流能力线,负责实时对话编排、TTS 返回和工具调用。
计费价格
公开资料未说明
输入形式
音频 / 文本
计费价格
公开资料未说明
输入形式
音频 / 文本
Granite Speech 4.1 2B Plus 是 IBM 于 2026 年 4 月发布的增强语音理解模型。
计费价格
公开资料未说明
输入形式
音频 / 文本
计费价格
公开资料未说明
输入形式
音频 / 文本