Token导航 LogoToken导航TokenDH.com
Deepgram logo
官方核验于 2026-04-16

Deepgram

Deepgram 是语音识别和实时语音基础设施里的代表厂商,适合做语音转写、客服质检和语音 Agent。它更偏开发者和企业基础设施路线,不走消费级创作产品定位。

官方入口原生官方接口有免费额度语音模型

主分类:语音模型

适合:语音助手 / 企业接入 / 呼叫中心

付费:信用卡 / 企业合同

地区:国际可用

接入判断

按原生接口接

Deepgram 适合作为官方原生入口,接入前先按文档核对鉴权方式、模型 ID 和计费口径。

协议:官方原生 API

额度:Deepgram 常见提供新账号试用 credits,具体额度和地区规则以当前控制台为准。

模型:已收录 41 个

模型能力

41 个模型
语音模型实时语音 Agent对话式 TTS低延迟语音

Deepgram Flux TTS

分类:语音模型 / 上下文:- / 调用名:flux-tts

Deepgram Flux TTS 是 2026 年 8 月发布的面向实时语音 Agent 的对话式文本转语音模型,支持跨轮上下文、打断处理和流式输出。

audio_generation语音输出realtimemultilingual
语音模型实时语音 Agent电话机器人低延迟对话

Flux General English

分类:语音模型 / 上下文:- / 调用名:flux-general-en

Deepgram 当前面向英语实时语音 Agent 的 Flux 会话转写模型,主打 turn detection、打断处理和更低语音交互延迟。

speech_recognition语音输入
语音模型多语言实时对话语音 Agent跨语言客服

Flux General Multilingual

分类:语音模型 / 上下文:- / 调用名:flux-general-multi

Deepgram 当前面向多语言实时对话的 Flux 版本,适合跨语言客服、语音助手和多语种语音 Agent。

speech_recognition语音输入
语音模型会议转写多说话人多语言 STT

Nova-3

分类:语音模型 / 上下文:- / 调用名:nova-3-general

Deepgram 当前主力通用语音识别模型,适合会议、字幕、多说话人和跨语言转写。

speech_recognition语音输入
语音模型医疗转写临床记录专业术语

Nova-3 Medical

分类:语音模型 / 上下文:- / 调用名:nova-3-medical

Deepgram 当前医学语音识别模型,适合临床记录、医疗口述和医疗场景转写。

speech_recognition语音输入
语音模型旧链路兼容通用转写多语言覆盖

Nova-2

分类:语音模型 / 上下文:- / 调用名:nova-2-general

Deepgram 仍在公开支持的 Nova-2 通用模型,适合需要兼容旧链路、旧语言覆盖和较稳定 STT 行为的项目。

speech_recognition语音输入
语音模型会议纪要多人讨论办公录音

Nova-2 Meeting

分类:语音模型 / 上下文:- / 调用名:nova-2-meeting

Nova-2 的会议场景变体,适合会议纪要和讨论型多人语音内容。

speech_recognition语音输入
语音模型电话录音客服质检呼叫中心

Nova-2 Phonecall

分类:语音模型 / 上下文:- / 调用名:nova-2-phonecall

Nova-2 的电话场景变体,适合客服录音、呼叫中心和双声道通话转写。

speech_recognition语音输入
语音模型金融客服投顾录音术语转写

Nova-2 Finance

分类:语音模型 / 上下文:- / 调用名:nova-2-finance

Nova-2 的金融场景变体,适合金融客服、投顾录音和金融专业术语转写。

speech_recognition语音输入
语音模型对话机器人语音助手实时会话

Nova-2 Conversational AI

分类:语音模型 / 上下文:- / 调用名:nova-2-conversationalai

Nova-2 的对话场景变体,适合旧版语音助手、对话机器人和实时对话理解链路。

speech_recognition语音输入
语音模型语音信箱留言整理异步语音

Nova-2 Voicemail

分类:语音模型 / 上下文:- / 调用名:nova-2-voicemail

Nova-2 的语音信箱场景变体,适合留言信箱和异步语音消息整理。

speech_recognition语音输入
语音模型视频字幕访谈转写内容整理

Nova-2 Video

分类:语音模型 / 上下文:- / 调用名:nova-2-video

Nova-2 的视频内容场景变体,适合长视频字幕、访谈和内容转写。

speech_recognition语音输入
语音模型医疗旧链路医学术语临床记录

Nova-2 Medical

分类:语音模型 / 上下文:- / 调用名:nova-2-medical

Nova-2 的医学转写变体,适合医疗旧链路兼容和受控专业术语场景。

speech_recognition语音输入
语音模型得来速点单高噪声对话餐饮语音

Nova-2 DriveThru

分类:语音模型 / 上下文:- / 调用名:nova-2-drivethru

Nova-2 的得来速点单场景变体,适合车载点单和高噪声点餐对话。

speech_recognition语音输入
语音模型车载语音驾驶舱助手车机控制

Nova-2 Automotive

分类:语音模型 / 上下文:- / 调用名:nova-2-automotive

Nova-2 的汽车场景变体,适合车载语音助手和驾驶舱语音指令。

speech_recognition语音输入
语音模型空管通话航空指令专业术语

Nova-2 ATC

分类:语音模型 / 上下文:- / 调用名:nova-2-atc

Nova-2 的空管场景变体,适合航空通话和 ATC 指令转写。

speech_recognition语音输入
语音模型高质量 TTS语音助手多语言语音输出

Aura-2 Voices

分类:语音模型 / 上下文:- / 调用名:aura-2-voices

Deepgram 当前主力 Aura-2 语音合成家族,适合客服播报、语音助手和品牌化语音输出。

audio_generation语音输出tts
语音模型英语 TTS旧链路兼容语音播报

Aura-1 Voices

分类:语音模型 / 上下文:- / 调用名:aura-1-voices

Deepgram 仍公开保留的 Aura-1 英语语音家族,适合旧版 TTS 链路兼容和英语播报。

audio_generation语音输出tts
语音模型Whisper 兼容轻量实验旧工具适配

Whisper Tiny

分类:语音模型 / 上下文:- / 调用名:whisper-tiny

Deepgram Whisper Cloud 的 tiny 规格,适合兼容 Whisper 生态和更轻量的实验链路。

speech_recognition语音输入
语音模型Whisper 兼容基础转写旧工具适配

Whisper Base

分类:语音模型 / 上下文:- / 调用名:whisper-base

Deepgram Whisper Cloud 的 base 规格,适合兼容 OpenAI Whisper 基础能力。

speech_recognition语音输入
语音模型Whisper 兼容中档规模旧工具适配

Whisper Small

分类:语音模型 / 上下文:- / 调用名:whisper-small

Deepgram Whisper Cloud 的 small 规格,适合兼容 Whisper 中档规模模型。

speech_recognition语音输入
语音模型Whisper 兼容默认兼容规格中高精度

Whisper Medium

分类:语音模型 / 上下文:- / 调用名:whisper-medium

Deepgram Whisper Cloud 的 medium 规格,也是 docs 里默认 whisper 别名对应的主力规格。

speech_recognition语音输入
语音模型Whisper 兼容高精度兼容旧工具适配

Whisper Large

分类:语音模型 / 上下文:- / 调用名:whisper-large

Deepgram Whisper Cloud 的 large 规格,适合需要更强 Whisper 兼容效果的场景。

speech_recognition语音输入
语音模型历史兼容通用转写旧链路维护

Nova

分类:语音模型 / 上下文:- / 调用名:nova-general

Deepgram Legacy Models 里的 Nova 1 通用模型,作为 Nova-2 之前的上一代公开型号保留。

speech_recognition语音输入legacy
语音模型历史兼容电话录音旧客服链路

Nova Phonecall

分类:语音模型 / 上下文:- / 调用名:nova-phonecall

Legacy Models 里的 Nova 电话场景型号,适合旧版电话语音链路兼容。

speech_recognition语音输入legacy
语音模型历史兼容医疗转写旧链路维护

Nova Medical

分类:语音模型 / 上下文:- / 调用名:nova-medical

Legacy Models 里的 Nova 医疗型号,适合旧版医疗转写链路兼容。

speech_recognition语音输入legacy
语音模型历史兼容语音信箱留言整理

Nova Voicemail

分类:语音模型 / 上下文:- / 调用名:nova-voicemail

Legacy Models 里的 Nova 语音信箱型号,适合旧版留言场景兼容。

speech_recognition语音输入legacy
语音模型历史兼容点单场景高噪声语音

Nova DriveThru

分类:语音模型 / 上下文:- / 调用名:nova-drivethru

Legacy Models 里的 Nova DriveThru 型号,适合旧版餐饮点单链路兼容。

speech_recognition语音输入legacy
语音模型历史兼容关键词增强高精度旧链路

Enhanced General

分类:语音模型 / 上下文:- / 调用名:enhanced-general

Deepgram Legacy Models 里的 Enhanced 通用模型,强调比 Base 更低词错率和更强关键词增强。

speech_recognition语音输入legacy
语音模型历史兼容会议纪要增强型转写

Enhanced Meeting

分类:语音模型 / 上下文:- / 调用名:enhanced-meeting

Legacy Models 里的 Enhanced 会议型号,适合旧版高精度会议转写。

speech_recognition语音输入legacy
语音模型历史兼容客服通话高精度电话转写

Enhanced Phonecall

分类:语音模型 / 上下文:- / 调用名:enhanced-phonecall

Legacy Models 里的 Enhanced 电话型号,适合旧版客服通话高精度转写。

speech_recognition语音输入legacy
语音模型历史兼容金融术语高精度转写

Enhanced Finance

分类:语音模型 / 上下文:- / 调用名:enhanced-finance

Legacy Models 里的 Enhanced 金融型号,适合旧版金融术语转写。

speech_recognition语音输入legacy
语音模型历史兼容点单语音高噪声

Enhanced DriveThru

分类:语音模型 / 上下文:- / 调用名:enhanced-drivethru

Legacy Models 里的 Enhanced DriveThru 型号,适合旧版高噪声点单场景。

speech_recognition语音输入legacy
语音模型历史兼容车载语音驾驶舱控制

Enhanced Automotive

分类:语音模型 / 上下文:- / 调用名:enhanced-automotive

Legacy Models 里的 Enhanced Automotive 型号,适合旧版车载语音链路兼容。

speech_recognition语音输入legacy
语音模型历史兼容大体量转写基础 STT

Base General

分类:语音模型 / 上下文:- / 调用名:general

Deepgram Legacy Models 里的 Base 通用模型,适合大体量旧版基础转写链路。

speech_recognition语音输入legacy
语音模型历史兼容会议纪要基础转写

Base Meeting

分类:语音模型 / 上下文:- / 调用名:meeting

Legacy Models 里的 Base 会议型号,适合旧版会议转写兼容。

speech_recognition语音输入legacy
语音模型历史兼容电话录音基础转写

Base Phonecall

分类:语音模型 / 上下文:- / 调用名:phonecall

Legacy Models 里的 Base 电话型号,适合旧版通话录音基础转写。

speech_recognition语音输入legacy
语音模型历史兼容金融转写基础 STT

Base Finance

分类:语音模型 / 上下文:- / 调用名:finance

Legacy Models 里的 Base 金融型号,适合旧版金融转写链路兼容。

speech_recognition语音输入legacy
语音模型历史兼容语音留言基础转写

Base Voicemail

分类:语音模型 / 上下文:- / 调用名:voicemail

Legacy Models 里的 Base 语音信箱型号,适合旧版留言场景兼容。

speech_recognition语音输入legacy
语音模型历史兼容视频字幕基础转写

Base Video

分类:语音模型 / 上下文:- / 调用名:video

Legacy Models 里的 Base 视频型号,适合旧版视频字幕和内容转写。

speech_recognition语音输入legacy
语音模型历史兼容对话系统基础实时转写

Base Conversational AI

分类:语音模型 / 上下文:- / 调用名:conversationalai

Legacy Models 里的 Base Conversational AI 型号,适合旧版对话系统兼容。

speech_recognition语音输入legacy