Deepgram音频AI——光标插件
Cursor IDE的语音到文本、文本到语音和音频智能,由 Deepgram.
特性
| 工具 | 它做什么 |
|---|---|
transcribe_audio | 转录音频文件或网址——50多种语言、演讲者日记、关键字增强 |
text_to_speech | 从文本生成自然语音——4+Aura-2语音,MP3输出 |
analyze_audio | 情感分析、话题检测、意图识别(英语) |
summarize_audio | 在一次通话中转录+总结 |
list_models | 浏览可用的Deepgram STT和TTS型号 |
另外: 3技能, 2条规则, 1名代理人,以及 2个斜线命令 获得原生Cursor体验。
快速开始
1.获取Deepcram API密钥
注册地址: console.depgram.com --免费套餐包括200美元的信用额度。
2.安装插件
从Cursor Marketplace安装,或克隆并在本地安装:
git clone https://github.com/your-username/deepgram-cursor-plugin.git3.配置API密钥
将您的密钥添加到Cursor的MCP配置中:
{
"mcpServers": {
"deepgram": {
"command": "node",
"args": ["
/mcp-server/build/index.js"],
"env": {
"DEEPGRAM_API_KEY": "your-api-key-here"
}
}
}
}4.使用它
/transcribe https://example.com/meeting.mp3
/speak Hello, this is a test of Deepgram text-to-speech.或者请音频工程师代理帮助完成任何音频任务。
工具参考
转录_音频
使用扬声器标签和智能格式转录音频。
参数:
source(必需)--URL或本地文件路径language--语言代码(默认:自动检测)model--Deepgram模型(默认值:nova-3)diarize--演讲者日记(默认:true)smart_format--智能格式化(默认:true)keywords--要提升的关键字数组
文本到语音
从文本生成语音音频。
参数:
text(必填)--说话文本(最多2000个字符)model--语音模型(默认值:aura-2-asteria-en)output_path--输出文件路径(默认:./deepgram-tts-output.mp3)
分析音频
分析音频的情感、主题和意图。只有英语。
参数:
source(必需)--URL或本地文件路径sentiment--启用情绪分析(默认值:true)topics--启用主题检测(默认值:true)intents--启用意图识别(默认:true)
summarize_audio
一步转录和总结音频。
参数:
source(必需)--URL或本地文件路径language--语言代码(默认:自动检测)model--Deepgram模型(默认值:nova-3)
list_models
浏览可用的Deepgram型号。不需要API密钥。
参数:
type--筛选器:stt,tts,或all(默认值:all)
技能
- 转录会议 --使用演讲者标签进行会议转录的指导工作流程
- 生成语音 --通过语音选择逐步生成文本到语音
- 分析音频情感 --具有情感、主题和意图的深度音频分析
命令
/transcribe--快速转录文件或URL/speak--快速生成文本到语音
代理
音频工程师 --一位人工智能专家,主动为您的音频文件建议最佳操作(转录、分析、总结或生成语音)。
发展
cd mcp-server
npm install
npm run build # Compile TypeScript
npm run dev # Watch mode与MCP检查员一起测试:
DEEPGRAM_API_KEY=your-key npx @modelcontextprotocol/inspector node build/index.js许可证
麻省理工学院
