全面解析MCP Speaker DiarizationMCP Server的核心功能、安装配置和实用案例。作为顶级Model Context Protocol服务器,MCP Speaker Diarization能让AI助手访问实时数据、执行操作,为您提供更智能的工作体验和自动化解决方案。
安装状态
已补齐
命令预览
pip install -r requirements.txt
全面解析MCP Speaker DiarizationMCP Server的核心功能、安装配置和实用案例。作为顶级Model Context Protocol服务器,MCP Speaker Diarization能让AI助手访问实时数据、执行操作,为您提供更智能的工作体验和自动化解决方案。
安装状态
已补齐
命令预览
pip install -r requirements.txt
全面解析Speech Interface (Faster Whisper)MCP Server的核心功能、安装配置和实用案例。作为顶级Model Context Protocol服务器,Speech Interface (Faster Whisper)能让AI助手访问实时数据、执行操作,为您提供更智能的工作体验和自动化解决方案。
一个基于AI的Telegram机器人,用于根据用户需求自动收集VkusVill超市的食品购物篮,支持语音和文本输入。
安装状态
已补齐
工具数量
0
GitHub Stars
25
命令预览
python3 -m venv venv
基于NVIDIA Parakeet TDT 0.6B V2模型的音频和视频文件转录服务,支持多种格式转换和详细时间戳输出。
工具数量
0
GitHub Stars
11
基于GLM-ASR-Nano的高精度语音识别服务,支持17种语言,提供Web UI、REST API和SSE流式传输功能。
安装状态
已补齐
工具数量
0
GitHub Stars
7
命令预览
docker run -d --gpus all -p 7860:7860 neosun/glm-asr:v2.0.1
mcp-claude-say 是一个为 Claude Code 提供的语音交互服务,支持文本到语音(TTS)和语音到文本(STT)功能,实现完整的语音对话体验。
安装状态
已补齐
工具数量
7
GitHub Stars
7
命令预览
pip install chatterbox-tts uvicorn fastapi torchaudio
GPU加速的说话人分割、转录和情感识别服务,支持REST API和WebSocket流式传输。
安装状态
已补齐
工具数量
11
GitHub Stars
5
命令预览
python -m venv venv && source venv/bin/activate
一个基于语音输入的多模态产品搜索助手,利用LangGraph进行多步骤代理编排,结合RAG和网络搜索功能,通过语音输入和输出提供产品搜索服务。
安装状态
已补齐
工具数量
0
GitHub Stars
2
命令预览
pip install -r requirements.txt
一款利用AI技术将语音录音转换为可操作任务、日历事件和结构化笔记的工具,支持Claude AI和MCP协议。
工具数量
0
GitHub Stars
2
基于ESP32-S3开发板和Python服务端的智能语音助手解决方案,支持语音识别、大语言模型推理、语音合成及硬件控制扩展,适用于智能家居和语音控制场景。
安装状态
已补齐
工具数量
0
GitHub Stars
2
命令预览
pip install -r requirements.txt
通过连接小智智能盒子和欧克劳(OpenClaw),实现语音交互功能,让欧克劳成为你的智能助手。
工具数量
0
GitHub Stars
2
Cantonese.ai MCP服务器提供文本转语音和语音转文本工具,支持粤语和英语,适用于语音处理和集成开发。
安装状态
已补齐
工具数量
2
GitHub Stars
1
命令预览
uv run mcp dev server.py
一个为Claude Desktop提供实时麦克风输入的模型上下文协议(MCP)服务器,支持多种语音转文本引擎和低延迟音频捕获。
工具数量
0
GitHub Stars
1
claude-stt是一款本地化、隐私保护的语音转文本工具,专为Claude Code设计,支持跨平台使用,提供两种录音模式:静音检测和按键通话。
安装状态
已补齐
工具数量
2
GitHub Stars
1
命令预览
pip install pynput pyaudio pyperclip
Claude Voice是一款AI驱动的语音记录、转录和笔记系统,支持语音笔记、语音命令和桌面音频捕获,适用于个人知识管理和会议记录。
工具数量
4
GitHub Stars
1
Deepgram的模型上下文协议服务器,为AI编辑器提供直接访问Deepgram的语音、转录和音频智能工具的服务。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
pip install deepgram-mcp
基于OpenAI Whisper优化的超快速音频转录服务器,支持多语言转录、说话人识别和翻译功能。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
uv run dev
MCP Hands-Free是一个支持语音输入的MCP服务器,允许用户通过语音与任何MCP兼容的AI助手交互,无需键盘输入。
安装状态
已补齐
工具数量
1
GitHub Stars
1
命令预览
python3 server.py
一个结合语音识别和日历管理的工具,通过MCP服务器和OpenAI兼容API实现语音命令操作日历事件。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
python3 -m pip install --user radicale
一个用于语音处理的MCP服务器实现,支持自动语音识别(ASR)和文本转语音(TTS)功能,适用于需要语音处理的应用场景。
安装状态
已补齐
工具数量
2
GitHub Stars
1
命令预览
python -m mcp_server_speech [--transport/-t {sse,stdio}]