Token导航 LogoToken导航TokenDH.com

MCP 工具与服务目录

找到适合你的 MCP Server,快速完成接入

按功能、传输方式和来源整理 MCP Server,提供安装命令、配置方式、仓库与文档入口,方便你快速比较并接入合适的服务。

正式条目

87,640

可复制安装

36,828

最近生成

2026-05-22

音视频stdio

Speech MCP是一个为Goose设计的语音交互扩展,提供实时音频处理、语音识别、文本转语音及现代音频可视化界面。

安装状态

已补齐

工具数量

0

GitHub Stars

81

命令预览

pip install speech-mcp[kokoro] # Basic Kokoro support with English

音视频未说明

为Claude Code提供双向语音交互功能,通过本地运行的语音转文本和文本转语音工具实现与Claude的自然语言对话。

工具数量

2

GitHub Stars

14

音视频stdio

MCP-Audio是一款符合AIO-2030标准的MCP插件,通过Audio语音识别API实现语音到文字的转换,支持多格式输入和JSON-RPC结构化输出。

安装状态

已补齐

工具数量

2

GitHub Stars

8

命令预览

python -m venv venv && source venv/bin/activate

音视频stdio

一个用于录制音频并使用OpenAI的Whisper模型进行转录的MCP服务器,可作为Goose自定义扩展或独立MCP服务器使用。

安装状态

已补齐

工具数量

3

GitHub Stars

6

命令预览

pip install -e .

音视频stdio

一个基于Python的服务器,提供语音转文本、说话人识别、文本翻译和文本摘要等功能。

安装状态

已补齐

工具数量

5

GitHub Stars

2

命令预览

python -m venv venv

音视频stdio

IntelliGlow是一个基于MCP协议的智能灯光控制系统,支持通过UDP网络通信控制智能灯泡,具备语音命令、AI推理和直接硬件控制功能。

安装状态

已补齐

工具数量

8

GitHub Stars

1

命令预览

pip install -e .

音视频未说明

一个本地MCP服务器,提供语音转文本和文本转语音工具,适用于Claude Code的语音交互。

工具数量

5

GitHub Stars

1

音视频stdio

提供通过stdio和MCP模式的语音识别和文本提取功能,支持从文件和base64编码数据中识别语音,并生成结构化结果。

安装状态

已补齐

工具数量

4

GitHub Stars

0

命令预览

pip install -r requirements.txt

音视频HTTP

全面解析Audio Transcriber (OpenAI Whisper)MCP Server的核心功能、安装配置和实用案例。作为顶级Model Context Protocol服务器,Audio Transcriber (OpenAI Whisper)能让AI助手访问实时数据、执行操作,为您提供更智能的工作体验和自动化解决方案。

音视频stdio

全面解析Fast Whisper MCP ServerMCP Server的核心功能、安装配置和实用案例。作为顶级Model Context Protocol服务器,Fast Whisper MCP Server能让AI助手访问实时数据、执行操作,为您提供更智能的工作体验和自动化解决方案。

安装状态

已补齐

命令预览

pip install -r requirements.txt

音视频stdio

全面解析MCP AudioMCP Server的核心功能、安装配置和实用案例。作为顶级Model Context Protocol服务器,MCP Audio能让AI助手访问实时数据、执行操作,为您提供更智能的工作体验和自动化解决方案。

安装状态

已补齐

命令预览

pip install -r requirements.txt

音视频HTTP

全面解析MCP Speaker DiarizationMCP Server的核心功能、安装配置和实用案例。作为顶级Model Context Protocol服务器,MCP Speaker Diarization能让AI助手访问实时数据、执行操作,为您提供更智能的工作体验和自动化解决方案。

安装状态

已补齐

命令预览

pip install -r requirements.txt

音视频未说明

全面解析Speech Interface (Faster Whisper)MCP Server的核心功能、安装配置和实用案例。作为顶级Model Context Protocol服务器,Speech Interface (Faster Whisper)能让AI助手访问实时数据、执行操作,为您提供更智能的工作体验和自动化解决方案。

音视频stdio

基于GLM-ASR-Nano的高精度语音识别服务,支持17种语言,提供Web UI、REST API和SSE流式传输功能。

安装状态

已补齐

工具数量

0

GitHub Stars

7

命令预览

docker run -d --gpus all -p 7860:7860 neosun/glm-asr:v2.0.1

音视频stdio

mcp-claude-say 是一个为 Claude Code 提供的语音交互服务,支持文本到语音(TTS)和语音到文本(STT)功能,实现完整的语音对话体验。

安装状态

已补齐

工具数量

7

GitHub Stars

7

命令预览

pip install chatterbox-tts uvicorn fastapi torchaudio

音视频stdio

GPU加速的说话人分割、转录和情感识别服务,支持REST API和WebSocket流式传输。

安装状态

已补齐

工具数量

11

GitHub Stars

5

命令预览

python -m venv venv && source venv/bin/activate

音视频未说明

一款利用AI技术将语音录音转换为可操作任务、日历事件和结构化笔记的工具,支持Claude AI和MCP协议。

工具数量

0

GitHub Stars

2