集成ElevenLabs文本转语音功能的FastAPI后端与React前端应用,支持语音选择、实时通信及Cursor集成。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
python -m venv .venv
集成ElevenLabs文本转语音功能的FastAPI后端与React前端应用,支持语音选择、实时通信及Cursor集成。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
python -m venv .venv

@demon24ru/fish-speech-mcp
一个用于文本转语音合成的MCP服务器,支持语音参考保存和与MCP兼容的LLMs集成。
安装状态
已补齐
工具数量
2
GitHub Stars
1
命令预览
npx @demon24ru/fish-speech-mcp
一个通用的MCP服务器,用于通过MCP兼容的AI代理(如Claude Code、Cursor或自定义代理)与Gemini Live Chrome扩展和Web应用交互,提供会话管理、语音工具和转录捕获功能。
安装状态
已补齐
工具数量
12
GitHub Stars
1
命令预览
pip install websockets mcp
Gemini Media MCP是一个全面的AI媒体生成工具包,集成了Google的VEO 3.1视频生成和NanoBanana Pro 2图像生成技术,适用于需要高质量AI生成媒体的开发者和创作者。
安装状态
已补齐
工具数量
13
GitHub Stars
1
命令预览
pip install veo-mcp-server
Gemini 3 Pro MCP Server 是一个基于Google Gemini 2.5 Pro模型的视频分析服务器,支持多种输入方式、高级视频处理和研究驱动的视频创作功能。
安装状态
已补齐
工具数量
8
GitHub Stars
1
命令预览
pip install -r requirements.txt
通过Groq托管的Whisper模型提供音频/视频转录服务,支持单词级时间戳、自动缓存和成本估算。
安装状态
已补齐
工具数量
2
GitHub Stars
1
命令预览
python3 -m venv venv

@h-ear/mcp-server
AI驱动的音频分类服务,支持识别声音、检测噪声事件,并能分类7000多种声音类别,适用于城市噪音和鸟类物种识别等场景。
安装状态
已补齐
工具数量
14
GitHub Stars
1
命令预览
npx @h-ear/mcp-server --key YOUR_API_KEY
基于OpenAI Whisper优化的超快速音频转录服务器,支持多语言转录、说话人识别和翻译功能。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
uv run dev
JARVIS语音系统是一款GPU加速的语音合成工具,提供漫威JARVIS角色同款英式英语语音,支持智能家居集成和智能对话功能。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
docker run --rm --gpus all nvidia/cuda:11.8-base-ubuntu20.04 nvidia-smi
一款基于Kokoro-82M模型的文本转语音工具,支持命令行、MCP服务器和剪贴板文本转换,适用于本地Claude、Codex客户端及ChatGPT Mac应用。
安装状态
已补齐
工具数量
8
GitHub Stars
1
命令预览
pip install -r requirements.txt
一款为Claude Desktop提供语音功能的扩展,支持70多种语言的单词发音、音频闪卡生成和完整语言课程。
安装状态
已补齐
工具数量
4
GitHub Stars
1
命令预览
uv run pytest tests/ -v
LigueLead MCP Server是一款用于通过API发送短信、闪信和语音通话的通信服务器,适用于巴西市场,支持无代码集成。
安装状态
已补齐
工具数量
5
GitHub Stars
1
命令预览
docker run -d -p 3000:3000 \
一款基于LiveKit的语音助手,用于诊所接待,可为两个分支机构(锡亚尔科特和拉合尔)预约基于日期的可用时间,与患者确认详细信息,并通过实时TTS进行语音交互。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
python -m venv .\venv
基于Llasa-8B的高质量文本转语音系统,支持智能GPU内存管理、多语言语音生成和声音克隆功能。
安装状态
已补齐
工具数量
5
GitHub Stars
1
命令预览
docker run -d \
本地运行的AI生成服务器,支持文本到图像、音乐、语音及3D模型的转换。
安装状态
已补齐
工具数量
5
GitHub Stars
1
命令预览
pip install -U "huggingface_hub"
mcparr是一个统一的MCP服务器,为*arr媒体自动化堆栈提供19个行动导向的工具,涵盖媒体获取、下载和字幕管理。
安装状态
已补齐
工具数量
19
GitHub Stars
1
命令预览
uv run python -m mcparr
一个提供14种LLM驱动的视频分析工具的服务,包括帧提取、运动检测、场景分割和音频转录等功能。
安装状态
已补齐
工具数量
5
GitHub Stars
1
命令预览
uv run workout-judge analyze example_videos/sample.mov
基于Model Context Protocol (MCP)标准构建的中间件服务器,提供AI绘图、视频生成、智能排版等功能,适用于支持MCP的客户端调用。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
pip install -r requirements.txt
一个结合语音识别和日历管理的工具,通过MCP服务器和OpenAI兼容API实现语音命令操作日历事件。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
python3 -m pip install --user radicale

@modelcontextprotocol/inspector
一个基于MCP协议的播客内容抓取、转录和摘要生成工具,可与Claude Code或Claude Desktop集成使用。
安装状态
已补齐
工具数量
10
GitHub Stars
1
命令预览
npx @modelcontextprotocol/inspector node dist/index.js