一款从短视频分享链接下载无水印视频并自动提取语音文案的工具,支持WebUI、MCP集成和命令行操作。
安装状态
已补齐
工具数量
5
GitHub Stars
1.0k
命令预览
uv run python web/app.py
一款从短视频分享链接下载无水印视频并自动提取语音文案的工具,支持WebUI、MCP集成和命令行操作。
安装状态
已补齐
工具数量
5
GitHub Stars
1.0k
命令预览
uv run python web/app.py
Speech MCP是一个为Goose设计的语音交互扩展,提供实时音频处理、语音识别、文本转语音及现代音频可视化界面。
安装状态
已补齐
工具数量
0
GitHub Stars
81
命令预览
pip install speech-mcp[kokoro] # Basic Kokoro support with English
A Model Context Protocol (MCP) server that provides ASR(Automatic Speech Recognition) capabilities using the whisper engine. This server exposes TTS functionality through MCP tools, making it easy to integrate speech synthesis into your applications.
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
/YOUR_CONDA_PATH/bin/uv --directory /YOUR_PATH/asr_mcp_server run asr_server.py {}
Local MCP server for MLX Whisper transcription
安装状态
已补齐
工具数量
0
GitHub Stars
23
命令预览
uv run mlx_whisper_mcp.py
A high-performance speech recognition MCP server based on Faster Whisper, providing efficient audio transcription capabilities.
安装状态
已补齐
工具数量
0
GitHub Stars
17
命令预览
pip install -r requirements.txt
MCP-Audio是一款符合AIO-2030标准的MCP插件,通过Audio语音识别API实现语音到文字的转换,支持多格式输入和JSON-RPC结构化输出。
安装状态
已补齐
工具数量
2
GitHub Stars
8
命令预览
python -m venv venv && source venv/bin/activate
一个用于录制音频并使用OpenAI的Whisper模型进行转录的MCP服务器,可作为Goose自定义扩展或独立MCP服务器使用。
安装状态
已补齐
工具数量
3
GitHub Stars
6
命令预览
pip install -e .
MCPServer is a Python-based server that leverages Alibaba's FunASR library to provide speech processing services through the FastMCP framework.
安装状态
已补齐
工具数量
7
GitHub Stars
3
命令预览
python -m venv .venv
一个基于Python的服务器,提供语音转文本、说话人识别、文本翻译和文本摘要等功能。
安装状态
已补齐
工具数量
5
GitHub Stars
2
命令预览
python -m venv venv
IntelliGlow是一个基于MCP协议的智能灯光控制系统,支持通过UDP网络通信控制智能灯泡,具备语音命令、AI推理和直接硬件控制功能。
安装状态
已补齐
工具数量
8
GitHub Stars
1
命令预览
pip install -e .
为LLM应用提供电话操作工具(如语音通话和短信发送)的MCP服务器,通过Vonage API实现真实世界交互。
安装状态
已补齐
工具数量
2
GitHub Stars
1
命令预览
pip install -r requirements.txt
提供通过stdio和MCP模式的语音识别和文本提取功能,支持从文件和base64编码数据中识别语音,并生成结构化结果。
安装状态
已补齐
工具数量
4
GitHub Stars
0
命令预览
pip install -r requirements.txt
基于Faster Whisper的高性能语音识别MCP服务器,提供高效的音频转录功能。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
pip install -r requirements.txt
全面解析Fast Whisper MCP ServerMCP Server的核心功能、安装配置和实用案例。作为顶级Model Context Protocol服务器,Fast Whisper MCP Server能让AI助手访问实时数据、执行操作,为您提供更智能的工作体验和自动化解决方案。
安装状态
已补齐
命令预览
pip install -r requirements.txt
全面解析MCP AudioMCP Server的核心功能、安装配置和实用案例。作为顶级Model Context Protocol服务器,MCP Audio能让AI助手访问实时数据、执行操作,为您提供更智能的工作体验和自动化解决方案。
安装状态
已补齐
命令预览
pip install -r requirements.txt
一个基于AI的Telegram机器人,用于根据用户需求自动收集VkusVill超市的食品购物篮,支持语音和文本输入。
安装状态
已补齐
工具数量
0
GitHub Stars
25
命令预览
python3 -m venv venv
基于GLM-ASR-Nano的高精度语音识别服务,支持17种语言,提供Web UI、REST API和SSE流式传输功能。
安装状态
已补齐
工具数量
0
GitHub Stars
7
命令预览
docker run -d --gpus all -p 7860:7860 neosun/glm-asr:v2.0.1
mcp-claude-say 是一个为 Claude Code 提供的语音交互服务,支持文本到语音(TTS)和语音到文本(STT)功能,实现完整的语音对话体验。
安装状态
已补齐
工具数量
7
GitHub Stars
7
命令预览
pip install chatterbox-tts uvicorn fastapi torchaudio
GPU加速的说话人分割、转录和情感识别服务,支持REST API和WebSocket流式传输。
安装状态
已补齐
工具数量
11
GitHub Stars
5
命令预览
python -m venv venv && source venv/bin/activate
一个基于语音输入的多模态产品搜索助手,利用LangGraph进行多步骤代理编排,结合RAG和网络搜索功能,通过语音输入和输出提供产品搜索服务。
安装状态
已补齐
工具数量
0
GitHub Stars
2
命令预览
pip install -r requirements.txt