基于ESP32-S3开发板和Python服务端的智能语音助手解决方案,支持语音识别、大语言模型推理、语音合成及硬件控制扩展,适用于智能家居和语音控制场景。
安装状态
已补齐
工具数量
0
GitHub Stars
2
命令预览
pip install -r requirements.txt
基于ESP32-S3开发板和Python服务端的智能语音助手解决方案,支持语音识别、大语言模型推理、语音合成及硬件控制扩展,适用于智能家居和语音控制场景。
安装状态
已补齐
工具数量
0
GitHub Stars
2
命令预览
pip install -r requirements.txt
Cantonese.ai MCP服务器提供文本转语音和语音转文本工具,支持粤语和英语,适用于语音处理和集成开发。
安装状态
已补齐
工具数量
2
GitHub Stars
1
命令预览
uv run mcp dev server.py
claude-stt是一款本地化、隐私保护的语音转文本工具,专为Claude Code设计,支持跨平台使用,提供两种录音模式:静音检测和按键通话。
安装状态
已补齐
工具数量
2
GitHub Stars
1
命令预览
pip install pynput pyaudio pyperclip
Deepgram的模型上下文协议服务器,为AI编辑器提供直接访问Deepgram的语音、转录和音频智能工具的服务。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
pip install deepgram-mcp
基于OpenAI Whisper优化的超快速音频转录服务器,支持多语言转录、说话人识别和翻译功能。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
uv run dev
MCP Hands-Free是一个支持语音输入的MCP服务器,允许用户通过语音与任何MCP兼容的AI助手交互,无需键盘输入。
安装状态
已补齐
工具数量
1
GitHub Stars
1
命令预览
python3 server.py
一个结合语音识别和日历管理的工具,通过MCP服务器和OpenAI兼容API实现语音命令操作日历事件。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
python3 -m pip install --user radicale
一个用于语音处理的MCP服务器实现,支持自动语音识别(ASR)和文本转语音(TTS)功能,适用于需要语音处理的应用场景。
安装状态
已补齐
工具数量
2
GitHub Stars
1
命令预览
python -m mcp_server_speech [--transport/-t {sse,stdio}]
基于NCNN和Whisper的音频转录服务,支持将音频文件转换为文本,适用于语音识别和转录场景。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
uv run python test/run_whisper.py
一个基于Python的Xiaozhi AI修改版,专为Orange Pi设备设计,支持与MCP Server和Home Assistant并行运行,提供语音唤醒和摄像头功能。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
python -m venv xiaozhi-venv --system-site-packages
STT(语音转文本)工具支持通过麦克风录音或音频文件转录将用户语音输入转换为文本,实现AI与用户之间的双向语音通信。
安装状态
已补齐
工具数量
6
GitHub Stars
1
命令预览
pip install sounddevice numpy webrtcvad-wheels
通过本地或远程服务器上的Whisper进行语音转录,支持Claude Code通过SSH/tmux环境进行远程语音输入。
安装状态
已补齐
工具数量
1
GitHub Stars
1
命令预览
python windows_recorder.py --channel monitoring
一个端到端的语音交互助手,支持语音输入、意图识别、工具调用和语音播报的完整链路。
安装状态
已补齐
工具数量
10
GitHub Stars
1
命令预览
pip install -r requirements.txt
一个通过Claude Code实现语音对话的MCP服务器,支持多语言语音识别与合成。
安装状态
已补齐
工具数量
3
GitHub Stars
1
命令预览
pip install -r requirements.txt
一个本地智能代理,通过实时语音翻译和自然语音合成技术,支持技术面试场景下的多语言交流。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
python -m venv /app/venv
SpeakerMan是一个基于人工智能的完整语音聊天系统,结合语音识别(Whisper)、自然语言处理(Gemini)和语音合成(gTTS)技术,提供流畅的对话体验。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
python3 --version
一个基于多模态AI的VTuber控制系统,支持语音、视觉、听觉输入,与Unreal Engine集成,适用于虚拟主播和交互式AI场景。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
pip install -r requirements.txt
一个结合语音识别和人工智能的日历管理工具,支持通过语音或文本指令管理日历事件,并与CalDAV服务器集成。
安装状态
已补齐
工具数量
3
GitHub Stars
0
命令预览
python3 -m pip install --user radicale
一个结合语音识别和日历管理的工具,通过语音指令管理日程并与CalDAV服务器交互。
安装状态
已补齐
工具数量
3
GitHub Stars
0
命令预览
python3 -m pip install --user radicale
一个集成了语音识别和日历管理的工具,支持通过语音命令操作CalDAV日历事件。
安装状态
已补齐
工具数量
3
GitHub Stars
0
命令预览
python3 -m pip install --user radicale