TextToSpeech MCP服务器
本地文本到语音MCP服务器,使用macOS Say和Kokoro TTS引擎提供高质量、隐私优先的TTS合成。
特性
- 本地处理:所有TTS合成都在本地进行-没有数据发送到外部服务
- 多引擎:
- macOS Say(快速、内置、23种语音、多种语言) - Kokoro TTS(高质量神经合成,21种声音,8种语言)
- MCP集成:适用于Claude Desktop和其他MCP兼容客户端
- 多语言支持:43种语言,包括英语、西班牙语、法语、日语、中文等
快速开始
1.安装依赖项
npm install2.建设项目
npm run build3.测试服务器
npm start4.配置克劳德桌面
将此配置添加到您的Claude Desktop设置中:
{
"mcpServers": {
"local-tts": {
"command": "node",
"args": ["./dist/server.js"],
"cwd": "/path/to/your/TextToSpeech-MCP"
}
}
}可用工具
synthesize_text
使用自定义选项将文本转换为语音。
参数:
text(必填):要转换的文本(最多50000个字符)voice(可选):语音名称(例如,“Alex”、“Samantha”、“Daniel”)engine(可选):“macos”、“kokoro”或“auto”(默认值:“auto“)outputFormat(可选):“aiff”、“wav”、“mp3”、“m4a”(默认:“aif”)speed(可选):速度倍数0.1-3.0(默认值:1.0)quality(可选):“快速”、“平衡”、“高”(默认:“平衡”)
list_voices
列出具有过滤选项的可用语音。
参数:
engine(可选):“macos”、“kokoro”、“all”(默认值:“all”)language(可选):语言过滤器(例如,“en-us”、“es”、“fr”)gender(可选):“男性”、“女性”、“中性”
health_check
检查发动机可用性和系统健康状况。
play_audio
使用控制选项播放生成的音频文件。
参数:
audioPath(可选):音频文件的路径(默认为最新路径)action(可选):播放、暂停、停止、恢复(默认:播放)
示例用法
基础合成
Use the synthesize_text tool to say "Hello, world!" using the default voice.语音选择
List all English female voices, then use one to synthesize a greeting.多语言
Synthesize "Bonjour le monde" using a French voice.发展
可用脚本
npm run build-构建TypeScriptnpm run dev-使用手表模式构建npm start-启动服务器npm test-运行测试(即将推出)npm run lint-运行ESLintnpm run format-使用Prettier格式化代码
环境变量
TTS_OUTPUT_DIR-音频输出目录(默认:./output)TTS_TEMP_DIR-临时文件目录(默认:./temp)TTS_ENGINE-默认引擎:“macos”、“kokoro”、“auto”(默认:“自动”)TTS_QUALITY-默认质量:“快速”、“平衡”、“高”(默认:“平衡”)
状态
✅ 第一阶段完成:macOS Say引擎,支持23种语音 ✅ 第二阶段完成:Kokoro TTS集成21种声音 📋 第三阶段计划:批量音频播放和高级功能
MCP检验员测试
npx @modelcontextprotocol/inspector node dist/server.js然后打开http://localhost:5173以交互方式测试服务器。
需求
- macOS(适用于macOS Say引擎)
- Node.js 18+
- TypeScript
许可证
麻省理工学院
