Token导航 LogoToken导航TokenDH.com
MCP Srt Tts logo
音视频stdio官方级别未说明来源级核验

MCP Srt Tts

MCP Server

mcp-srt-tts 是一个基于MCP协议的工具,能够将SRT字幕文件转换为高质量语音,支持自动处理时间轴重叠和语音平滑过渡。

工具数

0

提示词数

0

GitHub Stars

0

资源数

0
语音合成PythonClaudeClaude

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

denganliang

提供方

denganliang

最后核验

2026/5/17 20:21

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

命令预览

pip install -r requirements.txt

详细介绍

mcp-srt-tts

英语 | 中文说明

mcp-srt-tts 是一个强大的 模型上下文协议(MCP) 使用远程TTS引擎将SRT字幕转换为高质量语音的服务器。

它的特点是 自动流量技术 智能地处理时间线重叠和 交叉渐变平滑 用于自然的音频转换。

mcp-srt-tts 是一个强大的 MCP(模型上下文协议) 工具,它可以调用远程 TTS 引擎,将 SRT 字幕文件批量转换为高质量的语音文件。

它内置了 Auto-Flow(自动顺延流) 技术,能智能处理语音重叠问题,并自动应用 淡入淡出(Cross-fade) 处理,让合成的语音听起来自然流畅。

______________________________________________________________________

🇬🇧 英文描述

✨ 特性

  • MCP支持:设计为直接用作 技能 在Claude Code或其他MCP客户端中。
  • 自动流量计时:自动检测口语句子是否长于其字幕槽,以及 调整时间线 以防止重叠/混乱,同时保持序列的完整性。
  • 平滑过渡:适用 50ms淡入/淡出信封 以消除点击、弹出和硬剪切。
  • 自动修剪:自动从生成的音频中删除尾随静音。
  • 同步SRT:生成新的 .srt 该文件与生成的音频的时间完全匹配。自从 Auto-Flow 可能会移动音频片段以防止重叠,原始字幕可能会失去同步。此新文件可确保您的字幕与新音轨保持同步。该文件的名称与输出音频相同(例如,如果输出为 speech.wav,副标题将是 speech.srt).
  • 参考音频:通过将参考音频文件(音色)上传到TTS服务器来支持语音克隆。

🔌 TTS后端要求

此工具依赖于 索引文本转语音 用于语音合成。 请自行部署:

您需要提供部署的TTS服务器URL作为参数。

📦 安装

1.克隆存储库

git clone https://github.com/denganliang/mcp-srt-tts.git
cd mcp-srt-tts

2.安装依赖项

pip install -r requirements.txt

🚀 使用Claude代码

您可以使用以下工具将此工具作为技能添加到Claude Code中 mcp 命令。

窗户:

claude mcp add srt-tts -- python "D:\path\to\mcp-srt-tts\mcp_server.py"

*(注意:请将路径替换为实际的绝对路径)*

macOS/Linux:

claude mcp add srt-tts -- python "/path/to/mcp-srt-tts/mcp_server.py"

示例提示

添加后,您可以简单地用自然语言问Claude:

“转换 movie.srt 音频使用 ref_voice.wav。我的TTS服务器位于 http://localhost:8000."

克劳德将:

  1. 解析SRT。
  2. 上传参考音频。
  3. 为每一行合成语音。
  4. 自动调整定时 以防止重叠。
  5. 生成最终结果 output.wav 并已同步 output.srt.

🛠 独立使用(CLI)

您也可以直接将其作为Python脚本运行,而无需MCP:

python main.py    [-o output.wav]

______________________________________________________________________

🇨🇳 中文说明

✨ 核心功能

  • 完美支持 MCP:专为 Claude Code 设计,安装后可作为 技能 直接通过自然语言调用。
  • Auto-Flow 自动顺延:脚本会自动检测生成的语音长度。如果语音比字幕时间长,程序会自动顺延下一句的开始时间,彻底解决语音重叠(Overlap)和嘈杂混乱的问题,保证每一句话都清晰完整。
  • 平滑过渡处理:对每一段语音的首尾应用 50ms 淡入淡出(Fade Envelope),消除拼接处的爆音和生硬感。
  • 自动裁剪:生成完成后,自动检测并移除末尾多余的静音空白。
  • 同步字幕生成:会自动生成一个与新语音时间轴完全对应的新 .srt 文件。由于 Auto-Flow 可能会平移语音片段以避免重叠,原字幕的时间轴可能会失效。程序会根据最终生成的音频时间,输出一个新的字幕文件,文件名与输出音频保持一致(例如输出 speech.wav,则生成 speech.srt)。
  • 参考音频支持:支持上传本地参考音频文件,用于 TTS 的音色克隆。

🔌 TTS 后端要求

本工具使用 索引文本转语音 作为语音合成后端。 请自行部署服务:

使用时需将部署好的 TTS 服务地址作为参数传入。

📦 安装步骤

1. 克隆仓库

git clone https://github.com/denganliang/mcp-srt-tts.git
cd mcp-srt-tts

2. 安装依赖

pip install -r requirements.txt

🚀 在 Claude Code 中使用

使用 mcp 命令将此工具注册为 Skill。

Windows 用户:

claude mcp add srt-tts -- python "D:\你的路径\mcp-srt-tts\mcp_server.py"

*(注意:请务必使用 mcp_server.py 的绝对路径)*

macOS / Linux 用户:

claude mcp add srt-tts -- python "/你的路径/mcp-srt-tts/mcp_server.py"

调用示例

添加成功后,你可以直接对 Claude 说:

“帮我把 video.srt 转成语音,参考音色用 my_voice.wav,TTS服务地址是 http://127.0.0.1:8000

Claude 会自动完成以下工作:

  1. 解析 SRT 字幕。
  2. 上传参考音频。
  3. 逐行合成语音。
  4. 自动调整时间轴以防止语音重叠。
  5. 输出最终的 output.wav 文件和同步的 output.srt 字幕。

🛠 独立运行 (CLI 模式)

如果你不想通过 Claude 调用,也可以直接运行脚本:

python main.py    [-o 输出文件名.wav]

📄 许可证

MIT许可证

目录标签

目录标签

语音合成PythonClaude字幕转语音本地部署自动时间轴处理TTS工具

支持客户端

Claude

接入字段

传输方式(transport,传输协议)

stdio

鉴权方式(authType,认证方式)

none

工具数量(toolCount,工具数)

0

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

stdionone部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

来源信息

继续浏览同类 MCP