Token导航 LogoToken导航TokenDH.com
Agent-Speaker logo
开发工具未说明官方级别未说明来源级核验

Agent-Speaker

MCP Server

为AI编码助手添加语音输出功能,使用kokoro-onnx模型实现快速、自然的语音合成,降低认知负荷。

工具数

3

提示词数

0

GitHub Stars

5

资源数

0
语音合成PythonClaude开发工具Claude

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

NetDevAutomate

提供方

NetDevAutomate

最后核验

2026/5/17 20:21

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

详细介绍

演讲者

AI编码代理的本地TTS——大声说出响应

将语音输出添加到任何AI编码代理(Claude Code、Kiro CLI、Gemini CLI、OpenCode、Crush、Amp)。用途 kokoro onnx (82M参数)用于快速、自然发音的语音,延迟约1.5秒。

所有代理都通过 主控程序 暴露一个 speak 工具。Kokoro模型加载一次并在内存中保持温暖,消除了后续调用的冷启动延迟。

为什么?

  • 听觉通道有助于专注和处理(特别是对于神经发散用户)
  • 听到口头回应可以减少“文本墙”的负担
  • 自然音质——不是机器人,不会让你分心

快速开始

git clone /speaker.git
cd speaker
./scripts/install.sh

这将安装 speak-mcp MCP服务器,并配置任何检测到的AI工具。

用法

在任何代理会话中:

平台启用禁用
克劳德代码/speak-start/speak-stop
Kiro命令行界面@speak-start@speak-stop
Gemini CLI@speak-start@speak-stop
OpenCode@speak-start@speak-stop
放大器@speak-start@speak-stop

默认情况下,语音处于关闭状态。启用后,代理调用 speak MCP工具及其完整响应(不包括代码块)。

MCP服务器

speak-mcp 入口点运行a FastMCP 服务器公开了三个工具: speak, list_voices,以及 speaker_statusKokoro模型在内存中保持温暖——第一次调用加载模型(~2s),后续调用的开销约为200ms。

工具模式

字段
姓名speak
参数text: str, voice: str = "am_michael", speed: float = 1.0
退货str --确认或错误消息

添加到任何代理

添加到代理的MCP配置中:

{
  "mcpServers": {
    "speaker": {
      "command": "speak-mcp",
      "args": []
    }
  }
}

然后在代理的提示中添加:

The user can toggle voice with @speak-start and @speak-stop.
When enabled, call the speak tool with your full response text.
Exclude code blocks from spoken text.

docs/agent-install.md 针对特定平台的配置。

声音

kokoro onnx的声音遵循这种模式 {accent}{gender}_{name}:

语音描述
am_michael美国男性(默认)——清晰、自然
af_heart美国女性——暖色调
af_bella美国女性——聪明
am_adam美国男性-更深
bf_emma英国女性

速度

通过 speed 作为工具参数(0.5=慢,2.0=快,默认值1.0)。

运作原理

  1. 代理人致电 speak 带响应文本的MCP工具
  2. MCP服务器(speak-mcp)通过以下方式合成音频 kokoro onnx
  3. 音频重新采样24kHz->48kHz,并通过声音设备播放
  4. 模型在内存中保持温暖,以实现低延迟的后续调用

建筑

Agent (Claude/Kiro/Gemini/...)
  |
  | MCP protocol (stdio)
  v
speak-mcp (FastMCP server)
  |
  | SpeakerEngine (in-process)
  v
kokoro-onnx -> sounddevice -> audio out

需求

  • Python 3.10+
  • 紫外线 用于安装
  • macOS或Linux(kokoro-onnx通过onnx运行时在CPU上运行)

许可证

麻省理工学院

生成的人工制品

🔍 探索此项目 --人工智能生成的概述 谷歌笔记本LM
🎧 听音频概述两位AI主持人讨论该项目——非常适合通勤
📊 浏览幻灯片演示就绪项目概述

*产生于 notebookrm仓库工件*

目录标签

目录标签

语音合成PythonClaude开发工具本地部署AI编码助手自然语言处理辅助功能

支持客户端

Claude

接入字段

传输方式(transport,传输协议)

未说明

鉴权方式(authType,认证方式)

none

工具数量(toolCount,工具数)

3

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

未说明none部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

仍需确认:installCommand

来源信息

继续浏览同类 MCP