Token导航 LogoToken导航TokenDH.com
Cantonese AI MCP Server logo
音视频stdio官方级别未说明来源级核验

Cantonese AI MCP Server

MCP Server

Cantonese.ai MCP服务器提供文本转语音和语音转文本工具,支持粤语和英语,适用于语音处理和集成开发。

工具数

2

提示词数

0

GitHub Stars

1

资源数

0
语音合成开发工具PythonClaude语音识别Claude DesktopClaude

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

hhy-joseph

提供方

hhy-joseph

最后核验

2026/5/17 20:20

运行时

Python

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

命令预览

uv run mcp dev server.py

详细介绍

Cantonese.ai MCP服务器

![License: MIT](https://opensource.org/licenses/MIT)

MCP(模型上下文协议)服务器 它为 文本到语音语音转文本 转换使用 营地.ai API此服务器设计为与以下设备一起运行 mcp dev.

______________________________________________________________________

✨ 特性

  • 文本转语音工具:将粤语或英语文本转换为高质量音频。
  • 语音转文本工具:将音频文件转录为文本。
  • 现代工具:设置为 uv 用于快速包管理。
  • 易于集成:与任何兼容MCP的客户端(例如LLM代理)连接。
  • 安全:您的 cantonese.ai API密钥作为一个环境变量被安全地处理。

______________________________________________________________________

🚀 入门指南

先决条件

  • Python 3.8+
  • uv:我们建议使用 uv 用于Python包管理。

安装

  1. 克隆存储库:
   git clone 
   cd cantonese-ai-mcp-server
  1. 创建并激活虚拟环境:
   uv venv
   source .venv/bin/activate
  1. 安装依赖项:

此项目使用 uv 从同步依赖关系 pyproject.toml.

   uv sync
  1. 设置API密钥:

您将需要来自的API密钥 cantonese.ai.将API密钥导出为环境变量。您可以将此添加到您的 .bashrc.zshrc 用于持久化的文件。

   export CANTONESE_AI_API_KEY="your-api-key-here"

运行服务器

使用以下命令启动MCP开发服务器。它将关注以下方面的变化 server.py 并自动重新加载。

uv run mcp dev server.py

您应该看到一个输出,指示服务器已启动并可用,通常在 http://127.0.0.1:6274.

运行服务器并在Claude Desktop中使用

uv run server.py

请查看 面向服务器开发人员 关于如何设置与Cladue Desktop的连接。

🛠️ 使用工具

服务器运行后,它将公开两个工具。

工具: text_to_speech

将文本字符串转换为音频文件。

论据:

-text (string,必填):要转换为语音的文本。 -voice (字符串,可选,默认值:“默认”):用于语音合成的语音。 -language (字符串,可选,默认:“广东话”):文本的语言。可以是“广东话”或“英语”。 -output_filename (string,必填):保存音频的文件名(例如。, output.mp3).

调用示例:

{
  "tool": "text_to_speech",
  "arguments": {
    "text": "你好世界",
    "output_filename": "hello_world.mp3"
  }
}

成功响应:

{
  "success": true,
  "message": "Audio file saved as hello_world.mp3"
}

工具: speech_to_text

将音频文件转录为文本。

论据:

input_filename (string,必填):要转录的本地音频文件的路径(例如。, audio.wav).

调用示例:

{
  "tool": "speech_to_text",
  "arguments": {
    "input_filename": "audio.wav"
  }
}

成功响应:

该工具将返回一个JSON对象,其中包含来自API的转录详细信息。

{
  "success": true,
  "result": {
    "text": "你好世界",
    "confidence": 0.95,
    "language": "cantonese",
    "duration": 2.3,
    "timestamp": "2025-06-02T11:22:00Z"
  }
}

📜 许可证

此项目根据MIT许可证获得许可-请参阅 LICENSE 文件以获取详细信息。

目录标签

目录标签

语音合成开发工具PythonClaude语音识别本地部署粤语处理API集成

支持客户端

Claude DesktopClaude

接入字段

传输方式(transport,传输协议)

stdio

鉴权方式(authType,认证方式)

none

运行时(runtime,运行环境)

Python

工具数量(toolCount,工具数)

2

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

stdionone部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

来源信息

继续浏览同类 MCP