MCP音频插件
mcp-audio 是一个符合AIO-2030的MCP插件,使用音频语音识别API执行语音到文本转录。
它暴露了 identify_voice 方法通过两者 multipart/form-data 和 base64 格式,支持AIO tools.call 并返回JSON-RPC结构化输出。
______________________________________________________________________
特性
- 完全符合AIO标准的MCP插件(
/tools.call,/help) - 转换
.wav/.mp3使用SiliconFlow将音频文件转换为转录本 - API密钥通过
.env文件 - Docker兼容和最小依赖
- AIO端点注册表注册就绪
______________________________________________________________________
设置(本地)
1.克隆和安装
git clone git@github.com:AIO-2030/mcp-audio.git
cd mcp-audio
python -m venv venv && source venv/bin/activate
pip install -r requirements.txt2.添加.env文件
cp .env.example .env设置音频URL和API密钥:
AUDIO_URL=https--xxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxx
API_KEY=sk-xxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxx3.运行MCP服务器
python src/mcp_server.py4.Docker
4.1构建和运行
docker build -t mcp-audio .
docker run --env-file .env -p 8080:8080 mcp-audioAPI概述
POST/api/v1/mcp/voice_model
直接上传音频文件。答复:
{
"transcript": "hello world",
"confidence": 0.91,
"audio_hash": "a1b2c3..."
}POST/api/v1/mcp/tools.call(AIO协议)
JSON-RPC格式,带有base64编码音频。答复:
{
"method": "tools.call",
"params": {
"method": "identify_voice",
"inputs": [
{
"type": "audio",
"value": ""
}
]
}
}GET/api/v1/mcp/help
Auto提供mcp_audio_register.json的内容。Queen AI用于MCP发现和服务索引。
测试工具
Base64语音测试
python test/test_audio_base64.py健康检查
python health_check.pyMCP注册(到AIO端点容器)
./register_mcp.sh需要jq、dfx和一个正在运行的endpoint_register容器。
