Token导航 LogoToken导航TokenDH.com
Claude Voice logo
开发工具未说明官方级别未说明来源级核验

Claude Voice

MCP Server

Claude Voice是一款AI驱动的语音记录、转录和笔记系统,支持语音笔记、语音命令和桌面音频捕获,适用于个人知识管理和会议记录。

工具数

4

提示词数

0

GitHub Stars

1

资源数

0
ShellClaude语音识别Claude

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

rabb1tl0ka

提供方

rabb1tl0ka

最后核验

2026/5/17 20:22

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

详细介绍

克劳德之声

语音记录、转录和笔记系统 克劳德代码.

AI第一第二脑语音接口,可实现:

  • 语音笔记 -将想法直接发送到您的vault收件箱
  • 语音命令 -向Claude说出提示,而不是打字
  • 桌面音频捕获 -记录和转录会议、视频、播客

建筑

此仓库包含三个紧密集成的模块:

claude-voice/
├── mcp-server/      # MCP server providing voice tools to Claude Code
├── voice-tools/     # Shared bash utilities for audio/transcription
└── skills/          # Claude Code skills (user-facing /commands)

特性

/voice_note

使用自动静音检测录制语音笔记并保存到vault收件箱。

  • 自动检测静音(约1.5秒暂停停止录制)
  • 用Whisper转录
  • 保存到当前或指定的vault
  • 自定义标题或基于时间戳的文件名

用途:

/voice_note                              # Record to current vault
/voice_note "bitcoin thoughts"           # Custom title
/voice_note bruno2brain-v3 "daily log"  # Specific vault

/voice_prompt

向克劳德说出命令,而不是打字。

用途:

/voice_prompt
[Speak: "Create a new note about quantum computing"]
[Claude executes your spoken command]

/listen_start & /listen_stop

录制桌面音频输出(扬声器/耳机),用于会议笔记、视频摘要等。

用途:

/listen_start    # Start background recording
[... attend meeting, watch video ...]
/listen_stop     # Stop, transcribe, summarize, save to inbox

安装

先决条件

  • Linux(建议使用Ubuntu/Debian)
  • Python 3.8+
  • jq (sudo apt install jq)

其他所有内容(ffmpeg、portaudio、Whisper)都由安装程序处理。

一次性安装

git clone https://github.com/rabb1tpt/claude-voice.git
cd claude-voice

# Linux
./install.sh

# macOS
./install-macos.sh

安装程序将:

  1. 检查并提供安装系统deps(ffmpeg, portaudio等等)
  2. 安装 耳语 用于转录(或检测现有安装)
  3. 设置MCP服务器Python venv
  4. Symlink技能 ~/.claude/skills/
  5. 注册 voice MCP服务器中 ~/.claude/settings.json (可在全球所有Claude Code会话中使用)

然后 重新启动克劳德代码 你准备好了。

macOS注意事项: /listen_start/listen_stop 需要PulseAudio,并且仅支持Linux。 /voice_prompt/voice_note 在两个平台上工作。

用法

安装后,这些技能可以在任何Claude Code会话中使用:

/voice_note              # Quick voice capture
/voice_prompt            # Speak a command
/listen_start            # Start recording desktop audio
/listen_stop             # Stop and process recording

或者自然地问——克劳德会在相关时自动调用技能:

  • “录制有关此会议的语音备忘”
  • “听听我要说什么,然后执行它”

音频源

  • 语音笔记和提示:麦克风输入(自动静音检测)
  • 聆听环节:桌面音频输出(通过PulseAudio环回的扬声器/耳机)

输出格式

语音备忘

# inbox/voice-{title}.md

[Transcription of your voice note]

#voice-note

聆听环节

# inbox/listen-YYYY-MM-DD-HHMMSS.md

## Summary
[AI-generated summary of the audio]

## Full Transcript
[Complete transcription with timestamps]

#listen-session

运作原理

  1. 技能 (.md 文件位于 skills/)定义用户界面-哪些命令可用以及如何使用它们
  2. MCP服务器 (mcp-server/server.py)提供实际工具(record_voice_note, listen)通过模型上下文协议连接到Claude代码
  3. 语音工具 (voice-tools/)包含用于音频处理、转录和文件处理的共享bash实用程序

当你调用一项技能时,Claude Code:

  1. 加载技能说明
  2. 调用相应的MCP工具
  3. MCP服务器使用语音工具进行录音和转录
  4. 将结果返回给Claude进行处理

故障排除

“没有可用的MCP工具”

  • 检查一下 .mcp.json 存在于vault中,并指向正确的路径
  • 验证Python venv是否已激活并安装了依赖项
  • 重新启动Claude Code会话

“转录失败”

  • 验证Whisper是否已在本地安装: which whisper
  • 检查音频文件是否已创建(临时文件在 /tmp/)
  • 确保已安装ffmpeg: which ffmpeg

桌面音频未录制

  • 验证PulseAudio环回是否已配置
  • 检查 pactl list sources 用于监控设备
  • 有关PulseAudio设置,请参阅语音工具README

哲学:人工智能第一大脑第二大脑

该系统代表了 AI优先的方法 个人知识管理:

传统PKM:类型→ 组织→ 搜索→ Read AI第一PKM:说话→ AI捕捉→ 会话检索

通过消除每一步的摩擦(语音与打字、人工智能组织与手动标记、对话与搜索),我们实现了:

  • 以语速捕捉思想
  • 灵感迸发时从事平行项目
  • 无缝上下文切换,不中断流程

语音界面使第二大脑感觉像是思维的延伸,而不是你必须“使用”的单独工具

贡献

问题和PR欢迎!这是一个公开的个人工作流程工具——如果它能帮助你构建自己的人工智能优先系统,那就是目标。

许可证

MIT许可证-请参阅许可证文件

学分

由...建造 @rabb1tl0ka 作为bruno2brain-v3跳马系统的一部分。

技术支持:

目录标签

目录标签

ShellClaude语音识别本地部署AI笔记会议记录个人知识管理语音命令

支持客户端

Claude

接入字段

传输方式(transport,传输协议)

未说明

鉴权方式(authType,认证方式)

session

工具数量(toolCount,工具数)

4

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

未说明session部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

仍需确认:installCommand

来源信息

继续浏览同类 MCP