Token导航 LogoToken导航TokenDH.com
效率需要联网clawhub未标认证来源可访问clear审计提醒

audio-note-taker音频记事本

Agent Skill

用于辅助音频、音乐、语音转写、语音合成或声音素材处理。它适合让 Agent 生成配乐说明、整理音频流程、调用语音工具或处理播客和视频配音素材。使用时需要确认输入音频来源、输出格式、时长和模型限制;涉及人声克隆、版权音乐或公开发布时,应先核对授权和合规边界。

总安装

9,029

周安装

380

GitHub Stars

公开资料未说明

下载量

3,162
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:audio-note-taker(音频记事本)
来源仓库:https://github.com/utopiabenben/audio-note-taker
安装命令:
openclaw skills install audio-note-taker
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install audio-note-taker

简介

语音笔记助手:录音自动转文字并整理成结构化笔记,支持说话人识别,自动总结要点和行动项

SKILL.md

name
audio-note-taker
description
语音笔记助手:录音自动转文字并整理成结构化笔记,支持说话人识别,自动总结要点和行动项
metadata

audio-note-taker - 语音笔记助手

智能语音笔记助手——自动将录音转成结构化文字笔记。

适用场景

  • 🎙️ 会议记录:自动转录会议内容,提炼行动项
  • 🎓 讲座笔记:课堂/讲座录音转文字,自动整理要点
  • 📰 采访整理:语音采访转文字稿,快速生成报道素材
  • 💼 工作复盘:项目复盘录音 → 结构化记录
  • 📝 日常笔记:快速语音记录 → 文字存档

核心功能

  • 高精度转写:基于 OpenAI Whisper API,支持多种语言
  • 结构化输出:自动划分段落,识别关键信息
  • 智能摘要:提取核心观点、决策、待办事项
  • 说话人区分:可选说话人识别和标记
  • Markdown 格式:输出易读、易编辑的笔记
  • 多种输入:支持音频文件或直接录音

快速开始

基础转写

audio-note-taker /path/to/recording.m4a
# 输出:recording_notes.md

指定主题和格式

audio-note-taker /path/to/meeting.mp3 \
  --title "2026-Q1 产品规划会" \
  --language zh \
  --output meeting_notes.md

启用说话人识别

audio-note-taker /path/to/interview.wav \
  --detect-speakers true \
  --output interview_transcript.md

生成深度摘要(需配置 LLM)

audio-note-taker /path/to/lecture.mp3 \
  --summarize true \
  --extract-action-items true \
  --output lecture_summary.md

参数说明

参数类型默认说明
input路径必填音频文件路径(支持 mp3, m4a, wav, ogg 等)
--title字符串自动生成笔记标题
--language代码auto音频语言(en, zh, ja, auto 等)
--output路径{input}_notes.md输出文件路径
--detect-speakers布尔false是否识别不同说话人
--summarize布尔false生成摘要(需 OPENAI_API_KEY)
--extract-action-items布尔false提取行动项
--model字符串whisper-1Whisper 模型(whisper-1)
--format字符串markdown输出格式(markdown, txt, json)

环境变量

变量名说明必填
OPENAI_API_KEYOpenAI API 密钥
OPENAI_BASE_URL自定义 API 地址(可选)
NOTE_TAKER_MODEL摘要模型(默认 gpt-4-turbo)

输出内容示例

# 会议记录:2026-Q1 产品规划会
**时间**:2026-03-15 14:00-15:30  
**地点**:线上  
**参会人**:张三、李四、王五

---

## 📝 会议纪要

### 讨论要点

1. Q1 产品上线延期原因分析
2. Q2 核心功能优先级排序
3. 资源分配调整

### ✅ 决议事项

- [x] 确定 Q2 三大核心功能
- [x] 批准额外 2 名开发人力
- [x] 下周三前发布详细排期

### 📋 待办事项

| 负责人 | 任务 | 截止时间 |
|--------|------|---------|
| 张三 | 完成 PRD 文档 | 2026-03-18 |
| 李四 | 技术方案评审 | 2026-03-20 |
| 王五 | 资源配置协调 | 2026-03-17 |

---

## 📄 完整转录(可折叠)

<details>
<summary>展开查看完整对话</summary>

[14:00] 张三:大家好,我们今天...
[14:05] 李四:关于延期,我觉得...
...
</details>

与其他技能集成

  • social-publisher:将会议纪要直接整理成公众号/小红书文章
  • summarize:对长录音先提取关键信息,再生成摘要
  • wechat-formatter:将会议纪要快速格式化为公众号可发内容

技术细节

  • 使用 OpenAI Whisper API 进行语音转文字
  • 可选集成 GPT 模型进行摘要和行动项提取
  • 支持中英文混合识别
  • 音频预处理:自动降噪、格式转换(通过 ffmpeg)
  • 输出 UTF-8 编码,支持中文排版

安装依赖

# 系统依赖
apt install -y ffmpeg

# Python 依赖(自动安装)
pip install openai>=1.0.0

许可证

MIT

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

73.15%
按下载量换算2,313

安全审计

VirusTotal

通过

ClawScan

可疑

Static analysis

通过

权限和风险

需要联网

该 Skill 可能需要联网访问来源站点、仓库或外部 API;具体网络访问范围需要结合源码和 README 复核。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills