Token导航 LogoToken导航TokenDH.com
效率敏感数据clawhub未标认证来源可访问clear审计通过

localspeechrecognitionlocalspeechrecognition 效率

Agent Skill

用于辅助音频、音乐、语音转写、语音合成或声音素材处理。它适合让 Agent 生成配乐说明、整理音频流程、调用语音工具或处理播客和视频配音素材。使用时需要确认输入音频来源、输出格式、时长和模型限制;涉及人声克隆、版权音乐或公开发布时,应先核对授权和合规边界。

总安装

11,297

周安装

457

GitHub Stars

1

下载量

3,546
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:localspeechrecognition(localspeechrecognition 效率)
来源仓库:https://github.com/zktufo/localspeechrecognition
安装命令:
openclaw skills install localspeechrecognition
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install localspeechrecognition

简介

本地语音转文字工具,使用 faster-whisper 模型完全免费运行。

  • 收到语音消息(.ogg/.m4a/.mp3)后自动触发转录,支持中文日语等多语言。
  • 适合音频处理、语音转写或声音素材相关工作流程。
  • 涉及公开传播时应核对授权与合规边界。
  • localspeechrecognition 属于效率类 Skill,可作为该场景下的辅助能力补充。

SKILL.md

name
speech-recognition-local
description
本地语音转文字 / Local Speech-to-Text. 使用 faster-whisper 在本地运行 Whisper 模型,无需 API 费用,完全免费。收到语音消息(.ogg .m4a .mp3)自动触发转录,支持中文/英文/日语/自动检测。| Free local STT/TTS alternative — runs Whisper on your machine, no API costs, auto-transcribes voice messages in seconds.
metadata
{"clawdbot":{"emoji":"🎙️","os":["linux","darwin","win32"]}}

本地语音识别 / Local Speech Recognition

使用 faster-whisper 在本地运行 Whisper 模型,无需任何 API 费用。免费、离线、保护隐私。 Runs faster-whisper locally — no API keys, no costs, fully offline & private.

功能特点 / Features

  • 🎙️ 全自动转录 — 收到语音消息自动触发,无需手动调用
  • 💰 完全免费 — 无需 API key,无任何费用
  • 🔒 隐私安全 — 所有处理在本地完成,音频不离开你的设备
  • 🌐 多语言支持 — 中文 / 英文 / 日语 / 自动检测
  • 快速响应 — VAD 静音过滤,模型内存缓存
  • 📦 主流格式 — .ogg .m4a .mp3 .wav

使用方式 / Usage

收到语音消息后,OpenClaw 自动调用转录脚本并将结果注入对话。

转录命令 / Command:

python3 ~/.openclaw/workspace/skills/speech-recognition-local/scripts/transcribe.py <audio_file> [language]

参数说明 / Parameters:

参数默认值说明
audio_file音频文件路径 / Audio file path
languagezh语言:zh / en / ja / auto

模型说明 / Model Info

  • 默认模型 / Default: base(精度与速度平衡)
  • 首次使用自动下载 / Auto-download on first use
  • VAD 静音过滤已启用 / VAD filtering enabled
  • 模型缓存在内存中 / Model cached in memory

适用场景 / Use Cases

场景 / Scenario说明
语音消息转文字将微信/飞书/Telegram 语音转为可阅读文本
会议记录录制音频后快速转录存档
播客字幕将音频文件批量转为文字稿
隐私敏感场景不希望音频数据上传第三方

限制 / Limitations

  • 支持格式 / Supported: .ogg .m4a .mp3 .wav
  • 文件大小 / Max size: 25MB

安装前提 / Requirements

  • Python 3.8+
  • faster-whisper(首次使用自动安装)

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

96.5%
按下载量换算3,422

安全审计

VirusTotal

通过

ClawScan

通过

Static analysis

通过

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills