Token导航 LogoToken导航TokenDH.com
效率敏感数据clawhub未标认证来源可访问clear审计通过

feishu-voice-sender-tts飞书语音发送器 tts

Agent Skill

用于辅助音频、音乐、语音转写、语音合成或声音素材处理。它适合让 Agent 生成配乐说明、整理音频流程、调用语音工具或处理播客和视频配音素材。使用时需要确认输入音频来源、输出格式、时长和模型限制;涉及人声克隆、版权音乐或公开发布时,应先核对授权和合规边界。

总安装

7,008

周安装

292

GitHub Stars

2

下载量

2,336
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:feishu-voice-sender-tts(飞书语音发送器 tts)
来源仓库:https://github.com/sunxq1017-hash/feishu-voice-sender-tts
安装命令:
openclaw skills install feishu-voice-sender-tts
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install feishu-voice-sender-tts

简介

飞书语音发送器 tts 支持 TTS 语音合成和可选 ASR 功能。

  • 适用于用户明确要求发送飞书语音消息的场景。feishu-voice-sender-tts 属于效率类 Skill,可作为该场景下的辅助能力补充。
  • 通过 clawhub 安装,需结合来源仓库和 README 确认具体用法。
  • 安装前建议确认权限范围和维护状态,注意是否触发联网或文件读写。
  • 涉及语音识别时应核对输入音频来源和模型限制。

SKILL.md

name
feishu-voice-sender-tts
description
|
metadata
openclaw
primaryEnv
FEISHU_APP_SECRET
requires
env
bins
env
description
Volcengine TTS app ID
required
true
sensitive
false
description
Volcengine TTS access key
required
true
sensitive
true
description
Feishu app ID
required
true
sensitive
false
description
Feishu app secret
required
true
sensitive
true
description
Volcengine ASR app ID (optional, only needed for speech recognition)
required
false
sensitive
false
description
Volcengine ASR access key (optional, only needed for speech recognition)
required
false
sensitive
true
description
Default Feishu open_id for the recipient
required
false
sensitive
false
description
Volcengine ASR resource ID for local-file recognition (optional, defaults to the flash/local-file ASR resource)
required
false
sensitive
false

飞书语音发送器 Feishu Voice Sender

支持 TTS 语音合成,以及可选的 ASR 语音识别功能,同时支持基于上下文的情绪参数。

⚠️ 重要声明

执行模式 | Execution Model

  • 此 Skill 不会自动运行,仅在用户明确要求时执行
  • This skill does not monitor, intercept, or automatically process messages. It only runs when explicitly invoked.
  • 仅处理用户提供的输入,不读取任意本地文件
  • Only processes user-provided input. Does not read arbitrary local files.

外部依赖 | External Dependencies

  • ffmpeg: 仅用于音频格式转换(mp3 → opus),不执行任意命令
  • ffmpeg is used ONLY for audio format conversion (mp3 → opus). No arbitrary command execution. No user-controlled shell input.

触发场景 | Invocation Examples

当用户明确要求发送飞书语音消息时,可调用此 Skill,例如:

  • "发语音给..."
  • "用语音回复"
  • "发送语音消息"
  • "voice message"
  • "send voice"

This skill may be invoked only when the user explicitly requests a voice message via Feishu/Lark. It does not run automatically.

AI 使用方法

当用户明确要求时,使用以下方式发送语音:

import sys
sys.path.insert(0, 'src')
from feishu_voice import send_voice_message

# 发送语音消息
send_voice_message(
    text="要播报的内容",
    user_input="用户的原始请求(用于情绪感知)"
)

参数说明:

  • text: AI 生成的播报内容(必填,最大 300 字符)
  • user_input: 用户的原始输入,用于让豆包感知情绪(可选)
  • receive_id: 接收者 ID(可选,默认从环境变量读取)

示例:

# 用户说:"用激动的语气发语音说项目成功了"
send_voice_message(
    text="项目成功了!我们超额完成了目标!",
    user_input="用激动的语气发语音说项目成功了"
)

数据流 | Data Flow

Text path: 用户提供文本 → 情绪上下文参数 → TTS 语音合成 → 格式转换 → 飞书发送

ASR path: 用户明确提供本地音频文件(当前支持 .ogg / OGG Opus 输入)→ 极速版 ASR(flash recognize API)→ 返回文本结果

环境变量配置

必需配置(TTS + Feishu)

export TTS_APP_ID="your-tts-app-id"
export TTS_ACCESS_KEY="your-tts-access-key"
export FEISHU_APP_ID="your-feishu-app-id"
export FEISHU_APP_SECRET="your-feishu-app-secret"

可选配置

# ASR 语音识别(仅在需要使用 ASR 功能时配置)
export ASR_APP_ID="your-asr-app-id"
export ASR_ACCESS_KEY="your-asr-access-key"
export ASR_RESOURCE_ID="volc.bigasr.auc_turbo"

# 默认接收者
export DEFAULT_RECEIVE_ID="ou_xxx"

注意: ASR 是可选功能,仅在调用语音识别时需要配置 ASR_APP_ID 和 ASR_ACCESS_KEY。若未显式提供 ASR_RESOURCE_ID,代码默认按本地文件极速识别场景使用 volc.bigasr.auc_turbo

获取方式:

  • 豆包语音:火山引擎控制台 https://console.volcengine.com/
  • 飞书:飞书开放平台 https://open.feishu.cn/

功能特性

  • 🎙️ 语音合成(TTS) - 使用豆包 TTS 2.0 生成语音
  • 🎯 语音识别(ASR) - 使用豆包极速版 flash recognize API 识别本地 OGG/Opus 音频
  • 🎭 情绪参数 - 支持通过 context_texts 传递情绪上下文
  • 🔒 安全限制 - 仅处理用户提供的输入

安全说明 | Security

输入限制

  • 仅接受用户直接提供的文本输入
  • ASR 当前仅处理用户明确提供的 .ogg 音频文件(飞书语音常见为 OGG/Opus)
  • 文本长度限制 300 字符
  • 不读取任意本地文件,仅处理用户明确提供的 .ogg 音频文件用于 ASR

音频输入限制 | Audio Input Constraints

  • 仅处理用户明确提供的音频文件
  • Only processes audio files explicitly provided by the user
  • 不访问系统音频、麦克风或消息历史
  • Does NOT access system audio, microphone, or message history
  • 不扫描本地目录
  • Does NOT scan local directories

执行限制

  • 不监听消息
  • 不自动运行
  • 不扫描目录
  • 不执行用户控制的命令

临时文件

  • 使用 tempfile 模块创建临时文件
  • 处理完成后立即删除
  • 不保留任何持久文件

依赖

requests>=2.28.0

系统依赖:

  • ffmpeg(用于音频格式转换 mp3 → opus)
  • Python 3.8+

安装

pip install -r requirements.txt

注意: 需要系统安装 ffmpeg

  • macOS: brew install ffmpeg
  • Ubuntu: sudo apt-get install ffmpeg

项目结构

feishu-voice-sender-tts/
├── SKILL.md
├── requirements.txt
└── src/
    └── feishu_voice.py

更新日志

V2.0.2 (2026-03-24)

  • 🎯 修正本地音频 ASR 调用方式,改为 flash recognize API 所需的 JSON + base64 请求体
  • 🔧 新增 ASR_RESOURCE_ID 环境变量支持,默认适配本地文件极速识别场景
  • 🗣️ 明确桌面清洁版支持本地 OGG/Opus 音频识别
  • 📝 同步 SKILL.md 描述与实际实现,避免文档与代码不一致

V2.0.0 (2026-03-23)

  • 🔒 安全重构:移除所有硬编码密钥,改为环境变量
  • 🗑️ 删除 shell 脚本(send.sh / install.sh)
  • 🐍 纯 Python 实现:使用 requests 替代 curl
  • 🛡️ 增加安全限制:输入验证、文件类型检查、长度限制
  • 📝 重写 SKILL.md:明确声明执行模式和安全边界
  • 🧹 使用 tempfile 替代固定路径
  • 🔑 ASR/TTS 密钥分离
  • 💾 Feishu token 缓存
  • ⏱️ 动态音频时长计算
  • 🔒 ffmpeg 安全声明
  • 📝 文档降调,减少营销感

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

90.33%
按下载量换算2,110

安全审计

VirusTotal

通过

ClawScan

通过

Static analysis

通过

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills