Token导航 LogoToken导航TokenDH.com
效率敏感数据clawhub未标认证来源可访问clear审计提醒

volcengine-tts-feishuvolcengine tts 飞书

Agent Skill

volcengine-tts-feishu 用于补充效率相关能力,适合在 OpenClaw 中需要让 Agent 承接效率相关任务时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

4,704

周安装

227

GitHub Stars

1

下载量

1,648
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:volcengine-tts-feishu(volcengine tts 飞书)
来源仓库:https://github.com/raydoomed/volcengine-tts-feishu
安装命令:
openclaw skills install volcengine-tts-feishu
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install volcengine-tts-feishu

简介

火山引擎豆包语音合成模型2.0 TTS。支持多种音色、情感参数、SSML标记,生成高质量中文语音,支持一键发送飞书语音气泡。使用HTTP单向流式API,稳定可靠。

SKILL.md

name
volcengine-tts-feishu
description
火山引擎豆包语音合成模型2.0 TTS。支持多种音色、情感参数、SSML标记,生成高质量中文语音,支持一键发送飞书语音气泡。使用HTTP单向流式API,稳定可靠。

火山引擎豆包语音合成 TTS → 飞书语音

火山引擎官方豆包语音合成服务,支持 2.0 模型,多种情感控制、音色切换,支持SSML标记。集成飞书发送,合成后直接以语音气泡发送。

配置

火山引擎凭证

首次使用需要创建 ~/.openclaw/workspace/skills/volcengine-tts-feishu/config.json 存放你的凭证:

{
  "appid": "你的AppID",
  "access_token": "你的Access Token",
  "default_resource_id": "seed-tts-2.0",
  "default_voice": "zh_female_meilinvyou_uranus_bigtts",
  "default_emotion": "vocal-fry"
}

配置好默认值后,使用时可以省略参数,只传 --text。也可以每次命令行传入覆盖配置。

飞书发送

飞书AppID/AppSecret自动从 ~/.openclaw/openclaw.json 读取,OpenClaw已经配置好飞书的话不需要额外配置,直接用 --send-to <open_id> 即可发送语音气泡。

使用

单个脚本,通过 --send-to 参数控制是否发送飞书:

1. 仅生成MP3文件(不发送)

不加 --send-to → 只生成MP3保存到文件,不发送飞书:

cd ~/.openclaw/workspace/skills/volcengine-tts-feishu
source scripts/.venv/bin/activate

python scripts/http_tts.py \
  --appid <你的AppID> \
  --access_token <你的Access Token> \
  --resource_id seed-tts-2.0 \
  --voice_type zh_female_meilinvyou_uranus_bigtts \
  --emotion excited \
  --text "你好,欢迎使用火山引擎豆包语音合成。" \
  --output output.mp3

2. 合成后直接发送飞书语音气泡(一步到位)

加上 --send-to <open_id> → 自动完成全套流程:

  1. TTS合成MP3
  2. ffmpeg转Opus格式(飞书语音要求)
  3. 上传到飞书获取file_key
  4. 发送 msg_type: audio 语音气泡
cd ~/.openclaw/workspace/skills/volcengine-tts-feishu
source scripts/.venv/bin/activate

python scripts/http_tts.py \
  --appid <你的AppID> \
  --access_token <你的Access Token> \
  --resource_id seed-tts-2.0 \
  --voice_type zh_female_meilinvyou_uranus_bigtts \
  --emotion excited \
  --text "你好,欢迎使用火山引擎豆包语音合成。" \
  --send-to <open_id>

默认配置已经存在 `config.json` 中,使用时可以省略这些参数,只传 `--text` 和 `--send-to`。飞书配置自动从 `~/.openclaw/openclaw.json` 读取,不需要额外配置。

**使用经验:**
- 不需要叠加多个情感,单个 `emotion` 参数效果最佳
- **最关键断句停顿规则(最终确认):**
  - `...` 表示 **大喘气/长停顿**,只在真正需要换气的时候用
  - `,` 表示 **句间短停顿**,句子内部自然分隔用逗号
  - **完整语义必须连着放一起**,绝对不强行拆分完整语义
  - **能连着说就尽量连着说**,只有真的需要停下来大喘气才加 `...`
  - 不要过度碎分到单个字或每个词都停顿(会导致有气无力,像树懒一样慢吞吞)
  - 正常说话就是完整句子,用正常标点,根本不需要加省略号,自然合成就行
  - 省略号直接连写,不需要在气口之间加额外空格
- 不要在文本中添加朗读提示(如"用XX语气说"),模型会把提示也读出来
- 开启 `--send-to` 后自动完成全套流程:MP3合成 → Opus转换 → 上传飞书 → 发送语音气泡
- 使用 `--send-to` 时,临时MP3自动存放于系统临时目录,发送完成后自动清理,不会在技能目录残留文件
- 仅生成文件时,MP3保存到你指定的 `--output` 路径

**断句总结:**
- ❌ 错误:过度拆分每个词、每个短句都硬加省略号、拆分完整语义 → 都会导致慢吞吞像树懒
- ✅ 正确:`...` 只用在真正需要大喘气的地方,句子内部自然分隔用 `,`,完整语义连着不拆分

### 完整参数用法

cd ~/.openclaw/workspace/skills/volcengine-tts-feishu source scripts/.venv/bin/activate

python scripts/http_tts.py \ --appid <AppID> \ --access_token <Access Token> \ --resource_id seed-tts-2.0 \ --voice_type <音色ID> \ --emotion <情感> \ --text "要合成的文本" \ --output output.mp3 \ [--send-to <open_id>] # 直接发送飞书语音,可选


### 参数说明

| 参数 | 必填 | 说明 |
|------|------|------|
| `--appid` | 是 | 火山引擎AppID |
| `--access_token` | 是 | 火山引擎Access Token |
| `--voice_type` | 是 | 音色ID |
| `--text` | 是 | 要合成的文本 |
| `--output` | 是(仅生成文件时必填;发送飞书时会自动使用临时目录,不需要指定) | 输出MP3文件路径,发送飞书后自动清理 |
| `--sample_rate` | 否 | 采样率,默认 `24000` |
| `--format` | 否 | 格式 `mp3/pcm/ogg_opus`,默认 `mp3` |
| `--resource_id` | 否 | `seed-tts-1.0` / `seed-tts-2.0`,默认 `seed-tts-2.0` |
| `--emotion` | 否 | 情感参数,见下文 |
| `--emotion-scale` | 否 | 情感强度,范围 1~5,默认 `4`,越大情绪越明显 |

## 常用音色 (2.0模型)

| 音色ID | 说明 |
|--------|------|
| `zh_female_vv_uranus_bigtts` | Vivi 女 |
| `zh_female_meilinvyou_uranus_bigtts` | 魅力女友 女 |
| `zh_male_shuaiyuwen_uranus_bigtts` | 帅语文 男 |

完整音色列表:https://www.volcengine.com/docs/6561/1257544

## 情感参数

支持单情感参数,适合 2.0 模型:

| 参数值 | 说明 |
|--------|------|
| `happy` | 开心 |
| `sad` | 悲伤 |
| `angry` | 生气 |
| `surprised` | 惊讶 |
| `fear` | 恐惧 |
| `hate` | 厌恶 |
| ✨ `excited` | 激动 ✨ 默认 |
| `coldness` | 冷漠 |
| `neutral` | 中性 |
| `depressed` | 沮丧 |
| `lovey-dovey` | 撒娇 |
| `shy` | 害羞 |
| `comfort` | 安慰鼓励 |
| `tension` | 咆哮/焦急 |
| `tender` | 温柔 |
| ✨ `vocal-fry` | 低语/ASMR气泡音 ✨ |

## SSML支持

支持SSML标记控制音调、语速、情感,标记不会被读出:

<speak> <emotion category="lovey-dovey"> <semitones>降2度</semitones> <prosody rate="slow">你好,欢迎使用火山引擎豆包语音合成。</prosody> </emotion> </speak>


直接把SSML字符串传给 `--text` 参数即可。

## 依赖安装

首次使用需要创建虚拟环境并安装依赖:

cd ~/.openclaw/workspace/skills/volcengine-tts-feishu python3 -m venv scripts/.venv source scripts/.venv/bin/activate pip install -r requirements.txt


依赖:`requests`

## 系统依赖

发送飞书语音需要 `ffmpeg` 用来转格式(MP3 → Opus):

macOS

brew install ffmpeg

Ubuntu/Debian

sudo apt install ffmpeg

CentOS

sudo yum install ffmpeg


如果没有ffmpeg,`--send-to` 功能无法使用。只生成MP3不需要ffmpeg。

## 确认虚拟环境

每次运行前先激活虚拟环境:

cd ~/.openclaw/workspace/skills/volcengine-tts-feishu source scripts/.venv/bin/activate


确认是否在虚拟环境中:

which python


输出应该包含 `scripts/.venv/bin/python`,说明正确激活。

用完可以退出:

deactivate

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

85.14%
按下载量换算1,403

安全审计

VirusTotal

可疑

ClawScan

可疑

Static analysis

通过

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills