Token导航 LogoToken导航TokenDH.com
效率敏感数据clawhub未标认证来源可访问clear审计提醒

day253-volcengine-ai-audio-ttsday253 volcengine ai 音频 tts

Agent Skill

用于辅助音频、音乐、语音转写、语音合成或声音素材处理。它适合让 Agent 生成配乐说明、整理音频流程、调用语音工具或处理播客和视频配音素材。使用时需要确认输入音频来源、输出格式、时长和模型限制;涉及人声克隆、版权音乐或公开发布时,应先核对授权和合规边界。

总安装

10,772

周安装

458

GitHub Stars

1

下载量

3,774
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:day253-volcengine-ai-audio-tts(day253 volcengine ai 音频 tts)
来源仓库:https://github.com/day253/day253-volcengine-ai-audio-tts
安装命令:
openclaw skills install day253-volcengine-ai-audio-tts
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install day253-volcengine-ai-audio-tts

简介

day253-volcengine-ai-audio-tts 基于字节跳动语音服务实现文本转语音。

  • 适用于多语言旁白、语音选择与 TTS 模板生成。
  • 支持自定义音色与语速调整。
  • 安装命令为 openclaw skills install day253-volcengine-ai-audio-tts。
  • 需注意版权合规与人声克隆的使用边界。

SKILL.md

name
volcengine-ai-audio-tts
description
Text-to-speech generation on Volcengine (ByteDance) speech services. Use when users need narration, multi-language speech output, voice selection, or TTS troubleshooting. Supports online one-shot HTTP API (openspeech.bytedance.com).

Category: provider

Volcengine 语音合成 TTS

Validation

mkdir -p output/volcengine-ai-audio-tts
python -m py_compile skills/ai/audio/volcengine-ai-audio-tts/scripts/generate_tts.py && echo "py_compile_ok" > output/volcengine-ai-audio-tts/validate.txt

Pass criteria: command exits 0 and output/volcengine-ai-audio-tts/validate.txt is generated.

Output And Evidence

  • Save generated audio files, request payloads, and response metadata to output/volcengine-ai-audio-tts/.
  • Keep one validation log per execution.

Prerequisites

  • Python 3.8+. No extra SDK required (uses requests and stdlib).
  • Install: pip install requests
  • Set environment variables (from Volcengine 豆包语音控制台):

- VOLCENGINE_TTS_APP_ID — 应用 ID - VOLCENGINE_TTS_TOKEN — 应用 Token(用于 Authorization: Bearer;${token}) - VOLCENGINE_TTS_CLUSTER — 业务集群,如 volcano_tts(标准音色)

Optional: use .env in repo root or script directory; script will load them.

Normalized interface (tts.generate)

Request

  • text (string, required) — 合成文本,UTF-8,单次建议 ≤1024 字节
  • voice_type (string, required) — 音色,见 发音人参数列表,如 BV700_streaming
  • encoding (string, optional) — 编码格式:pcm | wav | mp3 | ogg_opus,默认 mp3
  • rate (int, optional) — 采样率 8000/16000/24000,默认 24000
  • speed_ratio (float, optional) — 语速 [0.2, 3],默认 1.0
  • volume_ratio (float, optional) — 音量 [0.1, 3],默认 1.0
  • pitch_ratio (float, optional) — 音高 [0.1, 3],默认 1.0
  • language (string, optional) — 语言,如 cn

Response

  • audio_path (string) — 本地保存的音频文件路径
  • sample_rate (int)
  • format (string)
  • duration_ms (string, when returned by API)
  • code (int) — 3000 表示成功

Quick start (Python script)

# 使用内联 JSON 请求
python skills/ai/audio/volcengine-ai-audio-tts/scripts/generate_tts.py \
  --request '{"text":"你好,这是一段测试语音。","voice_type":"BV700_streaming"}' \
  --output output/volcengine-ai-audio-tts/audio/out.mp3

# 使用请求文件
python skills/ai/audio/volcengine-ai-audio-tts/scripts/generate_tts.py \
  --file request.json \
  --output output/volcengine-ai-audio-tts/audio/out.wav \
  --print-response

Operational guidance

  • 每次请求的 reqid 需唯一,脚本内使用 UUID。
  • 长文本请分段多次调用或使用异步长文本接口。
  • 音色与 cluster 需与控制台一致;复刻音色使用 speaker id 作为 voice_type
  • 遇 429 请降低并发或增加间隔。

Output location

  • Default output: output/volcengine-ai-audio-tts/audio/
  • Override base dir with OUTPUT_DIR.

Workflow

1) Confirm user intent, text, voice, and output format. 2) Run one minimal request to verify credentials and cluster/voice_type. 3) Execute the target synthesis with explicit parameters. 4) Verify results and save output/evidence files.

References

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

70.78%
按下载量换算2,671

安全审计

VirusTotal

通过

ClawScan

可疑

Static analysis

未展示

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills