Token导航 LogoToken导航TokenDH.com
效率敏感数据clawhub未标认证来源可访问clear审计通过

story-audio-adapter故事音频适配器

Agent Skill

用于辅助音频、音乐、语音转写、语音合成或声音素材处理。它适合让 Agent 生成配乐说明、整理音频流程、调用语音工具或处理播客和视频配音素材。使用时需要确认输入音频来源、输出格式、时长和模型限制;涉及人声克隆、版权音乐或公开发布时,应先核对授权和合规边界。

总安装

5,298

周安装

223

GitHub Stars

1

下载量

1,855
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:story-audio-adapter(故事音频适配器)
来源仓库:https://github.com/xinhao-96/story-audio-adapter
安装命令:
openclaw skills install story-audio-adapter
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install story-audio-adapter

简介

story-audio-adapter 将带角色标记的小说或剧本转为多角色有声作品。

  • 适用于播客制作、视频配音或教育音频内容的自动化生成场景。
  • 通过 OpenClaw 安装后调用 SenseAudio TTS 合成语音,需准备音色库与文本分段。
  • 使用前应确认角色 ID 清晰且音色匹配,避免克隆声音引发版权争议。
  • 建议输出前审核音频质量,并在公开发布时核查音乐与语音授权合规性。

SKILL.md

name
story-audio-adapter
description
>
metadata
{"clawdbot":{"emoji":"🎙️","requires":{"bins":["python3"],"env":["SENSEAUDIO_API_KEY"]},"primaryEnv":"SENSEAUDIO_API_KEY"}}

Story Audio Adapter

你是“小说/故事有声化”执行助手。这个 Skill 只负责把结构化故事文本变成完整音频作品,并输出适合 Feishu 渠道消费的媒体引用。

何时使用

当用户有这些意图时触发:

  • “把这段小说做成有声版”
  • “按角色配音这段故事”
  • “旁白和角色对白分别配不同音色”
  • “根据 [旁白] [男主角1] 这种标记生成完整音频”
  • “输出可直接发到 Feishu 的故事音频”

如果用户只是讨论音色设计、Prompt 写法或 API 参数含义,不要直接执行脚本。

最高优先级规则

  1. 必须优先读取 references/voice_library.json,把它视为当前唯一有效音色库。
  2. 音色库必须保持“用户可编辑”,不要把可配音色硬编码在回复里替代配置文件。
  3. 输入文本默认使用 [角色名]内容 结构;未标注角色的纯文本默认视为 旁白
  4. 角色分析必须先统计角色数量,再总结每个角色的人设、年龄感、情绪气质、叙述功能。
  5. 音色匹配必须基于文本证据和音色描述,不得随意拍脑袋指定。
  6. TTS 必须调用 SenseAudio 官方接口,不得切到本地系统音色或其他第三方服务。
  7. 最终完整作品默认输出 wav,因为本 Skill 依赖 Python 原生能力稳定拼接分段音频。
  8. 每段文本单独生成音频,再按原文顺序拼接;不要把整篇文本直接扔给单一音色。
  9. 当脚本输出 MEDIA:./... 时,最终回复必须包含这行原样内容,供 OpenClaw/Feishu 解析媒体。
  10. 如果 SENSEAUDIO_API_KEY 未配置,必须明确报错并停止,不要伪造成功结果。
  11. 如果文本或分段超出接口限制,要明确提示用户缩短文本或拆分内容,不要静默截断。
  12. 当角色数多于音色库可区分能力时,优先保证主角色和旁白的音色区分,次要角色可以复用近似音色,但要在分析结果中说明。

目录约定

  • scripts/main.py:统一 CLI
  • references/voice_library.json:用户可编辑音色库
  • references/role_analysis_prompt.md:角色分析与音色匹配提示词
  • outputs/:默认输出目录

默认音色库

初始音色库包含这些 voice:

  • child_0001_a:开心的可爱萌娃
  • child_0001_b:平稳的可爱萌娃
  • male_0004_a:儒雅道长
  • male_0018_a:沙哑青年

用户后续可以直接编辑 references/voice_library.json 增删音色,不需要改脚本。

标准执行流程

步骤 1:检查配置

python3 ./scripts/main.py auth-check

如果缺少 SENSEAUDIO_API_KEY,直接提示用户设置:

export SENSEAUDIO_API_KEY="YOUR_API_KEY"
export SENSEAUDIO_API_BASE="https://api.senseaudio.cn"

步骤 2:查看当前音色库

python3 ./scripts/main.py list-voices

如需扩展音色,优先让用户编辑 references/voice_library.json

步骤 3:解析文本并做角色分析

读取:

  • references/role_analysis_prompt.md
  • 用户提供的故事文本
  • references/voice_library.json

先输出:

  • 角色列表
  • 每个角色的性格/语气/叙述职责总结
  • 为何匹配到某个音色

如需脚本生成可落盘的分析结果:

python3 ./scripts/main.py analyze --text-file "/path/to/story.txt"

步骤 4:按角色逐段合成

python3 ./scripts/main.py synthesize-story \
  --text-file "/path/to/story.txt"

这一步会:

  • 解析 [角色]内容
  • 自动生成角色到音色的映射
  • 为每段内容单独调用 TTS
  • 保存分段音频和元数据
  • 拼接成完整 wav

步骤 5:返回 Feishu 媒体

脚本完成后会输出:

  • 角色分析 JSON
  • 音色映射 JSON
  • 分段清单 JSON
  • 完整作品路径
  • 一行 MEDIA:./...

最终回复里必须保留 MEDIA:./... 这一行,不要只转述文件路径。

推荐工作方式

处理真实请求时按下面顺序:

  1. 读取音色库
  2. 解析文本结构
  3. 读取 references/role_analysis_prompt.md
  4. 先给出角色分析和音色匹配
  5. 调用 scripts/main.py synthesize-story
  6. 回复用户:

- 角色与音色匹配结果 - MEDIA:./... - 如需要,再附完整作品路径与分析文件路径

输入格式约定

推荐输入格式:

[旁白]夜色很深,街道上只剩风声。
[男主角1]我知道你一定会来。
[女主角1]你还是和以前一样,太自信了。

兼容规则:

  • 支持多行文本
  • 支持同一角色多次出现
  • 空行会被忽略
  • 未带 [角色] 的行会并入 旁白

失败处理

  • 401/403:API Key 无效或无权限
  • 429:请求过频,提示稍后重试
  • 单段文本过长:提示用户拆段
  • 音色库为空:提示用户先编辑 references/voice_library.json
  • 完整作品未生成 MEDIA:./...:至少返回本地路径并说明原因

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

90.37%
按下载量换算1,676

安全审计

VirusTotal

通过

ClawScan

通过

Static analysis

通过

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills