Token导航 LogoToken导航TokenDH.com
研究检索需要联网clawhub未标认证来源可访问clear审计提醒

bilibili-summarizerbilibili 总结者

Agent Skill

bilibili-summarizer 用于查找、检索和筛选相关信息,适合在 OpenClaw 中需要根据关键词、任务场景或来源线索快速定位候选结果时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

5,990

周安装

240

GitHub Stars

1

下载量

1,939
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:bilibili-summarizer(bilibili 总结者)
来源仓库:https://github.com/zhangligong0826/bilibili-summarizer
安装命令:
openclaw skills install bilibili-summarizer
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install bilibili-summarizer

简介

当用户分享视频链接(Bilibili/B站、抖音/抖音、YouTube、小红书/小红书)并要求提取字幕、总结视频时,应使用此技能。

SKILL.md

name
bilibili-summarizer
description
This skill should be used when the user shares a video link (Bilibili/B站, Douyin/抖音, YouTube, Xiaohongshu/小红书) and asks to extract subtitles, summarize the video content, or evaluate its information density. Also supports local video files. Trigger phrases include 总结这个B站视频, 提取字幕, bilibili链接, BV号, 信息密度, 帮我看这个视频, 语音转字幕, 字幕管理, 字幕收藏, 抖音视频总结, 总结抖音, 总结YouTube, 总结小红书, 视频字幕, or any message containing a bilibili.com, douyin.com, youtube.com, xiaohongshu.com, or xhslink.com URL, or a video file path (.mp4/.mkv/.mov).

视频字幕提取与总结技能(B站 + 抖音 + YouTube + 小红书 + 本地文件)

技能概述

从 B站、抖音、YouTube、小红书视频及本地视频文件提取字幕(支持 API 字幕 + AI 语音识别双通道),生成结构化总结与信息密度评分,并提供弹幕分析、关键帧截图、说话人分离、SRT 字幕导出等高级功能。

支持的平台

平台API字幕ASR语音识别总结评分弹幕分析链接格式
B站bilibili.com/video/BVxxxBVxxx
抖音douyin.com/video/xxxv.douyin.com/xxx
YouTubeyoutube.com/watch?v=xxxyoutu.be/xxx
小红书xiaohongshu.com/explore/xxxxhslink.com/xxx
本地文件/path/to/video.mp4

v3.0 新增功能

  • 一键流程 (pipeline.py) — 自动完成全部步骤,Agent 只需调一次
  • 批量处理 — 支持多个链接同时处理
  • B站收藏夹/合集 — 自动提取收藏夹内所有视频
  • 本地视频文件 — 直接拖入本地 mp4/mkv/mov 文件
  • YouTube 支持 — yt-dlp 下载音频 + ASR 识别
  • 小红书支持 — yt-dlp 下载音频 + ASR 识别 + 网页信息提取
  • SRT 字幕导出 — 标准字幕格式,可导入任意播放器
  • 说话人分离 — 识别多人对话(FunASR SD 模型)
  • 弹幕分析 — 词频统计、密度图、高赞弹幕(仅B站)
  • 关键帧截图 — 固定间隔或场景切换检测

脚本清单

所有脚本位于 ~/.workbuddy/skills/bilibili-summarizer/scripts/

脚本功能依赖
pipeline.py⭐ 一键流程(推荐使用)yt-dlp, ffmpeg, FunASR/Whisper
video_fetcher.py提取视频信息 + API 字幕(B站/抖音/YouTube/小红书)Python 标准库 / yt-dlp
video_audio.py下载/提取视频音频(B站/抖音/YouTube/小红书/本地)yt-dlp, ffmpeg
speech_to_text.py语音转文字(ASR + 说话人分离 + SRT导出)FunASR 或 Whisper
danmaku_analyzer.pyB站弹幕分析(词频/密度/热评)Python 标准库
frame_extractor.py关键帧截图(间隔/场景检测)ffmpeg
subtitle_manager.py字幕收藏管理Python 标准库
bilibili_fetcher.pyB站专用(向后兼容)Python 标准库
bilibili_audio.pyB站专用(向后兼容)yt-dlp, ffmpeg

⭐ 推荐使用:一键流程(pipeline.py)

单个视频

python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/pipeline.py "https://www.bilibili.com/video/BVxxxx"
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/pipeline.py "https://v.douyin.com/xxx"
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/pipeline.py "https://youtube.com/watch?v=xxx"
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/pipeline.py "https://www.xiaohongshu.com/explore/xxx"
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/pipeline.py "/path/to/local_video.mp4"

批量处理

# 多个链接空格分隔
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/pipeline.py "链接1" "链接2" "链接3"

# B站收藏夹
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/pipeline.py --collection "https://space.bilibili.com/xxx/favlist?fid=xxx"

可选功能

# 导出 SRT 字幕
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/pipeline.py "链接" --format srt

# 提取关键帧截图
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/pipeline.py "链接" --frames

# 弹幕分析(仅B站)
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/pipeline.py "链接" --danmaku

# 说话人分离
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/pipeline.py "链接" --diarize

# 全部功能
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/pipeline.py "链接" --all

分步使用(高级场景)

第一步:尝试提取 API 字幕(B站)

python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/video_fetcher.py "B站链接或BV号"

输出 JSON,包含 info(视频信息)和 subtitle(字幕内容)。

  • subtitle.status 为「已提取」且 subtitle.plain_text 有内容,直接进入第四步(总结 + 评分)
  • 若「无字幕」或「下载失败」,进入第二步
  • 抖音/YouTube/本地文件:直接跳到第二步

第二步:下载/提取音频

# 在线视频(B站/抖音/YouTube)
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/video_audio.py "视频链接"

# 本地视频文件
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/video_audio.py "/path/to/video.mp4"

第三步:语音转文字(增强版)

# 基本识别
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/speech_to_text.py "音频文件路径"

# 导出 SRT 字幕格式
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/speech_to_text.py "音频文件路径" --format srt

# 说话人分离(仅 FunASR)
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/speech_to_text.py "音频文件路径" --diarize

说话人分离输出示例:

[00:15][说话人0] 今天我们聊聊人工智能的发展
[00:32][说话人1] 我觉得AI最大的问题是可控性
[01:05][说话人0] 对,这个观点我同意

第四步:生成结构化总结

根据提取到的字幕(API 或 ASR)和视频信息,按以下模板输出。

重要: Agent 必须利用自身知识库,对视频作者和视频中提到的关键人物进行背景调查和分析,帮助用户判断视频的信息可信度和价值。

## 📺 视频总结

**标题:** {title}
**作者:** {owner}
**平台:** B站 / 抖音 / YouTube / 小红书 / 本地文件
**时长:** {duration}
**标签:** {tags}
**字幕来源:** API字幕 / ASR语音识别({engine})

---

### 👤 作者背景
(根据作者名称和视频内容,搜索/回忆该作者的背景信息:
- 身份/职业(如:某领域专家、自媒体博主、企业高管、学者等)
- 知名度和影响力(粉丝量级、行业地位)
- 擅长领域/内容方向
- 历史争议或口碑
- 可信度评估:🔴 低 / 🟡 中 / 🟢 高,并说明原因)

### 🧑 视频主人公/关键人物
(视频中重点讲述的人物,如果与作者是同一人则标注"即作者"并合并说明。
多人则分别列出,每人包含:
- 姓名/称呼
- 身份/职业
- 与视频主题的关系
- 可信度评估:🔴 低 / 🟡 中 / 🟢 高,并说明原因
- 值得关注的点(如:是否有利益相关、是否有权威背书等))

### 🎯 核心主题
(一句话概括视频核心讲了什么)

### 📋 内容大纲
(按视频时间线列出 3-7 个关键节点,格式:[MM:SS] 主题)

### 💡 核心观点 / 关键信息
(提炼 3-5 条最有价值的结论或知识点)

### 🔑 关键词
(5-10 个关键词)

背景调查规则:

  • 优先利用 Agent 自身知识库中关于该作者/人物的信息
  • 如果无法确认背景,明确标注"⚠️ 未能确认该作者/人物背景,建议自行搜索核实"
  • 不要编造或猜测未知的背景信息
  • 对涉及医疗、法律、金融等敏感领域的观点,必须额外标注可信度警告

第五步:信息密度评分

信息密度 = 单位时间内传递的有效知识/信息量,满分 10 分。

评分维度:

维度说明权重
语速密度字符数 / 时长(秒),值越高越密集20%
知识含量是否包含数据、概念、方法、案例30%
逻辑结构内容是否有清晰的论点-论据结构20%
冗余度重复、闲聊、过渡语比例(越低越好)15%
实用性观看后能直接应用的比例15%

输出格式:

---

## 📊 信息密度评分

**综合评分:X.X / 10** ⭐⭐⭐⭐⭐

| 维度 | 评分 | 说明 |
|------|------|------|
| 语速密度 | X/10 | ... |
| 知识含量 | X/10 | ... |
| 逻辑结构 | X/10 | ... |
| 冗余度   | X/10 | ... |
| 实用性   | X/10 | ... |

**评分说明:** (为何得这个分,适合什么类型的观众)
**观看建议:** (正常速度 / 1.5x / 2x,或跳过某些章节)

第六步:高级分析(可选)

弹幕分析(仅B站)

# 基本弹幕分析(词频 + 密度 + 热评)
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/danmaku_analyzer.py "B站链接或BV号"

# 仅高频词
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/danmaku_analyzer.py "BV号" --top-words 20

# 弹幕密度图
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/danmaku_analyzer.py "BV号" --density

弹幕分析可以补充到总结中:

### 📊 弹幕分析

**弹幕总数:** XXXX 条
**高频关键词:** 关键词1(xxx次)、关键词2(xxx次)、...
**高潮片段:** 05:30-06:00(弹幕密度最高)
**观众热评:**
- [03:45] "这个观点太精辟了"
- [08:12] "原来如此,终于明白了"

关键帧截图

# 每30秒一张
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/frame_extractor.py "视频链接"

# 场景切换检测
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/frame_extractor.py "视频链接" --scene-detect

# 自定义间隔和数量
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/frame_extractor.py "链接" --interval 60 --max-frames 30

第七步:字幕收藏管理(可选)

用户可将字幕存入本地收藏库,后续统一管理。

# 添加字幕(从 pipeline 输出的 JSON 导入)
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/subtitle_manager.py add --json-file result.json

# 列出所有字幕
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/subtitle_manager.py list

# 导出为 Markdown / SRT
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/subtitle_manager.py export --format md --output ~/Desktop/字幕合集.md

# 搜索字幕内容
python3 ~/.workbuddy/skills/bilibili-summarizer/scripts/subtitle_manager.py search "关键词"

字幕数据库存储位置:~/.workbuddy/skills/bilibili-summarizer/cache/subtitles.json


完整处理流程图

用户输入(链接/本地文件/收藏夹URL)
        │
        ▼
  pipeline.py 一键流程
        │
  输入类型检测
  ╱    │    ╲    ╲    ╲
B站  抖音  YouTube 小红书 本地
  │    │    │    │
  │ video_fetcher.py
  │ 获取视频信息 + API 字幕
  │    │    │    │
  │ 有字幕?  │    │
  │ ╱    ╲   │    │
  │ 是     否  │    │
  │ │      │   │    │
  │ │ video_audio.py / extract_from_local
  │ │ 下载/提取音频
  │ │      │   │    │
  │ │ speech_to_text.py
  │ │ ASR 语音识别
  │ │ [--diarize] 说话人分离
  │ │ [--format srt] SRT导出
  │ │      │   │    │
  │ └──┬───┘───┘────┘
  │    │
  │ [--danmaku] 弹幕分析(仅B站)
  │ [--frames] 关键帧截图
  │    │
  │    ▼
  │  生成总结 + 信息密度评分
  │    │
  │    ▼
  │  subtitle_manager.py(可选)
  │  保存 / 管理 / 导出
  │
  └── 多视频批量处理循环

依赖安装

# 必须安装
brew install yt-dlp ffmpeg

# ASR 引擎(选一个)
pip install funasr modelscope torch torchaudio   # 推荐:FunASR(中文最优)
pip install openai-whisper                        # 备选:Whisper(通用)

注意事项

  • B 站 API 无需 Cookie 即可访问大部分公开视频信息
  • B 站 API 字幕依赖 UP 主上传或 B 站 AI 字幕
  • 抖音/YouTube/小红书 无公开字幕 API,通过 ASR 语音识别获取字幕
  • 抖音短链接(v.douyin.com)会自动解析为实际链接
  • YouTube 视频信息通过 yt-dlp 获取(无需 API Key)
  • 小红书短链接(xhslink.com)会自动解析为实际链接
  • 小红书视频信息通过网页解析获取,部分反爬策略可能导致偶尔失败
  • 说话人分离需要 FunASR SD 模型(cam++),首次会额外下载
  • 语音识别准确率约为 95%,建议以总结为主,不要逐字引用
  • 关键帧截图的在线视频需要临时下载(仅视频流,不含音频)
  • 弹幕分析依赖 B 站 API,可能因反爬策略偶尔失败
  • 付费/会员专属视频的音频可能无法下载

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

87.21%
按下载量换算1,691

安全审计

VirusTotal

通过

ClawScan

可疑

Static analysis

通过

权限和风险

需要联网

该 Skill 可能需要联网访问来源站点、仓库或外部 API;具体网络访问范围需要结合源码和 README 复核。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills