Token导航 LogoToken导航TokenDH.com
研究检索需要联网clawhub未标认证来源可访问clear审计提醒

video-transcript-extractor视频转录提取器

Agent Skill

用于辅助视频生成、动画合成、脚本化剪辑或 Remotion 等视频项目开发。它适合让 Agent 组织镜头、生成素材说明、维护合成代码或排查渲染问题。使用时需要确认分辨率、时长、素材路径和导出格式;涉及外部素材、人物肖像或商业发布时,应先核对版权授权和内容审核要求。

总安装

2,822

周安装

120

GitHub Stars

公开资料未说明

下载量

989
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:video-transcript-extractor(视频转录提取器)
来源仓库:https://github.com/huajianjiu000/video-transcript-extractor
安装命令:
openclaw skills install video-transcript-extractor
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install video-transcript-extractor

简介

从 TikTok、YouTube、Bilibili 等 20+ 平台提取音视频文本,支持多级字幕轨道策略。

  • 适合研究、舆情分析、多语种内容调研和自动化信息抓取任务。
  • 提供视频 URL 或文件,系统自动识别并提取带时间戳的转录文本,支持导出多种格式。
  • 仅限合法授权内容,禁止用于爬取受保护数据;部分平台可能限制访问频率,请注意合规性。
  • video-transcript-extractor 属于研究检索类 Skill,可作为该场景下的辅助能力补充。

SKILL.md

name
video-transcript-extractor
version
1.0.0
description
|
tags
["video", "transcript", "extraction", "speech-recognition", "youtube", "tiktok", "bilibili", "content-creation"]

Video Transcript Extractor

🎬 Extract text from videos and audio with multi-platform support

Skill Overview

This skill helps AI Agents extract text content from various video and audio platforms, supporting 20+ platforms including Douyin, Bilibili, Xiaohongshu, Weibo, WeChat Video, TikTok, YouTube, and Instagram. With multi-level extraction strategy (subtitle track → speech recognition → AI correction), it ensures 95%+ accuracy.

Core Capabilities

  • Multi-platform Support: Douyin, Kuaishou, Bilibili, Xiaohongshu, Weibo, WeChat Video, TikTok, YouTube and 20+ more
  • Smart Extraction: Prioritizes native subtitles (100% accuracy), uses ASR + AI correction when needed
  • Audio Separation: Automatically identifies and extracts background music info
  • Batch Processing: Support batch extraction for multiple video links
  • Multi-language: Chinese, English, Japanese, Korean and 100+ languages

Trigger Keywords

  • /extract-transcript
  • /video-to-text
  • /transcript-extraction
  • /video-subtitle-extract
  • /audio-to-text
  • /extract-video-text

How to Use

Basic Usage

Provide a video link, and the Agent automatically identifies the platform and extracts the transcript:

User: Extract transcript from: https://v.douyin.com/xxxxx
Agent: Extracting video transcript...
     Video Title: xxx
     Duration: 3m 25s
     
     【Transcript Content】
     (Full extracted transcript)
     
     【Background Music】
     Song: xxx
     Artist: xxx

Parameters

ParameterRequiredDescription
video_urlYesVideo share link
extract_audioNoWhether to extract audio, default false
auto_correctNoWhether to enable AI correction, default true

Supported Platforms

PlatformShare Link FormatSubtitleAudio
Douyinhttps://v.douyin.com/xxx
Kuaishouhttps://v.kuaishou.com/xxx
Bilibilihttps://b23.tv/xxx or BV号
Xiaohongshuhttps://www.xiaohongshu.com/xxx
Weibohttps://weibo.com/xxx
WeChat VideoVideo account link
TikTokhttps://tiktok.com/@xxx/video/xxx
YouTubehttps://youtube.com/xxx

Extraction Strategy

Strategy 1: Subtitle Track (Highest Priority)

Prioritize native subtitles from video:

  1. Extract CC subtitles/official subtitles
  2. Extract user-uploaded subtitle files
  3. Return original text if subtitles available

Strategy 2: Speech Recognition

Use ASR when no subtitles:

  1. Separate video/audio streams
  2. Call ASR API to recognize speech
  3. Return timestamp-to-text mapping

Strategy 3: AI Correction

Intelligent correction after recognition:

  1. Fix obvious typos
  2. Optimize punctuation
  3. Complement colloquial expressions
  4. Output complete, fluent transcript

Output Format

## Video Information
- Title: xxx
- Platform: YouTube
- Duration: 3m 25s
- Published: 2024-01-15
- Author: @xxx

## Transcript Content
(Complete transcript, ready for copy-paste)

## Timeline
- 00:00 - Opening Introduction
- 00:15 - Core Content Begins
- 01:30 - Case Analysis
- 03:00 - Summary

## Background Music
- Song: xxx
- Artist: xxx
- Music Link: https://...

Usage Examples

Example 1: Extract YouTube Video Transcript

User: Extract this video transcript: https://youtube.com/watch?v=xxx
Agent: Extracting YouTube video transcript...
     ✅ Extraction successful!
     
     Video Title: Future Trends in AI Agents
     Duration: 5m 12s
     
     【Transcript Content】
     Hello everyone, today we're going to talk about the future of AI agents...
     (Full transcript ~2000 words)

Example 2: Extract TikTok Video

User: Extract this TikTok transcript: https://tiktok.com/@user/video/xxx
Agent: Extracting TikTok video transcript...
     ✅ Extraction successful!
     
     Video Title: Quick makeup tutorial
     Subtitle Type: Auto-generated subtitles
     Accuracy: 98%
     
     【Transcript Content】
     (Full transcript content)

Example 3: Batch Extraction

User: Batch extract these video transcripts:
1. https://youtube.com/xxx1
2. https://tiktok.com/xxx2
3. https://instagram.com/xxx3

Agent: Batch extracting...
     ✅ Batch extraction complete!
     
     | # | Platform | Title | Status | Words |
     |---|----------|-------|--------|-------|
     | 1 | YouTube | AI Tutorial | ✅ Success | 1234 |
     | 2 | TikTok | Coding Tips | ✅ Success | 856 |
     | 3 | Instagram | Travel Vlog | ✅ Success | 542 |

Technical Implementation

API Call Flow

1. Parse video link → Get real URL and platform type
2. Call platform API → Get video info and subtitles/audio
3. Format conversion → Output as standard Markdown
4. AI correction (optional) → Improve accuracy
5. Return result → Display to user

API Endpoints Reference

PlatformAPI EndpointNotes
YouTube/api/v1/youtube/web/fetch_one_videoTikHub API
TikTok/api/v1/tiktok/web/fetch_one_videoTikHub API
Douyin/api/v1/douyin/web/fetch_one_video_by_share_urlTikHub API
Bilibili/api/v1/bilibili/web/fetch_one_videoRequires BV number

Audio Processing

  • Prioritize music.play_url field for pure audio
  • Fallback to video.play_addr field
  • Duration is in milliseconds, divide by 1000 for seconds

Notes

  1. Subtitle Priority: Native subtitles are prioritized for 100% accuracy
  2. Link Format: Supports both share links and direct links
  3. Copyright Notice: Extracted content is for learning reference only
  4. Long Video: Videos over 10 minutes should be extracted in segments
  5. Network Issues: Retry or manually provide subtitle files if needed

Use Cases

  • 📝 Content Creators: Quickly get viral video transcripts for reference
  • 🔍 Market Research: Analyze competitor video content strategies
  • 📚 Knowledge Organization: Convert video content to text notes
  • 🤖 AI Training: Collect corpus data
  • 📱 Social Sharing: Share core video content with friends

Changelog

v1.0.0 (2024-01-20)

  • Initial release
  • Support for YouTube, TikTok, Instagram, Douyin and more
  • Subtitle track priority extraction strategy
  • AI intelligent correction support

Author Info

  • Author: AI Agent Helper
  • Version: 1.0.0
  • Framework: OpenClaw

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

94.72%
按下载量换算937

安全审计

VirusTotal

通过

ClawScan

可疑

Static analysis

通过

权限和风险

需要联网

该 Skill 可能需要联网访问来源站点、仓库或外部 API;具体网络访问范围需要结合源码和 README 复核。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills