Token导航 LogoToken导航TokenDH.com
gobbler (Enablement Engineering) logo
文档知识未说明官方级别未说明来源级核验

gobbler (Enablement Engineering)

MCP Server

Gobbler是一款将各种内容(如YouTube视频、网页、文档、音频文件等)转换为结构化Markdown的工具,适用于AI系统处理。

工具数

0

提示词数

0

GitHub Stars

3

资源数

0
多格式支持PythonClaude自动化处理Claude DesktopClaudeCursorWindsurf

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

Enablement-Engineering

提供方

Enablement-Engineering

最后核验

2026/5/17 20:21

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

详细介绍

贪吃者

面向AI的通用内容转换为Markdown

Gobbler将任何内容(YouTube视频、网页、文档、音频文件,甚至实时浏览器会话)转换为干净、结构化的标记,人工智能系统可以立即对其进行推理。

![License: MIT](https://opensource.org/licenses/MIT) ![Python 3.11+](https://www.python.org/downloads/)

问题

人工智能助手在降价时工作得最好。但内容以无数种格式存在——PDF、视频、登录后的网页、录音。将内容转换为AI可以使用的格式需要:

  • 每种内容类型都有不同的工具
  • 用于提取和格式化的自定义脚本
  • 元数据丢失和输出不一致
  • AI代理没有统一的方式访问内容

Gobbler解决了这个问题。 一个工具,一种输出格式,多种访问模式。

解决方案

# Every content type → Same pattern → Same output format
gobbler youtube "https://youtube.com/watch?v=..." -o transcript.md
gobbler document report.pdf -o report.md
gobbler audio meeting.mp3 -o meeting.md
gobbler webpage "https://docs.example.com" -o docs.md

每次转换都会产生 使用YAML frontmatter标记:

---
source: https://youtube.com/watch?v=VIDEO_ID
type: youtube_transcript
title: "Video Title"
duration: 847
word_count: 2341
converted_at: 2025-01-03T10:30:00Z
---

# Video Title

Content here, ready for AI consumption...

快速开始

# Install
git clone https://github.com/Enablement-Engineering/gobbler.git
cd gobbler && make install

# Start services (for web/document conversion)
make start-docker

# Convert content
gobbler youtube "https://youtube.com/watch?v=dQw4w9WgXcQ"
gobbler document paper.pdf --no-ocr -o paper.md
gobbler audio interview.mp3 --model small -o interview.md

📖 全部文件

使用Gobbler的三种方法

1.CLI(用于人和脚本)

gobbler youtube URL              # YouTube transcripts
gobbler audio FILE               # Audio/video transcription
gobbler document FILE            # PDF, DOCX, PPTX, XLSX
gobbler webpage URL              # Web pages (JS-rendered)
gobbler batch youtube-playlist URL  # Batch processing

2.技能(针对AI代理)

技能是markdown指令文件(SKILL.md)教AI代理如何使用 gobbler CLI。兼容:

skills/
├── gobbler-youtube/     # 📺 YouTube transcription
├── gobbler-audio/       # 🎙️ Audio/video transcription  
├── gobbler-document/    # 📄 Document conversion (PDF, DOCX, PPTX, XLSX)
├── gobbler-webpage/     # 🌐 Web scraping with JS rendering
├── gobbler-browser/     # 🔌 Browser automation + AI chat integrations
├── gobbler-setup/       # 🔧 Installation and troubleshooting
└── gobbler-utils/       # 📦 Batch processing utilities

每项技能包括 OpenClaw兼容元数据 对于自动依赖性检查:

metadata:
  openclaw:
    emoji: 📺
    requires:
      bins: [gobbler]  # CLI tools that must be installed
    install:
      - id: gobbler
        kind: script
        label: Install Gobbler
        script: |
          git clone https://github.com/Enablement-Engineering/gobbler.git
          cd gobbler && uv sync && uv tool install .

使用OpenClaw:

# Copy skills to your OpenClaw workspace
cp -r skills/* ~/.openclaw/skills/

# Or symlink for development
ln -s $(pwd)/skills/* ~/.openclaw/skills/

使用克劳德代码:

# Add skills directory to CLAUDE.md or workspace instructions
echo "Skills available in ./skills/" >> CLAUDE.md

gobbler-browser 技能包括NotebookLM、Claude.ai、ChatGPT和Gemini的集成(DOM自动化-可能会因网站更新而中断)。

技能使用 渐进式披露--代理仅在启动时加载技能元数据,然后在触发时读取完整的CLI指令。

3.MCP协议(适用于AI编码助手)

# For Claude Code
claude mcp add gobbler-mcp -- uv --directory /path/to/gobbler run gobbler-mcp
// For OpenCode (opencode.json)
{
  "mcp": {
    "gobbler": {
      "type": "local",
      "command": ["uv", "--directory", "/path/to/gobbler", "run", "gobbler-mcp"]
    }
  }
}
// For Claude Desktop (~/.config/claude/claude_desktop_config.json)
{
  "mcpServers": {
    "gobbler-mcp": {
      "command": "uv",
      "args": ["--directory", "/path/to/gobbler", "run", "gobbler-mcp"]
    }
  }
}

特性

内容转换

类型命令后端
油管 gobbler youtube URLyoutube转录api
音频/视频gobbler audio FILE更快的耳语(本地)
文件gobbler document FILE文档(Docker)
网页gobbler webpage URLCrawl4AI(Docker)

浏览器自动化

通过Gobbler扩展控制浏览器以获取经过身份验证的内容:

gobbler browser extract          # Extract current page
gobbler notebooklm query "..."   # Query NotebookLM
gobbler chatgpt query "..."      # Send to ChatGPT
gobbler claude query "..."       # Send to Claude.ai
gobbler gemini query "..."       # Send to Gemini

设置:

  1. 在Chrome中加载扩展程序:

- 首选 chrome://extensions/ - 启用“开发人员模式” - 点击“加载解包”→ 选择 browser-extension/ 文件夹

  1. 创建一个名为的选项卡组 “小家伙” (右键单击任何选项卡→ 添加到组→ 新组)
  1. 将要控制的选项卡添加到Gobbler组

只有“Gobbler”组中的选项卡是可访问的——这可以防止意外访问敏感选项卡。

批处理

gobbler batch youtube-playlist "https://youtube.com/playlist?list=..."
gobbler batch directory ./documents --pattern "*.pdf"
gobbler batch webpages urls.txt --output-dir ./pages

建筑

Gobbler提供了三个接口,它们都使用相同的CLI和后端:

┌─────────────────────────────────────────────────────────────┐
│                     Your Automations                        │
└──────────────┬──────────────┬──────────────┬───────────────┘
               │              │              │
      ┌────────▼────┐  ┌──────▼─────┐  ┌─────▼─────┐
      │   Skills    │  │  gobbler   │  │    MCP    │
      │(CLI instrs) │  │    CLI     │  │  Server   │
      └────────┬────┘  └──────┬─────┘  └─────┬─────┘
               │              │              │
               └──────────────┼──────────────┘
                              ▼
                    ┌─────────────────┐
                    │  Provider Layer │
                    │  (Converters)   │
                    └────────┬────────┘
                             │
         ┌───────────────────┼───────────────────┐
         ▼                   ▼                   ▼
    ┌─────────┐        ┌───────────┐       ┌─────────┐
    │ Whisper │        │  Docling  │       │Crawl4AI │
    │ (local) │        │ (Docker)  │       │(Docker) │
    └─────────┘        └───────────┘       └─────────┘

技能 是教导Claude运行哪些CLI命令的markdown文件。 主控程序 公开了与Claude Desktop/Code工具相同的功能。

安装

先决条件

  • Python 3.11+
  • 紫外线 (Python包管理器)
  • Docker桌面(用于web/文档转换)
  • ffmpeg(用于从视频中提取音频)

安装

# Install uv (if not already installed)
curl -LsSf https://astral.sh/uv/install.sh | sh

# Clone and install
git clone https://github.com/Enablement-Engineering/gobbler.git
cd gobbler
make install

# Start Docker services
make start-docker

# Verify
gobbler --version

没有Docker怎么办

  • YouTube文字记录 -直接使用YouTube的API
  • 音频转录 -使用本地Whisper模型

Docker需要什么

  • 文档转换 -文档服务(端口5001)
  • 网络抓取 -Crawl4AI服务(端口11235)

配置

配置文件: ~/.config/gobbler/config.yaml

services:
  docling: "http://localhost:5001"
  crawl4ai: "http://localhost:11235"

storage:
  type: "sqlite"
  path: "~/.config/gobbler/jobs.db"

logging:
  level: "INFO"

故障排除

文档转换崩溃

# Use --no-ocr for digital PDFs (faster, less memory)
gobbler document file.pdf --no-ocr -o output.md

服务没有响应

docker compose up -d
docker compose ps
curl http://localhost:5001/health   # Docling
curl http://localhost:11235/health  # Crawl4AI

YouTube“IP被屏蔽”

# Set up TranscriptAPI.com for reliable access
export TRANSCRIPTAPI_KEY=your_key
gobbler youtube "URL"

狼吞虎咽的设置技巧 以完成故障排除。

项目结构

gobbler/
├── src/
│   ├── gobbler_cli/       # CLI interface (typer)
│   ├── gobbler_core/      # Converters & utilities
│   ├── gobbler_mcp/       # MCP protocol server
│   ├── gobbler_relay/     # Browser extension bridge
│   └── gobbler_queue/     # Background job queue
├── skills/                # AI agent instruction files
├── browser-extension/     # Chrome/Firefox extension
└── docker-compose.yml     # External services

文档

📖 全部文件 -安装、配置和使用指南

关键页面:

许可证

MIT许可证-请参阅 许可证 文件。

致谢

建在巨人的肩膀上:

目录标签

目录标签

多格式支持PythonClaude自动化处理内容转换本地部署Markdown生成AI数据处理

支持客户端

Claude DesktopClaudeCursorWindsurf

接入字段

传输方式(transport,传输协议)

未说明

鉴权方式(authType,认证方式)

none

工具数量(toolCount,工具数)

0

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

未说明none部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

仍需确认:installCommand

来源信息

继续浏览同类 MCP