Token导航 LogoToken导航TokenDH.com
Media Crawler MCP Server logo
浏览器工具stdio官方级别未说明来源级核验

Media Crawler MCP Server

MCP Server

MediaCrawler_MCP_Server是一个基于Python的媒体爬虫服务,支持通过关键词、视频ID或创作者ID爬取多个媒体平台的数据,并将数据存储到MySQL、JSON或CSV等格式中。

工具数

0

提示词数

0

GitHub Stars

37

资源数

0
Python自动化浏览器自动化

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

Bowenwin

提供方

Bowenwin

最后核验

2026/5/17 20:21

运行时

Python

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

命令预览

uv run playwright install

详细介绍

🔥 MediaCrawler_MCP_Server - MCP for MediaCrawler 🕷️

🔗 MediaCrawler仓库地址

🔧 基于MediaCrawler改进

  • python版本:所有包版本可用于python 3.13,以支持mcp的使用
  • mysql存储:如表已经存在,初始化不会覆盖原有数据

✨ 更多设置(config)可见MediaCrawler仓库

🧰 可使用的MCP工具

  1. crawl_search(platform: str, store_type: str, keywords: str) - Start the crawler for the media platform by keywords
  2. crawl_detail(platform: str, store_type: str, video_id: list): - Start the crawler for the media platform by video ID
  3. crawl_creator(platform: str, store_type: str, creator_id: list) - Start the crawler for the media platform by creator id.

📦 Python包安装

# 进入项目目录
cd MediaCrawler_MCP_Server

# 使用 uv sync 命令来保证 python 版本和相关依赖包的一致性
uv sync

🌐 浏览器驱动安装

# 安装浏览器驱动
uv run playwright install

⚙️ 设置

设置环境变量:

MYSQL_DB_HOST=localhost     # Database host
MYSQL_DB_PORT=3306         # Optional: Database port (defaults to 3306 if not specified)
MYSQL_DB_USER=your_username
MYSQL_DB_PWD=your_password
MYSQL_DB_NAME=your_database
CRAWLER_MAX_NOTES_COUNT=20 # number of notes you want to crawl
MAX_CONCURRENCY_NUM=1 # number of concurrent crawlers
ENABLE_GET_COMMENTS=true # crawl the comments or not

🚀 使用

添加至 claude_desktop_config.json or cline_mcp_settings.json

"mediacrawler": {
      "disabled": false,
      "timeout": 600,
      "type": "stdio",
      "command": "uv",
      "args": [
        "--directory",
        "path/to/MediaCrawler_MCP_Server",
        "run",
        "main.py"
      ],
      "env": {
        "MYSQL_DB_HOST": "localhost",
        "MYSQL_DB_PORT": "3306",
        "MYSQL_DB_USER": "your_username",
        "MYSQL_DB_NAME": "your_database",
        "MYSQL_DB_PWD": "your_password",
        "CRAWLER_MAX_NOTES_COUNT": "20",
        "MAX_CONCURRENCY_NUM": "1",
        "ENABLE_GET_COMMENTS": "true"
      }
  }

🌰 例子

  1. 帮我爬取b站视频资料,关键词为"钱",存储模式为mysql。
  2. 帮我爬取b站视频号为BV1d54y1g7db,BV1Sz4y1U77N的视频存储模式为json。
  3. 帮我爬取b站up主视频资料,其id为20813884,存储模式为csv。

目录标签

目录标签

Python自动化浏览器自动化媒体爬虫本地部署数据采集Python工具MySQL存储

接入字段

传输方式(transport,传输协议)

stdio

鉴权方式(authType,认证方式)

none

运行时(runtime,运行环境)

Python

工具数量(toolCount,工具数)

0

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

stdionone部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

来源信息

继续浏览同类 MCP