Token导航 LogoToken导航TokenDH.com
Cs Crawler MCP logo
AI代理stdio官方级别未说明来源级核验

Cs Crawler MCP

MCP Server

一个基于Model Context Protocol (MCP)的网页爬虫服务,提供多种输出格式和元数据提取功能,适用于网页数据抓取和集成。

工具数

2

提示词数

0

GitHub Stars

0

资源数

0
数据抓取PythonClaudeClaude DesktopClaudeCursor

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

CoachSteff

提供方

CoachSteff

最后核验

2026/5/17 20:19

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

命令预览

pip install -r requirements.txt

详细介绍

CS爬行器MCP

一种模型上下文协议(MCP)服务器,通过crawl4ai库提供网络爬行功能。

特性

  • 具有多种输出格式的Web爬行
  • 元数据抽取
  • MCP集成
  • 轻松部署

快速开始

  1. 克隆存储库
  2. 安装依赖项: pip install -r requirements.txt
  3. 安装剧作家: python -m playwright install chromium
  4. 配置您的MCP客户端

安装

git clone https://github.com/CoachSteff/cs-crawler-mcp.git
cd cs-crawler-mcp
pip install -r requirements.txt
python -m playwright install chromium

本地配置

此项目使用本地 config.json (被git忽略)并发送a config.json.template.

cp config.json.template config.json
# Edit python_path and server_path to your environment

CI/测试将回落到 config.json.template 用于在以下情况下进行架构检查 config.json 缺席。

用法

添加到您的MCP客户端配置(Claude Desktop、Cursor等)。两种选择:

  • NPX(没有Python预安装,在第一次运行时自动引导本地venv):
{
  "mcpServers": {
    "cs-crawler": {
      "command": "npx",
      "args": ["-y", "github:CoachSteff/cs-crawler-mcp@main"],
      "env": {}
    }
  }
}
  • 直接Python入口点(之后 pip install -r requirements.txt):
{
  "mcpServers": {
    "cs-crawler": {
      "command": "python3",
      "args": ["/absolute/path/to/cs-crawler-mcp/server.py"],
      "env": {}
    }
  }
}

可用工具

  • crawl_url -抓取单个URL
  • get_metadata -提取页面元数据

许可证

MIT许可证-有关详细信息,请参阅许可证文件。

目录标签

目录标签

数据抓取PythonClaude网页爬虫本地部署元数据提取MCP集成

支持客户端

Claude DesktopClaudeCursor

接入字段

传输方式(transport,传输协议)

stdio

鉴权方式(authType,认证方式)

none

工具数量(toolCount,工具数)

2

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

stdionone部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

来源信息

继续浏览同类 MCP