Token导航 LogoToken导航TokenDH.com
webscrapemcpserver logo
运维云端未说明官方级别未说明来源级核验

webscrapemcpserver

MCP Server

一个基于Node.js的网页爬虫服务,支持配置爬取深度、请求延迟等参数,适用于数据采集和内容分析。

工具数

1

提示词数

0

GitHub Stars

1

资源数

0
JavaScript自动化本地部署

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

jitsmaster

提供方

jitsmaster

最后核验

2026/5/17 20:21

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

详细介绍

Web爬虫MCP服务器部署指南

先决条件

  • Node.js(v18+)
  • npm(v9+)

安装

  1. 克隆存储库:
   git clone https://github.com/jitsmaster/web-crawler-mcp.git
   cd web-crawler-mcp
  1. 安装依赖项:
   npm install
  1. 构建项目:
   npm run build

配置

创建一个 .env 包含以下环境变量的文件:

CRAWL_LINKS=false
MAX_DEPTH=3
REQUEST_DELAY=1000
TIMEOUT=5000
MAX_CONCURRENT=5

运行服务器

启动MCP服务器:

npm start

MCP配置

将以下内容添加到MCP设置文件中:

{
  "mcpServers": {
    "web-crawler": {
      "command": "node",
      "args": ["/path/to/web-crawler/build/index.js"],
      "env": {
        "CRAWL_LINKS": "false",
        "MAX_DEPTH": "3",
        "REQUEST_DELAY": "1000",
        "TIMEOUT": "5000",
        "MAX_CONCURRENT": "5"
      }
    }
  }
}

用法

服务器提供 crawl 可以通过MCP访问的工具。示例用法:

{
  "url": "https://example.com",
  "depth": 1
}

配置选项

环境变量默认值描述
CRAWL_LINKSfalse是否关注链接
MAX_DEPTH3最大爬行深度
REQUEST_DELAY1000请求之间的延迟(毫秒)
超时5000请求超时(毫秒)
MAX_CONCURRENT5最大并发请求数

目录标签

目录标签

JavaScript自动化本地部署网页爬虫数据采集Node.js自动化工具

接入字段

传输方式(transport,传输协议)

未说明

鉴权方式(authType,认证方式)

none

工具数量(toolCount,工具数)

1

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

未说明none部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

仍需确认:installCommand

来源信息

继续浏览同类 MCP