帮助AI助手从受机器人保护的网站获取内容,使用Scrapling技术绕过自动化防护措施,返回干净的HTML或Markdown。
安装状态
已补齐
工具数量
2
GitHub Stars
85
命令预览
uvx --from git+https://github.com/cyberchitta/scrapling-fetch-mcp scrapling install
帮助AI助手从受机器人保护的网站获取内容,使用Scrapling技术绕过自动化防护措施,返回干净的HTML或Markdown。
安装状态
已补齐
工具数量
2
GitHub Stars
85
命令预览
uvx --from git+https://github.com/cyberchitta/scrapling-fetch-mcp scrapling install

playwright
MCP深度网络研究服务器是一个用于高级网络研究的模型上下文协议服务器,提供智能搜索队列、增强内容提取和深度研究能力。
安装状态
已补齐
工具数量
0
GitHub Stars
84
命令预览
npx playwright install chromium
Power your AI agents with Google Search–enhanced research via an open-source MCP server. Includes tools for Google Search, YouTube/web scraping, LLM-driven synthesis, persistent caching, and dual transport (STDIO + HTTP SSE) for efficient, flexible integration.
安装状态
已补齐
工具数量
8
GitHub Stars
35
命令预览
docker run -i --rm --env-file .env google-researcher-mcp
一个基于DuckDuckGo的MCP服务器,为LLM提供网页搜索和内容提取功能。
安装状态
已补齐
工具数量
0
GitHub Stars
16
命令预览
pip install -e .

@smithery/cli
A versatile MCP-compliant web content fetching tool that supports multiple modes (browser/node), formats (HTML/JSON/Markdown/Text), and intelligent proxy detection, with bilingual interface (English/Chinese).
安装状态
已补齐
工具数量
5
GitHub Stars
13
命令预览
npx -y @smithery/cli install @lmcc-dev/mult-fetch-mcp-server --client claude
一个基于Model Context Protocol (MCP)的浏览器自动化服务器,提供PDF生成、截图、内容提取、性能审计等全面的浏览器自动化功能。
安装状态
已补齐
工具数量
0
GitHub Stars
12
命令预览
docker run -p 3000:3000 ghcr.io/browserless/chromium
一个轻量级的MCP服务器,用于LLM编排,提供高效的网页内容搜索和提取功能。
安装状态
已补齐
工具数量
0
GitHub Stars
7
命令预览
Python is an easy to learn, powerful programming language...

mcp-fetch-node
A Model Context Protocol server that provides web content fetching capabilities.
安装状态
已补齐
工具数量
1
GitHub Stars
7
命令预览
npx -y mcp-fetch-node
一个基于Python的MCP网页爬虫工具,用于提取和保存网站内容,支持批量处理和可配置的输出目录。
安装状态
已补齐
工具数量
0
GitHub Stars
4
命令预览
pip install -r requirements.txt
一个基于Python和FastMCP的Mozilla Readability解析器服务器,用于提取和转换网页内容为干净的、适合LLM处理的Markdown格式。
安装状态
已补齐
工具数量
0
GitHub Stars
4
命令预览
python -m venv venv
Agent Scraper MCP Server是一款专业的网页抓取工具,提供网页内容提取、结构化数据抓取、截图等功能,适用于AI代理和自动化任务。
安装状态
已补齐
工具数量
6
GitHub Stars
3
命令预览
pip install -e ".[dev]"
DocNav是一个模型上下文协议(MCP)服务器,赋能LLM代理智能阅读、分析和管理长文档,模拟人类的理解和导航能力。
安装状态
已补齐
工具数量
8
GitHub Stars
3
命令预览
uv run server.py

mcp-server-scraper
一个无需API密钥的免费工具,用于从URL中提取干净的Markdown文本、链接和元数据,适用于文档、博客和文章的抓取。
安装状态
已补齐
工具数量
5
GitHub Stars
3
命令预览
npx mcp-server-scraper
一个实验性的MCP服务器,可将YouTube播放列表的转录文本提供使用,适用于需要快速获取视频内容转录的场景。
安装状态
已补齐
工具数量
0
GitHub Stars
3
命令预览
uv run server.py https://www.youtube.com/playlist?list=PLj6h78yzYM2MP0QhYFK8HOb8UqgbIkLMc
一个移除robots.txt检查的模型上下文协议服务器,提供网页内容抓取功能,将HTML转换为Markdown以便于处理。
安装状态
已补齐
工具数量
0
GitHub Stars
2
命令预览
uv run python -m mcp_fetch --help
一个基于Tavily搜索API的AI驱动网络搜索服务,支持HTTP/HTTPS代理配置,适用于需要通过代理服务器进行复杂网络搜索的场景。
安装状态
已补齐
工具数量
3
GitHub Stars
2
命令预览
pip install mcp-tavily-proxy
MCP WebScout是一个提供DuckDuckGo网络搜索和基于LLM的智能内容提取的服务,适用于需要高级网络数据抓取和分析的场景。
安装状态
已补齐
工具数量
2
GitHub Stars
2
命令预览
python -m venv .venv

@smithery/cli
一个强大的MCP服务器,提供网络搜索和相似内容查找功能,适用于需要网络搜索能力或基于查询查找相似内容的应用和项目。
安装状态
已补齐
工具数量
0
GitHub Stars
2
命令预览
npx -y @smithery/cli install @DeepSpringAI/parquet_mcp_server --client claude

playwright
MCP服务器通过Playwright从网页中提取干净的Markdown内容,适用于文档整理、内容分析和AI集成等场景。
安装状态
已补齐
工具数量
1
GitHub Stars
1
命令预览
npx playwright install chromium

@smithery/cli
一个用于高级网络研究的模型上下文协议(MCP)服务器,提供智能搜索队列、增强内容提取和深度研究能力。
安装状态
已补齐
工具数量
3
GitHub Stars
1
命令预览
npx -y @smithery/cli install @PedroDnT/mcp-deepwebresearch --client claude