MCP服务器提供网页爬取功能,支持多种内容格式输出(HTML、JSON、PDF、截图、Markdown)和浏览器交互特性,适用于数据采集和内容分析场景。
安装状态
已补齐
工具数量
6
GitHub Stars
0
命令预览
python launch_server.py
MCP服务器提供网页爬取功能,支持多种内容格式输出(HTML、JSON、PDF、截图、Markdown)和浏览器交互特性,适用于数据采集和内容分析场景。
安装状态
已补齐
工具数量
6
GitHub Stars
0
命令预览
python launch_server.py
CSToolbox是ChatSpeed的扩展工具包,通过MCP协议提供网络搜索、网页内容爬取和图表生成等功能。它支持多种搜索引擎,能够从网页中提取结构化内容,并快速生成各种数据可视化图表。此外,还提供PDF文档处理和文本内容提取功能。适用于需要自动化网络搜索、数据抓取和可视化的开发者和数据分析师。
GitHub Stars
0
该工具集成了Firecrawl的网页爬取能力与Cursor MCP服务器,通过改进网页内容处理来增强AI辅助功能。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
pip install -r requirements.txt
这是一个可以爬取阅读网页内容的工具,主要面向百度网页,链接以https://www.baidu.com/bh开头,适用于需要获取阅读网页内容的场景。
工具数量
0
GitHub Stars
0
一个用于抓取、爬取和分析网页的服务器工具,支持29种功能,包括SEO审计、内容提取、性能检查和跟踪审计等。
工具数量
29
GitHub Stars
0
Firecrawl Server for MCP是一个提供网页爬取和内容抓取功能的Express API服务器,适用于需要批量处理URL或爬取整个网站的场景。
工具数量
4
GitHub Stars
0
Firecrawl MCP Server是一个基于Docker的多架构网络爬虫服务器,提供网页抓取和爬取功能,适用于数据采集和自动化任务。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
docker run -d \

@smithery/cli
Firecrawl MCP Server是一个集成了Firecrawl的模型上下文协议服务器,提供网页爬取、搜索、内容提取和深度研究等功能,适用于数据采集和分析场景。
安装状态
已补齐
工具数量
8
GitHub Stars
0
命令预览
npx -y @smithery/cli install @mendableai/mcp-server-firecrawl --client claude

@smithery/cli
Firecrawl MCP Server 是一个集成了网页爬取、内容提取和搜索功能的模型上下文协议服务器,适用于数据采集和深度研究场景。
安装状态
已补齐
工具数量
8
GitHub Stars
0
命令预览
npx -y @smithery/cli install @mendableai/mcp-server-firecrawl --client claude
一个提供断链检查功能的MCP服务器,支持流式HTTP传输,适用于AI助手检查URL、扫描网页和爬取整个网站的断链。
安装状态
已补齐
工具数量
4
GitHub Stars
0
命令预览
docker run -p 3000:3000 broken-link-checker-mcp
Crawl4AI RAG MCP Server是一个集成网页爬取和检索增强生成(RAG)功能的服务,专为AI代理和AI编程助手设计,支持高级网页爬取、内容存储和智能检索。
安装状态
已补齐
工具数量
9
GitHub Stars
0
命令预览
pip install uv
Crawl4AI RAG MCP服务器是一个集成了网页爬取和检索增强生成(RAG)功能的工具,旨在为AI代理和AI编程助手提供高级的网页内容抓取和知识检索能力。
安装状态
已补齐
工具数量
5
GitHub Stars
0
命令预览
pip install uv
MCP-reader是一个用于网页抓取和爬行的服务器,通过真实浏览器操作,并通过artifact offloading技术保持LLM上下文的小型化,适用于数据提取和管理的场景。
工具数量
10
GitHub Stars
0
一个展示多个模型上下文协议(MCP)服务器与AWS Bedrock协同工作的演示项目,包括数学计算、天气信息和网页爬取功能。
安装状态
已补齐
工具数量
7
GitHub Stars
0
命令预览
python client.py
一个通过MCP协议暴露雅虎日本实时推文搜索功能的服务,无需API密钥,采用网页爬取技术实现。
工具数量
1
GitHub Stars
0
一个基于Python的Monorepo项目,探索模型上下文协议(MCP)并集成Crawl4AI的网页爬取功能,适用于内容抓取和数据处理。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
uv run python -c "from crawling.client import fetch_markdown_sync; print(fetch_markdown_sync...
一个用于管理和通过Docker Compose启动多个MCP服务器的工具,支持多种功能如Web搜索、文本转换、浏览器操作和网页爬取。
工具数量
0
GitHub Stars
0
Perplexity MCP Server是一个基于Docker的多架构AI网络搜索和研究服务器,支持HTTP和SSE协议,适用于开发和研究场景。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
docker run -d \
使用Playwright MCP和LLM调用的端到端网页爬取工作流,用于提取和解析房地产列表页面的数据,并导出为Excel文件。
工具数量
0
GitHub Stars
0
一个基于Python的服务器,集成了网页爬取和Google日历管理功能,适用于自动化数据收集和日程管理。
安装状态
已补齐
工具数量
5
GitHub Stars
0
命令预览
pip install requests beautifulsoup4 crawl4ai fastmcp google-api-python-client google-auth-oa...