HULFT MCP Server 是一个基于AWS AI服务的文档处理服务器,提供文本提取、文档分类、字段提取等功能。
安装状态
已补齐
工具数量
11
GitHub Stars
0
命令预览
pip install pre-commit
HULFT MCP Server 是一个基于AWS AI服务的文档处理服务器,提供文本提取、文档分类、字段提取等功能。
安装状态
已补齐
工具数量
11
GitHub Stars
0
命令预览
pip install pre-commit
一个通用的MCP服务器,用于处理PDF文档中的文本内容,提取文本并分块,转换为带有LaTeX支持的Markdown格式。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
uv run python run.py --transport sse
一个基于自然语言命令控制浏览器的代理工具,支持多步骤任务、自动搜索、点击、滚动、截图、文本提取和总结等功能。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
python3 -m venv venv

mistral-ocr-mcp
Mistral OCR MCP服务器是一个基于Node.js/TypeScript的PDF OCR处理工具,支持从本地PDF、URL和图像中提取文本、表格和结构化数据,优化多语言文档处理。
安装状态
已补齐
工具数量
6
GitHub Stars
0
命令预览
npx mistral-ocr-mcp
MCP服务器,用于从PDF文件中提取文本,并支持通过Tesseract OCR从嵌入的图像中提取文本。
安装状态
已补齐
工具数量
1
GitHub Stars
0
命令预览
python -m venv venv
一个基于Model Context Protocol (MCP)的PDF文档阅读和分析服务,支持在VS Code中查看、提取文本、生成摘要和分析PDF内容。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
docker run --name pdf-reader-mcp -it pdf-reader-mcp
一个基于FastMCP的PDF文件阅读服务器,支持PDF文本提取、OCR识别和图像提取,提供内置的Web调试器以便测试。
安装状态
已补齐
工具数量
3
GitHub Stars
0
命令预览
pip install pymupdf mcp

@johangorter/mcp-pdf-server
一个基于Node.js的服务器,实现MCP协议,用于从PDF文件中提取纯文本,支持安全目录访问控制和字符限制。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
npx @johangorter/mcp-pdf-server /path/to/documents /path/to/pdfs
一个用于提取微信公众号文章纯文本(标题和正文)的最小实现工具,适用于需要快速获取文章内容的场景。
安装状态
已补齐
工具数量
1
GitHub Stars
0
命令预览
python server.py
一款基于本地LLM的PDF文本提取与聊天工具,支持PDF上传、文本提取、RAG增强检索和本地模型对话,无需API密钥或互联网连接。
安装状态
已补齐
工具数量
2
GitHub Stars
0
命令预览
uv run streamlit run app/main.py
一个基于PyPDFium2的PDF处理和分析服务,提供文本提取、元数据提取、搜索、页面操作、表格处理等功能。
安装状态
已补齐
工具数量
10
GitHub Stars
0
命令预览
python3 -m venv venv
一个基于MCP协议的Python工具,用于从PDF文件中提取和读取页面,适用于LM Studio等前端。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
pip install git+https://github.com/VadimDu/pdf-mcp-tool.git
一个用于读取PDF文件并提取文本内容的MCP服务器,支持页面范围指定和元数据检索。
安装状态
已补齐
工具数量
2
GitHub Stars
0
命令预览
pip install -r requirements.txt
MCP服务器提供的PDF工具,支持从PDF第一页提取文本和生成希伯来语文件名建议。
安装状态
已补齐
工具数量
1
GitHub Stars
0
命令预览
pip install -r requirements.txt
该服务通过PUG View和PUG Rest API为AI代理提供全面的化学数据检索功能,弥补了现有工具仅能获取部分PubChem数据的不足。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
uv run pubchem-mcp-sse
一个完整的、领域无关的框架,用于从PDF中提取高质量文本,将其存储在可搜索的向量数据库中,并通过模型上下文协议服务器提供AI助手集成。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
python -m venv venv
一个轻量级的文档处理服务,支持多种文档格式的文本提取和分析,适用于招标文件处理、文档元数据提取和验证。
安装状态
已补齐
工具数量
4
GitHub Stars
0
命令预览
pip install -r requirements.txt
Universal File Reader是一个MCP服务器,用于从PDF、CSV、Excel和图像文件中提取文本和结构化信息,支持自动选择处理器和OCR回退功能。
安装状态
已补齐
工具数量
3
GitHub Stars
0
命令预览
pip install -e .
提供网页文本内容提取和链接抓取功能的工具,适用于网页内容分析和数据处理。
安装状态
已补齐
工具数量
2
GitHub Stars
0
命令预览
pip install -e .
一个基于MCP协议的网站内容提取服务,能够从网页中提取可读文本和元数据,支持AI代理和大型语言模型集成。
安装状态
已补齐
工具数量
3
GitHub Stars
0
命令预览
uv run python -m server