基于FastMCP的PDF工具,适用于LLM/智能体前端(如LM-Studio)
一个Python工具,允许大型语言模型(LLMs)从PDF文件中提取并读取页面 MCP协议设计用于与前端(如)配合使用 LM Studio(注:此处为保持原样,若需具体含义翻译,可为“语言模型工作室”或根据具体上下文调整)。
✅ 特点
- 从PDF的特定页面范围中提取文本
- 可选择将提取的页面保存为新的PDF文件
- 使用Pydantic方案进行输入验证
- 通过MCP协议与LM Studio无缝协作
🚀 安装
直接从GitHub安装:
pip install git+https://github.com/VadimDu/pdf-mcp-tool.git或者以开发模式安装:
git clone https://github.com/VadimDu/pdf-mcp-tool.git
cd pdf-tool
pip install -e .🛠 测试
在LLM/agent实际使用前,对这个mcp工具进行测试:
python -m pdf_tool.pdf_tool_mcp_server或者
fastmcp run pdf_tool/pdf_tool_mcp_server.py如果一切正常,你应该会看到类似这样的信息: [date time] INFO Starting MCP server 'PDF-tool' with transport 'stdio'
🎉 在LM Studio中的使用
在你的(内容/列表/计划等)中添加以下内容 mcp.json 文件:
{
"pdf-tool": {
"command": "python",
"args": [
"-m",
"pdf_tool.pdf_tool_mcp_server"
]
}
}