Token导航 LogoToken导航TokenDH.com
Pdfbox MCP logo
文档知识未说明官方级别未说明来源级核验

Pdfbox MCP

MCP Server

基于Apache PDFBox的PDF处理服务,提供文本提取、元数据获取和页面计数功能。

工具数

3

提示词数

0

GitHub Stars

0

资源数

0
PDF处理文本提取Java元数据管理

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

amannm

提供方

amannm

最后核验

2026/5/17 20:22

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

详细介绍

PDFBox MCP服务器

使用Apache PDFBox提供PDF处理功能的模型上下文协议(MCP)服务器。

特性

  • 提取文本 -使用可选的页面范围支持从PDF文件中提取文本内容
  • 获取元数据 -提取PDF元数据(标题、作者、创建日期等)
  • get_page_count -获取PDF文件中的总页数

依赖项

  • Java 17+
  • Apache PDFBox 3.0.5
  • MCP SDK 0.10.0
  • Maven用于构建管理

用法

构建项目:

mvn compile

运行服务器:

mvn exec:java

工具

提取文本

从PDF文件中提取文本内容。

参数:

  • file_path (必填):PDF文件的路径
  • page_range (可选):页面范围(例如“1-5”或“全部”)

获取元数据

从PDF文件中提取元数据,包括标题、作者、创建日期等。

参数:

  • file_path (必填):PDF文件的路径

get_page_count

获取PDF文件中的页数。

参数:

  • file_path (必填):PDF文件的路径

状态

目前正在开发中。实现了核心功能,但编译需要对MCP SDK API进行调整。

目录标签

目录标签

PDF处理文本提取Java元数据管理本地部署文档分析

接入字段

传输方式(transport,传输协议)

未说明

鉴权方式(authType,认证方式)

none

工具数量(toolCount,工具数)

3

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

未说明none部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

仍需确认:installCommand

来源信息

继续浏览同类 MCP