pagebraid-mcp
pagebraid-mcp 是一个MCP服务器,用于在可以调用MCP工具但不提供本机PDF读取的代理中读取本地PDF文件。
它目前公开了一个工具: read_pdf.
需求
- 支持以下功能的MCP客户端
stdio服务器 npm在启动MCP服务器的计算机上可用- 如果你想使用多模式模型
auto或image_only,因为服务器可以返回页面图像 - 纯文本模型仍然可以使用
text_only
Codex配置
将服务器添加到 ~/.codex/config.toml:
[mcp_servers]
[mcp_servers.pagebraid]
command = "npx"
args = ["-y", "pagebraid-mcp"]如果您希望Codex启动本地构建,而不是 npx,使用:
[mcp_servers]
[mcp_servers.pagebraid]
command = "node"
args = ["
/dist/index.js"]对于本地构建,请使用以下内容准备项目:
npm install
npm run build其他MCP客户端
对于使用JSON的MCP客户端 stdio 服务器配置,等效设置为:
{
"mcpServers": {
"pagebraid": {
"command": "npx",
"args": ["-y", "pagebraid-mcp"]
}
}
}对于本地构建,将客户端指向已编译的条目:
{
"mcpServers": {
"pagebraid": {
"command": "node",
"args": ["
/dist/index.js"]
}
}
}替换 走自己的地方路。
型号和使用说明
- PDF路径必须在运行此MCP服务器的同一台计算机上可访问。
auto返回提取的文本和渲染的页面图像。image_only需要一个可以消费图像内容的模型。- 如果模型仅为文本,请使用
text_only.
工具
read_pdf
输入:
file_path:本地PDF路径mode:auto|text_only|image_onlypages:可选页面选择器
pages 仅支持以下格式:
"23":只读第23页"23-27":阅读第23至27页"23-":从第23页开始阅读,直到达到有效载荷预算或文档结束
行为:
auto返回文本和页面图像text_only仅返回文本image_only仅返回页面图像- 如果发生截断,响应将包括剩余的页面范围和建议的下一次调用
状态
- 主要为Codex构建和调试
- Claude Code可能会在客户端积极截断大型MCP工具的响应,因此其内置的文档/PDF工具通常是更好的选择
- 其他MCP客户端尚未经过测试
备注
- 缓存当前位于内存中,由以下键控
path + size + mtimeMs - 还没有OCR回退
- 实施说明:
docs/implementation-notes.md
