OCR MCP中的文本
英语| 中文
OCR MCP服务器中的文本
TextIn MCP Server是一个用于提取文本和对文档执行OCR的工具,包括文档文本识别、ID识别和发票识别。它还支持将文档转换为Markdown格式。
工具
recognition_text
- 图像、Word文档和PDF文件的文本识别。 - 输入: - path (字符串,必填): file path 或 a URL (HTTP/HTTPS) pointing to a document - 返回:文档的文本。 - 支持以下转换: - 可移植文档格式 - 图像(Jpeg、Jpg、Png、Bmp)
doc_to_markdown
- 将图像、PDF和Word文档转换为Markdown。 - 输入: - path (字符串,必填): file path 或 a URL (HTTP/HTTPS) pointing to a document - 返回:文档的Markdown。 - 支持以下转换: - 可移植文档格式 - Microsoft Office文档(Word、Excel) - 图像(Jpeg、Jpg、Png、Bmp)
general_information_extration
- 自动识别和提取文档中的信息,或识别和提取用户指定的信息。 - 输入: - path (字符串,必填): file path 或 a URL (HTTP/HTTPS) pointing to a document - key (string\[\],可选):用户想要识别的非表格文本信息,输入格式是字符串数组。 - table_header (string\[\],可选):用户想要识别的表信息,输入格式是字符串数组。 - 返回:关键信息JSON。 - 支持以下转换: - 可移植文档格式 - Microsoft Office文档(Word、Excel) - 图像(Jpeg、Jpg、Png、Bmp)
当输入是URL时,它不支持处理对受保护资源的访问。
设置
APP_ID和APP_SECRET
点击 这里 注册TextIn帐户。
按照说明获取APP_ID和APP_SECRET中的文本 这里.
NPX
{
"mcpServers": {
"textin-ocr": {
"command": "npx",
"args": [
"-y",
"@intsig/server-textin"
],
"env": {
"APP_ID": "",
"APP_SECRET": "",
"MCP_SERVER_REQUEST_TIMEOUT": "600000"
},
"timeout": 600
}
}
}许可证
此MCP服务器根据MIT许可证获得许可。这意味着您可以根据MIT许可证的条款和条件自由使用、修改和分发软件。有关更多详细信息,请参阅项目存储库中的LICENSE文件。
