返回市场
MCP-PDF阅读器

MCP-PDF阅读器

作者:DeepSeekMine31 星标更新:2025-04-29

项目介绍

📄 MCP PDF Server

基于FastMCP的PDF文件阅读服务器。

支持通过MCP协议从PDF中提取文本、OCR识别和图像提取,并内置了一个Web调试器以方便测试。


🚀 功能特性

  • read_pdf_text
    逐页从PDF中提取普通文本。

  • read_by_ocr
    使用OCR识别扫描或基于图像的PDF中的文本。

  • read_pdf_images
    提取指定PDF页面中的所有图像(Base64编码输出)。


📂 项目结构

mcp-pdf-server/
├── pdf_resources/        # 上传和处理过的PDF文件目录
├── txt_server.py         # 主服务入口点
└── README.md             # 项目文档

⚙️ 安装

推荐Python版本:3.9+

pip install pymupdf mcp

注意:要使用OCR功能,可能需要一个带有OCR支持的MuPDF构建或外部OCR库。


🔦 启动服务器

运行以下命令:

python txt_server.py

你应该会看到如下日志:

正在提供服务 http://127.0.0.1:6231

🌐 Web调试界面

打开浏览器并访问:

http://127.0.0.1:6231
  • 从左侧面板选择工具
  • 在右侧面板填写参数
  • 点击“运行”来测试工具

无需编程——通过Web UI轻松调试和测试。


🛠️ API工具列表

工具描述输入参数返回值
read_pdf_text从PDF页面中提取普通文本file_path, start_page, end_page页面文本列表
read_by_ocr通过OCR识别文本file_path, start_page, end_page, language, dpiOCR提取的文本
read_pdf_images从PDF页面中提取图像file_path, page_number图像列表(Base64编码)

📝 示例用法

从第1页到第5页提取文本:

mcp run read_pdf_text --args '{"file_path": "pdf_resources/example.pdf", "start_page": 1, "end_page": 5}'

对第1页进行OCR识别:

mcp run read_by_ocr --args '{"file_path": "pdf_resources/example.pdf", "start_page": 1, "end_page": 1, "language": "eng"}'

从第3页提取所有图像:

mcp run read_pdf_images --args '{"file_path": "pdf_resources/example.pdf", "page_number": 3}'

📢 注意事项

  • 文件必须放置在pdf_resources/目录内,或者提供绝对路径。
  • OCR功能需要环境中有适当的OCR支持。
  • 处理大文件时,请根据需要调整内存和超时设置。

📜 许可证

本项目采用MIT许可证。 对于商业用途,请注明原始来源。 </中文翻译>