MCP PDF Server 是一个基于 Model Context Protocol(MCP)的服务器,用于高效管理 PDF 文件。
该项目由嵌入式开发者创建,旨在使像 Cursor 这样的AI编码工具能够直接读取和总结PDF数据表文档,或者通过问答等方式使开发工作更加便捷。也就是说,其主要目的是支持AI快速理解PDF数据表的内容,并提供所需信息。
该项目包含两个主要组件:
主要功能:
通过 RESTful API 和 Web UI,可以轻松地与外部系统集成。该服务器既可以在 Docker 中部署,也可以在本地环境中轻松部署和运行。适用于各种 PDF 文档(如数据表、论文、合同等)的自动化管理和搜索。
/app/datasheets 下的 PDF 文件列表构建镜像
docker build -t mcp-pdf-server:1.0.0 .
运行容器
docker run -d \
-v /主机/路径/数据:/app/datasheets \
-p 5050:5050 \
-p 5080:5080 \
--name mcp-pdf-server \
mcp-pdf-server:1.0.0
/主机/路径/数据,则可在容器内部的 /app/datasheets 访问。使用 docker-compose
# 修改 docker-compose.yml 中的 /path/to/your/datasheets 为实际的 PDF 文件夹路径。
docker-compose up -d --build
安装依赖
pip install -r requirements.txt
启动服务器
python mcp_server/mcp_pdf_server.py
# 或者
uvicorn manager_server.main:app --host 0.0.0.0 --port 5080
read_local_pdf
接收本地 PDF 文件路径并提取文本。
read_url_pdf
接收 PDF 文件的 URL 并提取文本。
server_pdf_list
返回 /app/datasheets 下的所有 PDF 文件列表。
server_pdf_search
根据文件名搜索服务器上的 PDF 文件,并提取该 PDF 的文本。
/app/datasheets 路径(Docker 容器内)。/app/datasheets。/app/mcp_server(以容器内部为准)。Apache License 2.0
作者: Dev91