一个模型上下文协议(MCP)服务器,提供从PDF文件中读取和提取文本内容的工具,支持本地文件和URL。
Philip Van de Walker
邮箱:philip.vandewalker@gmail.com
GitHub:https://github.com/trafflux
git clone https://github.com/trafflux/pdf-reader-mcp.git
cd pdf-reader-mcp
docker build -t mcp/pdf-reader .
要运行服务器并访问本地PDF文件:
docker run -i --rm -v /path/to/pdfs:/pdfs mcp/pdf-reader
将/path/to/pdfs替换为实际的PDF文件目录路径。
如果不使用本地PDF文件:
docker run -i --rm mcp/pdf-reader
添加到您的MCP设置配置中:
{
"mcpServers": {
"pdf-reader": {
"command": "docker",
"args": [
"run",
"-i",
"--rm",
"-v",
"/path/to/pdfs:/pdfs",
"mcp/pdf-reader"
],
"disabled": false,
"autoApprove": []
}
}
}
不使用本地PDF文件:
{
"mcpServers": {
"pdf-reader": {
"command": "docker",
"args": ["run", "-i", "--rm", "mcp/pdf-reader"],
"disabled": false,
"autoApprove": []
}
}
}
read_local_pdf
{
"path": "/pdfs/document.pdf"
}
{
"success": true,
"data": {
"text": "提取的内容..."
}
}
read_pdf_url
{
"url": "https://example.com/document.pdf"
}
{
"success": true,
"data": {
"text": "提取的内容..."
}
}
服务器处理各种错误情况,并给出清晰的错误信息:
错误响应遵循以下格式:
{
"success": false,
"error": "详细的错误消息"
}
.
├── Dockerfile # 容器配置
├── README.md # 本文档
├── requirements.txt # Python依赖项
└── src/
├── __init__.py # 包初始化
└── server.py # 主服务器实现
版权所有 2_0_2_5 Philip Van de Walker
根据Apache许可证,版本2.0(“许可证”)获得许可; 除非符合许可证,否则不得使用此文件。 您可以通过以下网址获得许可证副本:
http://www.apache.org/licenses/LICENSE-2.0
除非适用法律要求或书面同意,否则根据许可证分发的软件 按“原样”分发,不附带任何形式的保证或条件, 无论是明示还是暗示。有关具体管理权限和限制的细则,请参阅许可证。
欢迎贡献!请随时提交拉取请求。
对于问题、问题或贡献,请联系Philip Van de Walker: