用于从PDF文件中提取内容的MCP服务器,并修复了Claude Code CLI安装的问题。
此分支包括安装和运行与Claude Code(CLI版本)相关的关键修复。
__main__.py - 允许通过 python -m pdf_extraction 命令作为模块运行包。claude mcp add 命令一起工作的安装过程。服务器实现了一个工具:
pdf_path 作为必需的字符串参数(本地文件路径)pages 作为可选的字符串参数(逗号分隔的页码,支持负索引如 -1 表示最后一页)claude 命令)# 克隆这个分支
git clone https://github.com/lh/mcp-pdf-extraction-server.git
cd mcp-pdf-extraction-server
# 在开发模式下安装
pip install -e .
# 检查pdf-extraction安装的位置
which pdf-extraction
# 示例输出: /opt/homebrew/Caskroom/miniconda/base/bin/pdf-extraction
# 使用上面的完整路径添加服务器
claude mcp add pdf-extraction /opt/homebrew/Caskroom/miniconda/base/bin/pdf-extraction
# 验证是否已添加
claude mcp list
# 启动一个新的Claude会话
claude
# 在Claude中键入:
/mcp
# 应该看到:
# MCP 服务器状态
# • pdf-extraction: 连接
连接后,你可以让Claude提取PDF内容:
"你能从 /path/to/document.pdf 中提取内容吗?"
"提取 /path/to/document.pdf 的第1-3页和最后一页"
ls -la $(which pdf-extraction)pdf-extraction如果你遇到Python导入错误:
claude mcp add pdf-extraction /path/to/python -m pdf_extraction如果 pip install -e . 失败:
python --versionpython -m venv venv
source venv/bin/activate # 在Windows上:venv\Scripts\activate
pip install -e .
此分支特别适用于Claude Code CLI。如果你使用的是Claude Desktop(GUI应用程序),请参阅原始仓库获取安装说明。
欢迎贡献!此分支的主要更改是添加了 __main__.py,使其可以作为模块运行。
同原始仓库。