一个MCP服务器,帮助AI助手从实现机器人检测的网站获取文本内容,弥合了你在浏览器中能看到的内容与AI能访问的内容之间的差距。
此工具优化用于从实现机器人检测的网站低量检索文档和参考资料(仅限文本/HTML)。它未被设计或测试用于通用站点抓取或数据采集。
注意:该项目是在与Claude Sonnets 3.7和4.5合作下开发的,并使用了LLM Context。
# 安装 scrapling-fetch-mcp
uv tool install scrapling-fetch-mcp
# 安装浏览器二进制文件(必需 - 大型下载)
uvx --from scrapling-fetch-mcp scrapling install
重要:浏览器安装会下载数百MB的数据,必须在首次使用前完成。如果MCP服务器在首次使用时超时,浏览器可能仍在后台安装。等待几分钟后再次尝试。
将以下配置添加到你的Claude Desktop MCP设置中:
MacOS:~/Library/Application Support/Claude/claude_desktop_config.json
Windows:%APPDATA%\Claude\claude_desktop_config.json
{
"mcpServers": {
"scrapling-fetch": {
"command": "uvx",
"args": ["scrapling-fetch-mcp"]
}
}
}
更新配置后,请重启Claude Desktop。
此MCP服务器提供了两种工具,当您要求其获取网络内容时,Claude可以自动使用这些工具:
AI根据您的请求决定使用哪种工具。您只需自然地提问:
"你能获取 https://example.com/api 的文档吗?"
"找到该页面上所有关于'认证'的提及"
"从他们的主页获取安装说明"
这些工具支持三种级别的机器人检测绕过:
Claude默认以基础模式开始,并在需要时升级。
基于Scrapling构建,用于具有机器人检测绕过的网络抓取。
Apache 2.0