这是一个用于 Scraper.is 的 Model Context Protocol (MCP) 集成 —— 一个强大的网络爬取工具,适用于AI助手。
此包允许AI助手通过MCP协议进行网络内容爬取,使它们能够访问来自网络的最新信息。
npm install -g scraperis-mcp
或者使用yarn:
yarn global add scraperis-mcp
你需要一个Scraper.is API密钥来使用此包。
创建一个包含您的Scraper.is API密钥的.env文件:
SCRAPERIS_API_KEY=your_api_key_here
要使用此包与Claude Desktop:
全局安装该包:
npm install -g scraperis-mcp
向您的claude_desktop_config.json文件添加以下配置:
{
"mcpServers": {
"scraperis_scraper": {
"command": "scraperis-mcp",
"args": [],
"env": {
"SCRAPERIS_API_KEY": "your-api-key-here",
"DEBUG": "*"
}
}
}
}
将your-api-key-here替换为您实际的Scraper.is API密钥。
重启Claude Desktop以应用更改。
对于开发和测试,您可以使用MCP Inspector:
npx @modelcontextprotocol/inspector scraperis-mcp
此包旨在与支持模型上下文协议(MCP)的AI助手一起使用。当正确配置时,AI助手可以使用以下工具:
scrape工具允许AI从网站中提取内容。它支持各种格式:
markdown: 返回markdown格式的内容html: 返回HTML格式的内容screenshot: 返回网页的截图json: 返回结构化的JSON数据示例提示给AI:
你能从techcrunch.com抓取最新的新闻并给我总结一下吗?
根据提示从网页中抓取内容。
参数:
prompt (字符串): 描述要抓取什么的提示,包括URLformat (字符串): 返回内容的格式 (markdown, html, screenshot, json, quick)示例:
{
"prompt": "获取producthunt.com上的前10个产品",
"format": "markdown"
}
克隆仓库:
git clone https://github.com/Ai-Quill/scraperis-mcp.git
cd scraperis-mcp
安装依赖项:
npm install
构建项目:
npm run build
npm run build: 构建项目npm run watch: 监视更改并重新构建npm run dev: 使用MCP Inspector进行开发npm run test: 运行测试npm run lint: 运行ESLint欢迎贡献!请随意提交Pull Request。
本项目采用MIT许可证 - 查看LICENSE文件了解详情。