MCP 服务器当前正在开发中
尚未准备好用于生产环境
将在可用时更新
🚀 高性能的 Crawl4AI MCP 服务器 —— 使 AI 助手能够通过模型上下文协议(Model Context Protocol)访问网络抓取、爬虫和深度研究。比 FireCrawl 更快更高效!
该项目实现了一个自定义的模型上下文协议(MCP)服务器,该服务器与 Crawl4AI(一个开源的网络抓取和爬虫库)集成。该服务器部署在 Cloudflare Workers 上作为远程 MCP 服务器,允许像 Claude 这样的 AI 助手访问 Crawl4AI 强大的网络抓取功能。
有关此项目的详细信息,请参阅以下文档:
crawl4ai-mcp/
├── src/
│ ├── index.ts # 主入口点,带有 OAuth 提供者设置
│ ├── auth-handler.ts # 认证处理器
│ ├── mcp-server.ts # MCP 服务器实现
│ ├── crawl4ai-adapter.ts # Crawl4AI API 的适配器
│ ├── tool-schemas/ # MCP 工具模式定义
│ │ └── [...].ts # 工具模式
│ ├── handlers/
│ │ ├── crawl.ts # 网络爬虫实现
│ │ ├── search.ts # 搜索功能
│ │ └── extract.ts # 内容提取
│ └── utils/ # 实用函数
├── tests/ # 测试案例
├── .github/ # GitHub 配置
├── wrangler.toml # Cloudflare Workers 配置
├── tsconfig.json # TypeScript 配置
├── package.json # Node.js 依赖项
└── README.md # 项目文档
克隆仓库:
git clone https://github.com/BjornMelin/crawl4ai-mcp-server.git
cd crawl4ai-mcp-server
安装依赖项:
npm install
设置 Cloudflare KV 命名空间:
wrangler kv:namespace create CRAWL_DATA
更新 wrangler.toml 中的 KV 命名空间 ID:
kv_namespaces = [
{ binding = "CRAWL_DATA", id = "your-namespace-id" }
]
启动开发服务器:
npm run dev
服务器将在 http://localhost:8787 可用
您也可以使用 Docker 进行本地开发,这包括 Crawl4AI API 和调试 UI:
设置环境变量:
cp .env.example .env
# 编辑 .env 文件中的 API 密钥
启动 Docker 开发环境:
docker-compose up -d
访问服务:
更多详情请参阅 Docker 设置指南。
该项目包含使用 Jest 的全面测试套件。要运行测试:
# 运行所有测试
npm test
# 在开发期间运行监视模式下的测试
npm run test:watch
# 运行带有覆盖率报告的测试
npm run test:coverage
# 运行仅单元测试
npm run test:unit
# 运行仅集成测试
npm run test:integration
在 Docker 中运行:
docker-compose exec mcp-server npm test
部署到 Cloudflare Workers:
npm run deploy
您的服务器将在分配给已部署工作者的 Cloudflare Workers URL 上可用。
此服务器实现了模型上下文协议,允许 AI 助手访问其工具。
crawl:从起始 URL 爬取网页getCrawl:通过 ID 检索爬取数据listCrawls:列出所有爬取或按域过滤search:通过查询搜索索引文档extract:从 URL 提取结构化内容通过修改 wrangler.toml 中的环境变量来配置服务器:
MAX_CRAWL_DEPTH:网络爬取的最大深度(默认值:3)MAX_CRAWL_PAGES:最大爬取页面数(默认值:1 00)API_VERSION:API 版本字符串(默认值:"v1")OAUTH_CLIENT_ID:用于认证的 OAuth 客户端 IDOAUTH_CLIENT_SECRET:用于认证的 OAuth 客户端密钥该项目正在考虑这些组件进行开发:
欢迎贡献!请在开始功能或错误修复工作之前检查开放的问题或创建一个新的问题。请参阅 贡献指南 获取详细的指导方针。
如果您遇到问题或有任何疑问:
如果您在研究或项目中使用了 Crawl4AI MCP 服务器,请使用以下 BibTeX 条目引用它:
@software{crawl4ai_mcp_2025,
author = {Melin, Bjorn},
title = {Crawl4AI MCP 服务器:适用于 AI 助手的高性能网络爬虫},
url = {https://github.com/BjornMelin/crawl4ai-mcp-server},
version = {1.0.0},
year = {2025},
month = {5}
}