返回市场
网页侦察兵-mcp

网页侦察兵-mcp

作者:pinkpixel-dev8 星标更新:2025-09-20

项目介绍

MseeP.ai 安全评估徽章

<p align="center"> <img src="assets/logo.png" alt="Web Scout MCP Logo" width="300"/> </p> <h1 align="center">Web Scout MCP 服务器</h1> <p align="center"> <a href="https://www.npmjs.com/package/@pinkpixel/web-scout-mcp"><img src="https://img.shields.io/npm/v/@pinkpixel/web-scout-mcp.svg" alt="npm 版本"></a> <a href="https://github.com/pinkpixel-dev/web-scout-mcp/blob/main/LICENSE"><img src="https://img.shields.io/badge/license-MIT-blue.svg" alt="许可证"></a> <a href="https://nodejs.org/en/"><img src="https://img.shields.io/badge/node-%3E%3D18.0.0-brightgreen.svg" alt="Node.js 版本"></a> <a href="https://smithery.ai/badge/@pinkpixel-dev/web-scout-mcp"><img alt="Smithery 徽章" src="https://smithery.ai/badge/@pinkpixel-dev/web-scout-mcp"></a> <a href="https://mseep.ai/app/f19a6453-c635-4bc8-b26a-3e9e36428a98"><img src="https://mseep.ai/badge.svg" alt="在 MseeP 上验证"></a> </p> <p align="center"> 使用 DuckDuckGo 和内容提取进行网络搜索的 MCP 服务器,支持多个 URL 和内存优化。 </p>

✨ 功能

  • 🔍 DuckDuckGo 搜索:快速且注重隐私的网络搜索能力
  • 📄 内容提取:从网页中提取干净、可读的文本
  • 🚀 并行处理:支持同时从多个 URL 提取内容
  • 💾 内存优化:智能内存管理以防止应用程序崩溃
  • ⏱️ 速率限制:智能请求节流以避免 API 封锁
  • 🛡️ 错误处理:强大的错误处理以确保可靠运行

📦 安装

通过 Smithery 安装

要通过 Smithery 自动安装 Web Scout for Claude Desktop:

npx -y @smithery/cli install @pinkpixel-dev/web-scout-mcp --client claude

全局安装

npm install -g @pinkpixel/web-scout-mcp

局部安装

npm install @pinkpixel/web-scout-mcp

🚀 使用方法

命令行

全局安装后运行:

web-scout-mcp

使用 MCP 客户端

在您的 MCP 客户端的 config.json 中添加以下内容(例如 Claude Desktop、Cursor 等):

{
  "mcpServers": {
    "web-scout": {
      "command": "npx",
      "args": [
        "-y",
        "@pinkpixel/web-scout-mcp@latest"
      ]
    }
  }
}

环境变量

当嵌入包并自己调用 createServer() 时,设置环境变量 WEB_SCOUT_DISABLE_AUTOSTART=1。默认情况下,运行发布的入口点(例如 node dist/index.jsnpx @pinkpixel/web-scout-mcp)会自动引导 stdio 运输。

🧰 工具

该服务器提供以下 MCP 工具:

🔍 DuckDuckGoWebSearch

使用 DuckDuckGo 搜索引擎发起网络搜索查询,并返回一个结构良好的发现列表。

输入:

  • query (字符串):搜索查询字符串
  • maxResults (数字,可选):返回的最大结果数(默认值:10)

示例:

{
  "query": "最新的人工智能进展",
  "maxResults": 5
}

输出: 格式化的搜索结果列表,包含标题、URL 和摘要。

📄 UrlContentExtractor

抓取并从网页中提取干净、可读的内容,删除不必要的元素如脚本、样式和导航。

输入:

  • url:单个 URL 字符串或 URL 字符串数组

示例(单个 URL):

{
  "url": "https://example.com/article"
}

示例(多个 URL):

{
  "url": [
    "https://example.com/article1",
    "https://example.com/article2"
  ]
}

输出: 指定 URL 的提取文本内容。

🛠️ 开发

# 克隆仓库
git clone https://github.com/pinkpixel-dev/web-scout-mcp.git
cd web-scout-mcp

# 安装依赖
npm install

# 构建
npm run build

# 运行
npm start

📚 文档

有关项目的更多详细信息,请参阅以下资源:

📋 要求

  • Node.js >= 18.0.0
  • npm 或 yarn

📄 许可证

该项目根据 Apache 2.0 许可证 授权。

<p align="center"> <sub>由 <a href="https://pinkpixel.dev">Pink Pixel</a> 制作 ❤️</sub> <br> <sub>✨ 梦想它,像素化它 ✨</sub> </p>