返回市场
获取-mcp

获取-mcp

作者:zcaceres642 星标更新:2025-09-03

项目介绍

获取MCP服务器

fetch mcp logo

此MCP服务器提供多种格式的网页内容获取功能,包括HTML、JSON、纯文本和Markdown。

在NPM上可用

<a href="https://glama.ai/mcp/servers/nu09wf23ao"> <img width="380" height="200" src="https://gips1.baidu.com/it/u=3142805115,1461594307&fm=3081&app=3081&f=PNG?w=760&h=400" alt="Fetch Server MCP服务器" /> </a>

组件

工具

  • fetch_html

    • 获取网站并返回其内容作为HTML
    • 输入:
      • url(字符串,必需):要获取的网站URL
      • headers(对象,可选):包含在请求中的自定义头部
      • max_length(数字,可选):最大获取长度(默认5000,可通过环境变量更改)
      • start_index(数字,可选):与max_length一起使用以分段检索内容,默认为0
    • 返回网页的原始HTML内容
  • fetch_json

    • 从URL获取JSON文件
    • 输入:
      • url(字符串,必需):要获取的JSON的URL
      • headers(对象,可选):包含在请求中的自定义头部
      • max_length(数字,可选):最大获取长度(默认5000,可通过环境变量更改)
      • start_index(数字,可选):与max_length一起使用以分段检索内容,默认为0
    • 返回解析后的JSON内容
  • fetch_txt

    • 获取网站并返回其内容作为纯文本(无HTML)
    • 输入:
      • url(字符串,必需):要获取的网站URL
      • headers(对象,可选):包含在请求中的自定义头部
      • max_length(数字,可选):最大获取长度(默认5000,可通过环境变量更改)
      • start_index(数字,可选):与max_length一起使用以分段检索内容,默认为0
    • 返回网页的内容,移除了HTML标签、脚本和样式
  • fetch_markdown

    • 获取网站并返回其内容作为Markdown
    • 输入:
      • url(字符串,必需):要获取的网站URL
      • headers(对象,可选):包含在请求中的自定义头部
      • max_length(数字,可选):最大获取长度(默认5000,可通过环境变量更改)
      • start_index(数字,可选):与max_length一起使用以分段检索内容,默认为0
    • 返回网页内容转换为Markdown格式

资源

此服务器不提供任何持久资源。它设计用于按需抓取和转换网络内容。

开始使用

  1. 克隆仓库
  2. 安装依赖项:npm install
  3. 构建服务器:npm run build

使用方法

要使用服务器,可以直接运行:

npm start

这将启动运行在标准输入输出上的Fetch MCP服务器。

环境变量

  • DEFAULT_LIMIT - 设置抓取的默认大小限制(0 = 无限制)

与桌面应用集成

要将此服务器与桌面应用集成,请在应用的服务器配置中添加以下内容:

{
  "mcpServers": {
    "fetch": {
      "command": "npx",
      "args": [
        "mcp-fetch-server"
      ],
      "env": {
        "DEFAULT_LIMIT": "50000" // 可选地更改默认限制
      }
    }
  }
}

特性

  • 使用现代fetch API获取网络内容
  • 支持请求的自定义头部
  • 提供多种格式的内容:HTML、JSON、纯文本和Markdown
  • 使用JSDOM进行HTML解析和文本提取
  • 使用TurndownService进行HTML到Markdown的转换

开发

  • 运行npm run dev以启动TypeScript编译器的监视模式
  • 使用npm test来运行测试套件

许可证

该项目采用MIT许可证。