返回市场
快速GPT数据集MCP

快速GPT数据集MCP

作者:boleyn19 星标更新:2025-06-19

项目介绍

Knowledge Base Management MCP Server v2.0

一款基于FastMCP的知识库管理工具,专为FastGPT设计,提供智能化的知识库搜索和管理功能。支持自适应知识搜索,帮助AI助手更好地理解和检索相关信息。

🌟 核心特性

🎯 自适应知识搜索

  • 智能关键词扩展自动将核心词扩展为同义词、相关词及上下文词
  • 多层次搜索策略从精确匹配到模糊搜索的渐进式搜索
  • 跨数据集并行搜索同时在多个知识库中搜索相关信息
  • 深度文件夹探索自动发现深目录中的知识库资源

🔧 丰富的工具集

  • 目录树浏览快速了解知识库结构和可用的数据集
  • 精准搜索在指定数据集中进行高精度的内容检索
  • 批量搜索跨多个数据集并行搜索及结果汇总
  • 查看完整内容获取文档的完整内容和详细信息
  • 深度文件夹探索发现并访问嵌套文件夹内的资源

🚀 快速开始

1. 安装依赖

此项目使用uv进行依赖管理:

# 安装 uv(如果尚未安装)
curl -LsSf https://astral.sh/uv/install.sh | sh

# 安装项目依赖
uv sync

2. 配置环境

复制配置文件并根据需要修改:

cp config.env.example .env

.env文件中配置您的设置:

# 知识库配置
DEFAULT_PARENT_ID=your-parent-id

# API配置
API_BASE_URL=http://your-api-domain.com
API_TOKEN=your-api-token

# MCP服务器配置
MCP_SERVER_HOST=0.0.0.0
MCP_SERVER_PORT=18007

3. 启动服务器

# 使用 uv 运行
uv run python main.py

# 或者激活虚拟环境后运行
source .venv/bin/activate  # Linux/Mac
# 或 .venv\Scripts\activate  # Windows
python main.py

服务器将在配置的端口上启动(默认)http://0.0.0.0:18007),SSE端点是http://0.0.0.0:18007/sse

🔗 FastGPT集成配置

MCP客户端配置

向FastGPT的MCP配置添加以下设置:

{
  "name": "知识库管理工具",
  "url": "http://0.0.0.0:18007/sse?parentId=YOUR_PARENT_ID",
  "description": "智能知识库搜索和管理工具"
}

🔑 ParentId配置说明

parentId是访问知识库的关键标识符,可以通过两种方式配置:

方法1:URL参数配置(推荐)

直接在MCP配置的URL中指定:

http://0.0.0.0:18007/sse?parentId=your-specific-parent-id

方法2:默认配置

.env文件中设置默认值:

DEFAULT_PARENT_ID=your-default-parent-id

智能切换机制

  • 系统会自动检测URL中的parentId参数变化
  • 支持会话级别的parentId存储和管理
  • 当URL参数变化时,自动更新当前会话的知识库访问权限

🛠️ 可用工具

1. 📁 get_dataset_tree

检索知识库目录树,浏览所有可用的数据集和文件夹。

# 基础用法
get_dataset_tree()

# 带过滤的用法
get_dataset_tree(search_value="网络管理系统", deep=6)

2. 🔍 search_dataset

在指定数据集中进行精准搜索。

search_dataset(
    dataset_id="dataset-123",
    text="用户权限管理",
    limit=10
)

3. 🔍 multi_dataset_search

跨多个数据集并行搜索。

multi_dataset_search(
    dataset_ids=["dataset-1", "dataset-2", "dataset-3"],
    query="系统配置",
    limit_per_dataset=5
)

4. 📄 view_collection_content

查看文档的完整内容。

view_collection_content(
    collection_id="collection-456",
    page_size=50
)

5. 🎯 expand_search_keywords

智能关键词扩展以增强搜索性能。

expand_search_keywords(
    original_query="用户管理",
    expansion_type="comprehensive"
)

6. 📂 explore_folder_contents

深入探索文件夹内容,发现嵌套资源。

explore_folder_contents(
    folder_id="folder-789",
    search_value="配置文档",
    deep=8
)

🧠 智能搜索策略

自适应搜索过程

  1. 关键词扩展使用expand_search_keywords生成相关词汇
  2. 目录探索通过get_dataset_tree发现相关数据集
  3. 精准搜索使用search_dataset在目标数据集中搜索
  4. 批量搜索通过multi_dataset_search扩大搜索范围
  5. 深度查看使用view_collection_content获取完整信息

最佳实践

# 1. 首先扩展关键词
expanded = expand_search_keywords("用户权限", "comprehensive")

# 2. 探索相关数据集
tree = get_dataset_tree("用户 权限 管理", deep=5)

# 3. 多数据集并行搜索
results = multi_dataset_search(
    dataset_ids=["found-dataset-1", "found-dataset-2"],
    query="用户权限管理配置",
    limit_per_dataset=8
)

# 4. 查看详细内容
content = view_collection_content("relevant-collection-id")

📊 特性

🎯 智能化

  • 自动关键词扩展和语义理解
  • 渐进式搜索策略,从精确到模糊
  • 智能结果排序和相关性评分

⚡ 高性能

  • 跨多个数据集的并行搜索
  • 异步处理提高响应速度
  • 智能缓存和会话管理

🔧 易用性

  • 统一的API接口设计
  • 详细的错误提示和日志
  • 灵活的参数配置

🛡️ 可靠性

  • 改进的异常处理机制
  • 会话级别的状态管理
  • 自动重试和容错处理

📝 日志与调试

服务器提供了详细的日志信息,包括:

  • 🔑 ParentId使用和切换记录
  • 🔍 搜索请求和结果统计
  • ⚡ 性能监控和错误追踪
  • 📊 工具使用分析

🤝 与FastGPT的合作

此工具专门为FastGPT设计,并提供:

  1. 智能知识检索帮助AI快速找到相关信息
  2. 文本理解通过关键词扩展增强理解能力
  3. 多源信息整合跨数据集搜索提供全面视角
  4. 动态知识库切换通过parentId灵活访问不同的知识库

🔧 技术架构

  • 框架:FastMCP(基于FastAPI)
  • 传输协议:Server-Sent Events (SSE)
  • 异步处理:asyncio并发处理
  • 会话管理:基于客户端ID的状态存储
  • API集成:RESTful API客户端

📞 支持与反馈

如果您有任何问题或建议,请通过以下方法联系我们:

  • 查看日志文件获取详细的错误信息
  • 检查.env配置文件是否正确
  • 确认API连接和parentId设置
  • 使用uv run python main.py启动服务器

让AI更智能地管理和检索知识! 🚀