返回市场
智能AI桥接

智能AI桥接

作者:Platano782 星标更新:2025-11-23

项目介绍

Smart AI Bridge

<a href="https://glama.ai/mcp/servers/@Platano78/Smart-AI-Bridge"> <img width="380" height="200" src="https://gips3.baidu.com/it/u=4134187626,227015957&fm=3081&app=3081&f=PNG?w=760&h=400" /> </a>

面向企业的MCP服务器,支持多AI编排、动态令牌扩展、智能路由、高级模糊匹配以及全面的安全性。

🎯 概述

Smart AI Bridge 是一个生产就绪的模型上下文协议(MCP)服务器,它可以在多个后端之间自动进行故障转移、智能路由和高级错误预防操作,以协调AI驱动的开发操作。

关键特性

🤖 多AI后端编排

  • 预配置的4后端系统:1个本地模型 + 3个云AI后端(完全可定制 - 自带提供商)
  • 完全可扩展:通过EXTENDING.md指南添加无限数量的后端
  • 智能路由:根据任务复杂度和内容分析自动选择后端
  • 健康感知故障转移:带有自动回退链路的断路器
  • 自带模型:配置任何AI提供商(本地模型、云API、自定义端点)

🎨 自带后端:系统附带了使用本地LM Studio和NVIDIA云API的示例配置,但支持任何AI提供商 - OpenAI、Anthropic、Azure OpenAI、AWS Bedrock、自定义API或通过Ollama/vLLM等本地模型。参见EXTENDING.md以获取集成指南。

🎯 高级模糊匹配

  • 三阶段匹配:精确匹配(<5ms) → 模糊匹配(<50ms) → 建议(<100ms)
  • 错误预防:减少80%的“未找到文本”错误
  • 莱文斯坦距离:行业标准相似度计算
  • 强化安全:具有DoS防护的9.7/10安全评分
  • 跨平台:自动处理Windows/Unix行尾

🛠️ 综合工具集

  • 总计19种工具:9种核心工具 + 10种智能别名
  • 代码审查:具有安全审计的AI驱动分析
  • 文件操作:高级读取、编辑、写入操作,具有原子事务
  • 批量编辑:批量操作,自动回滚
  • 验证:具有模糊匹配支持的飞行前检查

🔒 企业级安全性

  • 安全评分:具有全面控制措施的9.7/10评分
  • DoS防护:复杂度限制、迭代上限、超时强制执行
  • 输入验证:类型检查、结构验证、清理
  • 指标跟踪:操作监控和滥用检测
  • 审计追踪:完整的日志记录,带有错误清理

🏆 生产就绪:100%测试覆盖率,企业级可靠性,MIT许可

✨ v1.2.2 新增功能

🎯 真正的动态令牌检测(补丁发布)

  • 自动检测上下文限制:从/v1/models端点查询实际模型max_model_len
  • 多服务支持:自动与vLLM、LM Studio、Ollama兼容
  • 修复硬编码回退:纠正了65,536 → 8,192令牌(符合实际Qwen2.5-Coder-14B-AWQ)
  • 运行时更新:启动时后端最大令牌数更新为检测值
  • 影响:防止令牌溢出错误,准确的健康检查报告
  • 即插即用:切换模型(4K、8K、32K、128K+)无需更改配置

✨ v1.2.1 新增功能

🔧 自动检测热修复(关键修复)

  • 端口优先级修复:vLLM端口8002在通用HTTP端口8080之前扫描
  • LLM验证:验证/v1/models响应包含实际LLM模型名称
  • 增强验证validateEndpoint()检查内容,而不仅仅是HTTP状态码
  • 影响:增加本地模型使用率从0%到90%以上(修复云回退问题)
  • 无需操作:自动检测在启动时自动工作

✨ v1.2.0 新增功能

🎯 动态令牌扩展

  • 自动令牌分配:根据请求复杂度智能扩展令牌限制
  • 统一生成:大型游戏开发脚本16,384令牌
  • 复杂请求:综合代码生成8,192令牌
  • 简单查询:快速高效响应2,048令牌
  • 后端感知限制:尊重各个AI模型的最大容量
  • 性能优化:简单查询中令牌使用量减少75%
  • 零破坏性变更:与现有代码完全向后兼容

✨ v1.1.1 新增功能

🔧 MCP协议合规性修复

  • 解决JSON解析错误:修复Claude Desktop中的JSON解析错误
  • MCP合规日志:所有日志重定向到stderr以满足协议要求
  • 增强的日志器:可配置的日志级别(静默、错误、警告、信息、调试)
  • 生产就绪:消除Claude Desktop集成中的“意外令牌”错误

✨ v1.1.0 新增功能

  • LocalServiceDetector - 自动发现本地AI服务(vLLM、LM Studio、Ollama),支持WSL
  • ConversationThreading - 具有线程ID和搜索能力的多轮对话管理
  • UsageAnalytics - 综合使用跟踪、成本分析和优化建议
  • Dashboard Server - 可选的基于Web的监控界面(需手动启用,默认禁用)

🚀 多后端架构

灵活的4后端系统预配置了1个本地 + 3个云后端,以实现最大的开发效率。该架构是完全可扩展的 - 请参阅EXTENDING.md以了解如何添加额外的后端。

🎯 预配置的AI后端

系统附带了4个专用后端(可通过EXTENDING.md扩展):

云后端1 - 编码专家(优先级1)

  • 专长:高级编码、调试、实现
  • 最佳用途:JavaScript、Python、API开发、重构、游戏开发
  • 路由:自动用于编码模式和task_type: 'coding'
  • 示例提供商:OpenAI GPT-4、Anthropic Claude、通过NVIDIA API的Qwen、Codestral等

云后端2 - 分析专家(优先级2)

  • 专长:数学分析、研究、策略
  • 特点:具有思考过程的高级推理能力
  • 最佳用途:游戏平衡、统计分析、战略规划
  • 路由:自动用于分析模式和数学/研究任务
  • 示例提供商:通过NVIDIA/自定义API的DeepSeek、Claude Opus、GPT-4 Advanced等

本地后端 - 无限令牌(优先级3)

  • 专长:大上下文处理、无限容量
  • 最佳用途:处理大于50KB的大文件、大量文档、庞大的代码库
  • 路由:自动用于大提示和无限令牌需求
  • 示例提供商:通过LM Studio、Ollama、vLLM的任何本地模型 - DeepSeek、Llama、Mistral、Qwen等

云后端3 - 通用用途(优先级4)

  • 专长:通用任务、额外的备用容量
  • 最佳用途:多样化的任务、备份路由、多模态能力
  • 路由:备用和通用查询
  • 示例提供商:Google Gemini、Azure OpenAI、AWS Bedrock、Anthropic Claude等

🎨 示例配置:默认设置使用LM Studio(本地)+ NVIDIA API(云),但您可以配置任何提供商。参见EXTENDING.md以获取逐步集成OpenAI、Anthropic、Azure、AWS或自定义API的说明。

🧠 智能路由智能

先进的内容分析结合经验学习:

// 智能路由决策树
if (prompt.length > 50,000) → 本地后端(无限容量)
else if (检测到数学/分析模式) → 云后端2(分析专家)
else if (检测到编码模式) → 云后端1(编码专家)
else → 默认为云后端1(最高优先级)

模式识别

  • 编码模式function|class|debug|implement|javascript|python|api|optimize
  • 数学/分析模式analyze|calculate|statistics|balance|metrics|research|strategy
  • 大上下文:文件大小>100KB或提示长度>50,000字符

🚀 快速设置

1. 安装依赖项

cd .
npm install

2. 测试连接

npm test

3. 添加到Claude Code配置

生产多后端配置

{
  "mcpServers": {
    "smart-ai-bridge": {
      "command": "node",
      "args": ["smart-ai-bridge.js"],
      "cwd": ".",
      "env": {
        "LOCAL_MODEL_ENDPOINT": "http://localhost:1234/v1",
        "CLOUD_API_KEY_1": "your-cloud-api-key-1",
        "CLOUD_API_KEY_2": "your-cloud-api-key-2",
        "CLOUD_API_KEY_3": "your-cloud-api-key-3"
      }
    }
  }
}

注意:示例配置使用LM Studio作为本地端点和NVIDIA API作为云后端,但您可以配置任何提供商(OpenAI、Anthropic、Azure、AWS Bedrock等)。LOCAL_MODEL_ENDPOINT应指向您的本地模型服务器(localhost、127.0.0.1或WSL2/远程IP)。

4. 重启Claude Code

🛠️ 可用工具

🎯 智能编辑预防功能

带有模糊匹配的增强edit_file工具

革命性的文件编辑,具有智能错误预防和自动校正功能。

新功能:

  • 智能验证模式严格(精确)、宽松(模糊)、干运行(仅验证)
  • 模糊匹配引擎:可配置的相似度阈值(0.1-1.0)以容忍拼写错误
  • 智能建议:最多10个替代匹配及其相似度得分
  • 性能优化:实时应用下的模糊匹配<50ms

示例:

@edit_file({
  file_path: "/src/user.js",
  validation_mode: "宽松",     // 启用模糊匹配
  fuzzy_threshold: 0.8,           // 要求80%相似度
  suggest_alternatives: true,      // 获取有用的建议
  edits: [
    {
      find: "const userName = 'alice'",  // 即使有小错误也能匹配
      replace: "const userName = 'bob'",
      description: "使用智能匹配更新用户名"
    }
  ]
})

带有验证的增强read工具

高级文件读取,具有编辑操作的飞行前验证能力。

新功能:

  • 文本验证:在编辑前验证文本模式的存在
  • 多种验证模式基础模糊全面
  • 批量验证:在一个操作中验证多个文本模式
  • 详细结果:匹配位置、相似度得分和建议

示例:

@read({
  file_paths: ["/src/user.js"],
  verify_texts: [
    "function processUserData",
    "const userName = 'alice'",
    "return userData.score"
  ],
  verification_mode: "模糊",     // 智能模式匹配
  fuzzy_threshold:  0.8
})

主要AI查询工具

query_deepseek - 智能多后端路由

革命性的AI查询系统,根据任务专长自动选择后端。

特点:

  • 智能路由:根据内容分析自动选择端点
  • 能力消息:透明反馈哪个AI处理了您的请求
  • 备用保护:自动回退到备用端点
  • 任务专长:针对编码、分析和大上下文任务优化路由

示例:

@query_deepseek(
  prompt="实现一个完整的游戏库存系统,包括拖放、物品堆叠和持久性",
  task_type="coding",  // 自动路由到Qwen 3 Coder
  context="使用React和Node.js构建RPG游戏"
)

route_to_endpoint - 直接端点控制

强制查询特定AI端点以进行比较或专门任务。

示例:

@route_to_endpoint(
  endpoint="cloud_backend_1",  // 或"cloud_backend_2","local_backend"
  prompt="优化这个React组件的性能"
)

compare_endpoints - 多AI比较

在同一查询上运行多个端点以比较响应和能力。

示例:

@compare_endpoints(
  prompt="设计一个RPG的角色进步系统",
  endpoints=["cloud_backend_1", "cloud_backend_2", "local_backend"]
)

系统监控工具

check_deepseek_status - 多后端健康检查

监控所有已配置AI后端的状态和能力。

示例:

@check_deepseek_status()
// 返回:所有后端的状态、路由统计、性能指标

高级文件分析工具

analyze_files - 闪电般快速的文件分析

企业级文件分析,具有并发处理、安全验证和智能内容传输。

特点:

  • 并发处理:多文件分析速度提高300%
  • 智能路由:>100KB文件自动路由到本地后端(无限令牌)
  • 安全验证:内置恶意内容检测
  • 跨平台:Windows/WSL/Linux路径规范化
  • 模式过滤:使用glob模式的智能文件选择

示例:

@analyze_files(
  files=["src/**/*.js", "config/*.json"],
  analysis_type="安全审核",
  output_format="详细"
)

youtu_agent_analyze_files - 大型文件分块系统

高级分块系统,用于处理>32KB的文件并保持语义边界。

特点:

  • 语义分块:在分块间保持代码结构
  • 95%内容保留:最小的信息损失
  • 跨分块关系:维护文件部分之间的上下文
  • TDD开发:经过广泛测试的文件处理系统

示例:

@youtu_agent_analyze_files(
  files=["large_codebase/**/*.js"],
  chunk_strategy="语义",
  preserve_boundaries=true
)

📋 任务类型及智能路由

根据任务类型自动选择端点

编码任务 → 云后端1(编码专家)

  • coding:一般编程、实现、开发
  • debugging:错误修复、错误解决、故障排除
  • refactoring:代码优化、重构、清理
  • game_dev:游戏开发、Unity/Unreal脚本、游戏逻辑

分析任务 → 云后端2(分析专家)

  • analysis:代码审查、技术分析、研究
  • math:数学计算、统计、算法
  • architecture:系统设计、规划、战略决策
  • balance:游戏平衡、进度系统、指标分析

大上下文任务 → 本地后端(无限令牌)

  • unlimited:大文件处理、大量文档
  • 自动路由:提示长度>50,000字符或文件大小>100KB

任务类型优势

云后端1(编码)优势:

  • 最新的编码知识和最佳实践
  • 高级调试和优化技术
  • 游戏开发专业知识和Unity/Unreal模式
  • 现代JavaScript/Python/TypeScript能力

云后端2(分析)优势:

  • 具有思维过程可视化的能力推理
  • 复杂的数学分析和统计
  • 战略规划和架构设计
  • 游戏平衡和进度系统分析

本地后端优势:

  • 对于大规模上下文的无限令牌容量
  • 敏感代码和专有信息的隐私
  • 没有API速率限制或使用限制
  • 处理整个代码库的理想选择

🔧 配置及要求

多后端配置

系统预配置了4个后端(可通过EXTENDING.md扩展):

本地后端端点

  • URLhttp://localhost:1234/v1(根据您的本地模型服务器配置)
  • 示例设置:LM Studio、Ollama、vLLM或兼容OpenAI的自定义端点
  • 要求
    • 运行本地模型服务器(LM Studio/Ollama/vLLM等)
    • 服务器绑定到0.0.0.0:1234(而不是127.0.0.1以支持WSL2)
    • 如果在单独的机器上运行,请确保防火墙允许连接

云后端端点

  • 示例配置:NVIDIA API、OpenAI、Anthropic、Azure OpenAI、AWS Bedrock等