返回市场
MCP服务器双子座图像生成器

MCP服务器双子座图像生成器

作者:qhdrl1224 星标更新:2025-08-16

项目介绍

MseeP 徽章 smithery 徽章

<a href="https://glama.ai/mcp/servers/@qhdrl12/mcp-server-gemini-image-generator"> <img width="380" height="200" src="https://gips2.baidu.com/it/u=1536930415,821176421&fm=3081&app=3081&f=PNG?w=760&h=400" alt="Gemini 图像生成器服务器 MCP 服务器" /> </a>

Gemini 图像生成器 MCP 服务器

通过 MCP 协议使用 Google 的 Gemini 模型从文本提示生成高质量图像。

概述

此 MCP 服务器允许任何 AI 助手使用 Google 的 Gemini AI 模型生成图像。该服务器处理提示工程、文本到图像转换、文件名生成以及本地图像存储,使得通过任何 MCP 客户端创建和管理 AI 生成的图像变得容易。

特性

  • 使用 Gemini 2.0 Flash 进行文本到图像生成
  • 基于文本提示进行图像到图像变换
  • 支持基于文件和 base64 编码的图像
  • 根据提示自动智能生成文件名
  • 非英文提示的自动翻译
  • 具有可配置输出路径的本地图像存储
  • 严格排除生成图像中的文本
  • 高分辨率图像输出
  • 直接访问图像数据和文件路径

可用的 MCP 工具

该服务器为 AI 助手提供了以下 MCP 工具:

1. generate_image_from_text

根据文本提示描述创建新图像。

generate_image_from_text(prompt: str) -> Tuple[bytes, str]

参数:

  • prompt: 要生成的图像的文字描述

返回值:

  • 包含以下内容的元组:
    • 原始图像数据(字节)
    • 保存的图像文件路径(字符串)

这种双重返回格式允许 AI 助手直接处理图像数据或引用保存的文件路径。

示例:

  • "生成一幅夕阳照耀在山脉上的图像"
  • "创建一个科幻城市中飞翔的猪的逼真图像"

示例输出

此图像是使用以下提示生成的:

"你好,你能创建一个带有翅膀和礼帽的猪飞越充满绿色植被的未来科幻城市的三维渲染图像吗?"

飞翔的猪在科幻城市上空

一个带有翅膀和礼帽的猪飞越充满绿色植被的未来科幻城市的三维渲染图像

已知问题

当使用此 MCP 服务器与 Claude Desktop Host 时:

  1. 性能问题:使用 transform_image_from_encoded 可能比其他方法需要更长时间来处理。这是因为通过 MCP 协议传输大量 base64 编码图像数据的开销。

  2. 路径解析问题:在使用 Claude Desktop Host 时可能会遇到正确解析图像路径的问题。主机应用程序可能无法正确解释返回的文件路径,从而难以访问生成的图像。

为了获得最佳体验,请考虑使用替代的 MCP 客户端或尽可能使用 transform_image_from_file 方法。

2. transform_image_from_encoded

根据文本提示使用 base64 编码的图像数据对现有图像进行变换。

transform_image_from_encoded(encoded_image: str, prompt: str) -> Tuple[bytes, str]

参数:

  • encoded_image: 带有格式头的 base64 编码图像数据(必须是以下格式:"data:image/[format];base64,[data]")
  • prompt: 如何变换图像的文字描述

返回值:

  • 包含以下内容的元组:
    • 原始变换后的图像数据(字节)
    • 保存的变换后图像文件路径(字符串)

示例:

  • "在这个风景中添加雪"
  • "将背景改为海滩"

3. transform_image_from_file

根据文本提示对现有的图像文件进行变换。

transform_image_from_file(image_file_path: str, prompt: str) -> Tuple[bytes, str]

参数:

  • image_file_path: 要变换的图像文件路径
  • prompt: 如何变换图像的文字描述

返回值:

  • 包含以下内容的元组:
    • 原始变换后的图像数据(字节)
    • 保存的变换后图像文件路径(字符串)

示例:

  • "在这个图像中的人旁边添加一只羊驼"
  • "使这个白天场景看起来像夜晚"

示例变换

使用上面创建的飞翔的猪图像,我们应用了以下提示进行变换:

"添加一只可爱的婴儿鲸鱼在猪旁边飞翔"

之前: 飞翔的猪在科幻城市上空

之后: 飞翔的猪与婴儿鲸鱼

原始飞翔的猪图像加上一只可爱的婴儿鲸鱼在旁边飞翔

设置

先决条件

  • Python 3.11+
  • Google AI API 密钥(Gemini)
  • MCP 主机应用程序(Claude Desktop App、Cursor 或其他兼容 MCP 的客户端)

获取 Gemini API 密钥

  1. 访问 Google AI Studio API 密钥页面
  2. 使用您的 Google 账户登录
  3. 点击“创建 API 密钥”
  4. 复制新的 API 密钥用于配置
  5. 注意:API 密钥提供每月一定额度的免费使用量。您可以在 Google AI Studio 中检查您的使用情况

安装

通过 Smithery 安装

要通过 Smithery 自动安装 Gemini 图像生成器 MCP:

npx -y @smithery/cli install @qhdrl12/mcp-server-gemini-image-gen --client claude

手动安装

  1. 克隆仓库:
git clone https://github.com/your-username/mcp-server-gemini-image-generator.git
cd mcp-server-gemini-image-generator
  1. 创建虚拟环境并安装依赖项:
# 使用 uv(推荐)
uv venv
source .venv/bin/activate  # 在 Windows 上:.venv\Scripts\activate
uv pip install -e .

# 或使用常规 venv
python -m venv .venv
source .venv/bin/activate  # 在 Windows 上:.venv\Scripts\activate
pip install -e .
  1. 设置环境变量(选择一种方法):

方法 A:使用 .env 文件(可选)

# 在项目根目录下创建 .env 文件
cat > .env << 'EOF'
GEMINI_API_KEY=your-gemini-api-key-here
OUTPUT_IMAGE_PATH=/path/to/save/images
EOF

方法 B:直接在 Claude Desktop 配置中设置(推荐)

  • 直接在 claude_desktop_config.json 中设置环境变量(如下文配置部分所示)

配置 Claude Desktop

在您的 claude_desktop_config.json 中添加以下内容:

  • macOS: ~/Library/Application Support/Claude/claude_desktop_config.json
  • Windows: %APPDATA%\Claude\claude_desktop_config.json
{
    "mcpServers": {
        "gemini-image-generator": {
            "command": "uv",
            "args": [
                "--directory",
                "/absolute/path/to/mcp-server-gemini-image-generator",
                "run",
                "mcp-server-gemini-image-generator"
            ],
            "env": {
                "GEMINI_API_KEY": "your-actual-gemini-api-key-here",
                "OUTPUT_IMAGE_PATH": "/absolute/path/to/your/images/directory"
            }
        }
    }
}

重要配置注意事项:

  1. 替换路径为实际路径:

    • /absolute/path/to/mcp-server-gemini-image-generator 替换为您克隆此仓库的实际位置
    • /absolute/path/to/your/images/directory 替换为您希望保存生成图像的位置
  2. 环境变量:

    • your-actual-gemini-api-key-here 替换为您从 Google AI Studio 获取的真实 Gemini API 密钥
    • 使用绝对路径 OUTPUT_IMAGE_PATH 以确保图像正确保存
  3. 具有真实路径的示例:

{
    "mcpServers": {
        "gemini-image-generator": {
            "command": "uv",
            "args": [
                "--directory",
                "/Users/username/Projects/mcp-server-gemini-image-generator",
                "run",
                "mcp-server-gemini-image-generator"
            ],
            "env": {
                "GEMINI_API_KEY": "GEMINI_API_KEY",
                "OUTPUT_IMAGE_PATH": "OUTPUT_IMAGE_PATH"
            }
        }
    }
}

使用

一旦安装并配置完成,您可以请求 Claude 生成或变换图像,使用如下的提示:

生成新图像

  • "生成一幅夕阳照耀在山脉上的图像"
  • "创建一个未来城市景观的插图"
  • "制作一张戴着墨镜的猫的照片"

变换现有图像

  • "在此图像中添加雪景"
  • "编辑这张照片,使其看起来像是在夜间拍摄的"
  • "在这张图片的背景中添加一条飞龙"

生成/变换的图像将被保存到您配置的输出路径,并显示在 Claude 中。更新后的返回类型允许 AI 助手直接处理图像数据,而无需访问保存的文件。

测试

您可以通过运行 FastMCP 开发服务器来测试应用程序:

fastmcp dev server.py

此命令启动本地开发服务器,并在 http://localhost:5173/ 提供 MCP Inspector。MCP Inspector 提供了一个方便的 Web 接口,在这里您可以直接测试图像生成工具,无需使用 Claude 或其他 MCP 客户端。您可以输入文本提示,执行工具并立即查看结果,这对开发和调试非常有用。

许可证

MIT 许可证