一个用于 ComfyUI 的第三方 API 生图节点集合,主要面向 OpenAI-compatible 聊天接口,也包含 GPT Image 专用请求节点。
仓库不会内置任何 API Key 或服务商地址。用户需要在节点里填写自己的 base_url、api_key 和模型名。
- 支持 OpenAI-compatible
/v1/chat/completions生图接口 - 支持自定义
base_url、API Key 和模型名 - 支持点击
Fetch Models从/v1/models获取模型列表 - 支持 Gemini / Nano Banana Pro 这类图片模型的原生
imageConfig - 支持 1K、2K、4K 分辨率和常见长宽比
- 支持 1-2 张参考图输入
- 支持解析 Markdown 图片、图片 URL、
b64_json、GeminiinlineData - 提供 GPT Image 专用节点,使用流式
/v1/chat/completions - 提供高级节点,可输出原始响应和图片引用,方便调试
如果你的 ComfyUI 启动器支持从 GitHub 仓库安装自定义节点,可以直接填入本仓库地址:
https://github.com/Marigold1122/Chat-Image-Bridge-Node
安装后重启 ComfyUI。
进入 ComfyUI 的 custom_nodes 目录:
cd ComfyUI/custom_nodes
git clone https://github.com/Marigold1122/Chat-Image-Bridge-Node.git ComfyUI-ChatImageBridge如果你的环境缺少依赖,可以安装:
pip install -r ComfyUI-ChatImageBridge/requirements.txt然后重启 ComfyUI。
添加节点:
api -> Chat Image Bridge -> Chat Image Bridge
主要参数:
api_key:你的第三方中转站或模型服务商 API Keybase_url:接口地址,可以填服务商根地址、/v1地址,或完整/v1/chat/completions地址model:模型名,默认是gemini-3-pro-image-previewprompt:提示词resolution:分辨率,支持auto、1K、2K、4Kaspect_ratio:长宽比,支持auto、1:1、16:9、9:16等timeout_seconds:请求超时时间
可选输入:
image_1image_2
输出:
image
可以直接接到 Save Image 或其他 ComfyUI 图像节点。
添加节点:
api -> Chat Image Bridge -> Chat Image Bridge 2
该节点针对 catapi.catcard.uk 的 Gemini 原生 generateContent 接口。默认地址已经填写,日常使用时前面板只需要操作提示词、输出比例和分辨率。
- 左侧图片输入全部平等命名为
Image 1、Image 2……;不预设主图和参考图。 - 初始只显示
Image 1。连接最后一个图片口后自动增加下一个,最多14张;断开末尾多余连接后自动收起。 - 用户可以在提示词中写“use the person from Image 1 and the clothes from Image 2”,插件会自动给图片加英文顺序标签。
- 没有连接图片时自动进行文生图,连接图片后自动进行编辑或参考图生成。
- 右侧只有一个 IMAGE 输出。
- Base URL 和 API Key 默认折叠在
Connection Settings中。请求超时使用内部安全默认值,不占用前面板空间。
前面板核心参数:
Prompt
Output Ratio
Resolution
分辨率会同时切换模型名和发送 imageConfig.imageSize:
| 分辨率 | 模型 |
|---|---|
1K |
gemini-3.1-flash-image-1K |
2K |
gemini-3.1-flash-image-2K |
4K |
gemini-3.1-flash-image-4k |
输出比例使用一个下拉框:
Auto / Keep Input:不发送aspectRatio。单图编辑保持输入比例,多图输入由模型结合提示词决定。Square · 1:1:方形输出。Landscape · 16:9、Landscape · 21:9等:横向输出。Portrait · 9:16、Portrait · 3:4等:竖向输出。Custom Ratio:此时才显示自定义输入框和Exact Custom Ratio (Experimental)开关。
实验开关默认关闭。关闭时沿用稳定模式:例如填写 20:9,节点会自动映射到最接近的服务端合法比例 21:9;填写 9:20 会映射为 9:16。
打开 Exact Custom Ratio (Experimental) 后,节点不会发送服务端不接受的自定义 aspectRatio,而是在用户图片之后附加一张内部 Canvas Guide,让模型按目标画幅进行扩图或构图,再对返回结果做少量居中裁切以得到严格的整数比例。用户提示词仍然负责描述人物位置、只向哪一侧扩展、留白和背景颜色等语义,节点不会预先把原图强制放在画面中心。
实验模式只请求一次,不会在失败后自动切换稳定模式再次生成,因此不会因为插件自动回退而产生第二次生图计费。如结果不理想,可由用户关闭开关后手动使用稳定映射模式。
节点不再绘制额外的比例示意图,完全使用原生 ComfyUI 控件,避免界面覆盖问题。
服务端当前支持:1:1、1:4、1:8、2:3、3:2、3:4、4:1、4:3、4:5、5:4、8:1、9:16、16:9、21:9。服务端不直接接受 20:9 等任意值;稳定模式负责映射,实验模式使用 Canvas Guide 绕开非法枚举传参。
最多支持14个动态 ComfyUI IMAGE 输入。中转站实测可以接受20张,但模型的可靠公开能力为14张,因此节点将上限设置为14。
实测任意比例的 1000×437 输入图选择 Auto / Keep Input + 4K 后输出为 6152×2688,基本精确保留原图比例;同一输入选择 Landscape · 16:9 + 4K 时输出为 5504×3072。因此节点既支持保持原画幅的高清重绘,也支持改变画幅与提升分辨率同时进行。
添加节点:
api -> Chat Image Bridge -> GPT Image Generate
这个节点面向 GPT Image / Nano Banana 这类绘图接口,使用流式 /v1/chat/completions。base_url 可以填写服务商根地址、/v1 地址,或完整 /v1/chat/completions 地址。
生图节点适合纯文生图,或者把输入图当作参考图。你只需要填写 api_key、prompt,选择模型、分辨率和比例即可。当分辨率和比例都明确选择时,节点内部会自动把 1K / 2K / 4K 和比例转换为接口需要的 size,例如:
4K + 16:9 -> 3840x2160
2K + 1:1 -> 2048x2048
1K + 9:16 -> 720x1280
如果 resolution 或 aspect_ratio 选择 auto,节点不会强制报错;能换算出像素尺寸时会传 size,不能换算时会把你的分辨率或比例意图写入流式聊天消息,让服务商按语义处理。
添加节点:
api -> Chat Image Bridge -> GPT Image Edit
编辑节点适合“改这张图”的任务。它只接收一张待编辑图片,不提供 aspect_ratio,因为比例直接来自原图。
如果 resolution=auto,节点不会传 size。如果选择 1K / 2K / 4K,节点会读取输入图宽高,保持原图比例,并把最长边换算到对应档位:
1K -> 最长边约 1280
2K -> 最长边约 2048
4K -> 最长边约 3840
例如输入图是 2560x2560,选择 4K 时会传 3840x3840;输入图是 3000x2000,选择 4K 时会传 3840x2560。节点不会改写你的 prompt,用户写什么就传什么。
支持的模型:
| 模型 | 分辨率 |
|---|---|
gpt-image-2-vip |
1K、2K、4K |
gpt-image-2 |
1K |
nano-banana |
1K |
nano-banana-2 |
1K、2K、4K |
nano-banana-pro |
1K、2K、4K |
节点使用流式 /v1/chat/completions 请求,适合生成时间较长的图片任务,减少 Cloudflare 超时概率。如果服务商在流式响应中返回图片直链,节点会自动下载并转成 ComfyUI 的 IMAGE。
下面几种都可以:
https://example.com
https://example.com/v1
https://example.com/v1/chat/completions
节点会自动整理为请求需要的接口地址。
通用节点填好 api_key 和 base_url 后,可以点击节点里的:
Fetch Models
节点会请求:
/v1/models
然后把返回的模型列表填入 model 下拉框。
如果你的服务商不支持 /v1/models,也可以直接手动填写模型名。
对于 Gemini 图片模型,例如:
gemini-3-pro-image-preview
当 resolution 或 aspect_ratio 不是 auto 时,通用节点会优先使用 Gemini 原生请求格式,并传入:
{
"generationConfig": {
"responseModalities": ["TEXT", "IMAGE"],
"imageConfig": {
"imageSize": "4K",
"aspectRatio": "16:9"
}
}
}这样 4K 和长宽比会作为真正的图片参数发送,而不是只写进 prompt。
GPT Image 节点则会按接口文档传入 size,例如 3840x2160。
添加节点:
api -> Chat Image Bridge -> Chat Image Bridge Advanced
高级节点适合调试或特殊接口,额外提供:
- 原始响应
response - 图片引用
image_refs system_promptsizeextra_body_json- 最多 14 张参考图输入
- API Key 只在节点 UI 里填写,本仓库不会硬编码任何 Key。
- 不同中转站对 OpenAI-compatible 的兼容程度不同,字段支持可能不完全一致。
gpt-image-2和nano-banana在 GPT Image 节点里只开放 1K,选择更高分辨率会直接报错,避免请求失败或产生无效消耗。- 旧版工作流如果使用过
endpoint_url,建议改成新版的base_url。