minimaxH3-PromptHelper提示词优化助手

功能

插件包含三个节点:

节点作用
closerAI-minimaxH3-PromptHelper将创作需求和参考图转换为 H3 英文提示词及中文对照。
closerAI-minimaxH3-本地结果解析将本地 LLM 的 <EN>/<ZH> 输出拆分为英文和中文提示词。
closerAI-minimaxH3-无侵入加速为当前工作流的 H3 模型副本挂接缓存加速,不修改 ComfyUI 内部文件。

英文提示词是提交给 MiniMax H3 的规范版本;中文提示词用于审阅和编辑。

安装

目录应位于:

ComfyUI/custom_nodes/closerAI-minimaxH3-PromptHelper

须完全重启 ComfyUI。

提示词助手

输入

字段说明
运行模式直接调用 API 由节点请求模型;本地 LLM 指令 只输出指令,不发起网络请求。
API 提供方直接调用时选择 OpenAI 兼容Google Gemini
用户需求视频主题、角色、动作、镜头、对白、声音、结局等自然语言要求。
生成模式自动识别、纯文本、首帧、首尾帧、尾帧或全参考。多角色/多参考图优先使用全参考。
视频时长(秒)用于镜头时间和关键帧对齐。
画面比例镜头数量目标画面比例及建议分镜密度。
视觉风格偏好镜头运动强度控制风格和镜头节奏。
是否包含对白选择“是”时,在需求中给出应原样保留的对白。
参考图像可选 IMAGE 输入;图像顺序对应 <Picture 1><Picture 2>
参与分析的图像数量从批量图像中选取 1 至 4 张发送给视觉模型。
参考素材说明说明每张参考图、视频或音频的角色,例如“图 1 定义主角,图 2 定义对手”。
接口地址仅 OpenAI 兼容模式使用,例如 https://api.example.com/v1。节点会补上 /chat/completions
模型名称服务商模型名,或 Gemini 模式下的 Google 模型名。
API 密钥建议使用环境变量,避免工作流保存密钥。
网络代理地址可选 HTTP/Mixed 代理,例如 http://127.0.0.1:7890;不支持 SOCKS 端口。
最大输出 Token常规内容 4096;15 秒多镜头或全参考内容可试 6144
生成随机性0.2-0.4 更稳定,较高值会增加表达变化。

输出

输出说明
英文提示词接到 MiniMax H3 节点的 prompt 输入。
中文提示词用于查看、保存或人工修改。
本地LLM指令仅本地模式有内容。

在线 API

OpenAI 兼容 API

运行模式:直接调用 API
API 提供方:OpenAI 兼容
接口地址:https://你的服务地址/v1
模型名称:服务商提供的模型名
API 密钥:服务商 API Key

Google Gemini

运行模式:直接调用 API
API 提供方:Google Gemini
模型名称:gemini-2.5-flash
API 密钥:Gemini API Key

Gemini 使用 Google 原生 generateContent API,接口地址 不生效。图片会作为 inlineData 上传。也可设置 GOOGLE_API_KEY 环境变量。

本地 LLM 工作流

PromptHelper(运行模式:本地 LLM 指令)
  本地LLM指令 -> 本地 LLM 的提示词输入
  参考图像     -> 同时连接本地视觉 LLM 的图片输入

本地 LLM 文本输出
  -> closerAI-minimaxH3-本地结果解析
  -> 英文提示词 / 中文提示词

本地 LLM 必须返回:

<EN>
English MiniMax H3 prompt
</EN>
<ZH>
中文提示词
</ZH>

本地模式不会发起 HTTP 请求,也不会读取 API Key。参考图必须并联连接到本地视觉 LLM;输出指令不包含图片二进制数据。

多参考视频

两张以上参考图时,用批量 IMAGE 合并节点将图像按顺序接入主节点,设置 参与分析的图像数量,并选择 全参考模式。把相同图片分别接到 MiniMaxH3ReferenceToVideoref_image_0ref_image_1 等输入。在需求中明确每张图承担的角色。

无侵入加速

接线:

UNETLoader.MODEL -> 无侵入加速.模型
无侵入加速.模型 -> BasicScheduler.model
无侵入加速.模型 -> BasicGuider.model
参数说明建议
变化阈值当前采样步变化小于此值时可复用缓存。默认 0.12;质量优先 0.06-0.10
启用起点从该采样进度开始使用缓存。0.10
启用终点到该采样进度停止使用缓存。0.90
最大连续跳过连续复用缓存的步数上限。2;复杂运动用 1
缓存设备缓存放在 GPU 或 CPU。8GB 显存保持“自动”。

此节点不减少采样步数,而是在部分步骤跳过 H3 DiT block-loop 并应用缓存残差。用同一 seed 对比原版和加速版,检查人物身份、运动、镜头切换、文字和音画同步。

常见问题

带图返回空内容

降低参考图尺寸或数量,保持 最大输出 Token=4096,并确认模型支持视觉输入。可切换为本地模式,使用本地视觉 LLM。

本地结果无法解析

确认输出完整包含 <EN>...</EN><ZH>...</ZH>,不要输出 JSON、代码块或额外解释。

隐藏内容
本内容需权限查看
  • 普通用户: 599金币
  • VIP会员: 免费
  • 永久会员: 免费

主题授权提示:请在后台主题设置-主题授权-激活主题的正版授权,授权购买:RiTheme官网

声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。