minimaxH3-PromptHelper提示词优化助手

功能
插件包含三个节点:
| 节点 | 作用 |
|---|---|
closerAI-minimaxH3-PromptHelper | 将创作需求和参考图转换为 H3 英文提示词及中文对照。 |
closerAI-minimaxH3-本地结果解析 | 将本地 LLM 的 <EN>/<ZH> 输出拆分为英文和中文提示词。 |
closerAI-minimaxH3-无侵入加速 | 为当前工作流的 H3 模型副本挂接缓存加速,不修改 ComfyUI 内部文件。 |
英文提示词是提交给 MiniMax H3 的规范版本;中文提示词用于审阅和编辑。
安装
目录应位于:
ComfyUI/custom_nodes/closerAI-minimaxH3-PromptHelper
须完全重启 ComfyUI。
提示词助手
输入
| 字段 | 说明 |
|---|---|
运行模式 | 直接调用 API 由节点请求模型;本地 LLM 指令 只输出指令,不发起网络请求。 |
API 提供方 | 直接调用时选择 OpenAI 兼容 或 Google Gemini。 |
用户需求 | 视频主题、角色、动作、镜头、对白、声音、结局等自然语言要求。 |
生成模式 | 自动识别、纯文本、首帧、首尾帧、尾帧或全参考。多角色/多参考图优先使用全参考。 |
视频时长(秒) | 用于镜头时间和关键帧对齐。 |
画面比例、镜头数量 | 目标画面比例及建议分镜密度。 |
视觉风格偏好、镜头运动强度 | 控制风格和镜头节奏。 |
是否包含对白 | 选择“是”时,在需求中给出应原样保留的对白。 |
参考图像 | 可选 IMAGE 输入;图像顺序对应 <Picture 1>、<Picture 2>。 |
参与分析的图像数量 | 从批量图像中选取 1 至 4 张发送给视觉模型。 |
参考素材说明 | 说明每张参考图、视频或音频的角色,例如“图 1 定义主角,图 2 定义对手”。 |
接口地址 | 仅 OpenAI 兼容模式使用,例如 https://api.example.com/v1。节点会补上 /chat/completions。 |
模型名称 | 服务商模型名,或 Gemini 模式下的 Google 模型名。 |
API 密钥 | 建议使用环境变量,避免工作流保存密钥。 |
网络代理地址 | 可选 HTTP/Mixed 代理,例如 http://127.0.0.1:7890;不支持 SOCKS 端口。 |
最大输出 Token | 常规内容 4096;15 秒多镜头或全参考内容可试 6144。 |
生成随机性 | 0.2-0.4 更稳定,较高值会增加表达变化。 |
输出
| 输出 | 说明 |
|---|---|
英文提示词 | 接到 MiniMax H3 节点的 prompt 输入。 |
中文提示词 | 用于查看、保存或人工修改。 |
本地LLM指令 | 仅本地模式有内容。 |
在线 API
OpenAI 兼容 API
运行模式:直接调用 API
API 提供方:OpenAI 兼容
接口地址:https://你的服务地址/v1
模型名称:服务商提供的模型名
API 密钥:服务商 API Key
Google Gemini
运行模式:直接调用 API
API 提供方:Google Gemini
模型名称:gemini-2.5-flash
API 密钥:Gemini API Key
Gemini 使用 Google 原生 generateContent API,接口地址 不生效。图片会作为 inlineData 上传。也可设置 GOOGLE_API_KEY 环境变量。
本地 LLM 工作流
PromptHelper(运行模式:本地 LLM 指令)
本地LLM指令 -> 本地 LLM 的提示词输入
参考图像 -> 同时连接本地视觉 LLM 的图片输入
本地 LLM 文本输出
-> closerAI-minimaxH3-本地结果解析
-> 英文提示词 / 中文提示词
本地 LLM 必须返回:
<EN>
English MiniMax H3 prompt
</EN>
<ZH>
中文提示词
</ZH>
本地模式不会发起 HTTP 请求,也不会读取 API Key。参考图必须并联连接到本地视觉 LLM;输出指令不包含图片二进制数据。
多参考视频
两张以上参考图时,用批量 IMAGE 合并节点将图像按顺序接入主节点,设置 参与分析的图像数量,并选择 全参考模式。把相同图片分别接到 MiniMaxH3ReferenceToVideo 的 ref_image_0、ref_image_1 等输入。在需求中明确每张图承担的角色。
无侵入加速
接线:
UNETLoader.MODEL -> 无侵入加速.模型
无侵入加速.模型 -> BasicScheduler.model
无侵入加速.模型 -> BasicGuider.model
| 参数 | 说明 | 建议 |
|---|---|---|
变化阈值 | 当前采样步变化小于此值时可复用缓存。 | 默认 0.12;质量优先 0.06-0.10。 |
启用起点 | 从该采样进度开始使用缓存。 | 0.10。 |
启用终点 | 到该采样进度停止使用缓存。 | 0.90。 |
最大连续跳过 | 连续复用缓存的步数上限。 | 2;复杂运动用 1。 |
缓存设备 | 缓存放在 GPU 或 CPU。 | 8GB 显存保持“自动”。 |
此节点不减少采样步数,而是在部分步骤跳过 H3 DiT block-loop 并应用缓存残差。用同一 seed 对比原版和加速版,检查人物身份、运动、镜头切换、文字和音画同步。
常见问题
带图返回空内容
降低参考图尺寸或数量,保持 最大输出 Token=4096,并确认模型支持视觉输入。可切换为本地模式,使用本地视觉 LLM。
本地结果无法解析
确认输出完整包含 <EN>...</EN> 与 <ZH>...</ZH>,不要输出 JSON、代码块或额外解释。
主题授权提示:请在后台主题设置-主题授权-激活主题的正版授权,授权购买:RiTheme官网

评论(0)