更多AI前沿科技资讯,请关注我们:closerAI-一个深入探索前沿人工智能与AIGC领域的资讯平台

【closerAI ComfyUI】目前最强!国产开源最强视频生成模型MiniMaxH3:文生、图生、多参考视频生成!本地最强生产力!

大家好,我是Jimmy。

从昨天等到今天中午,万众期待的MiniMax H3终于开源权重,在昨天倒计时在重新更新6小时后,社区一片质疑。但就在今天下午,终于迎来了曙光!

如果使用官方发布的模型,在消费级显卡中是根本运行不了的。但comfyUI官方day0支持!极致的量化让消费级显卡本地运行成为可能!感谢miniMAX和社区佬们的努力!

MiniMax-H3 项目核心概述

  • 全能视听生成能力:
    支持文本转视频 (T2VA)、图转视频 (I2VA)、首尾帧转视频 (FL2VA) 以及尾帧反推 (L2VA) 等多种生成模式。
  • 原生音视频同步:
    能够直接生成长达 4~15 秒、分辨率高达 2K、带有 32 kHz 立体声音效(环境音、动作音及背景音乐)的视频内容。
  • 多语言支持:
    稳定支持中文、英文、日、韩、法、德等 11 种主流语言的对话与语音合成。

MiniMax H3 在comfyUI中的实现

由于comfyUI官方已支持,直接先更新comfyUI版本。

然后在comfyUI的仓库中下载对应模型和示例工作流:

地址:https://huggingface.co/Comfy-Org/MiniMax-H3

示例工作流如下:

comfyUI官方已将工作流进行极致的简化,非常清爽。

工作流体验

一、文生视频工作流,主要是时长与分辨率设置。

在尺寸与分辨率中,comfyUI官方给出了标注:

这里我用0.4,5秒,然后输入提示词:

integrated_multimodal_description: A cinematic, photorealistic scene set in a vibrant amusement park. A young woman, full-body shot, jumps up excitedly with both arms raised in the air, her face beaming with joy. She is wearing casual, colorful clothing suitable for a day at the park. The background features blurred roller coasters, bright carnival lights, and other park visitors. The camera performs a very subtle, gentle push-in toward her as she lands back on her feet, maintaining a steady eye-level framing throughout.

Mandarin 她高兴地跳起来说:这里真的太好玩啦!今天我要全部玩一遍!走起!

overall_soundscape: Cheerful ambient park sounds — distant roller coaster whooshes, faint crowd chatter, children laughing, footsteps on pavement, the rustle of her clothes as she jumps.

non_diegetic_music: N/A

生成效果如下:

效果非常赞!人物、画面、音频,流畅啊我的天!

二、图生视频工作流:

图生视频工作流就是在文生基础上接入参考图:

这里输入提示词:

她高兴地跳起来说:这里真的太好玩啦!今天我要全部玩一遍!走起!

同样5秒,0.4的百成分辨率,然后输入参考图:

生成效果如下:

三、多参考视频生成

主要区别是MiniMax H3 Reference to Video这个节点,将参考图,视频、音频

等素材接入即可。

提示词:

Use and as reference frames and exactly as it is.

CUT 1: 两个人发生矛盾在打架!左边女人说:“有本事你过来。”

CUT 2: 两个人缠在一起,打起来,右边女人说:“来就来,让你收费!”

生成效果如下:

半年时间,开源终于迎来了国产最强最稳视频生成模型!陆续还会有FLUX3和LTX3。 选择越来越多!本地生产力迎来奇点时刻!

如果对你有启发,请一键三连支持下我,你的支持是我持续输出的源泉!谢谢。

总结

MiniMax H3 是一款支持文本、图像、视频、音频全模态融合理解与原生立体声视频生成的 33B 开源通用 AI 系统;其核心亮点在于首创“全模态统一架构”与“原生视音频同步输出”,最大价值则是打破了多模态视频生成的技术壁垒,让开发者与创作者能够以开源可控的方式,低成本实现高一致性、长时序、音画同步的电影级视听内容创作。效果很赞哦,建议你一定试下。

原文地址:https://aigc.douyoubuy.cn/2026/08/03/421606/

会员小伙伴可在小站上下载本期工作流、优化节点、模型。

我在RH上也生成了应用,可以直接在上面体验下


本地算力不够怎么办?

如果本地设备算力不好的小伙伴,推荐使用线上comfyUI来运行体验:runninghub.cn

minimax_h3文生视频应用体验地址

https://www.runninghub.cn/ai-detail/2084286232988835841

minimax_h3图生视频应用体验地址

https://www.runninghub.cn/ai-detail/2084286858103713794

minimax_h3多参考视频生成应用体验地址

https://www.runninghub.cn/ai-detail/2084287787427262465

注册地址:https://www.runninghub.cn/?utm_source=kol01-RH151

通过这个链接第一次注册送1000点,每日登录送100点


最后几句:

如果对你有帮助,请一键三连支持下我,感谢!以下是小站主流的一些AI工具应用:

  1. CloserAI AI短剧工作台(本地化解决方案)
    https://aigc.douyoubuy.cn/ai-agent/
  2. closerAI FlowStudio本地AIGC无限画布创作工具
    https://aigc.douyoubuy.cn/closerai-flowstudio/
  3. closerAI AI绘画大师万象视界:
    https://aigc.douyoubuy.cn/closerai-vision/
  4. CLOSERAI POD电商印花批量生产工作站:
    https://aigc.douyoubuy.cn/?page_id=420541
  5. 印花提取:
    https://aigc.douyoubuy.cn/yinhua/

以上是就是本期的分享,当然,更多工作流、资讯、插件、工具也可以在我们closerAI会员站上获取(查看原文)

以上,既然看到这里了,如果觉得不错,随手点个赞、在看、转发三连吧,如果想第一时间收到推送,也可以给我个星标⭐~谢谢你看我的文章,我们,下次再见。

>/ 作者:JimmyMo

更多AI前沿科技资讯,请关注我们:closerAI-一个深入探索前沿人工智能与AIGC领域的资讯平台

隐藏内容
本内容需权限查看
  • 普通用户: 599金币
  • VIP会员: 免费
  • 永久会员: 免费

主题授权提示:请在后台主题设置-主题授权-激活主题的正版授权,授权购买:RiTheme官网

声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。