设为首页收藏本站 劰载中...

 找回密码
 立即注册
查看: 146|回复: 6

MiniMax-H3:让视频创作变得超简单,15秒2K大片一键出!文字图片一键生成带声高清视频

[复制链接]

1059

主题

1871

回帖

13万

积分

武林盟主

积分
137116

宣传达人灌水之王突出贡献荣誉管理论坛元老

QQ
发表于 昨天 18:14 | 显示全部楼层 |阅读模式

马上注册,下载更多AI资源软件

您需要 登录 才可以下载或查看,没有账号?立即注册

×

MiniMax-H3:让视频创作变得超简单,15秒2K大片一键出!文字图片一键生成带声高清视频 ... ... ... ...

MiniMax-H3:让视频创作变得超简单,15秒2K大片一键出!文字图片一键生成带声高清视频 ... ... ... ...

MiniMax-H3 是 MiniMax 公司推出的一款通用、全能型(omni-modal)多模态生成模型,可以同时理解和处理文字、图片、视频、音频,并生成带原生立体声音频的视频。
它像一个“全能视频创作助手”:你给它文字描述、参考图片、参考视频,甚至参考音频,它就能生成最长15秒、最高2K分辨率、带立体声的视频。它在预训练阶段就具备很强的多模态理解和复杂指令跟随能力,不只是简单的“文字转视频”。
MiniMax-H3 经过多次权威机构测试,应该是目前开源模型里能力最强的“文字/图片/视频/音频 → 带声音视频”全能生成工具,适合需要高质量、可控、带音频的短视频创作场景。

MiniMax-H3:让视频创作变得超简单,15秒2K大片一键出!文字图片一键生成带声高清视频 ... ... ... ...

MiniMax-H3:让视频创作变得超简单,15秒2K大片一键出!文字图片一键生成带声高清视频 ... ... ... ...


说两句:下午简单测试了下,应该是目前史上最强开源视频生成模型,甚至超越很多商业闭源模型。在提示词很简单的情况下生成的效果也很惊艳。第一时间做了WebUI和整合包,供大家体验!
感谢KJ大佬第一时间分享量化模型,后期社区会有更多大佬改进和发扬这个牛B的模型,本站也会持续更新!



主要特点

多模态输入输出:支持文字、图片、视频、音频的混合输入,输出同步的视频 + 立体声音频(32kHz)。
灵活的生成模式:
纯文字生成视频(Text-to-Video)
首帧/末帧/首尾帧控制生成
多参考(最多9张图、3段视频、3段音频等)控制生成

画质与规格:默认768p,可通过二次生成达到2K;支持多种宽高比(横屏、竖屏、方形等);24帧/秒;时长4–15秒。
语言支持:稳定支持11种语言(中、英、日、韩、法、德、西、意、葡、俄、阿),其他语言也有一定支持。
系统架构:分为三个模块——上下文理解与优化(H3-Context-IR)、基础生成(H3-Base,约33B参数)、2K高清再生成。开源的是基础生成部分,完整高清流程可通过官方API使用。



应用领域

内容创作:短视频、广告、宣传片、社交媒体内容快速生成。
影视与动画:预可视化、分镜、特效参考、简单动画片段。
游戏与虚拟现实:角色动画、场景演示、交互内容原型。
教育与培训:教学视频、演示动画。
营销与电商:产品展示视频、个性化广告。
多模态研究与开发:作为开源基座模型进行微调或二次开发。



使用教程:(建议N卡,显存12G起,运存32G起,支持50系显卡)

整合包包含所需所有节点,下载主程序和模型(ComfyUI文件夹),解压主程序一键包,将ComfyUI文件夹移动到主程序目录下即可。

WebUI模式:
双击启动跳转,进入WebUI后,根据需要切换文生视频和首尾帧视频生成选项卡,输入提示词或上传图像,设置相关参数,运行生成即可。

ComfyUI模式:
双击启动ComfyUI,进入WebUI后,点击左侧的 工作流程,选择对应的工作流,根据需要选择文生视频和首尾帧视频生成
输入提示词或上传需要生成的图像,输入提示词,设置相关参数,运行即可。

实测12G显存可以运行,但需要开启共享显存,且运存需要32G起。




百万像素和宽高比 对应参数 供大家参考

| 0.2 | 16:9 | 608 x 352 |
| 0.3 | 16:9 | 736 x 416 |
| 0.4 | 16:9 | 864 x 480 |
| 0.5 | 16:9 | 960 x 544 |
| 0.6 | 16:9 | 1056 x 608 |
| 0.7 | 16:9 | 1152 x 640 |
| 0.8 | 16:9 | 1216 x 672 |
| 0.9 | 16:9 | 1280 x 736 |
| 0.98 | 16:9 | 1344 x 768 |
| 1.0 | 16:9 | 1376 x 768 |
| 1.2 | 16:9 | 1504 x 832 |
| 1.5 | 16:9 | 1664 x 928 |
| 1.8 | 16:9 | 1824 x 1024 |
| 2.0 | 16:9 | 1920 x 1088 |



软件目录结构:

📂 ComfyUI/
├── 📂 diffusion_models/
│   ├── 📂 unet/
│   │      └── minimax_h3_fl2va_pruned_int8_convrot.safetensors
│   │      └── minimax_h3_ref2va_pruned_int8_convrot.safetensors
│   ├── 📂 text_encoders/
│   │      └── qwen3vl_32b_minimax_h3_int8_convrot.safetensors
│   └── 📂 vae/
│          └── minimax_h3_audio_vae_fp32.safetensors
│          └── minimax_h3_video_vae_fp16.safetensors
📂 deepface/
......


下载地址:
迅雷云盘:https://pan.xunlei.com/s/VOz6NBcY18pBU9WVo1mnG6ibA1?pwd=4hnz

夸克网盘:
🔒付费内容
游客, 上上宾会员 可免费下载该资源,点此开通上上宾 免费下载全站99%的付费资源。或单独支付 20碎银 下载该资源


百度网盘:
🔒付费内容
游客, 上上宾会员 可免费下载该资源,点此开通上上宾 免费下载全站99%的付费资源。或单独支付 40碎银 下载该资源

DEEPFACE论坛免责声明
本论坛发布的所有内容,包括图片、软件、模型等部分来自网络,版权归原作者所有。
本论坛提供的内容仅用于个人学习和研究,请勿滥用,否则由此引发的责任需自行承担。
请合理合法使用AI技术,并遵守当地法律法规,不要用于违法用途!
如本站发布内容侵犯了你的合法权益,请联系我们删除。
全站默认解压密码: https://deepface.cc/ 或 https://deepfaces.cc/ (密码就是这个网址,不要点开去找。复制完整网址即可,不要有空格)

各种参数DFL换脸模型/实时换脸模型底丹、实时换脸模型训练教学/实时换脸模型定制、AI软件个性化及功能定制
论坛所有一键包报错请在帖子下方跟帖,看到会回复,不支持一对一解答,请确认再下载!
全站默认解压密码: https://deepface.cc/ 或 https://deepfaces.cc/ (密码就是这个网址,不要点开去找。复制完整网址即可,不要有空格)

0

主题

1

回帖

6

积分

初入江湖

积分
6
发表于 昨天 19:00 | 显示全部楼层
终于等到了,H3真的强!这个星期估计H3的生态要雨后春笋那样出来了要!

0

主题

20

回帖

125

积分

无名之辈

积分
125
发表于 昨天 19:59 | 显示全部楼层
看了B站的评测,这个真的是史上最强开源视频模型了,等wan2gp版出来我也该续会员了,本来觉得最近没啥好用的模型了,没想到来了这么强的,这是我续费的动力哈哈,一年到期了,去年这个时候wan2.2横空出世,果断充电。一年过去了,发展速度太快了,坛主持续对wan2gp的汉化和整合比其它家的要准确好用,希望这个月为了这个NB的模型提前破例更新wan2gp,感谢!

1059

主题

1871

回帖

13万

积分

武林盟主

积分
137116

宣传达人灌水之王突出贡献荣誉管理论坛元老

QQ
 楼主| 发表于 昨天 22:32 | 显示全部楼层
215069003 发表于 2026-8-3 19:59
看了B站的评测,这个真的是史上最强开源视频模型了,等wan2gp版出来我也该续会员了,本来觉得最近没啥好用 ...

新模型只会越来越多,越来越强!

各种参数DFL换脸模型/实时换脸模型底丹、实时换脸模型训练教学/实时换脸模型定制、AI软件个性化及功能定制
论坛所有一键包报错请在帖子下方跟帖,看到会回复,不支持一对一解答,请确认再下载!
全站默认解压密码: https://deepface.cc/ 或 https://deepfaces.cc/ (密码就是这个网址,不要点开去找。复制完整网址即可,不要有空格)

0

主题

28

回帖

133

积分

上上宾

积分
133

上上宾

发表于 昨天 23:01 | 显示全部楼层
我觉得H3也没必要整合进wan2gp了,这一个就可以抵所有视频模型了。
大哥要不专门针对h3出个系列吧,加入视频和音频参考功能,再开放个API,嗲!

12

主题

153

回帖

2640

积分

超级版主

积分
2640

突出贡献

发表于 昨天 23:29 | 显示全部楼层
效果炸裂,有些效果甚至比sd2都要好

0

主题

20

回帖

125

积分

无名之辈

积分
125
发表于 4 小时前 | 显示全部楼层
nevets 发表于 2026-8-3 23:01
我觉得H3也没必要整合进wan2gp了,这一个就可以抵所有视频模型了。
大哥要不专门针对h3出个系列吧,加入视 ...

当然需要,一个comfyui,一个webui,工作台形式不一样,这么好的模型理应百花齐放,有各种操作流程适应不同偏好的人群,而且wan2gp是目前最顶级的webui了,不过有一点你说的对,wan2gp这次我准备只留H3视频模型哈哈
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|前沿AI软件资源站

GMT+8, 2026-8-4 04:51 , Processed in 0.038837 second(s), 4 queries , Redis On.

Powered by Discuz! X3.5

©2001-2023 Discuz! Team

快速回复 返回顶部 返回列表