全模态输入
同一个模型把文字、图片、视频和音频当作单一上下文来读取。
MiniMax 的全模态视频模型——原生立体声音频、领先的视频编辑,同在一个 Canvas。
MiniMax H3 是 MiniMax 推出的全模态视频模型,媒体常称它为「海螺 3.0」。同一个模型能把文字、图片、视频和音频当作一个整体来理解,一次生成即可返回 4–15 秒、最高 2K 的片段,并在同一次运算里带上原生立体声音频,还具备排名领先的视频编辑与动作迁移能力。
在 Renoise 中,MiniMax H3 与 Seedance 2.0、Kling 3.0 Omni 同在一个 Canvas 上运行。
还在和其他工具做取舍? 对比海螺 AI
同一个模型把文字、图片、视频和音频当作单一上下文来读取。
声音与画面在同一次运算里一起生成——无需单独处理音频。
只编辑视频中的局部区域,画面其余部分保持不变。
用参考动作驱动主体,让运动连贯、受控、可执导。

拖入最多 9 张图片、3 段视频和 3 段音频。系统自动进行 MD5 去重。

用大白话描述镜头、运动和声音,并设置 4 到 15 秒。
在模型选择器中选择 MiniMax H3,点击 Generate。
三者都在 Renoise 中运行——按镜头各取所需,没有谁更优。需要全模态编辑和动作迁移时选 MiniMax H3;需要电影级 21:9 和 4K 时选 Seedance 2.0;需要原生唇形同步和多镜头时选 Kling 3.0 Omni。
| 看你的镜头需求 | MiniMax H3 (Recommended) | Seedance 2.0 | Kling 3.0 Omni |
|---|---|---|---|
| 最适合 | 全模态编辑与动作迁移 | 音频原生、电影级 21:9 | 唇形同步与多镜头 |
| 原生音频 | ✓ 立体声 | ✓ | —(原生唇形同步) |
| 局部视频编辑 | ✓ 排名领先 | — | — |
| 动作迁移 | ✓ | — | — |
| 最高分辨率 | 最高 2K | 原生 4K | 1080p |
| 片段时长 | 4–15s | 4–15s,另有 Fast 模式 | 3–15s(含参考视频时 ≤10s) |
| 参考输入 | 图片 ×9、视频 ×3、音频 ×3 | 图片 ×9、视频 ×3、音频 ×3 | 图片 ×7、视频 ×1 |
一个 Renoise 订阅即可解锁 MiniMax H3,以及所有可用的视频和图片模型。
MiniMax H3 由 MiniMax 开发。Renoise 将它与 Seedance 2.0、Kling 3.0 Omni、Grok Imagine Video、Nano Banana 2 / Pro、GPT Image 2 和 Midjourney V7 一同集成——Renoise 本身并不训练视频模型。
基本可以这么说。「海螺 3.0」是媒体常用的俗称,官方名称是 MiniMax H3,属于 MiniMax 海螺 H 系列,接续海螺 01 和 02。
它是全模态的——同一个模型把文字、图片、视频和音频一起读取,在同一次运算里生成原生立体声音频,并新增了排名领先的局部视频编辑和动作迁移。
可以。音效、环境音和对白与画面在同一次运算里生成,并与动作同步——无需单独的音频步骤。
可以。它支持局部编辑,你可以只打磨片段中选定的部分,而场景、运动和音频的其余部分保持不变。它在 Artificial Analysis 榜单的视频编辑项目上排名第一。
单次生成最多支持 9 张图片、3 段视频和 3 段音频。Renoise 会将参考素材重新上传到其素材库,并自动进行 MD5 去重。
不能。MiniMax H3 的视频最高输出 2K。如果需要原生 4K 视频,请使用 Seedance 2.0;4K 也适用于图片模型 Nano Banana Pro 和 GPT Image 2。
MiniMax 称 H3 的权重将开源,但发布时尚未放出。在 Renoise 中,你今天就能直接在 Canvas 上使用 MiniMax H3,无需自己部署任何东西。
仅在获得授权时可以。模型会拦截可识别的真人面孔;请先确认一张你有权使用的面孔,通过后的面孔即可作为参考使用。公众人物、名人和未成年人不在许可范围内。
需要全模态编辑和动作迁移时选 MiniMax H3;需要电影级 21:9 和原生 4K 时选 Seedance 2.0;需要原生唇形同步和多镜头序列时选 Kling 3.0 Omni。三者同在一个 Canvas,可按镜头随时切换。
MiniMax H3 按 Renoise 的积分订阅计费,每条视频 $0.34 起,无需另外订阅 MiniMax。一个订阅还能解锁所有其它可用的视频和图片模型。