03 Aug 2026, 15:00
MiniMax H3 已上线
Media 页面新增了一个视频套装:MiniMax H3,一个全模态模型,在一次生成中同时产出画面与声音 —— 音频不是事后配上的,而是与视频同源生成。
开始第一个片段前值得了解的几点:
- 声音是模型的一部分。 像描述画面一样描述声音,它会与镜头一起生成。立体声,无需单独的配音步骤。
- 参考图像、音频与视频。 附加它们并在提示词中指向它们;模型会据此在多个镜头间保持主体或风格一致。
- 片段时长不是任意的。 H3 在 24 fps 下只接受固定格点上的长度,工作流会把你要求的时长对齐到最近的合法值。正好为整秒的是 8 秒、25 秒和 42 秒。
- 一个提示词,多个镜头。 模型会读取带有剪辑时间点的镜头列表,因此单次生成可以包含多个镜头,而不只是一个连续长镜头。
打开 Media → Video → MiniMax H3 即可启动。