
资讯
MiniMax H3 全模态视频模型在赣江新区首发
一句话:9 月 14 日 MiniMax 在南昌赣江新区首发全模态视频模型 H3,统一处理文本 / 图像 / 视频 / 音频输入,主打更长时长、更强一致性与音画一体生成。
背景
- 视频生成从「逐帧画面」竞争转向「原生全模态」:把文本、视频、音频在同一生成过程中联合建模,而非先画面后配音的拼接路线。
核心要点
- 全模态输入:文本 / 图像 / 视频 / 音频统一建模。
- 音画同步生成,而非后期拼接。
- 更长单次生成时长,降低分段拼接。
- 在角色 / 场景一致性上显著升级。
为什么重要
- 国产视频模型以「原生全模态」路线参与全球竞争,区别于后期拼接方案。
- 音画一体生成降低短视频、广告与影视预演的制作门槛。
关键事实速记
- 首发:2026-09-14
- 地点:南昌赣江新区
- 模型:MiniMax H3
- 特性:原生全模态 + 音画一体
📂 原文链接:查看原文 →
← 返回资讯列表
AI8899 · 内容仅供学习参考