← 资讯列表
资讯

MiniMax H3 全模态视频模型在赣江新区首发

📅 2026/9/14 08:00:00👁 1 阅读⏱ 约 2 分钟

一句话:9 月 14 日 MiniMax 在南昌赣江新区首发全模态视频模型 H3,统一处理文本 / 图像 / 视频 / 音频输入,主打更长时长、更强一致性与音画一体生成。

背景

  • 视频生成从「逐帧画面」竞争转向「原生全模态」:把文本、视频、音频在同一生成过程中联合建模,而非先画面后配音的拼接路线。

核心要点

  • 全模态输入:文本 / 图像 / 视频 / 音频统一建模。
  • 音画同步生成,而非后期拼接。
  • 更长单次生成时长,降低分段拼接。
  • 在角色 / 场景一致性上显著升级。

为什么重要

  • 国产视频模型以「原生全模态」路线参与全球竞争,区别于后期拼接方案。
  • 音画一体生成降低短视频、广告与影视预演的制作门槛。

关键事实速记

  • 首发:2026-09-14
  • 地点:南昌赣江新区
  • 模型:MiniMax H3
  • 特性:原生全模态 + 音画一体

📂 原文链接:查看原文 →

← 返回资讯列表 AI8899 · 内容仅供学习参考