← 资讯列表
资讯

智象未来发布 HD-V1:原生全模态视频,物理规律与音画一体

📅 2026/9/15 08:00:00👁 1 阅读⏱ 约 3 分钟

一句话:9 月 15 日智象未来(HiDream.ai)发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0(HD-V1),支持文本 / 图像 / 视频输入,一键生成 5–20 秒 1080p 视频,并同期完成 C+ 轮融资。

背景

  • 视频生成从「逐帧画面」竞争转向「原生全模态」:把文本、视频、音频在同一生成过程中联合建模,而非先画面后配音的拼接路线。

核心要点

  • 原生全模态架构,对文本、视频、音频联合建模,音画同步生成而非后期拼接。
  • 前置多模态意图理解模块,结构化规划镜头、运镜与音效。
  • 将重力、碰撞、惯性等物理规律写入生成逻辑,画面更真实。
  • 国际榜单:Artificial Analysis 图生视频(含音频)全球第 4,Arena.ai 第 8。

为什么重要

  • 中国视频模型进入全球第一梯队,且以「原生全模态」路线区别于后期拼接方案。
  • 物理规律建模让 AI 视频更接近真实质感,是商业化落地的关键。

关键事实速记

  • 发布:2026-09-15
  • 模型:HD-V1(HiDream-O1-Video-1.0)
  • 时长:5–20s / 1080p
  • 榜单:AA 第4 / Arena 第8

📂 原文链接:查看原文 →

← 返回资讯列表 AI8899 · 内容仅供学习参考