
资讯
智象未来发布 HD-V1:原生全模态视频,物理规律与音画一体
一句话:9 月 15 日智象未来(HiDream.ai)发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0(HD-V1),支持文本 / 图像 / 视频输入,一键生成 5–20 秒 1080p 视频,并同期完成 C+ 轮融资。
背景
- 视频生成从「逐帧画面」竞争转向「原生全模态」:把文本、视频、音频在同一生成过程中联合建模,而非先画面后配音的拼接路线。
核心要点
- 原生全模态架构,对文本、视频、音频联合建模,音画同步生成而非后期拼接。
- 前置多模态意图理解模块,结构化规划镜头、运镜与音效。
- 将重力、碰撞、惯性等物理规律写入生成逻辑,画面更真实。
- 国际榜单:Artificial Analysis 图生视频(含音频)全球第 4,Arena.ai 第 8。
为什么重要
- 中国视频模型进入全球第一梯队,且以「原生全模态」路线区别于后期拼接方案。
- 物理规律建模让 AI 视频更接近真实质感,是商业化落地的关键。
关键事实速记
- 发布:2026-09-15
- 模型:HD-V1(HiDream-O1-Video-1.0)
- 时长:5–20s / 1080p
- 榜单:AA 第4 / Arena 第8
📂 原文链接:查看原文 →
← 返回资讯列表
AI8899 · 内容仅供学习参考