3合1|文图视频统一生成模态数量
智谱发布GLM-5.2:对标GPT-5的全模态统一大模型,一Token统一文图视频生成
一Token统一:告别分模块建模时代
智谱GLM-5.2核心创新在于「统一多模态范式」——单个模型架构同时胜任文本理解、图像生成、视频生成三大任务,不再需要分别调用不同的子模块。技术路线与OpenAI的GPT-5理念一致:用一个统一架构解决所有模态的输出问题。这意味着用户在对话框中发一条指令,系统就能自动判断并输出最合适的格式——文字回答、配图、还是视频。
竖屏9:16高清视频一键生成是最受创作者关注的功能。过去制作竖屏视频需要经过分镜、生成、拼接等多个步骤,现在GLM-5.2一次指令即可产出可直接发布的视频内容,效率提升数倍。
国产统一多模态的里程碑
智谱CEO张鹏表示GLM-5.2在多个国际基准测试中达到GPT-5的同等水准,尤其在中文理解方面有天然优势。清华教授评价「这是国产大模型首次在统一多模态范式上与国际最前沿对齐」。新版本通过智谱开放平台提供API服务,定价策略较GPT-5有明显竞争力。
← 返回资讯列表
AI8899 · 内容仅供学习参考