← 资讯列表
3合1|文图视频统一生成模态数量

智谱发布GLM-5.2:对标GPT-5的全模态统一大模型,一Token统一文图视频生成

📅 2026/6/4 08:00:00👁 1 阅读⏱ 约 2 分钟

一Token统一:告别分模块建模时代

智谱GLM-5.2核心创新在于「统一多模态范式」——单个模型架构同时胜任文本理解、图像生成、视频生成三大任务,不再需要分别调用不同的子模块。技术路线与OpenAI的GPT-5理念一致:用一个统一架构解决所有模态的输出问题。这意味着用户在对话框中发一条指令,系统就能自动判断并输出最合适的格式——文字回答、配图、还是视频。

https://nimg.ws.126.net/?url=http%3A%2F%2Fdingyue.ws.126.net%2F2026%2F0605%2Fe4b7a2d3j00tgx8s7001jd001jk00v9p.jpg&thumbnail=660x2147483647&quality=80&type=jpg'/>

竖屏9:16高清视频一键生成是最受创作者关注的功能。过去制作竖屏视频需要经过分镜、生成、拼接等多个步骤,现在GLM-5.2一次指令即可产出可直接发布的视频内容,效率提升数倍。

国产统一多模态的里程碑

智谱CEO张鹏表示GLM-5.2在多个国际基准测试中达到GPT-5的同等水准,尤其在中文理解方面有天然优势。清华教授评价「这是国产大模型首次在统一多模态范式上与国际最前沿对齐」。新版本通过智谱开放平台提供API服务,定价策略较GPT-5有明显竞争力。

← 返回资讯列表 AI8899 · 内容仅供学习参考