
资讯
移动云发布国产 GPU + 类脑芯片异构混合推理系统
一句话:9 月 17 日移动云发布国产 GPU 与类脑芯片异构混合推理系统,在同一推理栈内调度不同架构芯片,兼顾高吞吐与低功耗,服务运营商级 AI 推理。
背景
- 推理成本与能效成为大模型规模化的核心约束;混合异构(通用 GPU + 类脑/神经形态)调度,是运营商降低单位推理能耗的关键路径。
核心要点
- 国产 GPU 与类脑芯片异构混合推理。
- 统一推理栈调度不同架构,按负载分配。
- 兼顾高吞吐与低功耗。
- 面向运营商级大模型推理服务。
为什么重要
- 异构混合推理降低单位 token 能耗,是 AI 基建降本的硬指标。
- 国产芯片协同调度减少对单一架构的依赖。
关键事实速记
- 发布:2026-09-17
- 主体:移动云
- 架构:国产 GPU + 类脑芯片
- 场景:运营商级推理
📂 原文链接:查看原文 →
← 返回资讯列表
AI8899 · 内容仅供学习参考