AI 摘要
快速了解本文
01
国内首个国产 GPU 与类脑芯片异构混合推理系统发布。
02
Deepseek V4 实测显示该系统性价比提升一倍以上。
03
业务运营成本降低 40% 以上,面向高实时性场景。
本摘要由 AI 辅助整理,请以正文内容为准。
数智朋克讯 9 月 11 日至 13 日在河北廊坊举行的 2026 中国算力大会上,移动云公司联合中国电子科技南湖研究院、北京灵汐科技、上海天数智芯、清华大学、北京大学共同发布了国内首个国产 GPU + 类脑芯片大模型异构混合推理系统。
经 Deepseek V4 实测,该系统相较同类国产 GPU 算力集群性价比提升一倍以上,业务运营成本降低 40% 以上。
核心技术思路
系统的核心思路是“分而治之,协同增效”:将大模型做 PD/AF 拆分,Attention 计算由国产 GPU 承担,FFN(MOE 专家)等延时敏感模块交由类脑芯片利用存算一体与片上大容量 SRAM 架构优势处理。任务拆解、协同调度与结果聚合通过自研模型编译器、高速互联协议和统一推理引擎实现。
关键数据
100%+性价比提升相较同类国产 GPU 集群
40%+运营成本降低业务运营层面
该系统可适配 Token 工厂、AI 代码生成、多智能体协同、智能制造等高实时性场景,并面向金融、安防、通信等安全敏感行业提供全栈国产化推理底座。

