国产算力新路径:GPU+类脑芯片混合推理,运营成本降四成

来源:爱集微 #GPU# #类脑芯片# #算力芯片#
329

9月11日至13日,2026中国算力大会在河北廊坊举行。会上,由移动云公司联合中国电子科技南湖研究院、北京灵汐科技、上海天数智芯、清华大学、北京大学共同打造的国内首个国产GPU+类脑芯片大模型异构混合推理系统正式发布。

据I了解,该系统在DeepSeek V4实测中表现突出:相比同类国产GPU算力集群,性价比提升一倍以上,业务运营成本降低40%以上。系统可广泛适配Token工厂、AI代码生成、多智能体协同、智能制造等高实时性场景,同时面向金融、安防、通信等安全敏感行业,提供全栈国产化推理底座。

官方介绍,这套系统的核心思路是“分而治之,协同增效”。具体而言,系统将大模型进行PD/AF拆分,把不同模块部署到各自最擅长的芯片上。其中,Attention计算交由国产GPU,发挥其通用计算优势;FFN(MOE专家)等延时敏感模块则交给类脑芯片,利用其存算一体、片上大容量SRAM的架构优势。通过自研模型编译器、高速互联协议和统一推理引擎,系统实现了两类算力的任务拆解、协同调度和结果聚合,从而突破传统单GPU推理的固有瓶颈。

业内人士认为,该系统的发布为国产算力在大模型推理领域提供了新的技术路径,有望推动国产芯片在异构协同、降本增效方面进一步落地。

责编: 张轶群
来源:爱集微 #GPU# #类脑芯片# #算力芯片#
THE END

*此内容为集微网原创,著作权归集微网所有,爱集微,爱原创

关闭
加载

PDF 加载中...