中国政策档案 Governance Archive HOLDINGS 234,771 · FONDS 122
Record · qbitai ACC. 900072559

China's First 100,000-Card Cluster Completed: Domestic Computing Power Supports the '100,000-Card Era'

中国首个十万卡集群落成!全国产算力支撑“十万卡时代”

Issuer
Date
2026-07-11
Instrument
other
Cited by
0
This news article reports the completion of the Sugon 8000 (Dengfeng) cluster in Zhengzhou, featuring 100,000 domestic AI accelerators. The cluster supports both scientific computing and large-scale AI model training, integrated into the national computing network.
Full text · 原文 1,879 字
允中 发自 凹非寺<br> 量子位 | 公众号 QbitAI<br> 中国AI算力,一脚油门踩进了十万卡时代。<br> 7月10日,郑州。中科曙光宣布,全国产AI超集群曙光8000(登峰)正式落成,并依托国家超算互联网,同步接入全国一体化算力网。<br> 十万张国产加速卡,跑起来了。<br> 这不是一个“加大号”的万卡集群。从万卡到十万卡,不是多加几个零,而是一道完全不同的工程题。<br> 网络怎么不堵、存储怎么不崩、散热怎么不烧、调度怎么不乱——规模每上一个量级,系统复杂度都是指数级翻倍。<br> 更关键的是,这座集群走的不是“堆卡”的老路。<br> 一座Token工厂,两种活都要能干<br> 当前AI算力中心有个普遍的尴尬:建了一堆集群,能跑大模型的跑不了科学计算,能跑科学计算的训不动大模型。<br> “两头不靠”的结构性错配,让大量算力资源躺在机房里晒太阳。<br> 曙光8000给出的解法是“原生超智融合”——同一套系统,既能扛住FP64双精度的科学计算任务,也能跑满万亿参数大模型的训练需求。<br> 从FP64到INT8,全精度覆盖。<br> 这不是把超算和智算拼在一起,而是从架构设计阶段就把两件事当作一件事来做。<br> 打个比方:以前的思路是为卡车修一条路,为轿车修另一条路。<br> 现在是修一条能同时跑卡车和轿车的路。看起来都是路,但设计逻辑完全不同。<br> 尽管“超智融合”概念并不新鲜,但作为业内首个基于原生超智融合路线打造、支持全精度计算的十万卡级算力集群案例,曙光8000无疑为国产算力资源配置优化给出了一条现实路径——<br> 通过构建“超智融合”平台,将分散的超算中心与智算中心资源池化,进而实现跨平台、跨架构的统一调度,这对于提升国产算力利用率、降低重复建设成本极具领航意义。<br> 工程奇迹不在纸上,在机房里<br> 十万卡集群的工程难度,业内心知肚明,但中科曙光依然创下了历史纪录。<br> 2024年系统研制,2025年完成工程建设,今年2月3万卡上线试运行,4月份再次投用6万卡AI4S集群,7月份10万卡部署落地。<br> 这个令人咂舌的工程奇迹,源于中科曙光30多年积淀的工程能力。<br> 据中科曙光高级副总裁李斌介绍,曙光8000在系统建设上,具有芯片、计算、存储、网络、散热、管理、服务等全链路全国产自研能力。<br> 其中,海光等国产芯片为系统建设提供底层支撑;<br> scaleFabric类IB原生RDMA高速网络实现十万卡集群高可靠连接;<br> ParaStor分布式存储支撑大模型训练和科学计算中的海量数据读写,并在2026全球IO500榜单中获得生产型全节点和10节点性能双榜第一。<br> 此外,叠加曙光数创在液冷技术上的核心优势,可有效支撑MW级高功率密度部署,并通过国产冷媒、全年自然冷却等方式,大幅提升曙光8000能效。<br> 难能可贵的是,如此强大的工程能力不是用来炫技的。<br> 中科曙光已同步将曙光8000接入国家超算互联网,以算力服务的方式向科研机构和产业界开放。<br> 目前已完成300余项应用适配,覆盖材料、电磁、量子、生物医药、天文气象等20多个领域,累计完成70余次万卡规模算力测试。<br> 算力的终极命题不是“跑分”,是“用好”<br> AI产业有一个被反复验证的规律:发布会上的参数永远跑不赢业务现场的考验。<br> 曙光8000已经在真实场景中交出了成绩单。<br> 8万张卡加速蛋白质折叠全流程模拟,直接服务新药研发;<br> 8.8万张卡完成328万亿网格湍流直接模拟,支撑航空、船舶等高端制造;<br> 9万张卡协同完成3.16万亿个原子的DFT高精度仿真。<br> 这些不是PPT数字,是科研团队在国产算力上跑出来的世界级成果。<br> 更值得关注的是,曙光8000采用了AI计算开放架构,支持多品牌AI加速卡,兼容主流生态。<br> 这意味着一线开发者和科研人员不需要重新学习一套封闭工具链,已有的模型和应用可以快速迁移上线。<br> 开放的另一个好处,是让整个产业链都能参与进来,而不只是看一家公司独自表演。<br> 大会期间,中科曙光与北京科学智能研究院达成战略合作,正式启动第二套全国产十万卡超智融合算力系统研制与建设。<br> 曙光8000正在从一个示范工程,走向可复制的标准方案。<br> 一条更难的路,一个更大的局<br> 东数西算、全国一体化算力网、国家超算互联网,这些顶层设计的目标都是同一件事:让算力像电力一样流动起来。<br> 曙光8000落子郑州颇具深意。<br> 郑州的区位、能源条件和网络节点地位,让它天然适合成为连接东西部算力的枢纽。<br> 这一子落下,意味着国家算力网的骨干节点有了十万卡级的承载能力。<br> 当更多十万卡级节点在全国铺开,中国将率先织成全球最大规模的算力调度网络——<br> 这才是登峰之后,真正值得看的风景。<br> *本文系量子位获授权刊载,观点仅为原作者所有。