中国政策档案 Governance Archive HOLDINGS 234,771 · FONDS 122
Record · qbitai ACC. 900072560

China's First 100,000-Card AI Cluster Completed with Fully Domestic Computing Power

中国首个十万卡集群落成!全国产算力支撑“十万卡时代”

Issuer
Date
2026-07-11
Instrument
other
Cited by
0
This news report announces the completion of the Sugon 8000 (Dengfeng) AI cluster, featuring 100,000 domestic accelerator cards, integrated with the National Supercomputing Internet and the National Integrated Computing Network. It highlights the cluster's native supercomputing-AI fusion architecture, engineering achievements, and applications in scientific fields.
Full text · 原文 1,879 字
允中 发自 凹非寺<br> 量子位 | 公众号 QbitAI<br> 中国AI算力,一脚油门踩进了十万卡时代。<br> 7月10日,郑州。中科曙光宣布,全国产AI超集群曙光8000(登峰)正式落成,并依托国家超算互联网,同步接入全国一体化算力网。<br> 十万张国产加速卡,跑起来了。<br> 这不是一个“加大号”的万卡集群。从万卡到十万卡,不是多加几个零,而是一道完全不同的工程题。<br> 网络怎么不堵、存储怎么不崩、散热怎么不烧、调度怎么不乱——规模每上一个量级,系统复杂度都是指数级翻倍。<br> 更关键的是,这座集群走的不是“堆卡”的老路。<br> 一座Token工厂,两种活都要能干<br> 当前AI算力中心有个普遍的尴尬:建了一堆集群,能跑大模型的跑不了科学计算,能跑科学计算的训不动大模型。<br> “两头不靠”的结构性错配,让大量算力资源躺在机房里晒太阳。<br> 曙光8000给出的解法是“原生超智融合”——同一套系统,既能扛住FP64双精度的科学计算任务,也能跑满万亿参数大模型的训练需求。<br> 从FP64到INT8,全精度覆盖。<br> 这不是把超算和智算拼在一起,而是从架构设计阶段就把两件事当作一件事来做。<br> 打个比方:以前的思路是为卡车修一条路,为轿车修另一条路。<br> 现在是修一条能同时跑卡车和轿车的路。看起来都是路,但设计逻辑完全不同。<br> 尽管“超智融合”概念并不新鲜,但作为业内首个基于原生超智融合路线打造、支持全精度计算的十万卡级算力集群案例,曙光8000无疑为国产算力资源配置优化给出了一条现实路径——<br> 通过构建“超智融合”平台,将分散的超算中心与智算中心资源池化,进而实现跨平台、跨架构的统一调度,这对于提升国产算力利用率、降低重复建设成本极具领航意义。<br> 工程奇迹不在纸上,在机房里<br> 十万卡集群的工程难度,业内心知肚明,但中科曙光依然创下了历史纪录。<br> 2024年系统研制,2025年完成工程建设,今年2月3万卡上线试运行,4月份再次投用6万卡AI4S集群,7月份10万卡部署落地。<br> 这个令人咂舌的工程奇迹,源于中科曙光30多年积淀的工程能力。<br> 据中科曙光高级副总裁李斌介绍,曙光8000在系统建设上,具有芯片、计算、存储、网络、散热、管理、服务等全链路全国产自研能力。<br> 其中,海光等国产芯片为系统建设提供底层支撑;<br> scaleFabric类IB原生RDMA高速网络实现十万卡集群高可靠连接;<br> ParaStor分布式存储支撑大模型训练和科学计算中的海量数据读写,并在2026全球IO500榜单中获得生产型全节点和10节点性能双榜第一。<br> 此外,叠加曙光数创在液冷技术上的核心优势,可有效支撑MW级高功率密度部署,并通过国产冷媒、全年自然冷却等方式,大幅提升曙光8000能效。<br> 难能可贵的是,如此强大的工程能力不是用来炫技的。<br> 中科曙光已同步将曙光8000接入国家超算互联网,以算力服务的方式向科研机构和产业界开放。<br> 目前已完成300余项应用适配,覆盖材料、电磁、量子、生物医药、天文气象等20多个领域,累计完成70余次万卡规模算力测试。<br> 算力的终极命题不是“跑分”,是“用好”<br> AI产业有一个被反复验证的规律:发布会上的参数永远跑不赢业务现场的考验。<br> 曙光8000已经在真实场景中交出了成绩单。<br> 8万张卡加速蛋白质折叠全流程模拟,直接服务新药研发;<br> 8.8万张卡完成328万亿网格湍流直接模拟,支撑航空、船舶等高端制造;<br> 9万张卡协同完成3.16万亿个原子的DFT高精度仿真。<br> 这些不是PPT数字,是科研团队在国产算力上跑出来的世界级成果。<br> 更值得关注的是,曙光8000采用了AI计算开放架构,支持多品牌AI加速卡,兼容主流生态。<br> 这意味着一线开发者和科研人员不需要重新学习一套封闭工具链,已有的模型和应用可以快速迁移上线。<br> 开放的另一个好处,是让整个产业链都能参与进来,而不只是看一家公司独自表演。<br> 大会期间,中科曙光与北京科学智能研究院达成战略合作,正式启动第二套全国产十万卡超智融合算力系统研制与建设。<br> 曙光8000正在从一个示范工程,走向可复制的标准方案。<br> 一条更难的路,一个更大的局<br> 东数西算、全国一体化算力网、国家超算互联网,这些顶层设计的目标都是同一件事:让算力像电力一样流动起来。<br> 曙光8000落子郑州颇具深意。<br> 郑州的区位、能源条件和网络节点地位,让它天然适合成为连接东西部算力的枢纽。<br> 这一子落下,意味着国家算力网的骨干节点有了十万卡级的承载能力。<br> 当更多十万卡级节点在全国铺开,中国将率先织成全球最大规模的算力调度网络——<br> 这才是登峰之后,真正值得看的风景。<br> *本文系量子位获授权刊载,观点仅为原作者所有。