中国首个十万卡级全国产AI超集群落成,曙光8000接入全国一体化算力网

84次阅读
没有评论

共计 1100 个字符,预计需要花费 3 分钟才能阅读完成。

核心摘要

中国首个十万卡集群落成! 全国产算力支撑“十万卡时代”

一句话

核心摘要:中科曙光在郑州宣布 , 全国产 AI 超集群曙光 8000(登峰) 正式落成, 并依托国家超算互联网接入全国一体化算力网。这一十万卡级集群不仅强调规模, 更试图解决 AI 训练、科学计算和产业应用之间长期存在的算力协同难题。

📌 十万卡集群落地, 国产算力进入新阶段

据公开信息,曙光 8000 采用十万张国产加速卡建设, 是国内首个十万卡级全国产 AI 超集群。相比万卡集群, 十万卡规模对网络互联、存储吞吐、散热能效、任务调度和系统稳定性都提出了更高要求, 并不是简单扩容即可完成。

🔍“超智融合”成为关键设计思路

当前不少算力中心面临资源错配: 部分系统更适合传统科学计算,部分系统更适合大模型训练, 跨任务复用效率并不理想。曙光 8000 提出的方向是“原生超智融合”, 即在同一套体系中同时支持科学计算和 AI 训练需求。

按照介绍,该集群覆盖从 FP64 双精度到 INT8 等多种计算精度, 目标是让材料模拟、量子计算、生物医药、气象天文以及大模型训练等不同任务, 可以在统一平台上获得调度与支撑。

💡 全链路国产化与工程能力是看点

中科曙光方面提到,曙光 8000 在芯片、计算、存储、网络、散热、管理和服务等环节具备全链路国产自研能力。其中, 国产芯片提供底层支撑, 高速网络负责大规模节点连接, 分布式存储用于承载大模型训练和科学计算中的海量读写。

  • 网络:采用类 IB 原生 RDMA 高速网络, 面向十万卡集群互联场景。
  • 存储:ParaStor 分布式存储支撑大规模数据读写, 并在 2026 全球 IO500 相关榜单中取得成绩。
  • 散热:结合液冷技术、国产冷媒和自然冷却方式, 服务高功率密度部署与能效提升。
  • 生态:采用 AI 计算开放架构, 支持多品牌 AI 加速卡, 并兼容主流应用生态。

📊 已适配 300 余项应用, 科研场景率先验证

算力基础设施最终要接受应用检验。公开信息显示, 曙光 8000 已完成 300 余项应用适配, 覆盖材料、电磁、量子、生物医药、天文气象等 20 多个领域, 并累计完成 70 余次万卡规模算力测试。

部分已披露案例包括:8 万张卡用于蛋白质折叠全流程模拟,服务新药研发;8.8 万张卡完成 328 万亿网格湍流直接模拟, 面向航空、船舶等高端制造;9 万张卡协同完成 3.16 万亿个原子的 DFT 高精度仿真。这些案例显示, 十万卡级算力正在从展示性指标走向科研与产业任务。

🚀 行业影响: 算力网需要可复制节点

曙光 8000 同步接入国家超算互联网,意味着其不只是一座独立机房, 而是全国一体化算力体系中的重要节点。对于“东数西算”、全国算力调度和科研资源共享而言, 十万卡级节点的出现, 有助于提升骨干算力承载能力。

本文基于公开信息整理, 如有侵权请联系删除。
正文完
 0