Asta Lab · 全栈情报站AI FULL-STACK INTELLIGENCE每日 · 全栈 · 精选

AstaNews

AI 全栈每日情报

ISC'26 TOP500 新世界第一:中国 LineShine 2.198 Exaflops,全 CPU 无加速器

Exaflops(EFLOPS)是每秒 10^18 次浮点运算。2.198 Exaflops 是目前 TOP500 榜单有史以来的最高纪录。为参照:此前排名第一的美国 Frontier 超算约达 1.2 Exaflops,是业界首台突破 1 Exaflops 的机器,LineShine 的数字约为其 1.8 倍。 全 CPU 无加速器是 LineShine 最值得分析的特征。主流超算和 AI 集群架构依赖 GPU(如 NVIDIA H100/H200)或专用 ASIC(如 Google TPU),因为这两类芯片在矩阵运算上的效率远超通用 CPU。LineShine 的全 CPU 设计意味着:要么中国开发了性能指标远超公开认知的新型 CPU 芯片,要么在系统级互联和并行工程上实现了突破性优化,或者两者兼而有之。 从出口管制背景来看,中国 9 年来首次重返 TOP500,据称此前退出与不提交数据以规避制裁核查相关。LineShine 的登顶也是一个信号:即使在 GPU 出口受限的情况下,中国在高性能计算方面仍具备达到世界第一的工程能力。 对 AI infra 的参考价值需要分层讨论。TOP500 使用的 HPL(High Performance Linpack)基准衡量密集矩阵计算能力,与 AI 训练和推理的实际工作负载有差异——AI 训练以混合精度为主,HPL 是双精度 FP64。因此 LineShine 的 2.198 Exaflops 不能直接换算成 AI 训练吞吐。但它暗示:在极端优化下,CPU 集群在某些计算模式下的天花板高于通常预期。 更长远的含义是:如果 GPU 出口管制持续收紧,中国是否有能力通过 CPU 路线在 AI 训练侧实现部分替代?LineShine 的存在本身不能回答这个问题(HPL 与 AI 训练的差异太大),但它提示工程路线的多样性不容忽视。 局限:LineShine 的硬件细节(CPU 型号、节点数量、互联架构)尚未完全公开,具体工程路线暂无法独立验证。TOP500 的 HPL 数字与 AI 实际性能的换算系数因任务而异,不宜过度推论。