简析曙光全栈布局🏹
技术圈看AI集群,最怕一句话:先把卡堆起来再说。
现实是,到了千卡、万卡规模,真正的问题不是有没有卡,而是卡之间能不能高效通信,数据能不能及时喂上,系统能不能稳定调度。否则再贵的算力,也可能在等网络、等存储、等任务。
所以曙光这套“算、存、传”全栈布局,我觉得比单点参数更值得看。scaleX40把超节点做成更易部署的箱式形态,降低工程复杂度;ParaStor F9000强调分布式高性能存储,FlashNexus主打集中式全闪高IO;scaleFabric则是400G无损网络,补的是大集群通信底座。
技术上,这其实是在回答一个问题:国产AI集群能不能从“能跑”走向“跑得稳、跑得久、跑得省”。这比单纯晒峰值更难。
曙光的路线有点像把发动机、油路、传动系统一起做。短期可能不如单个爆款参数刺激,但对真正的大规模智算中心来说,这才是硬菜。
技术观察 scaleFabric scaleX40 国产高速互联
