国联民生证券在研报中指出,弯道超车随着AI Agent时代的国联到来,Token需求呈现非线性增长,民生进而引发AI算力的超节产算超预期需求。超节点有望成为AI算力发展的点助关键趋势,而国产超节点的力计率提力或快速发展,可能为国产算力带来“弯道超车”的算效升国机遇。重点关注的迎机遇方向包括:1) 国产超节点龙头:浪潮信息(000977.SZ)、中科曙光(603019.SH)等;2) 华为超节点产业链:软通动力(301236.SZ)、弯道超车神州数码(000034.SZ)、国联中国长城(000066.SZ)、民生慧博云通(301316.SZ)、超节产算拓维信息(002261.SZ)等;3) 国产AI芯片/CPU:寒武纪(688256.SH)、点助海光信息(688041.SH)、力计率提力或中国长城、算效升国云天励飞(688343.SH)、龙芯中科(688047.SH)等;4) 云计算:金山云(03896)、网宿科技(300017.SZ)、优刻得(688158.SH)、青云科技(688316.SH)等。

国联民生证券的主要观点如下:

AI的发展推动了算力架构的变革,超节点在提升计算效率方面具有重要作用。AI算力与传统数据中心的计算模式不同,其核心在于推理、上下文处理与数据移动效率,而不仅限于服务器的峰值算力。AI工作负载需要在超长上下文中执行多步骤推理,平台各层级能力受到考验;在数万亿Token的规模下,微小的效率损耗会显著影响成本、吞吐量和竞争力。AI计算的进步可以通过三大扩展定律来体现,包括预训练扩展、后训练扩展和测试时扩展。

在大模型自回归推理中,存在Prefill(计算密集)与Decode(内存带宽密集)两种资源需求冲突的阶段,超节点有潜力成为实现P/D分离的重要支撑。在Decode阶段,性能的决定性因素不再是GPU的峰值算力,而是其在单位时间内的数据读写能力,这直接影响用户体验中的单字生成延迟。采用新型超节点服务器架构可实现高效的P/D任务划分,借助强大的内部互连网络改善数据传输效率。

以英伟达NVIDIA的Rubin平台为例,该平台以极限协同设计为基础,GPU、CPU、网络及软件协调构建,提升了整体系统性能,确保生产部署中的持续高效表现。

国产超节点的加速发展,可能为国产算力带来弯道超车的机遇。例如,浪潮信息的元脑SD200超节点展示了强大的大模型推理性能,单用户token生成速度达到112 tokens/s,且生成时延低于8.9ms,是国内首个突破10ms大关的超节点产品。

中科曙光推出的scaleX40超节点,集成了40张GPU,总算力超过28PFLOPS,能够满足大规模AI模型的训练需求。此外,华为的Atlas系列超节点,如Atlas 900、950和960,皆在算力和存储方面实现了重大突破,分别针对不同场景提供优化。

总体来看,国产超节点的发展不仅在技术创新方面取得进展,还提升了整体的市场竞争力。