【大河财立方 记者 司高妍 王宇 实习生 苏慧珍】面对AI大模型加速迭代、Token需求爆发式增长的行业趋势,大规模、高密度、低时延、绿色高效的智算基础设施成为通用人工智能发展的重要支撑。
7月19日,2026世界人工智能大会进入第三天,大河财立方记者在现场观察到,不同于以往几年,大多数厂商不再单纯追求单颗芯片的峰值性能,而是转向强调系统级协同效率与场景化落地能力,展品重心也从单一芯片转向智算集群和超节点。

在摩尔线程展台,记者注意到其以“词元时代万物智能”为主题,系统展示了“模型训练工厂、词元生产工厂、智能体生产工厂”三大AI工厂,其中首次公开展出的MTTC256超节点,以及可支撑万卡规模、万亿参数大模型训练的“夸娥”智算底座,吸引了不少观众驻足。
据摩尔线程工作人员介绍,MTTC256超节点采用计算与交换一体化的高密设计,具备多个核心优势。在互联层面,它首次在一层Scale-up网络中实现256卡全互联,突破业界普遍的64卡限制,将卡间通信延迟压缩至亚微秒级并显著提升带宽利用率,为大模型并行策略优化开辟更大空间;在部署层面,仅需两个标准机柜即可完成256卡极速互联,大幅提升智算中心密度并节省机房空间;同时,其2U节点设计完美兼容现有智算软硬件生态,支持集群从万卡向十万卡级平滑扩展。
同样在超节点上发力的还有沐曦股份。该企业在现场首发了曦景S系列超节点与曦索X300系列科学智能GPU,同时携手开源社区与行业伙伴,集中亮相国产自主算力规模化、产业化、场景化落地的最新成果。
据该企业工作人员介绍,本次首发的曦景S系列超节点产品,具备高带宽、灵活扩展、稳定可靠等特性。其中曦景S600实现单机柜内64卡高密度部署,依托柜内全互连架构,大幅降低数据交互时延,有效提高大模型并行计算中的通信,并可灵活支持EP、TP等多维并行策略,全面覆盖大模型训推流程。
算力产业的成熟,离不开生态的繁荣共建。记者注意到,沐曦股份的“开源工坊”作为其计算生态成果汇集地,集结九源联合体、龙蜥、木兰开源社区、模力方舟、vLLM、SGLang、RedHat、CNCF、蜜瓜智能、PyTorch基金会等十大顶流开源社区,串联起覆盖操作系统、云原生、推理加速、模型服务、集群内核全层级软件栈的AIInfra开源协作链路。
走进华为展台,硕大的机房整齐排列成“一面墙”。
据了解,华为昇腾950超节点是目前业界规模最大的单超节点,整机群搭载了1024张算力卡,能提供1EFLOPSFP8、2EFLOPSFP4澎湃算力,拥有业界最大256TB内存统一编址空间,它让端到端延时能降低到3微秒,并能适配海量并发的AI场景。当“超大带宽、超低时延、统一内存编址”三大能力相互协同,就能满足十万亿级参数大模型高效训练与推理,实现让集群像一台计算机一样工作。
如果说上述企业产品代表了算力集群技术的前沿探索,那么中科曙光展示的则是超大规模集群落地的实践成果。
大会现场,获评大会“镇馆之宝”的中国首个全国产十万卡AI超集群——曙光8000(登峰)公布最新运行数据:正式上线首周即需求爆满,应用满载运行,目前日均处理作业数突破15万个,单日处理作业峰值超过50万个。

十万卡规模稳定运行,考验的不是单一性能,而是整个系统的协同能力。据中科曙光介绍,曙光8000采用全球首创的高密度机柜结构,单个计算单元算力密度较其他超节点提升20倍,在有限空间内实现更高算力部署;自研scaleFabric类IB原生RDMA高速互连技术,实现十万卡规模稳定互连。与此同时,IO500生产型双料第一的ParaStor分布式存储、全球领先的浸没式相变液冷等关键技术协同工作,共同保障海量数据高效流转、系统长期稳定运行,为高负载状态下持续输出有效算力提供支撑。
由此来看,2026世界人工智能大会正释放出一种新信号,AI产业的底层算力竞争,正从单颗芯片的性能参数,转向整个计算系统的组织效率。
责编:刘安琪 | 审校:牛尚 | 审核:李震 | 监审:古筝