摩尔线程在2026世界人工智能大会上发布MTTC256超节点,采用计算+交换融合设计,实现单层网络256卡直连,突破传统64卡上限,通信延迟亚微秒级,支持万卡至十万卡级智算集群,适用于大模型训练与推理。
2026世界人工智能大会(WAIC)在上海正式开幕。作为国内少数具备全栈GPU研发与交付能力的领军企业,摩尔线程这次带来了一份扎实的答卷——以“词元时代 万物智能”为主题,首次同步启用上海世博展览馆和张江科学会堂两大展区,完整展示了“模型训练工厂、词元生产工厂、智能体生产工厂”三大AI核心基础设施。展会期间,摩尔线程还首次面向公众发布了自主研发的MTT C256超节点,为万卡级乃至十万卡级智能计算中心提供了全新的系统级架构和高性能算力底座。
大模型参数规模已经突破万亿级别,传统智算网络架构面临一个棘手问题——多层级交换带来的带宽衰减和通信时延越来越严重。摩尔线程这次推出的MTT C256超节点,采用“计算+交换”深度融合的一体化高密度设计,实现了一次技术跃迁:单层Scale-up网络可直连的GPU数量,从行业主流的64卡直接提升到了256卡。
长期稳定更新的攒劲资源: >>>点此立即查看<<<
具体来说,这个超节点在标准单宽机柜内就能实现128卡全互联,通过并柜部署可以扩展到256卡极速互联。传统多层网络架构下带宽损失严重、延迟居高不下的顽疾,在这里被彻底突破。GPU之间的通信延迟被压到了亚微秒级别,整体带宽利用率也显著提升,为大模型分布式训练策略的深度优化打开了更广阔的空间。

MTT C256超节点具备三大核心能力:
打破业内一层网络64卡互联的常规上限,在单一Scale-up网络内首次实现256卡全直连,卡间通信延迟稳定控制在亚微秒区间。
单机柜GPU部署密度显著领先同业,仅需两个标准2U机柜就能构建256卡一层Scale-up高速互联集群,在提升算力密度的同时,大幅缩减数据中心物理占地。
基于2U紧凑型节点设计,无缝适配当前主流智算软硬件生态体系,支撑智算集群从万卡规模向十万卡级别平滑升级和弹性扩展。

MTT C256超节点精准适配以下三类核心智算任务:
作为十万卡级集群的关键单元,全面支持大模型预训练、指令微调(SFT)、强化学习(RLHF)等全流程训练任务。
原生适配MoE稀疏架构及百万级超长上下文推理场景,兼具毫秒级响应与高并发吞吐性能。
面向高并发交互式应用,单用户token生成速率突破100 token/s,可高效支撑AI编程(AI Coding)等对低时延与强实时性要求严苛的前沿场景。
侠游戏发布此文仅为了传递信息,不代表侠游戏网站认同其观点或证实其描述