在单个机柜/超节点内部把多颗 GPU 通过高带宽低延迟总线紧耦合成一台"大机器"的扩展方式,区别于跨机柜的 Scale-Out。代表实现为 NVIDIA NVLink/NVL72;国产阵营中华为昇腾、阿里磐久紧耦合程度最高。Scale-Up 设计倾向从 Die 直出 RDMA 网卡或光纤,弱化 PCIe 的作用
<待补充,带年份 + 单位 + 来源>