跳转到内容

01|128 节点总体架构

查看原始笔记 · 仓库最近更新:2026-10-03。具体核验日期以正文为准。

  • 128 × 8-GPU B300 compute nodes
  • 1,024 GPUs
  • 初步按 4 × 32-node Scaling Unit 研究
  • 网络、供电、冷却、IP 和空间预留扩容
flowchart TB
U[Users / AI Platform] --> CP[Control Plane]
CP --> C[128 B300 Compute Nodes]
C <--> F[AI Compute Fabric]
C <--> S[High Performance Storage]
CP --> M[Management / Provisioning]
C --> O[OOB BMC Network]
C --> OBS[Observability]

至少逻辑区分 Compute Fabric、Storage Fabric、In-band Management/Service、OOB/BMC、Provisioning、External/User Access。

按 32 节点标准单元规划,便于分批上线、故障域控制、复制布线、独立验收和未来扩容。