01|128 节点总体架构
查看原始笔记 · 仓库最近更新:2026-10-03。具体核验日期以正文为准。
- 128 × 8-GPU B300 compute nodes
- 1,024 GPUs
- 初步按 4 × 32-node Scaling Unit 研究
- 网络、供电、冷却、IP 和空间预留扩容
flowchart TB U[Users / AI Platform] --> CP[Control Plane] CP --> C[128 B300 Compute Nodes] C <--> F[AI Compute Fabric] C <--> S[High Performance Storage] CP --> M[Management / Provisioning] C --> O[OOB BMC Network] C --> OBS[Observability]至少逻辑区分 Compute Fabric、Storage Fabric、In-band Management/Service、OOB/BMC、Provisioning、External/User Access。
按 32 节点标准单元规划,便于分批上线、故障域控制、复制布线、独立验收和未来扩容。