이 문서 정보
이 문서에서는 EVPN/VXLAN을 사용하여 GPU 백엔드 패브릭에서 GPU 멀티테넌시 지원을 포함하는 AI 클러스터 인프라의 설계 요구 사항 및 구현에 대해 설명합니다. 이 패브릭은 AI에 최적화된 주니퍼 데이터센터 QFX5240 시리즈 스위치를 기반으로 구축되었습니다. 클러스터에는 Nvidia H100 DGX와 AMD MI300X GPU 서버 및 Vast Storage 시스템이 포함됩니다.
모든 검증 테스트는 미국 캘리포니아주 서니베일에 위치한 주니퍼의 AI 혁신 연구소에서 수행되었습니다. 이 개방형 실험실에서 주니퍼는 고객 및 기술 파트너와 긴밀하게 협력하여 AI 솔루션을 개발하고 다양한 AI 애플리케이션 및 모델에 대한 구축을 테스트합니다.
AI Innovation Lab에서는 고객이 AI 학습 및 추론이 실제로 작동하는 모습을 볼 수 있습니다. 주니퍼는 MLPerf 성능 벤치마킹 및 비교를 위해 MLCommons 의 모델뿐만 아니라 고객별 모델을 실행하여 이러한 테스트를 수행합니다.