このドキュメントについて
このドキュメントでは、EVPN/VXLANを使用したGPUバックエンドファブリックでのGPUマルチテナント機能のサポートを含む、AIクラスターインフラストラクチャの設計要件と実装について説明します。このファブリックは、AIで最適化されたジュニパーデータセンター QFX5240シリーズスイッチをベースに構築されています。このクラスターには、Nvidia H100 DGX、AMD MI300X GPU サーバー、Vast Storage システムが含まれています。
すべての検証テストは、米国カリフォルニア州サニーベールにあるジュニパーのAIイノベーションラボで実施されました。このオープンラボでは、ジュニパーがお客様や技術パートナーと緊密に連携し、AIソリューションを開発し、さまざまなAIアプリケーションやモデルの導入をテストしています。
AIイノベーションラボでは、AIトレーニングと推論の実例をご覧いただけます。ジュニパーは、お客様固有のモデルとMLPerfパフォーマンスベンチマークおよび比較用の MLCommons のモデルの両方を実行して、これらのテストを実施しています。