← データセンター用語集
GPUクラウド
GPUクラウドはAI学習、ファインチューニング、推論、レンダリング向けのGPUコンピュート容量をレンタルするクラウドサービスで、GPU時間当たりまたは予約契約経由で請求されます。市場はハイパースケーラー(AWS、Azure、Google Cloud)とニッチなネオクラウドプロバイダー(CoreWeave、Lambda、Nebius、Crusoe)にまたがります。価格設定は大きく異なります。2026年現在、オンデマンドNVIDIA H100は専門プロバイダーで時間当たり約$2-3、ハイパースケーラーで$4-14の範囲で、2023年の約$8ピークから大幅に低下し、複数年予約クラスターは時間当たりはるかに低い価格です。現代のデプロイメントは高速相互接続(ラック内のNVLink、ラック間のInfiniBandまたはRoCE Ethernet)で数千のGPUをクラスタリングします。GPUクラウドは卸売りコロケーション・設計建設型容量の最大レッシーであり、1,000-GPUクラスターごとに約1.5-2.5 MWの液冷基盤が必要となるためです。
関連する場面