▮▮Coloprice
← Rechenzentrums-Glossar

GPU-Cloud

Eine GPU-Cloud ist ein Cloud-Service, der GPU-Rechenkapazität — für KI-Training, Fine-Tuning, Inferenz und Rendering — mietet; die Abrechnung erfolgt pro GPU-Stunde oder über reservierte Verträge. Der Markt umfasst Hyperscaler (AWS, Azure, Google Cloud) und spezialisierte Neocloud-Anbieter (CoreWeave, Lambda, Nebius, Crusoe). Die Preisgestaltung variiert stark: 2026 reichen On-Demand-Preise für NVIDIA H100s von ungefähr $2–3 pro GPU-Stunde bei spezialisierten Anbietern bis $4–14 bei Hyperscalern, deutlich unter den Spitzenwerten von etwa $8 im Jahr 2023; Mehrjahres-Verträge für reservierte Cluster haben viel niedrigere stündliche Kosten. Moderne Implementierungen bilden Cluster mit Tausenden GPUs mit Hochgeschwindigkeitsverbindungen (NVLink innerhalb von Racks, InfiniBand oder RoCE Ethernet dazwischen). GPU-Clouds gehören zu den größten Mietern von Wholesale-Colocation und maßgeschneiderter Kapazität, da jeder 1.000-GPU-Cluster ungefähr 1.5–2.5 MW flüssiggekühlte Infrastruktur benötigt.