Latenz
Latenz ist die Zeitspanne, die Daten benötigen um zwischen zwei Punkten in einem Netzwerk zu reisen, normalerweise gemessen in Millisekunden als Round-Trip-Time (RTT). Die physikalische Untergrenze ergibt sich daraus, dass sich Licht in optischer Faser mit etwa 200.000 km/s bewegt und damit etwa 1 ms einseitige Latenz pro 100 km Faser erzeugt, bevor Geräte-, Routing- und Warteschlangen-Verzögerungen hinzukommen. Typische Werte: unter 1–2 ms in einem Ballungsraum, 60–80 ms über den Atlantik, 150–250 ms von Südostasien nach Europa. Latenz treibt die Auswahl von Datacenter-Standorten für Börsenhandel, Gaming, Echtzeitkommunikation und interaktive KI-Inferenz an und motiviert Edge-Bereitstellungen näher bei den Benutzern. Innerhalb von KI-Clustern wird die Latenz zwischen GPUs in Ost-West-Richtung — gemessen in Mikrosekunden über InfiniBand, RoCE oder NVLink — durch die Trainingseffizienz in großem Maßstab begrenzt.
In unseren Daten
Wo das auftaucht