Louer un NVIDIA H100 à la mi-2026 coûte entre 1,38 $/h sur les places de marché de GPU et plus de 12 $/h en à la demande chez les hyperscalers — un écart de 1 à 8 pour un silicium identique. Le repère de référence, le Silicon Data H100 Rental Index, se situait autour de 2,53 $ par heure-GPU, tandis que les contrats réservés sur un an se traitaient autour de 2,35 $/h en mars 2026, en hausse de près de 40 % par rapport au plancher de 1,70 $ d’octobre 2025. Le H100 est passé du prix de pénurie à 8 $/h de 2023 au statut de commodité — et il entre aujourd’hui dans un nouveau cycle de tension.
Points clés
- Repère actuel : environ 2,53 $ par heure-GPU (indice Silicon Data, mi-2026) ; contrats d’un an autour de 2,35 $/h (mars 2026).
- Historique des prix : pic à environ 8 $/h (2023) → baisse continue sur 2024 → creux à 1-2 $/h (2025, plancher de 1,70 $ en octobre) → rebond de 40 % en 2026.
- C’est l’écart qui compte : médiane des places de marché à 1,70 $/h, médiane neocloud à 2,31 $, médiane hyperscaler à 6,11 $ — les hyperscalers facturent environ 3,3 fois la médiane des non-hyperscalers pour le même GPU, selon les données d’enchères de Compute Exchange.
- Comparaison B200 : 3,70-6,00 $/h à la demande chez les neoclouds, jusqu’à 14,24 $/h sur AWS ; fourchette publiée complète de 3,75 à 27 $/h.
- Point de bascule achat-location : des H100 d’occasion à 6 000-22 000 $ face à environ 20 600 $ par an au tarif de location réservé placent le seuil de rentabilité de la propriété autour de 18-24 mois de forte utilisation.
- Les contrats à terme sont arrivés : les contrats à terme sur puissance de calcul GPU du CME (indice Silicon Data) et de l’ICE (Ornn) rendent la courbe à terme publique pour la première fois.
Le prix des GPU se lit en regard de l’économie des sites : les tarifs de colocation prêts pour l’IA figurent dans notre indice de la colocation et notre catalogue de data centers d’Asie du Sud-Est ; les comparaisons de GPU en direct sont sur /fr/gpu/.
Historique des prix du H100 : 2023-2026
| Période | Contrat 1 an / tarif de référence | État du marché |
|---|---|---|
| Mi-2023 | Environ 8,00 $/h | Pic de pénurie ; allocation à la relation |
| 2024 | 3-5 $/h, en baisse | Arrivée de la vague de capacité des neoclouds |
| S1 2025 | 2-3 $/h | Arrivée des H200 et Blackwell ; la concurrence comprime les marges |
| Oct. 2025 | 1,70 $/h (plancher) | Excès d’offre ; craintes d’obsolescence du H100 |
| Déc. 2025 → janv. 2026 | 2,00 → 2,20 $ en spot (+10 % en 4 semaines) | Inflexion de la demande d’inférence |
| Mars 2026 | 2,35 $/h en contrats 1 an (+40 % depuis le plancher) | Tension ; Blackwell absorbé en amont |
| Mi-2026 | Environ 2,53 $/h à l’indice | Ferme, volatil |
Historique d’après Silicon Data, l’indice de location à 1 an de SemiAnalysis et l’analyse du pic de janvier 2026.
Le creux de 2025 a appris deux choses au marché. D’abord, la location de GPU est brutalement concurrentielle sur son segment de commodité — n’importe qui peut installer des H100 en baie, et les marges se sont effondrées en conséquence. Ensuite, la demande ne se limite pas à l’entraînement : la croissance de l’inférence a revalorisé un matériel prétendument obsolète. Un H100 qui avait perdu son statut de frontière pour l’entraînement restait le cheval de trait du service de modèles, et à 1,70 $/h il offrait soudain les FLOPS les moins chers du marché. Les acheteurs l’ont remarqué ; le rebond a suivi.
Tarifs à la demande par type de fournisseur, mi-2026
| Type de fournisseur | H100 à la demande ($/heure-GPU) | Médiane (données Compute Exchange) |
|---|---|---|
| Places de marché et clouds de niche | 1,38-1,49 $ en bas de fourchette | 1,70 $ |
| Neoclouds (Lambda, Nebius, RunPod, Spheron, etc.) | 1,90-3,50 $ | 2,31 $ |
| Hyperscalers (AWS, Azure, GCP) à la demande | 6 à plus de 12 $ (jusqu’à 11,68-12,29 $) | 6,11 $ |
| Offres réservées, tous types | 1,07-10,14 $ | 5,52 $ |
Sources : indice de prix GPU d’IntuitionLabs, Compute Exchange, AIMultiple.
Pourquoi la prime hyperscaler survit : inertie des achats en entreprise, verrouillage par les frais de sortie de données et la gravité des données, certifications de conformité, et crédits inclus dans les accords-cadres. Pour les charges qui échappent à ces contraintes, le même GPU coûte 60-75 % de moins un cran plus bas. Cet arbitrage est le modèle économique des neoclouds — et sa compression explique que leurs marges dépendent des engagements réservés plutôt que du spot.
Spot ou réservé : comment acheter
- Le spot, ou à la demande, convient à l’expérimentation par à-coups et aux fine-tunings courts. Vous payez le haut de la courbe pour le droit de partir quand vous voulez.
- Le réservé (1 à 12 mois) offre 30-60 % de remise sur le tarif à la demande. Les données d’enchères de mars 2026 en montrent la limite : les offres réservées allaient de 1,07 à 10,14 $/h — le choix du fournisseur compte plus que le type de contrat.
- Le pluriannuel (24-36 mois) verrouille le tarif du jour face à la courbe à terme. Maintenant que les contrats à terme se traitent, les trésoriers peuvent séparer la décision de capacité de la décision de prix (voir plus bas).
- Le matériel d’occasion, sur le marché secondaire, est devenu un vrai canal en juillet 2026, quand Compute Exchange a ouvert sa place de marché de GPU d’occasion : des H100 d’occasion à 6 000-22 000 $ contre 25 000-40 000 $ neufs, avec des demandes d’acheteurs allant de quelques centaines à plusieurs dizaines de milliers d’unités.
Règle empirique : à 2,35 $/h en réservé, une année d’un GPU revient à environ 20 600 $. Si votre utilisation dépasse durablement 60 % et que votre horizon excède 18-24 mois, la propriété à prix réduit (surtout en occasion), combinée à de la colocation — obtenez un tarif de référence de site via /fr/quote/ —, revient moins cher que la location. En deçà, louez.
Comparaison avec le B200
| Indicateur | H100 (SXM 80 Go) | B200 (192 Go) |
|---|---|---|
| À la demande chez les neoclouds | 1,90-3,50 $/h | 3,70-6,00 $/h |
| À la demande chez les hyperscalers | Jusqu’à 11,68-12,29 $/h | Jusqu’à 14,24 $/h (AWS p6) ; fourchette publiée jusqu’à 27 $ |
| Nœud de 8 GPU, neocloud | Environ 15-25 $/h | Environ 29,60 $/h (Spheron) |
| Nœud de 8 GPU, AWS | — | Environ 113,93 $/h (environ 82 030 $/mois) |
| Débit d’entraînement face au H100 | 1x | Environ 2,5-3x |
D’après l’enquête de prix B200 de Spheron et l’indice B200 de Silicon Data, qui a enregistré le passage du B200 d’environ 4,40 $/h à des pointes au-dessus de 6,00 $/h en un seul mois début 2026 — le Blackwell reste contraint par l’offre, et donc volatil (spot en hausse de 48 % entre février et avril 2026). Sur l’économie au token, un B200 à 4,50 $/h avec un débit environ 2,7 fois supérieur bat un H100 à 2,35 $/h ; la contrainte, c’est d’obtenir une allocation tout court.
L’arithmétique du cluster : ce que coûte réellement un déploiement de H100
Les tarifs unitaires masquent l’économie à l’échelle d’un déploiement. Trois façons de faire tourner 64 H100 (8 nœuds) pendant un an aux prix de la mi-2026 :
| Modèle d’approvisionnement | Hypothèse unitaire | Coût annuel, 64 GPU |
|---|---|---|
| À la demande chez un hyperscaler | 10 $/heure-GPU en moyenne | Environ 5,6 M$ |
| Neocloud réservé 1 an | 2,35 $/heure-GPU | Environ 1,32 M$ |
| Matériel d’occasion en propre + colocation | 14 k$/GPU d’occasion + environ 196 $/kW/mois de colo + électricité | Environ 0,9 M$ de capex + environ 0,35 M$/an de charges |
La ligne « propriété » suppose des H100 d’occasion au milieu de la fourchette secondaire de 6 000-22 000 $, un appel de puissance d’environ 45 kW par nœud avec les pertes du site, et de la colocation wholesale aux tarifs de l’indice (le $/kW actuel ici). L’écart entre la première et la troisième ligne — environ 6 fois en base annuelle — explique pourquoi les acheteurs avertis traitent l’approvisionnement en GPU comme une décision de portefeuille : l’à la demande hyperscaler pour les pointes, le neocloud réservé pour la charge de base, le matériel en propre pour les flottes d’inférence permanentes. C’est aussi pourquoi les tarifs publics des hyperscalers perdent continuellement du poids dans les indices de référence, alors même que leurs revenus GPU en valeur absolue progressent.
Deux frictions empêchent cet arbitrage de se refermer. La gravité des données en entreprise : sortir des données d’entraînement de chez un hyperscaler entraîne des frais de sortie qui peuvent effacer une année d’économies de location sur de gros corpus. Et la capacité opérationnelle : une flotte en propre exige une gestion des pannes, une expertise des fabriques InfiniBand et NVLink, et un partenaire d’hébergement — l’obstacle pratique que notre service de devis sert précisément à chiffrer.
Où vont les prix
Quatre forces, deux dans chaque sens :
À la hausse : (1) la demande d’inférence qui se cumule — chaque modèle déployé constitue une charge permanente ; (2) l’offre de H100 est désormais figée — la production est passée aux Blackwell et Rubin, si bien que le parc de H100 ne peut plus que diminuer.
À la baisse : (3) les volumes Blackwell montent en puissance sur 2026-2027, et chaque B200 déplace l’équivalent d’environ 2,5 à 3 H100 de demande ; (4) les réservations de 2023-2024 arrivant à échéance et les renouvellements de flotte poussent des A100 et des H100 en quantité sur le marché secondaire fin 2026.
La réponse honnête, c’est que la courbe à terme n’est plus affaire d’opinion : le CME Group (adossé à l’indice Silicon Data) et l’ICE avec Ornn lancent tous deux des contrats à terme à règlement en espèces sur la puissance de calcul GPU, couvrant les H100, H200, B200 et au-delà. Une fois liquides, ce sont ces contrats — et non les prévisions d’analystes — qui constitueront les perspectives de prix du H100. Notre scénario central de travail : les tarifs du H100 tiennent la bande des 2-3 $/h sur 2026, puis s’érodent vers une économie de type coût de l’électricité plus marge (1-1,50 $/h) à mesure que le Blackwell saturera en 2027-2028. Suivez les chiffres en direct sur notre page des prix GPU et notre tableau de bord statistique.
Questions fréquentes
Combien coûte la location d'un H100 en 2026 ?
Les tarifs à la demande vont de 1,38 à 1,49 $/h sur les places de marché et les clouds de niche, à environ 2-3 $/h chez les grands neoclouds, et de 6 à plus de 12 $/h chez les hyperscalers (AWS, Azure et GCP affichent jusqu'à 11,68-12,29 $/h). Le Silicon Data H100 Rental Index se situait autour de 2,53 $ par heure-GPU à la mi-2026, et les contrats réservés sur un an se traitaient autour de 2,35 $/h en mars 2026.
Pourquoi le prix des H100 est-il tombé de 8 dollars de l'heure ?
Les quelque 8 $/h de 2023 reflétaient une pénurie extrême pendant la première ruée sur l'entraînement des LLM. Les énormes ajouts de capacité des neoclouds sur 2024-2025, la disponibilité des H200 et des Blackwell, et la concurrence ont ramené les tarifs des contrats d'un an à un plancher proche de 1,70 $/h en octobre 2025, avant que la demande d'inférence ne fasse repartir les prix à la hausse.
Les prix des H100 repartent-ils à la hausse ?
Oui. Les tarifs des contrats d'un an ont progressé de près de 40 % depuis le plancher de 1,70 $/h d'octobre 2025 jusqu'à 2,35 $/h en mars 2026, et l'indice spot a bondi de 10 % en quatre semaines au passage de l'année 2025-2026 (de 2,00 à 2,20 $). Les moteurs : la croissance des charges d'inférence, l'offre Blackwell absorbée par les hyperscalers, et les entreprises qui prolongent la durée de vie de leur parc de H100.
Quelle est la différence entre tarification spot et réservée pour les GPU ?
Le spot, ou à la demande, se paie à l'usage sans engagement — prix unitaire le plus élevé, élasticité immédiate. Le réservé (1 à 36 mois) offre 30-60 % de remise sur le tarif à la demande, en échange d'une dépense engagée. Sur les enchères de Compute Exchange, les offres réservées de H100 allaient de 1,07 à 10,14 $/h, avec une médiane à 5,52 $ — de quoi mesurer l'ampleur de l'écart, à matériel identique.
Combien coûte la location d'un B200 par rapport à un H100 ?
Le B200 à la demande va de 3,70 à 6,00 $/h chez les neoclouds (Spheron à partir de 3,70 $, Lambda à 4,99 $) et jusqu'à 14,24 $/h sur AWS p6 — les tarifs publiés s'étalent de 3,75 à 27 $ tous fournisseurs confondus. Cela représente environ 2 à 3 fois le prix d'un H100 pour un débit d'entraînement d'environ 2,5 à 3 fois supérieur : l'économie du B200 au token est donc compétitive, quand on parvient à en obtenir.
Vaut-il mieux acheter ou louer des H100 ?
Un H100 neuf coûte 25 000-40 000 $ ; les unités d'occasion s'échangeaient entre 6 000 et 22 000 $ sur le marché secondaire à la mi-2026. À un tarif réservé de 2,35 $/h, un GPU loué revient à environ 20 600 $ par an — proche du prix du matériel. La propriété l'emporte donc au-delà d'environ 18-24 mois de forte utilisation, si vous savez gérer l'électricité, la colocation et le risque de revente. En deçà, la location gagne.
Où vont les prix des H100 ?
Les marchés à terme cotent désormais cette question : le CME (avec Silicon Data) et l'ICE (avec Ornn) ont tous deux annoncé des contrats à terme sur la puissance de calcul GPU en 2026. La mécanique de consensus pointe vers des prix fermes à court terme — demande d'inférence en hausse, offre de H100 qui ne s'étend plus — suivis d'une érosion à mesure que les volumes Blackwell et Rubin arriveront et que les réservations arrivant à échéance inonderont le marché secondaire fin 2026.
Sources
Sources primaires citées dans cet article. Chaque chiffre renvoie à son origine.
- Silicon Data H100 Rental Price Index
- Silicon Data: H100 Rental Price Over Time 2023-2025
- Silicon Data: H100 Price Spike — the 10% Surge
- SemiAnalysis: The Great GPU Shortage — H100 1-Year Rental Price Index
- IntuitionLabs: Data Center GPU Pricing 2026
- Compute Exchange: Reserved GPUs March 2026
- SiliconANGLE: Compute Exchange opens secondary H100/A100 market
- Spheron: NVIDIA B200 Cloud Pricing 2026
- Silicon Data: B200 Index Price March 2026 Update
- ICE: ICE and Ornn to Launch GPU Compute Futures Contracts
- AIMultiple: Cloud GPU Rental Price Index
Obtenir des devis
Décrivez votre besoin — nous vous mettons en relation avec les data centers de notre catalogue et vous transmettons de vrais devis. Gratuit pour les acheteurs.

