RunPod, Lambda et Vast.ai sont les trois clouds GPU que la plupart des équipes retiennent sous les hyperscalers, et ils occupent trois points distincts sur la courbe prix-fiabilité. Vast.ai est le moins cher — une marketplace pair-à-pair avec des H100 autour de 1,53-1,87 $/h et aucun SLA. RunPod est la voie médiane — une plateforme orientée développeurs avec des H100 à partir de 1,99 $/h, une facturation à la seconde et un palier Secure Cloud conforme SOC 2/HIPAA. Lambda est le cloud IA infogéré premium — H100 SXM à 3,99-4,29 $/h, avec un SLA de 99,9 % et des clusters InfiniBand jusqu’à plus de 2 000 GPU. Choisissez selon la tolérance de votre charge à l’interruption, pas selon le seul prix affiché. Voici les données.
Comparaison des tarifs GPU (à la demande, par GPU-heure)
Les prix ci-dessous sont les tarifs à la demande publiés par les fournisseurs à la mi-2026 ; les chiffres Vast.ai sont des moyennes de marketplace qui bougent en temps réel. Les tarifs en direct chez ces fournisseurs et d’autres sont suivis dans notre indice de prix GPU.
| GPU | Vast.ai (marketplace) | RunPod Community | RunPod Secure | Lambda |
|---|---|---|---|---|
| A100 80GB PCIe | ~0,80-1,20 $ | 1,19 $ | 1,39 $ | 1,99-2,79 $ (SXM/PCIe) |
| H100 PCIe | ~1,53-1,87 $ | 1,99 $ | 2,89 $ | — |
| H100 SXM | ~1,90-2,30 $ | 2,69 $ | 2,99 $ | 3,99-4,29 $ |
| H200 (141GB) | variable selon l’offre | 3,59 $ | 4,39 $ | ~4,49 $ quand listé |
| B200 (180GB) | variable selon l’offre | 5,89 $ | 5,89 $ | 6,69-6,99 $ |
Sources : tarifs RunPod, tarifs Lambda, comparatif Spheron, ComputePrices.
Trois mécaniques tarifaires comptent au-delà du tableau :
- Le palier interruptible de Vast.ai est le vrai plancher. Les instances interruptibles, attribuées aux enchères, tournent 50 % et plus en dessous des tarifs à la demande de la marketplace ci-dessus. Pour un entraînement qui gère bien les checkpoints, cela peut signifier du calcul H100 sous 1 $/h — mais votre job peut être préempté dès qu’une enchère plus élevée arrive.
- Les remises réservées et spot atteignent 30-50 % partout. Les trois proposent une tarification à l’engagement ; les instances réservées de Vast.ai remisent jusqu’à 50 %, et les plans d’économies de RunPod se cumulent avec les tarifs Community Cloud.
- La granularité de facturation favorise les petits. Vast.ai et RunPod facturent à la seconde, Lambda à la minute. Pour de l’inférence en pics et des expériences courtes, la facturation à la seconde plus le mode serverless de RunPod réduisent sensiblement le gaspillage.
Trois modèles économiques distincts
Vast.ai est une marketplace. L’entreprise ne possède aucun GPU ; elle met en relation des locataires avec plus de 40 data centers et des milliers d’hôtes indépendants proposant plus de 68 types de GPU, et les prix sont fixés par l’offre et la demande, pas par Vast. C’est pourquoi c’est le moins cher — et pourquoi la qualité varie de l’hôte professionnel en data center à la machine de particulier. Les scores de fiabilité des hôtes, les badges « datacenter vérifié » et les filtres secure cloud sont vos contrôles qualité, selon le comparatif de Lyceum.
RunPod est une plateforme hybride. Community Cloud agrège de la capacité tierce sélectionnée (économie de marketplace, ~97-99 % de disponibilité, pas de SLA) ; Secure Cloud tourne sur une infrastructure de data center certifiée, à ~99,5 % de disponibilité, avec du matériel dédié. Par-dessus s’ajoutent les commodités pour développeurs : plus de 18 classes de GPU, des templates, un palier serverless à autoscaling pour l’inférence, la facturation à la seconde et des certifications de conformité (SOC 2, HIPAA, RGPD) qui en font la plus utilisable en entreprise des options économiques, selon GPUCloudList.
Lambda est un cloud IA infogéré. Un catalogue délibérément étroit — H100, H200, B200, A100, majoritairement en SXM avec NVLink — vendu en instances isolées ou en 1-Click Clusters de 16 à plus de 2 000 GPU connectés en InfiniBand. C’est le seul des trois conçu d’emblée pour de l’entraînement distribué multi-nœuds sérieux, et le seul assorti d’un SLA contractuel de 99,9 % de disponibilité, avec un support humain par Slack, e-mail et téléphone. Vous payez cela 40 à 100 % au-dessus des tarifs RunPod/Vast.
Fiabilité, support et coûts cachés
| Facteur | Vast.ai | RunPod | Lambda |
|---|---|---|---|
| Garantie de disponibilité | Aucune (dépend de l’hôte) | ~99,5 % en Secure ; 97-99 % en Community (sans SLA) | SLA à 99,9 % |
| Risque d’interruption | Élevé en interruptible ; faible à la demande | Faible en Secure Cloud | Minimal |
| Entraînement multi-nœuds | Limité ; orienté mono-nœud | Multi-nœuds modeste | 1-Click Clusters, 16 à 2 000+ GPU, InfiniBand |
| Frais d’egress | Bande passante tarifée par l’hôte | Aucun | Aucun |
| Stockage | Tarifé par l’hôte | 0,05-0,14 $/Go/mois | NVMe inclus avec les instances |
| Conformité | Variable selon l’hôte ; filtre DC vérifié | SOC 2, HIPAA, RGPD | SOC 2 ; contrats entreprise |
| Support | Communauté + docs | Tickets, Discord ; docs solides | Support humain (Slack/e-mail/téléphone) |
| Facturation | À la seconde | À la seconde | À la minute |
Le tableau des « coûts cachés » est inhabituellement net dans ce trio face aux hyperscalers : l’absence de frais d’egress chez Lambda et RunPod rend gratuit le déplacement de jeux de données et de checkpoints, alors que le même trafic sur un cloud du top 3 se facture 0,08-0,12 $/Go. Le vrai coût caché, c’est le temps d’ingénierie : surveiller des jobs Vast.ai préemptés, ou refaire la queue pour de la capacité quand une région Community Cloud bon marché est épuisée. Chiffrez ce temps honnêtement avant de déclarer la marketplace moins chère. Si votre taux d’utilisation est élevé et soutenu sur 12 mois et plus, faites aussi le calcul location contre colocation — posséder ses GPU dans un espace de colocation peut passer sous les trois ; voyez notre catalogue de data centers et notre indice de prix de la colocation pour les données d’entrée.
Un exemple chiffré : un mois de fine-tuning
Les chiffres rendent les arbitrages concrets. Prenons un job de taille moyenne typique : le fine-tuning d’un modèle de 70 milliards de paramètres sur 8x H100 SXM pour 200 GPU-heures de calcul, plus 2 To de stockage jeux de données/checkpoints et 3 To de données déplacées dans les deux sens sur le mois.
| Poste de coût | Vast.ai (interruptible) | RunPod Secure | Lambda |
|---|---|---|---|
| Calcul (200 GPU-h x 8) | ~1,10 $/h x 1 600 = ~1 760 $ | 2,99 $/h x 1 600 = 4 784 $ | 3,99 $/h x 1 600 = 6 384 $ |
| Stockage (2 To-mois) | tarifé par l’hôte, ~100-200 $ | 0,05-0,07 $/Go = 100-140 $ | NVMe inclus = 0 $ |
| Transfert de données (3 To) | tarifé par l’hôte, souvent ~0 $ | 0 $ | 0 $ |
| Surcoût de préemption | +10-25 % de reprises = 175-440 $ | ~0 $ | ~0 $ |
| Total approximatif | ~2 050-2 400 $ | ~4 900 $ | ~6 400 $ |
La marketplace économise environ 55-60 % face à Lambda, même après avoir payé la taxe de préemption — à condition que le job gère proprement ses checkpoints et que personne n’attende le résultat. Inversez les hypothèses (échéance ferme, multi-nœuds avec fort trafic inter-GPU, exigences de conformité) et la prime Lambda achète du temps réel et de la certitude qui valent plus que la différence. La comparaison honnête n’est jamais tarif horaire contre tarif horaire ; c’est le coût total par job terminé.
Disponibilité : la contrainte que les tableaux de prix masquent
Les prix publiés supposent que vous pouvez réellement obtenir le GPU, et en 2026 c’est l’hypothèse la plus fragile de la pile. La capacité B200 reste contrainte par les allocations partout : Lambda oriente les volumes sérieux vers des conversations commerciales et des contrats réservés, les pools B200 de RunPod s’épuisent région par région, et les annonces B200 de Vast.ai apparaissent et disparaissent au gré des hôtes individuels. Les H100, en revanche, se sont nettement détendus à mesure que les flottes d’A100 partent à la retraite et que Blackwell monte en cadence — c’est exactement pourquoi les tarifs H100 de marketplace ont glissé sous 2 $/h.
Trois conséquences pratiques. D’abord, si votre calendrier d’entraînement est figé, réservez : une remise de 30-50 % pour engagement est aussi une garantie de capacité. Ensuite, la souplesse multi-région vaut de l’argent réel chez RunPod et Vast.ai ; les équipes capables de tourner dans n’importe quelle région attrapent de la capacité bon marché que les équipes mono-région ratent. Enfin, surveillez la courbe : la location de GPU est le coin du marché des data centers qui se retarife le plus vite, ce qui explique pourquoi nous la suivons en continu dans l’indice de prix GPU, aux côtés de l’indice de colocation, plus lent à bouger.
Lequel choisir si…
- Vous êtes amateur, chercheur, ou vous lancez des jobs par lots tolérants à l’interruption → Vast.ai. Les H100 les moins chers du marché (~1,53-1,87 $/h, moins en interruptible), la facturation à la seconde, aucun engagement. Faites des checkpoints souvent, filtrez sur les hôtes à forte fiabilité et traitez chaque instance comme jetable.
- Vous êtes une startup qui livre un produit IA → RunPod. Le meilleur équilibre : Community Cloud pour les expériences (H100 PCIe à 1,99 $/h), Secure Cloud pour la production (~99,5 % de disponibilité, SOC 2/HIPAA), le serverless pour l’inférence en pics, et pas de frais d’egress. C’est la recommandation par défaut pour la plupart des petites équipes.
- Vous êtes une entreprise ou une activité réglementée → RunPod Secure Cloud ou Lambda. RunPod si le coût compte et que le mono-nœud ou un multi-nœuds modeste suffit ; Lambda s’il vous faut un SLA contractuel à 99,9 %, des interlocuteurs humains nommés et des documents compatibles avec vos achats.
- Vous entraînez de grands modèles sur de nombreux nœuds → Lambda. Les 1-Click Clusters avec InfiniBand, de 16 à plus de 2 000 GPU H100/B200, sont le différenciateur ; aucun concurrent n’offre d’interconnexion comparable à cette échelle. La prime horaire de 40 à 100 % revient généralement moins cher que le temps réel perdu à cause d’un réseau inter-nœuds lent.
- Vous optimisez le coût d’un pipeline existant → répartissez par étape. Un schéma courant : prétraitement des jeux de données et ablations sur du Vast.ai interruptible, entraînements principaux sur des clusters Lambda, inférence de production sur RunPod serverless. Rien ne vous enferme — les trois facturent à la minute ou à la seconde.
- Vous pesez location contre propriété → faites le calcul à votre taux d’utilisation. À 2 $/h, un H100 coûte ~17 500 $ par an à pleine utilisation ; à 50 % d’utilisation en location, la propriété en colocation commence à l’emporter au bout de 18-24 mois. Demandez un devis et nous comparerons les options de colocation aux tarifs de location actuels.
Une dernière note sur l’enfermement : il est quasi inexistant, et c’est tout l’intérêt stratégique de cet étage du marché. Les trois fournisseurs prennent en charge les conteneurs Docker standard, l’accès SSH et le provisionnement piloté par API, si bien qu’un pipeline bâti sur l’un d’eux se déplace vers les autres en quelques jours, pas en quelques mois. Faites tourner votre première charge sérieuse sur deux des trois en parallèle, mesurez le débit réel par dollar plutôt que le prix catalogue, et laissez les données désigner le gagnant.
Les prix de ce marché bougent tous les mois — les tarifs B200 en particulier baissent à mesure que l’offre monte. Consultez le tracker GPU en direct avant de vous engager sur des durées réservées.
Questions fréquentes
Lequel est le moins cher pour louer un H100 : RunPod, Lambda ou Vast.ai ?
Vast.ai, à environ 1,53-1,87 $/h pour les H100 de la marketplace, les instances interruptibles étant encore 50 % moins chères. RunPod suit : H100 PCIe à partir de 1,99 $/h (Community Cloud) et H100 SXM à partir de 2,69 $/h. Lambda facture 3,99-4,29 $/h pour un H100 SXM — une prime de 40 à 100 % sur les deux autres — en échange d'un SLA de 99,9 % de disponibilité et de clusters connectés en InfiniBand.
Combien coûte un B200 par heure en 2026 ?
RunPod affiche le B200 (180GB) à 5,89 $/h, en Community comme en Secure Cloud. Le B200 SXM6 à la demande de Lambda revient à 6,69-6,99 $/GPU/h selon la taille d'instance. Sur la marketplace Vast.ai, le tarif du B200 fluctue avec l'offre, mais passe généralement sous les deux autres quand il est disponible. Pour situer, les tarifs B200 chez davantage de fournisseurs sont suivis dans notre indice de prix GPU.
Vast.ai est-il assez fiable pour de la production ?
Pas pour les charges critiques en disponibilité. Vast.ai est une marketplace pair-à-pair sans SLA au niveau de la plateforme — la fiabilité dépend de l'hôte individuel, qui va de l'opérateur de qualité data center au matériel grand public. Les scores de fiabilité des hôtes et les filtres « datacenter vérifié » atténuent le risque, et les instances à la demande (non interruptibles) sont stables en pratique, mais tout ce qui exige une disponibilité garantie relève de RunPod Secure Cloud (~99,5 %) ou de Lambda (SLA à 99,9 %).
Quelle différence entre RunPod Community Cloud et Secure Cloud ?
Community Cloud tourne chez des hôtes tiers sélectionnés, sans SLA et avec une disponibilité de l'ordre de 97-99 %, à des prix inférieurs de 10 à 30 % à ceux de Secure Cloud (par exemple, H100 PCIe à 1,99 $ contre 2,89 $/h ; H200 à 3,59 $ contre 4,39 $/h). Secure Cloud tourne dans des data centers certifiés, avec ~99,5 % de disponibilité, du matériel dédié et la posture de conformité (SOC 2, HIPAA, RGPD) qu'exigent les charges d'entreprise et réglementées.
Ces clouds GPU facturent-ils des frais d'egress ?
Lambda annonce explicitement zéro frais d'egress, et RunPod ne facture pas non plus le transfert de données — une économie significative face aux hyperscalers, où sortir quelques To de checkpoints peut coûter des centaines de dollars. Chez Vast.ai, le prix de la bande passante est fixé par l'hôte : vérifiez l'annonce. Stockage : les volumes réseau RunPod coûtent 0,05-0,07 $/Go/mois (0,14 $ en haute performance) ; Lambda embarque un NVMe conséquent avec les instances ; chez Vast.ai, le stockage est tarifé par l'hôte.
Quel cloud GPU pour l'entraînement multi-nœuds ?
Lambda. Ses 1-Click Clusters provisionnent de 16 à plus de 2 000 GPU HGX H100/B200 connectés en InfiniBand, avec facturation à la minute — ce que ni les pods standard de RunPod ni la marketplace de Vast.ai n'égalent pour l'entraînement distribué à grande échelle. RunPod gère bien le mono-nœud et le multi-nœuds modeste ; Vast.ai est le plus fort sur le mono-nœud et les charges tolérantes à l'interruption.
Sources
Sources primaires citées dans cet article. Chaque chiffre renvoie à son origine.
- RunPod: GPU Cloud Pricing
- Lambda: GPU Cloud Pricing and 1-Click Clusters
- Vast.ai: Marketplace Pricing Model
- GPUCloudList: Lambda Labs vs RunPod vs Vast.ai — Complete Comparison 2026
- Spheron: GPU Cloud Pricing Comparison 2026 — H100 from $2.01/hr
- Lyceum Technology: Lambda Labs vs RunPod vs Vast.ai — GPU Cloud Comparison
- RunPod: RunPod vs Vast.ai — GPU Cloud Platform Comparison
- ComputePrices: Lambda Labs GPU Pricing
Obtenir des devis
Décrivez votre besoin — nous vous mettons en relation avec les data centers de notre catalogue et vous transmettons de vrais devis. Gratuit pour les acheteurs.

