Louer un GPU spot : la remise, l'interruption et quand l'accepter
Ou : comment louer une machine à moitié prix en acceptant que quelqu’un d’autre puisse la reprendre à tout moment.
La réponse courte : une instance GPU spot ou interruptible coûte en général moitié moins cher, et jusqu’à 90 % de moins chez les grands clouds, contre la possibilité d’être reprise sans prévenir ou presque. Le préavis va de zéro seconde chez Google Cloud à une heure chez Novita, en passant par deux minutes chez AWS. C’est une excellente affaire pour les travaux qui sauvegardent leur progression et peuvent reprendre, et une très mauvaise pour un service en ligne ou un entraînement sans point de reprise. Parmi les leviers pour maîtriser la facture GPU, c’est le plus puissant et le plus risqué.
Le mécanisme varie d’un fournisseur à l’autre. Chez les grands clouds, le spot revend la capacité inutilisée, et la machine est récupérée quand un client à la demande en a besoin. Chez Vast.ai, c’est une enchère : selon sa documentation, l’offre la plus haute l’emporte, l’instance surenchérie est mise en pause, ses processus arrêtés, et elle repart quand son enchère redevient la meilleure. Ses données sont conservées, et son stockage reste facturé pendant la pause.
Pour qui : un développeur qui veut un prix bas sans risque d’interruption, pour un travail qui ne sauvegarde pas sa progression.
À partir de : 0,34 $ de l’heure pour une RTX 4090 en Community Cloud, à la demande et non interruptible, facturée à la seconde.
Pour démarrer : ouvrir un compte Runpod et lancer le pod en Community Cloud ; réserver le spot aux travaux qui reprennent seuls.
GPU spot : la remise et le préavis, fournisseur par fournisseur
| Fournisseur | Remise annoncée | Préavis avant interruption | Ce que devient la machine |
|---|---|---|---|
| AWS | jusqu’à 90 % | 2 minutes, sans garantie | arrêtée, supprimée ou mise en veille selon la configuration |
| Google Cloud | jusqu’à 91 %, GPU compris | 0 seconde par défaut, 120 secondes en option (préversion) | arrêtée en 30 secondes au plus, sans engagement de disponibilité |
| Azure | jusqu’à 90 % | 30 secondes, sans garantie | libérée par défaut, ou supprimée |
| Vast.ai | 50 à 80 % | non documenté | mise en pause, données conservées, reprise si l’enchère repasse devant |
| Novita AI | environ 50 % : RTX 4090 à 0,17 $ contre 0,33 $, H100 à 1,70 $ contre 3,39 $ | une heure de protection au lancement, puis une heure de préavis | reprise |
| Runpod | non affichée | sans préavis, selon son blog ; offre peut-être retirée | reprise |
Deux lignes méritent un commentaire. Google Cloud n’accorde par défaut aucun préavis : la machine s’arrête, et le délai de 30 secondes est celui qu’elle a pour s’éteindre proprement, pas celui qu’on a pour réagir. Novita, à l’inverse, garantit une heure pleine après le lancement puis une heure d’avertissement, ce qui transforme le spot en offre presque confortable pour des travaux de quelques heures. Chez Runpod, le statut des instances spot est devenu flou. Son blog prévient qu’elles peuvent être interrompues sans préavis, et sa page d’accueil les mentionne encore, mais elles ont disparu de la grille publique et de la documentation des pods, et un développeur rapportait le 27 septembre 2026 que l’API refusait désormais d’en créer. Mieux vaut les considérer comme indisponibles tant que Runpod ne les réaffiche pas.
Deux précisions valent pour les grands clouds. Le préavis de deux minutes d’AWS est donné « au mieux », sans garantie, et disparaît si l’instance est configurée pour se mettre en veille. Azure réserve ses machines spot aux abonnements payants : un compte d’essai ne peut pas en lancer. Dans tous les cas, le spot se prête mal aux premiers pas sur une plateforme, parce qu’une interruption inexpliquée ressemble à s’y méprendre à une erreur de configuration.
Le bon usage du spot tient en une règle : ne jamais y lancer un travail qui ne sait pas reprendre là où il s’est arrêté. Un entraînement qui écrit un point de reprise toutes les quinze minutes perd au pire quinze minutes. Une génération d’images par lots, où chaque image est indépendante, perd au pire l’image en cours. Un service qui répond à des clients en direct perd des clients.
Si vous préférez la stabilité à bas prix
Sans interruption, la RTX 4090 se loue déjà autour de 0,34 $ de l’heure chez plusieurs fournisseurs. Le relevé complet est dans le prix horaire de la RTX 4090.
Si vous cherchez à tester sans rien payer
Avant le spot, il y a les crédits offerts, qui ne s’interrompent pas. Ce que chaque fournisseur propose réellement est dans les crédits GPU offerts.
Si c’est la facturation qu’il faut comprendre
Le spot se combine avec la facturation à la seconde : une instance reprise au bout de vingt minutes ne coûte que vingt minutes. Les règles sont détaillées dans payer le GPU à la seconde.