Payer le GPU à la seconde : ce que la grille tarifaire ne dit pas
Ou : comment une petite unité de temps change la forme entière d’une facture.
La réponse courte : Runpod facture ses pods à la seconde, de 0,34 $ l’heure pour une RTX 4090 en Community Cloud à 3,49 $ pour une H100 SXM en Secure Cloud, sans frais d’entrée ni de sortie de données. Ce qui ne figure pas en gros sur la grille : le disque d’un pod arrêté continue de coûter, un compte neuf est plafonné à 80 $ de dépense par heure, et un solde tombé à zéro peut supprimer des données. La seconde est surtout précieuse pour les travaux courts et fréquents ; pour les longs, c’est le prix de l’heure qui compte. C’est la première ligne à comprendre dans ce que coûte l’heure de GPU.
Un détail amusant pour commencer : la documentation de Runpod ne s’accorde pas avec elle-même. Sa page tarifaire parle de facturation à la seconde, sa présentation des pods de facturation à la minute, sa page produit à la milliseconde. La page tarifaire fait foi, et la différence entre une seconde et une milliseconde ne changera la vie de personne. La différence avec la concurrence, en revanche, se voit : Scaleway et Lambda facturent à la minute, Verda par tranches prépayées de dix minutes, OVHcloud à l’heure entamée.
Pour qui : un développeur qui lance beaucoup de travaux courts, tests, générations ponctuelles, et ne veut payer que les secondes où la carte travaille.
À partir de : 0,34 $ de l’heure pour une RTX 4090 en Community Cloud, 1,09 $ pour une L40S en Secure Cloud, 10 $ de chargement minimum pour démarrer.
Pour démarrer : ouvrir un compte Runpod, charger le solde, et arrêter le pod dès la fin de chaque travail.
Runpod prix : la grille des pods, puis ce qui s’y ajoute
| Carte | Secure Cloud | Community Cloud |
|---|---|---|
| RTX 4090 24 Go | 0,74 $ | 0,34 $ |
| RTX 5090 32 Go | 0,99 $ | 0,69 $ |
| L40S 48 Go | 1,09 $ | 0,79 $ |
| A100 PCIe 80 Go | 1,59 $ | 1,19 $ |
| A100 SXM 80 Go | 1,59 $ | 1,39 $ |
| H100 PCIe 80 Go | 2,89 $ | 1,99 $ |
| H100 SXM 80 Go | 3,49 $ | 2,69 $ |
| H200 141 Go | 4,59 $ | 3,59 $ |
Le stockage suit trois règles. Le disque de conteneur coûte 0,10 $ par gigaoctet et par mois pendant que le pod tourne, et disparaît à l’arrêt. Le disque de volume, monté sur /workspace, coûte 0,10 $ pod allumé et 0,20 $ pod arrêté : c’est lui qu’on oublie. Le volume réseau coûte 0,07 $ sous le téraoctet, 0,05 $ au-delà, et survit à tout. Arrêter un pod libère la carte mais garde le volume ; le supprimer efface tout ce qui n’est pas sur un volume réseau. Et au redémarrage, rien ne garantit que la carte soit encore libre : la documentation prévient qu’on peut se retrouver avec « zéro GPU ».
Deux règles de compte méritent d’être connues avant la première facture. Un compte neuf est plafonné à 80 $ de dépense par heure, toutes ressources confondues, plafond qui augmente avec l’historique ou sur demande au support. Et quand le solde atteint zéro, les pods rattachés à un volume réseau sont arrêtés et leurs données conservées, mais les autres sont supprimés, sans récupération possible. La recharge automatique existe ; elle vaut la peine d’être activée. Pour les charges stables, les savings plans de trois ou six mois, payés d’avance et non remboursables, réduisent le prix du calcul, sans que Runpod publie le pourcentage.
Si vous passez au serverless
Les workers serverless se facturent aussi à la seconde, mais le démarrage et quelques secondes d’inactivité comptent dans la note. Ce que coûte ce réveil est détaillé dans le coût du démarrage à froid.
Si la seconde ne suffit pas à faire baisser la note
Pour des travaux qui supportent une interruption, les instances spot divisent parfois le prix par deux. Leurs conditions et leurs pièges sont dans louer un GPU interruptible.
Si vous voulez chiffrer un mois entier
La grille donne le prix d’une heure ; un projet se chiffre en heures utiles, stockage et transferts. La méthode est dans le budget d’un projet IA en trois lignes.