Québec, Canada

403-1381 1re Avenue

+1 581.849.27.96

bdgouthiere@gmail.com

Combien coûte vraiment un GPU loué : facture, spot, sortie réseau

Ou : pourquoi la facture de fin de mois ne ressemble jamais au prix de l’heure multiplié par le nombre d’heures.

Vous avez vu passer une RTX 4090 à 0,34 $ de l’heure et une H100 à moins de 3 $, et vous avez multiplié par le nombre d’heures prévues. C’est le bon réflexe et le mauvais résultat. Le prix d’un serveur GPU à l’heure n’est que la première ligne d’une facture qui en compte au moins quatre autres : le stockage des modèles, la sortie des données, les minutes perdues au démarrage et la granularité de la facturation. Le guide des fournisseurs GPU cloud compare les tarifs affichés ; cette section s’occupe de tout ce qui s’y ajoute, et de ce qui permet de le réduire. Pour la mécanique de base, la documentation tarifaire de Runpod montre bien ce qu’un loueur facture à côté de la carte.

Un exemple suffit à mesurer l’écart. Un projet qui génère des images sur une RTX 4090 en Secure Cloud, quatre heures par jour pendant vingt jours, consomme 80 heures de carte, soit 59,20 $ à 0,74 $ de l’heure. Si le pod garde un disque de 50 Go entre deux sessions, ce disque coûte 0,20 $ par gigaoctet et par mois pendant que la machine est arrêtée, soit une dizaine de dollars de plus. Le stockage ajoute ainsi près de 15 % à la facture, sans qu’une seule image de plus soit sortie. Avec un volume réseau à 0,07 $ le gigaoctet, la même ligne tombe à 3,50 $.

Les leviers existent, dans l’autre sens : instances interruptibles à moitié prix ou moins, facturation à la seconde qui efface les minutes inutiles, crédits d’essai et de parrainage, engagement de plusieurs mois pour les charges de travail stables. Ils demandent tous la même chose : savoir combien d’heures la carte travaille vraiment.

Pour qui : un développeur ou une petite équipe qui veut payer la carte à la seconde, sans frais de sortie de données, et arrêter la machine dès que le travail est fini.

À partir de : 0,34 $ de l’heure pour une RTX 4090 en Community Cloud, 0,79 $ pour une L40S, facturés à la seconde ; 0,07 $ par gigaoctet et par mois pour un volume réseau.

Pour démarrer : ouvrir un compte Runpod, ranger les modèles sur un volume réseau, et arrêter le pod à la fin de chaque session.

La carte fait tourner la grande roue. La facture compte aussi tous les petits engrenages qu'elle entraîne.

Serveur GPU : le prix affiché à l’heure et les quatre lignes qui s’y ajoutent

Chaque question de cette section a sa page, avec les chiffres relevés le 27 septembre 2026. Ensemble, elles couvrent le chemin complet, de l’estimation au paiement.

À la seconde, à la minute ou à l’heure entamée

Deux fournisseurs au même prix horaire peuvent facturer très différemment le même travail de dix minutes : Runpod le compte à la seconde, Scaleway à la minute, OVHcloud à l’heure entamée. Ce que change cette granularité, et comment lire la grille de Runpod, est détaillé dans payer le GPU à la seconde.

La remise contre le risque d’être interrompu

Les instances spot ou interruptibles coûtent souvent moitié moins, parfois beaucoup moins, contre la possibilité d’être reprises en plein calcul. Pour quels travaux ce risque est acceptable, et comment s’en protéger, est expliqué dans louer un GPU interruptible.

Les secondes payées pendant que le worker se réveille

Un worker serverless ne coûte rien à l’arrêt, mais son réveil se paie. Sur le pipeline de ce site, un démarrage à froid a pris 9,3 secondes pour 2,6 secondes de travail utile. Le calcul de ce coût caché est dans le coût du démarrage à froid.

Le plafond invisible d’un compte neuf

Sur un compte AWS neuf, le quota d’instances à H100 et A100 est fixé à zéro : il faut le demander avant de lancer la première carte. Les autres fournisseurs ont leurs propres limites, recensées dans les quotas d’un compte neuf.

Trois lignes de calcul pour un budget

Heures réellement utilisées, stockage, transferts : un budget GPU tient en trois lignes, à condition de ne pas en oublier une. La méthode, avec des exemples chiffrés, se trouve dans estimer le budget GPU.

Le stockage et la sortie réseau, les lignes oubliées

Les loueurs spécialisés offrent souvent la sortie de données, les grands clouds la facturent entre 0,087 $ et 0,12 $ le gigaoctet au-delà d’un petit volume gratuit, comme le détaille la grille d’AWS. Le détail, fournisseur par fournisseur, est dans les frais de stockage et de sortie.

Acheter la carte ou louer l’heure

Une RTX 4090 achetée finit par coûter moins cher que la même carte louée, à condition de la faire tourner assez longtemps et de compter l’électricité. Le point de bascule est calculé dans louer ou acheter sa carte.

Faire plus avec la même heure

Regrouper les requêtes, passer au FP8 sur les cartes qui le gèrent, compiler le modèle : ces techniques augmentent le nombre de résultats par heure payée. Ce qu’elles rapportent vraiment est mesuré dans optimiser le débit du GPU.

Les crédits gratuits, et leurs conditions

Plusieurs fournisseurs offrent du calcul pour démarrer : 30 $ par mois chez Modal, 200 € sur un premier projet chez OVHcloud, 300 CHF sur trois mois pour le Public Cloud Infomaniak. Ce qu’ils couvrent vraiment, GPU compris ou non, est recensé dans les crédits GPU offerts.

Le parrainage, petite remise honnête

Chez Runpod, un compte européen ouvert par parrainage reçoit 5 $ de crédits après un premier chargement de 10 $. Ce n’est pas une fortune, mais c’est près de deux heures de H100 en Secure Cloud, ou six heures de L40S en Community Cloud, pour quelques minutes à suivre la bonne procédure, décrite dans les crédits de parrainage Runpod.

La RTX 4090 à l’heure, fournisseur par fournisseur

La carte préférée des créateurs se loue de 0,16 $ à 0,74 $ de l’heure selon l’hôte, la gamme et la fiabilité. Le relevé complet, y compris la RTX 5090 qui lui succède, est dans le prix horaire de la RTX 4090.

Payer en euros, avec une facture au nom de la société

Pour une entreprise européenne, un fournisseur qui facture en dollars pose deux questions : le taux de change et la TVA. Les réponses, fournisseur européen et américain compris, sont dans facture et TVA d’un GPU loué.

Sur le même sujet