Les frais de sortie réseau : la ligne que la grille GPU oublie
Ou : ce que coûte le fait de reprendre ses propres données.
La réponse courte : chez les loueurs spécialisés comme Runpod, Lambda ou Nebius, la sortie de données est gratuite ; chez les fournisseurs européens, elle est incluse ; chez AWS, Azure et Google Cloud, elle coûte entre 0,087 $ et 0,12 $ le gigaoctet au-delà d’un petit volume gratuit. Le stockage, lui, se paie partout, y compris quand la machine est arrêtée, et c’est souvent la ligne la plus lourde des deux. Ces deux frais sont ceux qui séparent le plus souvent le devis de la facture dans le prix réel du GPU loué.
Le mot anglais « egress » désigne les données qui quittent le réseau du fournisseur vers Internet : un dataset qu’on rapatrie, des vidéos générées qu’on télécharge, un modèle entraîné qu’on exporte. L’entrée, elle, est gratuite presque partout, ce qui donne à ce modèle économique une forme familière : entrer ne coûte rien, sortir se paie. AWS l’écrit dans sa grille à la demande : 100 Go gratuits par mois, tous services confondus, puis 0,09 $ le gigaoctet sur les dix premiers téraoctets.
Pour qui : un projet qui télécharge des modèles lourds, exporte des vidéos ou rapatrie des datasets, et ne veut pas payer la sortie au gigaoctet.
À partir de : entrée et sortie de données gratuites sur les pods, 0,07 $ par gigaoctet et par mois pour un volume réseau sous le téraoctet.
Pour démarrer : ouvrir un compte Runpod, créer un volume réseau pour les modèles, et ne garder sur le disque du pod que ce qui change à chaque session.
Egress et stockage GPU cloud : ce que facture chaque fournisseur
| Fournisseur | Sortie de données vers Internet | Stockage persistant |
|---|---|---|
| Runpod | gratuite | volume réseau 0,07 $ par Go et par mois (0,05 $ au-delà d'1 To) ; disque de pod 0,20 $ à l’arrêt |
| Lambda | gratuite | système de fichiers autour de 0,20 $ par Go et par mois |
| Nebius | gratuite | non relevé |
| Modal | non détaillée sur la grille | volumes 0,09 $ par Gio et par mois |
| Novita AI | non relevé | volume réseau 0,002 $ par Go et par jour, soit environ 0,06 $ par mois |
| Vast.ai | fixée par chaque hôte, au téraoctet | fixé par chaque hôte, facturé même instance arrêtée |
| Scaleway | incluse | non relevé |
| OVHcloud | incluse, sauf contrats avec ses entités d’Asie-Pacifique | non relevé |
| IONOS | 2 To gratuits par mois, puis 0,030 € le Go | non relevé |
| Infomaniak | objets : 10 To gratuits par mois, puis 0,00811 € le Go | bloc 0,00011 € par Go et par heure, environ 0,08 € par mois |
| AWS | 100 Go gratuits par mois, puis 0,09 $ le Go | non relevé |
| Azure | 100 Go gratuits, puis 0,087 $ le Go | non relevé |
| Google Cloud | 0,12 $ le Gio en réseau Premium | non relevé |
Un exemple donne l’échelle. Un projet vidéo qui exporte 2 To de clips par mois ne paie rien de plus chez Runpod ou Scaleway. Chez AWS, les 1 900 Go au-delà du volume gratuit coûtent 171 $. Chez Google Cloud en réseau Premium, le premier téraoctet seul coûte déjà près de 123 $. Sur une facture de calcul de quelques centaines de dollars, cette ligne peut peser autant que les cartes.
Les places de marché ajoutent une variable. Chez Vast.ai, la page de facturation précise que chaque hôte fixe son propre tarif de bande passante, à l’octet envoyé ou reçu, exprimé au téraoctet. Deux offres au même prix horaire peuvent donc coûter très différemment sur un projet qui télécharge beaucoup : ce tarif s’affiche sur chaque offre, et il faut le lire avant de louer.
Le stockage est moins spectaculaire mais plus sournois, parce qu’il continue de courir quand tout est éteint. Chez Runpod, le disque d’un pod arrêté coûte 0,20 $ par gigaoctet et par mois, deux fois le tarif d’un pod en marche, alors qu’un volume réseau coûte 0,07 $ et se partage entre plusieurs machines. Chez Vast.ai, le stockage reste facturé tant que l’instance existe, même arrêtée. La règle pratique tient en une phrase : les modèles vont sur un volume réseau, les disques de pods se suppriment dès que le travail est fini.
Si vous voulez comparer l’ensemble de la facture
La sortie de données n’est qu’une des lignes ajoutées au prix de l’heure. La méthode pour tout additionner, avec trois exemples chiffrés, est dans le budget d’un projet IA en trois lignes.
Si c’est la granularité qui vous coûte
Une heure entamée due pour dix minutes de test pèse parfois plus que la sortie réseau. Ce que change la facturation à la seconde est détaillé dans payer le GPU à la seconde.
Si vous hésitez entre un grand cloud et un loueur spécialisé
Les grands clouds ajoutent une autre friction aux frais de sortie : un quota de GPU fixé à zéro sur un compte neuf. Elle est détaillée, fournisseur par fournisseur, dans les quotas d’un compte neuf.