L'A100 face à la H100 : moins chère à l'heure, et souvent suffisante
Ou : l’éloge de la carte d’avant, celle que tout le monde a cessé de regarder au moment où elle devenait abordable.
La réponse courte : une A100 de 80 Go fait tourner la plupart des modèles d’image, de vidéo et de langage qu’on sert en 2026, pour environ la moitié du prix d’une H100. Le 27 septembre 2026, elle se louait de 0,43 $ de l’heure chez l’hôte le moins cher de Vast.ai à plus de 5 $ chez Google Cloud, avec un cœur de marché entre 1,20 $ et 1,80 $. La H100 ne devient indispensable que pour l’entraînement de gros modèles, le calcul en FP8 ou les services qui ont besoin de chaque milliseconde. C’est la question la plus rentable des comparaisons entre fournisseurs GPU, parce qu’elle revient à se demander si l’on paie la carte dont on a besoin ou celle dont on parle.
L’A100, de génération Ampere, existe en 40 et en 80 Go, en format PCIe ou SXM, selon la fiche officielle de NVIDIA. La version de 80 Go a la même mémoire qu’une H100 : tout modèle qui tient dans l’une tient dans l’autre. La H100, de génération Hopper, calcule plus vite et gère nativement le format FP8, que l’A100 ignore. Pour de l’inférence de modèles de diffusion ou de LLM quantifiés, cette avance se paie souvent plus qu’elle ne rapporte.
Pour qui : un développeur ou une équipe qui fait de l’inférence ou du fine-tuning sur des modèles qui tiennent en 80 Go, et veut payer la carte la plus rentable.
À partir de : 1,19 $ de l’heure pour une A100 PCIe de 80 Go en Community Cloud, 1,59 $ en Secure Cloud, facturés à la seconde.
Pour démarrer : ouvrir un compte Runpod, lancer le même travail sur une A100 puis sur une H100, et comparer le coût par tâche plutôt que le prix de l’heure.
Louer une A100 à l’heure : le relevé, puis le bon calcul
| Fournisseur | Prix d’une A100 à l’heure | Remarque |
|---|---|---|
| Vast.ai | 0,80 $ en médiane, dès 0,43 $ (SXM, 80 Go) | place de marché, fiabilité variable |
| Runpod, Community Cloud | 1,19 $ (PCIe), 1,39 $ (SXM), 80 Go | à la seconde, sortie de données gratuite |
| Infomaniak | 1,31 € HT (80 Go) | instance complète en Suisse, GPU activés sur demande |
| Hyperstack | 1,35 $ (PCIe) | cartes hébergées au Québec |
| Runpod, Secure Cloud | 1,59 $ (80 Go) | datacenters certifiés, dont en Europe |
| Verda | 1,80 $ (80 Go), 1,29 $ (40 Go) | Helsinki |
| Lambda | 1,99 $ (40 Go), 2,79 $ (80 Go, par huit) | l’A100 de 80 Go ne se loue qu’en machine de huit |
| Modal | 2,50 $ (80 Go), 2,10 $ (40 Go) | processeur et mémoire en plus |
| AWS | 2,74 $ (40 Go, par huit) | Virginie |
| OVHcloud | 2,75 € HT (80 Go) | heure entamée due |
| Outscale | 3,60 € HT (80 Go) | carte seule, processeur et mémoire à part |
| Colab Enterprise | 4,71 $ plus 0,786 $ de gestion (80 Go) | Iowa |
| Replicate | 5,04 $ (80 Go) | facturé à la seconde |
| Google Cloud | 5,07 $ (80 Go) | une carte, Iowa |
Deux lignes surprennent. Pour mémoire, OVHcloud facture la même carte 2,75 € hors taxes. Infomaniak loue une instance A100 complète, 128 processeurs virtuels et 240 Go de mémoire compris, pour moins de la moitié du tarif d’OVHcloud : c’est l’A100 européenne la moins chère du relevé, pour qui accepte de passer par le support pour activer les GPU du Public Cloud Infomaniak. Et Lambda, qui loue la H100 à l’unité, réserve l’A100 de 80 Go aux machines de huit cartes.
Le bon calcul, ensuite, ne compare pas des heures mais des tâches. Si une H100 termine votre travail deux fois plus vite, elle vaut deux A100 : chez Runpod en Secure Cloud, 2,89 $ contre 1,59 $, le rapport est de 1,8. Autrement dit, la H100 devient rentable dès qu’elle est plus de 1,8 fois plus rapide sur votre charge de travail. Pour un entraînement qui profite du FP8, c’est souvent le cas. Pour générer des images avec Flux ou servir un modèle de langage quantifié, l’écart est en général plus faible, et c’est là qu’il faut mesurer. Une heure de test sur chaque carte coûte moins de cinq dollars, bien moins qu’un mois sur la mauvaise.
Si la H100 reste votre carte
Pour l’entraînement ou le FP8, le relevé des seize offres de H100, avec leurs frais annexes, est dans ce que coûte une heure de H100.
Si vous sortez de Colab faute d’A100
L’A100 n’y est jamais garantie, et une session s’arrête en général au bout de douze heures. Ce que change une carte louée à la seconde est pesé dans Colab ou GPU loué.
Si l’A100 européenne vous intéresse
Infomaniak n’est pas le seul fournisseur du continent à la louer. Qui la propose, où, et à quelles conditions, est détaillé dans le panorama des GPU cloud européens.