Québec, Canada

403-1381 1re Avenue

+1 581.849.27.96

bdgouthiere@gmail.com

Le tarif de Mistral, Infomaniak, OVH et OpenAI au million de tokens

Ou : six grilles, trois devises, et la découverte que le même modèle ne coûte jamais deux fois le même prix.

La réponse courte : Mistral facture son propre Small 4 0,15 $ en entrée et 0,60 $ en sortie par million de tokens, soit 0,12 € et 0,50 €, Infomaniak le même modèle 0,20 et 0,75 en francs suisses ou en euros. Sur gpt-oss-120b, les prix vont de 0,08 € chez OVHcloud à 0,15 € chez Scaleway et IONOS. Chez OpenAI, GPT-5 mini coûte 0,25 $ et 2 $, GPT-6 Sol 2 $ et 10 $. Un assistant interne de mille requêtes par jour revient ainsi, selon le fournisseur et le modèle, de 3 à 35 € par mois environ, et bien plus au sommet de gamme. Sur les modèles ouverts servis en Europe, l’écart entre fournisseurs est réel, mais l’écart entre modèles l’est bien davantage.

Trois précautions pour lire les tableaux. Les devises d’abord : Mistral affiche dollars et euros, OpenAI des dollars, les hébergeurs européens des euros hors taxes, Infomaniak le même montant en francs et en euros. Les remises ensuite : traitement par lots à moitié prix chez Mistral, OpenAI et Scaleway, entrées en cache à 90 % de remise chez Mistral et OpenAI. Le lieu de calcul enfin : sur la grille de Mistral, le prix de base correspond au point d’accès mondial, sans engagement de localisation, et le point d’accès européen coûte 10 % de plus.

Le prix de sortie mérite une attention particulière. Il est souvent trois à dix fois plus élevé que celui d’entrée, et un assistant qui rédige des réponses longues dépense surtout en sortie. Comparer les fournisseurs sur le seul prix d’entrée, c’est se tromper de colonne.

Pour qui : une équipe qui compare le coût réel des API LLM avant de choisir, et veut un modèle ouvert hébergé en Suisse sans conservation des prompts.

À partir de : 0,05 le million de tokens en entrée pour Nemotron Nano, 0,20 pour Mistral Small 4 et Gemma 4 chez Infomaniak AI Services, en francs suisses ou en euros hors taxes.

Pour démarrer : activer Infomaniak AI Services, utiliser le million de crédits offerts, et mesurer la consommation réelle de vos prompts avant de projeter la facture.

Prix API LLM 2026 : le coût par million de tokens, fournisseur par fournisseur

Les modèles servis chez plusieurs fournisseurs, prix d’entrée puis de sortie par million de tokens :

ModèleMistralInfomaniakOVHcloudScalewayIONOS
Mistral Small 40,12 € et 0,50 €0,20 et 0,75non proposénon proposénon proposé
Ministral 3 14B0,18 € et 0,18 €0,30 et 0,40non proposénon proposénon proposé
gpt-oss-120bnon proposénon proposé0,08 € et 0,40 €0,15 € et 0,60 €0,15 € et 0,65 €
Llama 3.3 70Bnon proposénon proposé0,67 € et 0,67 €0,90 € et 0,90 €0,65 € et 0,65 €
Qwen3.5 397Bnon proposé0,80 et 3,600,60 € et 3,60 €0,60 € et 3,60 €0,60 € et 3,60 €
Mistral Medium 3.51,25 € et 6,40 €non proposénon proposé1,50 € et 7,50 €non proposé

Les modèles propres à chaque catalogue, pour situer les gammes :

FournisseurModèleEntréeSortie
InfomaniakNemotron 3 Nano0,050,20
InfomaniakGemma 4 31B0,200,40
OVHcloudgpt-oss-20b0,04 €0,15 €
ScalewayGemma 4 26B0,25 €0,50 €
OpenAIGPT-5 nano0,05 $0,40 $
OpenAIGPT-5 mini0,25 $2 $
OpenAIGPT-6 Sol2 $10 $
OpenAIGPT-6 Astra10 $50 $

Relevés le 27 septembre 2026 sur les grilles officielles, dont celle d’OpenAI. Prix hors taxes chez les hébergeurs européens.

Pour passer des grilles à une facture, prenons l’assistant interne déjà utilisé sur la page des tarifs suisses : mille requêtes par jour ouvré, 2 000 tokens envoyés et 500 reçus, soit 44 millions de tokens en entrée et 11 millions en sortie par mois.

Fournisseur et modèleCoût mensuel
OVHcloud, gpt-oss-20b3,41 €
OVHcloud, gpt-oss-120b7,92 €
Mistral, Small 4 (point d’accès mondial)10,78 €
Infomaniak, Gemma 4 31B13,20
Scaleway, gpt-oss-120b13,20 €
Infomaniak, Mistral Small 417,05
OpenAI, GPT-5 mini33 $
Mistral, Medium 3.5125,40 €
OpenAI, GPT-6 Sol198 $

Deux conclusions ressortent. À gamme égale, les écarts entre fournisseurs vont du simple au double : gpt-oss-120b coûte 7,92 € chez OVHcloud et 13,20 € chez Scaleway pour le même usage. Entre gammes, il dépasse un à cinquante. Le premier levier d’économie est donc le choix du plus petit modèle qui fait le travail, pas la chasse au fournisseur le moins cher. Et à prix proche, le reste départage : localisation, conservation des prompts, limites de débit.

Le même travail, des sabliers de toutes tailles : c'est le choix du modèle, plus que du fournisseur, qui fixe la vitesse à laquelle le budget s'écoule.

Si vous visez l’hébergement suisse

La grille d’Infomaniak, embeddings, transcription et crédit d’essai compris, est détaillée dans les tarifs de l’API LLM suisse.

Si le volume justifie votre propre serveur

Au-delà d’un certain volume, un modèle ouvert servi sur un GPU loué coûte moins cher que n’importe quelle API. Le calcul est dans servir son LLM sur un GPU loué.

Si vous hésitez entre les deux françaises

OVHcloud est moins cher sur gpt-oss et Llama, Scaleway plus riche en modèles récents. Le match est dans OVHcloud face à Scaleway.