# Le tarif de Mistral, Infomaniak, OVH et OpenAI au million de tokens

> Mistral, Infomaniak, OVHcloud, Scaleway, IONOS et OpenAI : le prix au million de tokens des mêmes modèles, et le coût mensuel d'un usage type.


*Ou : six grilles, trois devises, et la découverte que le même modèle ne coûte jamais deux fois le même prix.*

La réponse courte : Mistral facture son propre Small 4 0,15 $ en entrée et 0,60 $ en sortie par million de tokens, soit 0,12 € et 0,50 €, Infomaniak le même modèle 0,20 et 0,75 en francs suisses ou en euros. Sur gpt-oss-120b, les prix vont de 0,08 € chez OVHcloud à 0,15 € chez Scaleway et IONOS. Chez OpenAI, GPT-5 mini coûte 0,25 $ et 2 $, GPT-6 Sol 2 $ et 10 $. Un assistant interne de mille requêtes par jour revient ainsi, selon le fournisseur et le modèle, de 3 à 35 € par mois environ, et bien plus au sommet de gamme. Sur [les modèles ouverts servis en Europe](/guides/gpu-cloud-ia/llm-open-source-europe/), l'écart entre fournisseurs est réel, mais l'écart entre modèles l'est bien davantage.

Trois précautions pour lire les tableaux. Les devises d'abord : Mistral affiche dollars et euros, OpenAI des dollars, les hébergeurs européens des euros hors taxes, Infomaniak le même montant en francs et en euros. Les remises ensuite : traitement par lots à moitié prix chez Mistral, OpenAI et Scaleway, entrées en cache à 90 % de remise chez Mistral et OpenAI. Le lieu de calcul enfin : sur [la grille de Mistral](https://mistral.ai/pricing/api/), le prix de base correspond au point d'accès mondial, sans engagement de localisation, et le point d'accès européen coûte 10 % de plus.

Le prix de sortie mérite une attention particulière. Il est souvent trois à dix fois plus élevé que celui d'entrée, et un assistant qui rédige des réponses longues dépense surtout en sortie. Comparer les fournisseurs sur le seul prix d'entrée, c'est se tromper de colonne.

> **Pour qui** : une équipe qui compare le coût réel des API LLM avant de choisir, et veut un modèle ouvert hébergé en Suisse sans conservation des prompts.
>
> **À partir de** : 0,05 le million de tokens en entrée pour Nemotron Nano, 0,20 pour Mistral Small 4 et Gemma 4 chez Infomaniak AI Services, en francs suisses ou en euros hors taxes.
>
> **Pour démarrer** : activer Infomaniak AI Services, utiliser le million de crédits offerts, et mesurer la consommation réelle de vos prompts avant de projeter la facture.

## Prix API LLM 2026 : le coût par million de tokens, fournisseur par fournisseur

Les modèles servis chez plusieurs fournisseurs, prix d'entrée puis de sortie par million de tokens :

| Modèle | Mistral | Infomaniak | OVHcloud | Scaleway | IONOS |
|---|---|---|---|---|---|
| Mistral Small 4 | 0,12 € et 0,50 € | 0,20 et 0,75 | non proposé | non proposé | non proposé |
| Ministral 3 14B | 0,18 € et 0,18 € | 0,30 et 0,40 | non proposé | non proposé | non proposé |
| gpt-oss-120b | non proposé | non proposé | 0,08 € et 0,40 € | 0,15 € et 0,60 € | 0,15 € et 0,65 € |
| Llama 3.3 70B | non proposé | non proposé | 0,67 € et 0,67 € | 0,90 € et 0,90 € | 0,65 € et 0,65 € |
| Qwen3.5 397B | non proposé | 0,80 et 3,60 | 0,60 € et 3,60 € | 0,60 € et 3,60 € | 0,60 € et 3,60 € |
| Mistral Medium 3.5 | 1,25 € et 6,40 € | non proposé | non proposé | 1,50 € et 7,50 € | non proposé |

Les modèles propres à chaque catalogue, pour situer les gammes :

| Fournisseur | Modèle | Entrée | Sortie |
|---|---|---|---|
| Infomaniak | Nemotron 3 Nano | 0,05 | 0,20 |
| Infomaniak | Gemma 4 31B | 0,20 | 0,40 |
| OVHcloud | gpt-oss-20b | 0,04 € | 0,15 € |
| Scaleway | Gemma 4 26B | 0,25 € | 0,50 € |
| OpenAI | GPT-5 nano | 0,05 $ | 0,40 $ |
| OpenAI | GPT-5 mini | 0,25 $ | 2 $ |
| OpenAI | GPT-6 Sol | 2 $ | 10 $ |
| OpenAI | GPT-6 Astra | 10 $ | 50 $ |

Relevés le 27 septembre 2026 sur les grilles officielles, dont [celle d'OpenAI](https://developers.openai.com/api/docs/pricing). Prix hors taxes chez les hébergeurs européens.

Pour passer des grilles à une facture, prenons l'assistant interne déjà utilisé sur la page des tarifs suisses : mille requêtes par jour ouvré, 2 000 tokens envoyés et 500 reçus, soit 44 millions de tokens en entrée et 11 millions en sortie par mois.

| Fournisseur et modèle | Coût mensuel |
|---|---|
| OVHcloud, gpt-oss-20b | 3,41 € |
| OVHcloud, gpt-oss-120b | 7,92 € |
| Mistral, Small 4 (point d'accès mondial) | 10,78 € |
| Infomaniak, Gemma 4 31B | 13,20 |
| Scaleway, gpt-oss-120b | 13,20 € |
| Infomaniak, Mistral Small 4 | 17,05 |
| OpenAI, GPT-5 mini | 33 $ |
| Mistral, Medium 3.5 | 125,40 € |
| OpenAI, GPT-6 Sol | 198 $ |

Deux conclusions ressortent. À gamme égale, les écarts entre fournisseurs vont du simple au double : gpt-oss-120b coûte 7,92 € chez OVHcloud et 13,20 € chez Scaleway pour le même usage. Entre gammes, il dépasse un à cinquante. Le premier levier d'économie est donc le choix du plus petit modèle qui fait le travail, pas la chasse au fournisseur le moins cher. Et à prix proche, le reste départage : localisation, conservation des prompts, limites de débit.

![Illustration : rangée de sabliers de laiton de tailles très différentes alignés sur une longue table sombre, le sable de chacun s'écoulant en ambre](/images/cout-par-million-tokens-comparatif-2026-sabliers.original.webp "Le même travail, des sabliers de toutes tailles : c'est le choix du modèle, plus que du fournisseur, qui fixe la vitesse à laquelle le budget s'écoule.")

### Si vous visez l'hébergement suisse

La grille d'Infomaniak, embeddings, transcription et crédit d'essai compris, est détaillée dans [les tarifs de l'API LLM suisse](/guides/gpu-cloud-ia/llm-open-source-europe/tarifs-api-llm-suisse/).

### Si le volume justifie votre propre serveur

Au-delà d'un certain volume, un modèle ouvert servi sur un GPU loué coûte moins cher que n'importe quelle API. Le calcul est dans [servir son LLM sur un GPU loué](/guides/gpu-cloud-ia/llm-open-source-europe/heberger-llm-vllm-ollama-gpu-cloud/).

### Si vous hésitez entre les deux françaises

OVHcloud est moins cher sur gpt-oss et Llama, Scaleway plus riche en modèles récents. Le match est dans [OVHcloud face à Scaleway](/guides/gpu-cloud-ia/llm-open-source-europe/duel-api-llm-francaises/).


---

Cette page contient des liens d'affiliation. Si tu souscris via ces liens, je peux toucher une commission sans coût supplémentaire pour toi. Mon avis reste indépendant et basé sur mon usage réel des outils que je recommande.


---

**Tarifs :** prix relevés le 27 septembre 2026 sur les sites officiels des fournisseurs, dans la devise qu'ils affichent : dollars américains pour les plateformes américaines, euros hors taxes pour les européennes. Les tarifs du GPU bougent souvent, et sur une place de marché chaque hôte fixe son prix : les montants cités peuvent avoir changé depuis cette date.

