# Deux API LLM françaises face à face : tarifs, catalogue, latence

> OVHcloud AI Endpoints contre Scaleway Generative APIs : prix au million de tokens des mêmes modèles, catalogue, offre gratuite et débit mesuré.


*Ou : Roubaix contre Paris, gpt-oss contre Mistral Medium, et un match où le moins cher n'est pas celui qu'on mesure.*

La réponse courte : sur les modèles que les deux servent, OVHcloud AI Endpoints est presque toujours moins cher que Scaleway Generative APIs : 0,08 € en entrée et 0,40 € en sortie pour gpt-oss-120b, contre 0,15 € et 0,60 €. Scaleway compense par un catalogue plus haut de gamme, avec Mistral Medium 3.5, DeepSeek V4 Flash et Gemma 4, par le premier million de tokens offert, et par des performances mesurées publiquement, ce qu'OVHcloud n'a pas. Les deux servent depuis la France, ne conservent pas les prompts et ne s'en servent pas pour entraîner des modèles. Parmi [les API LLM hébergées en Europe](/guides/gpu-cloud-ia/llm-open-source-europe/), ce sont les deux offres françaises les plus directes.

Les deux sociétés ont la même promesse et des centres de données différents. OVHcloud sert AI Endpoints depuis Gravelines, dans le Nord, et Scaleway ses Generative APIs depuis un centre parisien exploité par OPCORE. Les deux sont européennes et revendiquent d'échapper aux lois extraterritoriales américaines. Les deux proposent une API compatible OpenAI, ce qui rend le passage de l'une à l'autre presque trivial.

Leur politique de données est très proche. [La page d'OVHcloud](https://www.ovhcloud.com/fr/public-cloud/ai-endpoints/) annonce ne conserver que ce qui est nécessaire à la facturation et ne jamais utiliser les données pour entraîner des modèles. [Celle de Scaleway](https://www.scaleway.com/en/docs/generative-apis/reference-content/data-privacy/) applique une conservation nulle par défaut, avec une exception : le contenu des requêtes en erreur ou suspectes d'abus peut être gardé jusqu'à deux semaines.

> **Pour qui** : une équipe qui compare les API LLM européennes et veut, en plus des offres françaises, une option hébergée en Suisse sans conservation des prompts.
>
> **À partir de** : 0,20 le million de tokens en entrée pour Mistral Small 4 ou Gemma 4 chez Infomaniak AI Services, en francs suisses ou en euros hors taxes ; un million de crédits offerts le premier mois.
>
> **Pour démarrer** : activer Infomaniak AI Services et passer les mêmes prompts sur l'API suisse et sur les deux API françaises avant de choisir.

## OVH AI Endpoints vs Scaleway Generative APIs : prix et catalogue

| Modèle | OVHcloud AI Endpoints | Scaleway Generative APIs |
|---|---|---|
| gpt-oss-120b | 0,08 € et 0,40 € | 0,15 € et 0,60 € |
| Llama 3.3 70B | 0,67 € et 0,67 € | 0,90 € et 0,90 € |
| Mistral Small 3.2 24B | 0,09 € et 0,28 € | 0,15 € et 0,35 € |
| Qwen3.5 397B | 0,60 € et 3,60 € | 0,60 € et 3,60 € |
| Mistral Medium 3.5 | non proposé | 1,50 € et 7,50 € |
| Gemma 4 26B | non proposé | 0,25 € et 0,50 € |
| DeepSeek V4 Flash | non proposé | 0,40 € et 0,80 € |
| Qwen3.8 27B | 0,40 € et 2,70 € | non proposé |
| gpt-oss-20b | 0,04 € et 0,15 € | non proposé |
| Transcription Whisper | non relevé | 0,003 € la minute |

Prix au million de tokens hors taxes, entrée puis sortie, relevés le 27 septembre 2026.

| Critère | OVHcloud AI Endpoints | Scaleway Generative APIs |
|---|---|---|
| Essai gratuit | appels sans compte, 2 requêtes par minute ; 200 € sur un premier projet Public Cloud | premier million de tokens et 60 minutes de transcription |
| Débit avec une clé | 400 requêtes par minute par projet et par modèle | selon le palier du compte |
| Traitement par lots | non relevé | moitié prix |
| Débit mesuré publiquement | non suivi par Artificial Analysis | gpt-oss-120b à 78 tokens par seconde, Gemma 4 26B à 201 |

Le prix d'abord. Sur gpt-oss-120b, le modèle ouvert d'OpenAI, OVHcloud facture presque moitié moins que Scaleway en entrée et un tiers de moins en sortie ; sur Llama 3.3 70B et Mistral Small 3.2, l'écart va dans le même sens. Sur Qwen3.5 397B, les deux affichent exactement le même prix. Pour un usage en volume sur ces modèles, OVHcloud est le choix économique.

Le catalogue ensuite, où Scaleway prend l'avantage. Mistral Medium 3.5, le haut de gamme de Mistral, DeepSeek V4 Flash et Gemma 4, bien classé en français par le classement EuroEval, ne sont servis que chez lui. OVHcloud mise davantage sur des petits modèles bon marché, comme gpt-oss-20b à 0,04 € en entrée, utiles pour la classification ou l'extraction à grande échelle.

La mesure, enfin, et c'est un point rarement souligné. Artificial Analysis suit les performances de Scaleway, avec des débits corrects, 78 tokens par seconde sur gpt-oss-120b et 201 sur Gemma 4 26B, mais pas celles d'OVHcloud ni d'IONOS. Deux détails de la page d'OVHcloud invitent aussi à la prudence : elle affiche à la fois un engagement de disponibilité de 99,98 % et un autre de 99,5 %, et une mention de « disponibilité mondiale (hors UE) » difficile à interpréter. Rien de grave, mais de quoi poser la question au commercial avant un engagement.

Mon verdict. Pour un volume important sur gpt-oss ou Llama, OVHcloud. Pour un catalogue plus récent et des performances documentées, Scaleway. Et pour tester sans rien ouvrir, OVHcloud, seul à répondre sans compte.

![Illustration : deux comptoirs de laiton se faisant face dans une halle sombre, chacun garni de petits flacons lumineux de tailles différentes](/images/duel-api-llm-francaises-comptoirs.original.webp "Deux comptoirs, les mêmes flacons ou presque, et des prix qui ne s'affichent pas au même endroit de la balance.")

### Si vous voulez aussi l'option suisse

Infomaniak sert Mistral Small 4, Gemma 4 et Apertus depuis Genève, avec un engagement de non-conservation. Le bilan est dans [l'API LLM suisse à l'essai](/guides/gpu-cloud-ia/llm-open-source-europe/api-llm-suisse-avis-test/).

### Si vous voulez tous les prix côte à côte

Mistral, OpenAI, IONOS, Infomaniak, OVHcloud et Scaleway : la grille complète, modèle par modèle, est dans [le coût d'un million de tokens](/guides/gpu-cloud-ia/llm-open-source-europe/cout-par-million-tokens-comparatif-2026/).

### Si vous hésitez sur le modèle lui-même

gpt-oss, Llama, Mistral, Qwen, Gemma : le choix du modèle pèse plus que celui du fournisseur. Les critères sont dans [choisir son modèle ouvert](/guides/gpu-cloud-ia/llm-open-source-europe/quel-llm-open-source-choisir/).


---

Cette page contient des liens d'affiliation. Si tu souscris via ces liens, je peux toucher une commission sans coût supplémentaire pour toi. Mon avis reste indépendant et basé sur mon usage réel des outils que je recommande.


---

**Tarifs :** prix relevés le 27 septembre 2026 sur les sites officiels des fournisseurs, dans la devise qu'ils affichent : dollars américains pour les plateformes américaines, euros hors taxes pour les européennes. Les tarifs du GPU bougent souvent, et sur une place de marché chaque hôte fixe son prix : les montants cités peuvent avoir changé depuis cette date.

