Québec, Canada

403-1381 1re Avenue

+1 581.849.27.96

bdgouthiere@gmail.com

Deux API LLM françaises face à face : tarifs, catalogue, latence

Ou : Roubaix contre Paris, gpt-oss contre Mistral Medium, et un match où le moins cher n’est pas celui qu’on mesure.

La réponse courte : sur les modèles que les deux servent, OVHcloud AI Endpoints est presque toujours moins cher que Scaleway Generative APIs : 0,08 € en entrée et 0,40 € en sortie pour gpt-oss-120b, contre 0,15 € et 0,60 €. Scaleway compense par un catalogue plus haut de gamme, avec Mistral Medium 3.5, DeepSeek V4 Flash et Gemma 4, par le premier million de tokens offert, et par des performances mesurées publiquement, ce qu’OVHcloud n’a pas. Les deux servent depuis la France, ne conservent pas les prompts et ne s’en servent pas pour entraîner des modèles. Parmi les API LLM hébergées en Europe, ce sont les deux offres françaises les plus directes.

Les deux sociétés ont la même promesse et des centres de données différents. OVHcloud sert AI Endpoints depuis Gravelines, dans le Nord, et Scaleway ses Generative APIs depuis un centre parisien exploité par OPCORE. Les deux sont européennes et revendiquent d’échapper aux lois extraterritoriales américaines. Les deux proposent une API compatible OpenAI, ce qui rend le passage de l’une à l’autre presque trivial.

Leur politique de données est très proche. La page d’OVHcloud annonce ne conserver que ce qui est nécessaire à la facturation et ne jamais utiliser les données pour entraîner des modèles. Celle de Scaleway applique une conservation nulle par défaut, avec une exception : le contenu des requêtes en erreur ou suspectes d’abus peut être gardé jusqu’à deux semaines.

Pour qui : une équipe qui compare les API LLM européennes et veut, en plus des offres françaises, une option hébergée en Suisse sans conservation des prompts.

À partir de : 0,20 le million de tokens en entrée pour Mistral Small 4 ou Gemma 4 chez Infomaniak AI Services, en francs suisses ou en euros hors taxes ; un million de crédits offerts le premier mois.

Pour démarrer : activer Infomaniak AI Services et passer les mêmes prompts sur l’API suisse et sur les deux API françaises avant de choisir.

OVH AI Endpoints vs Scaleway Generative APIs : prix et catalogue

ModèleOVHcloud AI EndpointsScaleway Generative APIs
gpt-oss-120b0,08 € et 0,40 €0,15 € et 0,60 €
Llama 3.3 70B0,67 € et 0,67 €0,90 € et 0,90 €
Mistral Small 3.2 24B0,09 € et 0,28 €0,15 € et 0,35 €
Qwen3.5 397B0,60 € et 3,60 €0,60 € et 3,60 €
Mistral Medium 3.5non proposé1,50 € et 7,50 €
Gemma 4 26Bnon proposé0,25 € et 0,50 €
DeepSeek V4 Flashnon proposé0,40 € et 0,80 €
Qwen3.8 27B0,40 € et 2,70 €non proposé
gpt-oss-20b0,04 € et 0,15 €non proposé
Transcription Whispernon relevé0,003 € la minute

Prix au million de tokens hors taxes, entrée puis sortie, relevés le 27 septembre 2026.

CritèreOVHcloud AI EndpointsScaleway Generative APIs
Essai gratuitappels sans compte, 2 requêtes par minute ; 200 € sur un premier projet Public Cloudpremier million de tokens et 60 minutes de transcription
Débit avec une clé400 requêtes par minute par projet et par modèleselon le palier du compte
Traitement par lotsnon relevémoitié prix
Débit mesuré publiquementnon suivi par Artificial Analysisgpt-oss-120b à 78 tokens par seconde, Gemma 4 26B à 201

Le prix d’abord. Sur gpt-oss-120b, le modèle ouvert d’OpenAI, OVHcloud facture presque moitié moins que Scaleway en entrée et un tiers de moins en sortie ; sur Llama 3.3 70B et Mistral Small 3.2, l’écart va dans le même sens. Sur Qwen3.5 397B, les deux affichent exactement le même prix. Pour un usage en volume sur ces modèles, OVHcloud est le choix économique.

Le catalogue ensuite, où Scaleway prend l’avantage. Mistral Medium 3.5, le haut de gamme de Mistral, DeepSeek V4 Flash et Gemma 4, bien classé en français par le classement EuroEval, ne sont servis que chez lui. OVHcloud mise davantage sur des petits modèles bon marché, comme gpt-oss-20b à 0,04 € en entrée, utiles pour la classification ou l’extraction à grande échelle.

La mesure, enfin, et c’est un point rarement souligné. Artificial Analysis suit les performances de Scaleway, avec des débits corrects, 78 tokens par seconde sur gpt-oss-120b et 201 sur Gemma 4 26B, mais pas celles d’OVHcloud ni d’IONOS. Deux détails de la page d’OVHcloud invitent aussi à la prudence : elle affiche à la fois un engagement de disponibilité de 99,98 % et un autre de 99,5 %, et une mention de « disponibilité mondiale (hors UE) » difficile à interpréter. Rien de grave, mais de quoi poser la question au commercial avant un engagement.

Mon verdict. Pour un volume important sur gpt-oss ou Llama, OVHcloud. Pour un catalogue plus récent et des performances documentées, Scaleway. Et pour tester sans rien ouvrir, OVHcloud, seul à répondre sans compte.

Deux comptoirs, les mêmes flacons ou presque, et des prix qui ne s'affichent pas au même endroit de la balance.

Si vous voulez aussi l’option suisse

Infomaniak sert Mistral Small 4, Gemma 4 et Apertus depuis Genève, avec un engagement de non-conservation. Le bilan est dans l’API LLM suisse à l’essai.

Si vous voulez tous les prix côte à côte

Mistral, OpenAI, IONOS, Infomaniak, OVHcloud et Scaleway : la grille complète, modèle par modèle, est dans le coût d’un million de tokens.

Si vous hésitez sur le modèle lui-même

gpt-oss, Llama, Mistral, Qwen, Gemma : le choix du modèle pèse plus que celui du fournisseur. Les critères sont dans choisir son modèle ouvert.