# Vitesse ou catalogue : fal.ai face à Replicate, prix à l'unité

> fal.ai contre Replicate : prix de Flux, WAN, Kling et Veo, vitesse mesurée, taille du catalogue, conservation des fichiers et usage de vos données.


*Ou : le sprinteur, le bibliothécaire, et le chronomètre qui ne dit pas toujours ce qu'on attend.*

La réponse courte : sur les modèles fermés et sur Flux dev, fal.ai et Replicate facturent le même prix, 0,025 $ pour une image Flux dev de 1024 pixels de côté. La différence se fait ailleurs. fal.ai est nettement moins cher sur la vidéo ouverte, environ 0,20 $ le clip WAN 2.2 en 480p contre 0,40 $, garde vos fichiers au moins sept jours et s'engage par contrat à ne pas entraîner de modèle sur vos contenus. Replicate offre un catalogue sans équivalent, plus de 50 000 modèles, mais facture Kling 3.0 le double du prix de l'éditeur et efface vos résultats au bout d'une heure. Deux des plateformes qui dominent [les API image et vidéo](/guides/gpu-cloud-ia/api-inference-media/), deux philosophies.

Les deux sociétés sont installées à San Francisco, et leurs trajectoires ont divergé en 2025. fal.ai, fondée en 2021, a levé 140 millions de dollars en décembre 2025 sur une valorisation de 4,5 milliards, et revendique plus de 1 000 modèles de production ; j'ai compté 1 502 points d'accès actifs dans son catalogue public le 27 septembre 2026. Replicate, fondée en 2019, a été rachetée par Cloudflare, annonce faite le 17 novembre 2025. [Son billet d'annonce](https://replicate.com/blog/replicate-cloudflare) promet que l'API ne change pas et que la marque reste distincte, et aucune hausse de prix n'a suivi.

La réputation, elle, est établie depuis longtemps : fal.ai serait le sprinteur, Replicate le bibliothécaire. fal.ai se dit « jusqu'à dix fois plus rapide » et affirme avoir l'accès à Flux le plus rapide de la planète. Les mesures racontent une histoire plus nuancée, et c'est la partie la plus intéressante du match.

> **Pour qui** : un développeur qui hésite entre fal.ai et Replicate et veut un troisième point de comparaison sur les mêmes modèles, facturés à l'unité.
>
> **À partir de** : 0,012 $ l'image Flux dev et 0,15 $ le clip WAN 2.2 de cinq secondes en 480p chez WaveSpeed, contre 0,025 $ et 0,20 $ ou 0,40 $ chez fal.ai et Replicate.
>
> **Pour démarrer** : créer une clé sur WaveSpeed et lancer le même prompt sur les trois plateformes avant de choisir.

## fal.ai vs Replicate : prix, vitesse et catalogue côte à côte

| Critère | fal.ai | Replicate |
|---|---|---|
| Catalogue | 1 502 points d'accès actifs | plus de 50 000 modèles, dont une centaine officiels |
| Flux dev, 1024 x 1024 | 0,025 $ le mégapixel, arrondi au supérieur | 0,025 $ l'image |
| Flux schnell | 0,003 $ le mégapixel | 0,003 $ l'image |
| WAN 2.2 image vers vidéo, 480p, 5 s | 0,04 $ la seconde, soit 0,20 $ environ | 0,40 $ le clip, 0,05 $ en version rapide |
| WAN 2.2 image vers vidéo, 720p, 5 s | 0,08 $ la seconde, soit 0,40 $ environ | 1 $ le clip, 0,11 $ en version rapide |
| Kling 3.0 standard, sans son | 0,084 $ la seconde | 0,168 $ la seconde |
| Veo 3.1, avec son | 0,40 $ la seconde | 0,40 $ la seconde |
| Débit par défaut | 2 requêtes simultanées, jusqu'à 40 automatiquement | 600 créations par minute |
| Conservation des résultats | médias gardés 7 jours au moins, réglable | tout est effacé après 1 heure via l'API |
| Entraînement sur vos contenus | exclu par contrat, sauf API partenaires signalées | aucune exclusion explicite |

Commençons par la vitesse, puisque c'est l'argument de fal.ai. Sur les modèles que les deux plateformes servent et qu'[Artificial Analysis](https://artificialanalysis.ai/image/providers) mesure en continu, Replicate est souvent le plus rapide : 6,2 secondes médianes contre 16,9 sur FLUX.2 dev, 7,8 contre 22,3 sur Qwen-Image, 3,3 contre 3,7 sur Flux schnell. fal.ai reprend l'avantage sur Z-Image Turbo, 2,5 secondes contre 3,3, et les deux font jeu égal sur FLUX.2 klein. Flux dev, le modèle phare, n'est pas mesuré chez fal.ai. Autrement dit, la vitesse dépend du modèle bien plus que de la plateforme, et la seule mesure qui compte est celle de votre modèle, sur vos prompts.

Le prix, lui, se joue sur la vidéo. Sur WAN 2.2 en qualité complète, fal.ai facture environ 0,20 $ le clip de cinq secondes en 480p, Replicate 0,40 $, et l'écart grimpe en 720p. Replicate propose une version rapide beaucoup moins chère, 0,05 $ en 480p, mais c'est un autre réglage du modèle, pas le même résultat à meilleur prix. Sur Kling 3.0, Replicate facture 0,168 $ la seconde, le double de fal.ai et de la grille officielle de Kling. Sur Veo 3.1, en revanche, les deux s'alignent sur Google.

Les démarrages à froid ne coûtent rien chez l'un comme chez l'autre, mais ils ne se ressemblent pas. Les modèles officiels de Replicate restent chauds en permanence ; ses modèles communautaires, eux, peuvent mettre plusieurs minutes à démarrer quand personne ne les a appelés depuis un moment, selon sa propre documentation. C'est le revers du catalogue : le modèle rare que vous êtes seul à utiliser existe, mais il vous fera attendre.

Les données font la vraie différence de fond. [Les conditions API de fal.ai](https://fal.ai/legal/api-services) excluent explicitement l'usage de vos contenus pour créer ou entraîner ses produits, sauf sur les API partenaires encore marquées « en attente », où le contenu est transmis à l'éditeur du modèle. Celles de Replicate accordent une licence pour fournir le service et produire des données agrégées et anonymisées, sans exclusion écrite de l'entraînement. Replicate efface en revanche tout, entrées comprises, une heure après une prédiction lancée par l'API. C'est excellent pour la confidentialité, et fâcheux si votre code oublie de télécharger le fichier.

Mon verdict par profil. Pour un pipeline de production vidéo ou d'images en volume, avec webhooks et fichiers qui doivent survivre quelques jours, fal.ai. Pour un prototype, un modèle communautaire introuvable ailleurs ou un modèle personnalisé entraîné sur vos propres images, Replicate. Et pour Flux dev ou WAN 2.2 au plus bas prix, aucun des deux : WaveSpeed facture 0,012 $ l'image et 0,15 $ le clip.

![Illustration : moteur de laiton lustré posé devant d'immenses rayonnages chargés de boîtes lumineuses dans un entrepôt sombre](/images/duel-api-media-vitesse-catalogue-rayonnages.original.webp "D'un côté le moteur, de l'autre les rayonnages : la vitesse annoncée compte moins que la présence du modèle dont vous avez besoin.")

### Si vous ajoutez WaveSpeed à la comparaison

WaveSpeed facture Flux dev deux fois moins cher que les deux autres, mais se montre plus lent sur l'image. Le match avec fal.ai, modèle par modèle, est dans [WaveSpeed face à fal.ai](/guides/gpu-cloud-ia/api-inference-media/duel-api-media-latence-prix/).

### Si vous voulez tous les prix d'un coup d'œil

Flux, Seedream, Nano Banana, WAN, Kling et Veo chez cinq plateformes et chez les éditeurs eux-mêmes : le relevé complet est dans [le coût d'une génération, API par API](/guides/gpu-cloud-ia/api-inference-media/cout-api-inference-media-comparatif/).

### Si vos vidéos prennent plusieurs minutes

fal.ai retente un webhook jusqu'à 31 fois, Replicate environ une minute après la fin. Ce que cela change pour votre serveur est expliqué dans [webhook ou polling pour les jobs longs](/guides/gpu-cloud-ia/api-inference-media/webhooks-polling-jobs-longs-api-media/).


---

Cette page contient des liens d'affiliation. Si tu souscris via ces liens, je peux toucher une commission sans coût supplémentaire pour toi. Mon avis reste indépendant et basé sur mon usage réel des outils que je recommande.


---

**Tarifs :** prix relevés le 27 septembre 2026 sur les sites officiels des fournisseurs, dans la devise qu'ils affichent : dollars américains pour les plateformes américaines, euros hors taxes pour les européennes. Les tarifs du GPU bougent souvent, et sur une place de marché chaque hôte fixe son prix : les montants cités peuvent avoir changé depuis cette date.

