

Novita AI est un cloud à la carte qui regroupe plus de 200 modèles (LLM, image, vidéo et audio) derrière une seule API compatible OpenAI, tout en proposant la location de GPU. C'est une solution économique et exhaustive, et l'un des rares outils d'infrastructure à proposer un programme d'affiliation rémunéré en espèces.
Novita AI est un cloud d'IA à la carte, basé à San Francisco, qui regroupe plus de 200 modèles (LLM, image, vidéo, audio et embeddings) derrière une seule API compatible OpenAI, tout en proposant des instances GPU à la location. Fondée entre 2022 et 2023 et lancée sur Product Hunt en décembre 2023, l'entreprise reste autofinancée et à taille humaine (environ 16 personnes), mais elle joue dans la cour des grands grâce à ses partenariats : Novita est l'un des fournisseurs backend des Inference Providers de Hugging Face, et s'est associée au projet vLLM qui propulse une grande partie de l'infrastructure de service de l'industrie. L'argument principal est la consolidation. Au lieu d'avoir des comptes séparés pour le texte, l'image et l'audio, vous accédez à tout via une seule clé et une seule facture, à des prix que Novita affirme être jusqu'à 50% inférieurs à ceux des grands fournisseurs cloud.
Une seule clé permet d'accéder à des LLM comme DeepSeek, Qwen et Llama, à des modèles d'image, à des modèles vidéo tels que Kling et Seedance, à la synthèse vocale et au clonage de voix, ainsi qu'à des instances GPU RTX 4090 à partir d'environ $0.18 de l'heure. L'API reproduit celle d'OpenAI, la plupart des équipes peuvent donc faire la transition en modifiant simplement une URL de base. Llama 3.1 8B à $0.02 par million de tokens en entrée se situe parmi les prix les plus bas du marché et, fait inhabituel pour cette catégorie, Novita propose un programme d'affiliation ouvert rémunéré en espèces plutôt qu'un simple parrainage en crédits. Les contreparties sont une équipe restreinte, une documentation publique sur la conformité assez mince, et un débit qui reste en retrait par rapport aux spécialistes sur les grands modèles.
Ce que couvre Novita AI en juin 2026
Novita propose deux produits sous un seul compte. Le premier est une API d'inférence unifiée : choisissez un modèle par son nom, envoyez une requête de type OpenAI, et obtenez du texte, une image, un clip vidéo ou de l'audio. Le catalogue est véritablement exhaustif, ce qui constitue la raison principale de le choisir plutôt qu'un hébergeur exclusivement textuel. Le second est un cloud GPU avec des instances à la demande, spot et bare-metal pour les équipes qui recherchent de la puissance de calcul brute plutôt qu'un endpoint géré. Sa crédibilité repose moins sur son financement, qui est minime, que sur ses intégrations : être un backend sélectionnable au sein des Inference Providers de Hugging Face place Novita devant une immense audience de développeurs. De plus, le 7 avril 2025, l'entreprise a annoncé un partenariat officiel avec vLLM, fournissant de la puissance de calcul GPU au projet en échange d'un service optimisé en mémoire. Un benchmark d'Artificial Analysis d'avril 2026 a classé Novita premier pour la précision du raisonnement scientifique parmi les fournisseurs testés, un signal tiers très utile pour une entreprise de cette taille.
Novita face à DeepInfra et RunPod
La comparaison la plus pertinente est avec DeepInfra, et le choix se résume à la polyvalence contre la vitesse. DeepInfra est exclusivement textuel, sans API pour l'image, la vidéo ou l'audio et sans location de GPU, mais il a tendance à l'emporter sur le débit brut en sortie pour les grands modèles, là où le catalogue de Novita tourne en moyenne autour de 45 tokens par seconde. Si votre charge de travail est purement LLM et sensible à la latence, DeepInfra prend souvent l'avantage ; si vous avez besoin d'image, de vidéo et d'audio sur une seule facture, Novita est le choix évident. Face à RunPod, la différence réside dans la gestion. RunPod vous loue des GPU bruts et s'attend à ce que vous apportiez votre propre image Docker et votre infrastructure de service, tandis que Novita vous fournit un appel d'API géré en une ligne et ne propose des instances GPU que comme option complémentaire. Together AI est l'autre point de référence, avec un catalogue LLM plus profond et un fine-tuning géré qui fait défaut à Novita. Ainsi, les équipes fortement axées sur le Machine Learning qui ont besoin d'entraîner et de déployer au même endroit se tourneront vers Together AI, tandis que les créateurs multimodaux privilégieront Novita.
Ce que cela coûte réellement, et le rare programme d'affiliation en espèces
La tarification est basée sur l'utilisation, sans abonnement. Llama 3.1 8B coûte $0.02 en entrée et $0.05 en sortie par million de tokens, DeepSeek V4 Pro est à $1.60 et $3.20, les images commencent à $0.001 l'unité, la vidéo Kling est facturée à la seconde, et la synthèse vocale tourne autour de $15 par million de caractères. Les instances GPU commencent à environ $0.18 de l'heure en spot. Il existe une version gratuite, bien que les utilisateurs signalent qu'elle est limitée et que ses conditions ne sont pas clairement communiquées.
"Novita.AI est l'API Stable Diffusion la moins chère au monde." anyisalin, Product Hunt, 2024.
Le détail qui mérite d'être souligné pour quiconque monétise du contenu est le programme d'affiliation. Novita verse une commission en espèces de 10% sur les dépenses parrainées pendant 180 jours, avec une inscription libre en libre-service et un paiement PayPal via Tapfiliate. C'est véritablement rare dans l'infrastructure de l'IA, où presque tous les concurrents proposent des parrainages uniquement en crédits, voire rien du tout. Un système de parrainage distinct offrant dix crédits pour dix crédits existe également, mais c'est le programme en espèces qui se démarque.
Les points faibles de Novita
La plainte initiale la plus fréquente concerne la version gratuite, qui suscite des attentes qu'elle ne satisfait pas.
"Dit que c'est gratuit, vous créez un compte, le solde est bas, vous devez payer." Avis Trustpilot, mars 2026.
Au-delà de cela, les limites de requêtes (rate limits) sont atteintes plus tôt que prévu, les utilisateurs signalant des erreurs HTTP 429 autour de 300 requêtes par minute, et la procédure pour augmenter ces limites passe par Discord ou un appel commercial plutôt que par une mise à niveau en libre-service. Le support client privilégie Discord, et un utilisateur a décrit cinq jours de silence par e-mail avant de résoudre un problème via le chat. Sur les charges de travail importantes générant beaucoup de texte, l'écart de débit est réel, puisqu'une moyenne de catalogue proche de 45 tokens par seconde reste à la traîne par rapport aux fournisseurs spécialisés. Enfin, Novita met en avant sa conformité SOC 2 mais ne facilite pas l'accès au rapport, ce qui ralentit les processus d'achat pour les industries réglementées.
À qui s'adresse Novita, et qui devrait passer son chemin
Novita est parfaitement adapté aux développeurs indépendants et aux startups qui ont besoin de plusieurs modalités sous un seul compte de facturation, pour l'évaluation rapide de modèles où un endpoint compatible OpenAI permet de changer le nom d'un modèle en un clin d'œil, et pour les équipes soucieuses des coûts où $0.02 par million de tokens fait une réelle différence à grande échelle. L'accès optionnel aux GPU est un bonus pour les tâches personnalisées occasionnelles. Les créateurs de contenu dans le domaine de l'IA y trouvent également une véritable opportunité d'affiliation.
Passez votre chemin si vous avez besoin d'une conformité d'entreprise auditable immédiatement, car la documentation SOC 2 n'est pas en libre-service. Les équipes qui souhaitent un fine-tuning géré devraient se tourner vers Together AI ou une plateforme dédiée. Les applications à forte concurrence générant de très longs textes se heurteront au plafond de débit, et quiconque a besoin d'une tarification mensuelle fixe et prévisible ou d'un SLA d'entreprise contractuel trouvera que la facturation à l'usage et le support via Discord ne sont pas adaptés.
Avis des utilisateurs
Aucun avis pour l'instant. Soyez le premier à partager votre expérience !
Se connecter pour écrire un avis.
Articles associés
Guides et articles en lien avec Novita AI.

Google Vision AI Explained (2026): Pricing Per 1,000 Units, Free Tier, and Alternatives

Does API Cost More Than a Subscription for Claude Opus 4.8, GPT-5.5, and Grok?

Grok 4.3 API for Agents (May 2026): Pricing, Benchmarks, Migration

OpenAI GPT-Realtime-2 (May 2026): Pricing, Latency & 30-Min Voice Agent

Vantaige Launches the LLM VRAM Calculator: A Free GPU Compatibility Finder for Open-source and Open-Weight AI
