Novita AI

Novita AI

Outils Développeur
Novita AI
FreemiumAPI

À Propos

API de modèles et cloud GPU tout-en-un : plus de 200 modèles ouverts via une API compatible OpenAI, avec location à la seconde de GPU RTX 4090/5090, H100 et H200 et des tarifs spot jusqu'à ~50 % moins chers ; crédits de départ à l'inscription

Partager cet outil

Notre Verdict

À Essayer

Un guichet unique abordable pour API de modèles ouverts et GPU louables

Novita occupe un entre-deux utile : il est à la fois fournisseur d'API de modèles hébergés (plus de 200 LLM ouverts, modèles image, audio et vidéo derrière un endpoint compatible OpenAI) et un cloud GPU où l'on peut louer tout, d'une RTX 4090 à une H200, à la seconde, souvent avec des tarifs spot qui réduisent jusqu'à la moitié. Pour un builder solo ou une petite équipe, cette combinaison est réellement pratique — prototyper via l'API, puis louer des GPU bruts quand il faut entraîner ou exécuter du personnalisé, le tout depuis un tableau de bord et une facture. Les réserves honnêtes le maintiennent en Worth Trying : les évaluateurs notent l'absence de niveau de calcul gratuit perpétuel, donc le « commencez gratuitement » signifie en réalité des crédits de départ avant recharge, et la disponibilité spot fluctue avec la demande. Il n'offre pas non plus les SLA stricts d'un hyperscaler ni la concentration affûtée d'un cloud d'inférence mono-usage. Mais rapporté à ces compromis, Novita est un endroit légitimement bon marché et flexible pour construire — un choix solide quand votre charge couvre des API de modèles et du temps GPU brut occasionnel et que vous préférez ne pas jongler avec deux fournisseurs.

Idéal pour

  • Builders solo et petites équipes voulant API de modèles et GPU louables au même endroit
  • Charges sensibles au coût pouvant utiliser les tarifs spot GPU
  • Déployer des modèles personnalisés en endpoints serverless avec autoscaling

Envisagez des alternatives si

  • Vous avez besoin de SLA de niveau hyperscaler pour une production critique (→ AWS / GCP / Azure)
  • Vous avez seulement besoin d'inférence hébergée rapide de modèles populaires (→ Together AI / Cerebras)

Plateformes prises en charge

Application webAPI

Les plateformes disponibles incluent Application web et API.

Fonctionnalités Clés

API de modèles pour plus de 200 modèles ouverts (LLM, image, audio, vidéo) avec endpoints compatibles OpenAI
Cloud GPU couvrant RTX 4090/5090, L40S, H100 et H200 avec facturation à la seconde
Endpoints serverless, instances dédiées et bare metal depuis un seul tableau de bord
Tarifs spot pouvant réduire le coût GPU jusqu'à ~50 %
Déploiement serverless avec autoscaling pour modèles personnalisés
Disponibilité GPU mondiale visant les builders qui veulent de la capacité sans contrats longs

Tarifs

free
Les nouveaux comptes reçoivent des crédits de départ pour essayer les Model APIs ; il n'y a pas de niveau de calcul gratuit perpétuel — un travail GPU sérieux nécessite de recharger.
paid
Paiement à l'usage : les appels Model API sont facturés au token/à la requête selon le modèle, et les GPU à la seconde — classe RTX 4090 dès quelques dizaines de centimes de l'heure jusqu'aux niveaux H100/H200, avec des tarifs spot réduisant les coûts jusqu'à ~50 %. Endpoints dédiés et bare metal disponibles. (Vérifié avec la page tarifaire officielle, 2026-07-28.)

Cas d'Utilisation

Appeler des LLM ouverts et modèles multimédias via une seule API compatible OpenAI
Louer des GPU abordables pour l'entraînement, le fine-tuning ou l'inférence par lots
Déployer des modèles personnalisés en endpoints serverless avec autoscaling
Réduire la facture de calcul avec des tarifs spot GPU pour charges interruptibles

Avantages

Une plateforme couvre à la fois les API de modèles hébergés et la location de GPU brut
Gamme GPU large et à jour, dont RTX 5090 et H200, à des tarifs compétitifs
Tarifs spot et facturation à la seconde gardent les charges interruptibles bon marché
L'API compatible OpenAI rend la migration peu contraignante

Inconvénients

Pas de niveau de calcul gratuit perpétuel — un travail GPU sérieux nécessite une recharge (reproche fréquent en avis)
La disponibilité et le prix des GPU spot varient selon la région et la demande
Moins de garanties entreprise que les hyperscalers pour des SLA critiques
Sa large portée implique moins de spécialisation que les clouds d'inférence mono-usage

Dernière Mise à Jour

2026 : Novita continue d'élargir les deux versants de son offre — un catalogue croissant de plus de 200 API de modèles ouverts et une flotte GPU renouvelée (RTX 5090, H200) avec tarifs spot — se positionnant comme une plateforme abordable tout-en-un pour les builders qui veulent des API de modèles et du calcul louable au même endroit.

S'abonner aux actualités IA

Recevez les dernières recommandations d'outils IA et analyses dans votre boîte mail.

Nous respectons votre vie privée. Désabonnement à tout moment.