For AI agents: the complete documentation index is available at https://docs.ovhcloud.com/fr/llms.txt, the full documentation bundle is available at https://docs.ovhcloud.com/fr/llms-full.txt, and this page is available as Markdown at https://docs.ovhcloud.com/fr/guides/public-cloud/ai-machine-learning/ai-deploy-apps.md.

AI Deploy - App concept

Voir en Markdown

Découvrez le concept des apps AI Deploy

Définition

Une app dans AI Deploy est l’unité de travail soumise au cluster. Une app s’exécute en tant que container Docker au sein de l’infrastructure OVHcloud.

Chaque app AI Deploy est liée à un projet Public Cloud et spécifie une quantité de ressources à utiliser pour exécuter la tâche d’inférence, ainsi qu’une image Docker soit publiquement disponible, soit dans le registre partagé AI Deploy propre à votre projet, soit dans le registre privé de votre choix que vous avez ajouté. Pour ce dernier cas, consultez la documentation OVHcloud sur la manière d’ajouter, d’utiliser et de gérer les registres.

Considérations

Warning

Une app s’exécutera indéfiniment jusqu’à interruption manuelle.

  • Des données peuvent être attachées à une app pour servir d’entrée (par exemple des poids de modèle).
  • Si vous ne personnalisez pas votre demande de ressources, la valeur par défaut demandée est 1 GPU (Tesla V100S). La mémoire n’est pas personnalisable.
  • Le scaling des applications dépend de la configuration choisie. Il peut être statique ou automatique, et repose sur un seuil de déclenchement selon la métrique choisie par l’utilisateur.
  • La facturation des apps est à la minute et s’applique pendant les états SCALING et RUNNING de l’application. Chaque minute entamée est facturée intégralement.
  • Vous pouvez en savoir plus sur les limitations des apps ici.

Dans les coulisses

Les apps dans AI Deploy sont des containers Docker au sein de l’infrastructure OVHcloud.

Cycle de vie d’une app

Pendant sa durée de vie, l’app transitera entre les états suivants :

Info

Seul le temps RUNNING et SCALING de l’app est facturé. Pour plus d’informations sur la facturation des apps, reportez-vous à cette documentation.

  • QUEUED : la demande de déploiement de l’app est sur le point d’être traitée.
  • INITIALIZING : l’app est en cours de démarrage et, le cas échéant, les données distantes sont synchronisées.
  • RUNNING : l’app est en cours d’exécution, vous pouvez vous y connecter, les ressources de calcul (GPU/CPU) sont allouées à votre app spécifique et un endpoint HTTP est disponible.
  • SCALING : le déploiement de l’app monte ou descend en charge, selon la configuration de scaling. Pendant le scaling, l’app reste disponible si elle était déjà en cours d’exécution.
  • STOPPING : l’app est en cours d’arrêt, vos ressources de calcul sont libérées et les données éphémères sont supprimées.
  • STOPPED : l’app s’est terminée normalement et vous pouvez la redémarrer quand vous le souhaitez ou la supprimer.
  • FAILED : l’app s’est terminée en erreur, par exemple l’image Docker est invalide (inaccessible, construite avec Linux/ARM, etc.).
  • ERROR : l’app s’est terminée en raison d’une erreur backend (problème du côté d’OVHcloud).
  • DELETING : l’app est en cours de suppression.
  • DELETED : l’app est entièrement supprimée.
Schéma d'états d'une application AI Deploy avec les transitions entre QUEUED INITIALIZING SCALING RUNNING STOPPING STOPPED DELETING FAILED ERROR et DELETE

Aller plus loin

Pour une formation ou une assistance technique sur la mise en œuvre de nos solutions, contactez votre commercial ou consultez la page Professional Services pour obtenir un devis et faire analyser votre projet par nos experts.

Votre avis nous intéresse !

N’hésitez pas à nous faire part de vos questions, retours et suggestions pour améliorer le service :

Cette page vous a-t-elle aidé ?