AI Deploy - Tutoriel - Déployer une app interactive pour l'EDA et la prédiction en utilisant Streamlit
Comment déployer une app Streamlit pour de la prédiction et visualisation interactive de données
AI Deploy est couvert par les Conditions particulières OVHcloud Public Cloud.
Objectif
L'objectif de ce tutoriel est de déployer une application d'Exploratory Data Analysis (EDA) et de prédiction interactive.
Le cas d'usage est le jeu de données IRIS. Il s'agit d'une collection de données contenant des informations sur 50 observations de quatre variables différentes : petal length, petal width, sepal length et sepal width.
Le premier objectif est d'effectuer une exploration des données source du jeu de données Iris.
Ensuite, l'objectif est de réaliser des prédictions à l'aide d'un modèle entraîné. Nous allons donc utiliser un réseau de neurones et les poids issus de ce notebook pour classifier les fleurs d'iris entre différentes espèces (Setosa, Versicolor et Virginica). Les quatre caractéristiques sont envoyées en entrée du réseau de neurones.
Le modèle PyTorch sera chargé et exécuté, et les probabilités de prédiction pour chaque classe seront extraites. Selon les données d'entrée, il sera possible de visualiser l'iris correspondant sur un graphique PCA afin de comparer l'entrée aux autres points de données de notre jeu de données Iris.
Pour cela, vous allez utiliser Streamlit, un framework Python qui transforme des scripts en application web partageable. Vous apprendrez également à construire et à utiliser une image Docker personnalisée pour une application Streamlit.
Prérequis
- Un projet AI Deploy créé au sein d'un projet Public Cloud dans votre compte OVHcloud ;
- Un utilisateur pour AI Deploy ;
- Docker installé sur votre ordinateur local ;
- Quelques connaissances sur la construction d'images et les Dockerfile ;
- Vous devez également avoir suivi l'étape 6 du notebook Classification of iris varieties within the same species du dépôt GitHub. Vous pourrez ainsi sauvegarder votre modèle PyTorch
model_iris_classification.pth.
En pratique
Vous allez suivre différentes étapes pour construire votre application Streamlit.
- Plus d'informations sur les capacités de Streamlit sont disponibles ici.
- Le lien direct vers le fichier Python complet est disponible ici.
Nous allons ici principalement voir comment écrire les codes utils.py et app.py, le fichier requirements.txt et le Dockerfile. Si vous souhaitez voir le code complet, reportez-vous au dépôt GitHub.
Créer l'application Streamlit
Deux fichiers Python sont créés dans le but de charger le modèle PyTorch et de construire l'app Streamlit.
Définir le fichier utils.py
Ce fichier Python est dédié au chargement du modèle PyTorch. Vous pouvez trouver le code complet ici.
Tout d'abord, nous devons définir la classe Model avec l'architecture du réseau de neurones.
Ensuite, nous créons la fonction permettant de charger le checkpoint du modèle.
La dernière fonction nous permet de charger le modèle et d'obtenir des prédictions.
Pour en savoir plus sur la façon de sauvegarder un modèle avec PyTorch, reportez-vous à la dernière étape "Save the model for future inference" du notebook.
Vous pouvez trouver le modèle PyTorch model_iris_classification.pth sur le dépôt GitHub.
Écrire le fichier app.py
Chargez le jeu de données IRIS pour l'EDA.
Affichez la figure d'EDA basée sur le jeu de données source.
Créez une barre latérale avec des curseurs.
Exécutez une PCA.
Créez une fonction qui filtre les valeurs négatives du dataframe. Seules les valeurs positives du dataframe sont conservées. Si une valeur est négative, elle est fixée à zéro.
Définissez une fonction Python pour afficher une image selon l'espèce d'Iris.
Toutes les fonctions définies ci-dessus sont appelées dans le fichier Python main app.py pour construire l'app Streamlit.
Vous pouvez trouver cette partie du code ainsi que les différentes fonctions définies précédemment sur le dépôt GitHub.
Écrire le fichier requirements.txt de l'application
Le fichier requirements.txt nous permettra d'indiquer tous les modules nécessaires au fonctionnement de notre application. Ce fichier sera utile lors de l'écriture du Dockerfile.
Écrire le Dockerfile de l'application
Votre Dockerfile doit commencer par l'instruction FROM indiquant l'image parente à utiliser. Dans notre cas, nous choisissons de partir de l'image OVHcloud python:3.8 :
Créez le répertoire personnel et ajoutez-y vos fichiers :
Installez le fichier requirements.txt qui contient les modules Python nécessaires à l'aide d'une commande pip install ... :
Définissez votre commande de lancement par défaut pour démarrer l'application :
Attribuez les droits d'accès corrects à l'utilisateur ovhcloud (42420:42420) :
Construire l'image Docker depuis le Dockerfile
Depuis le répertoire contenant votre Dockerfile, exécutez l'une des commandes suivantes pour construire l'image de votre application :
-
La première commande construit l'image en utilisant l'architecture par défaut de votre système. Cela peut fonctionner si votre machine utilise déjà l'architecture
linux/amd64, qui est requise pour exécuter des containers avec nos produits AI. Cependant, sur des systèmes avec une architecture différente (par exempleARM64surApple Silicon), l'image résultante ne sera pas compatible et ne pourra pas être déployée. -
La seconde commande cible explicitement l'architecture
linux/amd64afin de garantir la compatibilité avec nos services AI. Elle nécessitebuildx, qui n'est pas installé par défaut. Si vous n'avez jamais utilisébuildxauparavant, vous pouvez l'installer en exécutant :docker buildx install
L'argument point . indique que votre contexte de build (emplacement du Dockerfile et des autres fichiers nécessaires) est le répertoire courant.
L'argument -t vous permet de choisir l'identifiant à donner à votre image. Les identifiants d'image sont généralement composés d'un nom et d'un tag de version <name>:<version>. Pour cet exemple, nous avons choisi streamlit-eda-iris:latest.
Tester en local (optionnel)
Lancez la commande Docker suivante pour lancer votre application localement sur votre ordinateur :
L'argument -p 8501:8501 indique que vous souhaitez exécuter une redirection de port depuis le port 8501 de votre machine locale vers le port 8501 du container Docker. Le port 8501 est le port par défaut utilisé par les applications Streamlit.
N'oubliez pas l'argument --user=42420:42420 si vous souhaitez simuler exactement le même comportement que celui qui se produira sur les apps AI Deploy. Il exécute le container Docker en tant qu'utilisateur OVHcloud spécifique (utilisateur 42420:42420).
Une fois démarrée, votre application devrait être disponible sur http://localhost:8501.
Envoyer l'image vers le registre partagé
Le registre partagé ne doit être utilisé qu'à des fins de test. Pensez à créer et à rattacher votre propre registre. Plus d'informations à ce sujet sont disponibles ici. Les images envoyées vers ce registre sont réservées aux workloads AI Tools et ne seront pas accessibles pour des usages externes.
Trouvez l'adresse de votre registre partagé en lançant cette commande :
Connectez-vous au registre partagé avec vos identifiants habituels d'utilisateur AI Platform :
Envoyez l'image compilée vers le registre partagé :
Lancer l'app AI Deploy
La commande suivante démarre une nouvelle app exécutant votre application Streamlit :
--default-http-port 8501 indique que le port à atteindre sur l'URL de l'app est le 8501.
--cpu 12 indique que nous demandons 12 CPU pour cette app.
Pensez à ajouter l'attribut --unsecure-http si vous souhaitez que votre application soit accessible sans authentification.
Aller plus loin
- Vous pouvez imaginer déployer un modèle d'IA avec un autre outil : Gradio. Reportez-vous à ce tutoriel.
- Une autre façon de créer une app AI Deploy est d'utiliser Flask ! C'est par ici.
Pour une formation ou une assistance technique sur la mise en œuvre de nos solutions, contactez votre commercial ou consultez la page Professional Services pour obtenir un devis et faire analyser votre projet par nos experts.
Votre avis nous intéresse !
N'hésitez pas à nous faire part de vos questions, retours et suggestions pour améliorer le service :
- Sur le serveur Discord OVHcloud