AI Endpoints - Premiers pas
Découvrez AI Endpoints, la plateforme serverless sécurisée d'OVHcloud qui permet aux développeurs d'accéder aux meilleurs modèles d'IA via des API simples d'utilisation. Aucune expertise en IA requise.
AI Endpoints est couvert par les Conditions particulières OVHcloud Public Cloud (voir l’Annexe 10 – « Conditions spécifiques – AI Endpoints »).
Introduction
AI Endpoints est une plateforme serverless proposée par OVHcloud qui offre un accès simplifié à une sélection de modèles d’IA pré-entraînés de renommée mondiale. La plateforme est conçue pour être simple, sécurisée et intuitive, avec la confidentialité des données comme priorité absolue. En effet, nous ne stockons pas les données des utilisateurs, ce qui en fait une solution idéale pour les développeurs souhaitant enrichir leurs applications de capacités d’IA tout en gardant leurs données privées et sécurisées.
Aucune expertise approfondie en IA n’étant requise, AI Endpoints est un choix idéal pour les développeurs à la recherche d’un moyen pratique et sécurisé d’intégrer l’IA dans leurs applications.
Objectif
L’objectif de ce guide est d’aider les développeurs intéressés par l’IA à démarrer rapidement et facilement avec AI Endpoints.
Il explique comment obtenir une clé d’accès, accéder aux modèles d’IA et interagir avec les API d’IA sur la plateforme AI Endpoints. En suivant ce guide, vous apprendrez à intégrer facilement des capacités d’IA dans vos applications.
Prérequis
- Un projet Public Cloud dans votre compte OVHcloud
- Un moyen de paiement défini sur votre projet Public Cloud. Les clés d’accès créées depuis des projets Public Cloud en mode Discovery (sans moyen de paiement) ne peuvent pas utiliser le service.
Accès à l'espace client OVHcloud
- Lien direct :
- Pour accéder à vos services :
Public Cloud> Sélectionnez votre projet >AI Endpoints
En pratique
Générer votre première clé d’accès API
L’obtention d’une clé API vous permet d’utiliser les modèles disponibles dans notre catalogue et de tester leur intégration dans vos solutions. Pour obtenir une clé d’accès API, suivez les étapes ci-dessous :
1. Accéder à la section AI Endpoints
Cliquez sur pour accéder à votre projet Public Cloud, puis rendez-vous dans la catégorie AI & Machine Learning du menu de gauche et choisissez AI Endpoints.
2. Générer une clé d’accès API
Cliquez ensuite sur le bouton bleu Générer ma première clé d’accès pour créer votre clé d’accès API. Cliquez ensuite sur le bouton Créer une nouvelle clé API. Il vous sera demandé de fournir un nom pour la clé ainsi qu’une description facultative. Vous pouvez également définir une date d’expiration pour la clé si vous le souhaitez.
Une fois les informations requises renseignées, cliquez sur le bouton Créer pour confirmer la création de votre clé API.
Notez que cette clé d’accès peut être révoquée à tout moment.
À propos des projets partagés
En raison des limitations actuelles de l’IAM (Identity and Access Management), la possibilité de créer et de gérer des clés API pour AI Endpoints varie selon la manière dont votre projet est partagé.
-
Si votre projet est partagé avec un NIC OVHcloud existant (avec les droits Read & Write) :
- Les membres de l’équipe ajoutés peuvent créer des clés API pour AI Endpoints.
- Cependant, les administrateurs du projet ne peuvent ni voir ni gérer les clés créées par ces utilisateurs.
- Par conséquent, les administrateurs ne peuvent pas révoquer ni auditer les tokens créés par les membres de l’équipe. Le seul moyen de révoquer de tels tokens est de retirer l’accès du NIC au projet.
-
Si votre projet est accessible via un partage basé sur l’IAM (
NIC/newuser) :- Les membres de l’équipe ajoutés ne peuvent pas créer de nouvelles clés API, à moins de disposer de droits IAM de niveau administrateur.
La plateforme est continuellement améliorée afin d’offrir une expérience plus fluide et plus cohérente sur l’ensemble des services. En attendant, veuillez contacter l’administrateur de votre projet pour qu’il crée la clé à votre place.
3. Conserver la clé d’accès API créée
Une fois créée, la clé s’affiche dans le tableau des clés API. Vous y verrez votre nouvelle clé d’accès, accompagnée de ses informations (nom, description, date d’expiration).
La valeur de votre clé s’affiche et vous pouvez la copier en cliquant sur l’icône de copie.
Il est essentiel de garder votre clé API privée et confidentielle.
De plus, la clé API affichée ne sera pas conservée en mémoire par le site : veillez donc à la stocker de manière sécurisée de votre côté pour un usage ultérieur.
Muni de votre clé d’accès API, vous êtes maintenant prêt à accéder aux modèles d’IA et à leurs API simples d’utilisation.
Accéder aux modèles d’IA
Une fois votre clé API générée, vous pouvez vous rendre sur la page Catalogue pour choisir le modèle d’IA avec lequel vous souhaitez interagir.
AI Endpoints propose une variété de modèles d’IA de renommée mondiale, parmi lesquels :
- Large Language Models (LLM) : utilisez des modèles comme LLaMa 3, Mistral et bien d’autres, pour des cas d’usage de conversation et de RAG.
- LLM de raisonnement : utilisez des modèles de raisonnement comme GPT-OSS pour les mathématiques, le code ou les tâches complexes.
- LLM de code : génération et complétion de code depuis un IDE avec des modèles comme Qwen Coder.
- LLM visuels : modèles multimodaux tels que Qwen VL, capables de traiter des entrées image et texte, pour des cas d’usage de compréhension d’image ou d’OCR.
- Embeddings : générez des embeddings à utiliser dans des applications de machine learning, comme BGE.
- Génération d’images : générez des images avec Stable Diffusion XL.
- Analyse audio : reconnaissance automatique de la parole avec des modèles comme Whisper.
Une fois la catégorie de modèle choisie, une liste de modèles vous est présentée.
Par exemple, si vous sélectionnez la catégorie Code LLM, vous verrez la liste des modèles d’assistant de code disponibles.
Pour accéder à l’un d’eux, cliquez simplement sur le nom du modèle que vous souhaitez utiliser. Prenons l’exemple de l’assistant de code gpt-oss-120b.
Vous accédez alors à une page dédiée proposant plusieurs options pour interagir avec le modèle choisi, dont la possibilité de consulter ses spécifications. Voici un aperçu des options disponibles :
Cette option fournit une interface conviviale permettant de tester et d’explorer les capacités du modèle, vous donnant l’occasion de voir comment il fonctionne avant d’effectuer un appel API. Notez que les Large Language Models (LLM) du playground sont actuellement limités à 1024 tokens en sortie à des fins de test. Cela signifie que les LLM ne généreront pas de réponses de plus de 1024 tokens dans le playground, ce qui vous permet de tester et de valider leur comportement.

Révoquer votre clé d’accès API
Pour préserver la sécurité et le contrôle de vos accès API, il est essentiel de révoquer les clés qui ne sont plus nécessaires.
Pour révoquer l’une de vos clés d’accès API, cliquez sur pour accéder à votre projet Public Cloud, puis cliquez sur AI Endpoints sous AI & Machine Learning dans le menu de gauche, puis sur la section de gestion Clés API.
Sur la page AI key management, un tableau répertorie toutes vos clés d’accès API générées, avec leur nom, leur description et leur date d’expiration. Repérez la clé que vous souhaitez révoquer et cliquez sur le bouton à trois points ... situé à côté de ses informations. Un menu s’ouvre alors, dans lequel vous pouvez sélectionner Supprimer. Confirmez cette action pour finaliser la révocation.
Vérification
Après avoir révoqué une clé API, vous pouvez vérifier qu’elle n’est plus valide en tentant de l’utiliser pour une requête API. L’API devrait renvoyer un message d’erreur indiquant que les identifiants sont invalides, tel que 403 Forbidden: Authentication Failed.
Limite de débit des modèles
Lors de l’utilisation d’AI Endpoints, les limites de débit suivantes s’appliquent :
- Anonyme : 2 requêtes par minute, par IP et par modèle.
- Authentifié avec une clé d’accès API : 400 requêtes par minute, par projet PCI et par modèle.
Si vous dépassez cette limite, un code d’erreur 429 est renvoyé.
Si vous avez besoin d’un usage plus important, contactez-nous afin d’étudier une augmentation de vos limites de débit.
Facturation et consommation
Pour toute information sur les tarifs et le cycle de vie des modèles de la plateforme, consultez la documentation AI Endpoints - Facturation et cycle de vie.
Pour plus de commodité, vous pouvez suivre votre consommation estimée et l’utilisation des modèles dans la section AI Endpoints de la catégorie AI & Machine Learning, dans le menu vertical de gauche de votre .
Aller plus loin
Pour découvrir comment créer des applications complètes et performantes avec AI Endpoints, explorez nos guides dédiés à AI Endpoints, qui regorgent de connaissances et d’inspiration, notamment sur les sujets suivants :
- Créer votre propre assistant de résumé audio avec AI Endpoints
- Mettre en place la gestion de la mémoire d’un chatbot avec LangChain et AI Endpoints
- Découvrir comment créer un système de Retrieval Augmented Generation (RAG)
- En savoir plus sur les fonctionnalités et les limitations d’AI Endpoints
Pour une formation ou une assistance technique sur la mise en œuvre de nos solutions, contactez votre commercial ou consultez la page Professional Services pour obtenir un devis et faire analyser votre projet par nos experts.
Votre avis nous intéresse !
N’hésitez pas à nous faire part de vos questions, retours et suggestions concernant AI Endpoints et ses fonctionnalités :
- Dans le canal #ai-endpoints du serveur Discord OVHcloud, où vous pouvez échanger avec la communauté et les équipes OVHcloud.


