For AI agents: the complete documentation index is available at https://docs.ovhcloud.com/fr/llms.txt, the full documentation bundle is available at https://docs.ovhcloud.com/fr/llms-full.txt, and this page is available as Markdown at https://docs.ovhcloud.com/fr/guides/public-cloud/ai-machine-learning/ai-endpoints-capabilities.md.

AI Endpoints - Caractéristiques, capacités et limites

Voir en Markdown

Découvrez les principales caractéristiques, capacités et limites de AI Endpoints

Info

AI Endpoints est couvert par les Conditions particulières OVHcloud Public Cloud (voir l’Annexe 10 – « Conditions spécifiques – AI Endpoints »).

Introduction

AI Endpoints est une plateforme serverless proposée par OVHcloud qui offre un accès simplifié à une sélection de modèles d’IA pré-entraînés reconnus mondialement. La plateforme est conçue pour être simple, sécurisée et intuitive, ce qui en fait une solution idéale pour les développeurs souhaitant enrichir leurs applications avec des capacités d’IA sans expertise poussée en IA ni préoccupations liées à la confidentialité des données.

Objectif

Cette page présente les caractéristiques techniques, les capacités et les limites d’AI Endpoints.

Caractéristiques

Fonctionnalités disponibles

FonctionnalitéDétails
Large sélection de modèlesAI Endpoints propose une large gamme de modèles d’IA pré-entraînés, couvrant des catégories telles que les LLM (Visual, Reasoning, Coding), l’analyse audio, les embeddings, le traitement du langage naturel, la traduction, la génération d’images et la vision par ordinateur. Pour la liste complète des modèles, consultez la page du catalogue AI Endpoints.
Métriques des modèlesLes utilisateurs peuvent accéder à diverses métriques dans l’, telles que le nombre d’appels effectués par modèle, les tokens d’entrée et de sortie pour les grands modèles de langage (LLM), et d’autres données d’utilisation. Ces informations peuvent vous aider à maîtriser les coûts et à mieux comprendre comment vos applications utilisent les capacités d’IA.
Confidentialité et souveraineté des donnéesOVHcloud accorde la priorité à la confidentialité et à la souveraineté des données, garantissant que les modèles d’IA accessibles via AI Endpoints sont pleinement conformes aux réglementations européennes strictes. Notre infrastructure, située à Gravelines, en France, respecte les réglementations européennes en matière de protection des données. Les données ne sont ni stockées ni partagées pendant ou après l’utilisation du modèle, ce qui garantit aux utilisateurs que leurs données sont sécurisées et protégées.
Accès avec des clés d’accès personnaliséesPour garantir un accès sécurisé et authentifié aux API des modèles, les utilisateurs doivent fournir une clé d’accès API dans chaque requête. Les clés d’accès peuvent être facilement créées en suivant les instructions du guide AI Endpoints - Premiers pas. Les clés API sont liées à un projet Public Cloud. Nous offrons la possibilité de gérer plusieurs clés pour différents projets ou équipes. De plus, chaque clé d’accès dispose de périodes de validité ajustables, permettant aux utilisateurs d’adapter leur accès à leurs besoins spécifiques.
Mode JSON (JSON Object)AI Endpoints prend en charge le mode JSON, qui garantit que la sortie du modèle est toujours un JSON syntaxiquement valide. Idéal lorsque vous souhaitez un format JSON systématiquement analysable.
Function Calling (Tools)Permet au modèle d’invoquer des fonctions prédéfinies (tools).
Structured Outputs (JSON Schema)S’appuie sur le mode JSON en imposant un schéma JSON spécifié, garantissant que les sorties respectent strictement les propriétés et types que vous avez définis.

Fonctionnalités prévues

Pour connaître les développements à venir, consultez notre roadmap Public Cloud afin de rester informé des nouvelles fonctionnalités et des mises à jour de modèles.

Capacités

Compatibilité avec l’API OpenAI

AI Endpoints est conçu pour être compatible avec l’API OpenAI, ce qui facilite l’intégration avec les applications et workflows existants. Cette compatibilité signifie que vous pouvez tirer parti des capacités d’IA sans avoir à modifier en profondeur votre stack technologique existante, ce qui vous permet de démarrer rapidement et facilement.

Utilisation flexible

Les API d’AI Endpoints sont agnostiques vis-à-vis du langage. Elles permettent aux développeurs d’utiliser le langage de programmation ou la technologie de leur choix pour travailler avec nos API, leur offrant la liberté de créer et d’intégrer des capacités d’IA selon leurs besoins et préférences.

Limites

Limite de débit des modèles

Lors de l’utilisation d’AI Endpoints, les limites de débit suivantes s’appliquent :

  • Anonyme : 2 requêtes par minute, par IP et par modèle.
  • Authentifié avec une clé d’accès API : 400 requêtes par minute, par projet Public Cloud et par modèle.

Si vous dépassez cette limite, un code d’erreur 429 sera renvoyé.

Limites de taille de payload

Afin de garantir la sécurité et la stabilité, les API d’AI Endpoints appliquent des limites de taille de payload de requête par défaut :

La plupart des endpoints sont limités à 2 Mo par corps de requête. Cela s’applique aux types d’entrée courants tels que les paramètres String et Json. Certains endpoints, comme ceux traitant des fichiers multimédias, sont spécifiquement configurés pour accepter des payloads plus volumineux en raison de leurs cas d’usage.

Les Visual Language Models (VLM) sont limités à 10 Mo par corps de requête. Les endpoints de transcription audio peuvent traiter des fichiers audio plus volumineux, mais restent limités par la taille et la durée du fichier audio. Les limites spécifiques de ces endpoints sont indiquées dans la documentation de leur modèle respectif.

Aucune limite d’utilisation

À ce jour, la plateforme AI Endpoints n’impose aucune limite d’utilisation pour les requêtes API, en dehors des limites de débit et de taille de payload.

Cependant, nous envisageons d’introduire à l’avenir une fonctionnalité de limite d’utilisation. Cette fonctionnalité vous permettra de définir une limite sur le nombre de tokens, de caractères ou de secondes d’audio consommés selon votre usage, offrant un meilleur contrôle et une meilleure gestion de la consommation d’AI Endpoints.

Aller plus loin

Parcourez la documentation AI Endpoints complète pour mieux comprendre les concepts principaux et démarrer.

Pour découvrir comment créer des applications complètes et performantes avec AI Endpoints, explorez nos guides AI Endpoints dédiés.

Pour une formation ou une assistance technique sur la mise en œuvre de nos solutions, contactez votre commercial ou consultez la page Professional Services pour obtenir un devis et faire analyser votre projet par nos experts.

Votre avis nous intéresse !

N’hésitez pas à nous faire part de vos questions, retours et suggestions concernant AI Endpoints :

  • Dans le canal #ai-endpoints du serveur Discord OVHcloud, où vous pouvez échanger avec la communauté et les équipes OVHcloud.
Cette page vous a-t-elle aidé ?