AI Endpoints - Caractéristiques, capacités et limites
Découvrez les principales caractéristiques, capacités et limites de AI Endpoints
AI Endpoints est couvert par les Conditions particulières OVHcloud Public Cloud (voir l’Annexe 10 – « Conditions spécifiques – AI Endpoints »).
Introduction
AI Endpoints est une plateforme serverless proposée par OVHcloud qui offre un accès simplifié à une sélection de modèles d’IA pré-entraînés reconnus mondialement. La plateforme est conçue pour être simple, sécurisée et intuitive, ce qui en fait une solution idéale pour les développeurs souhaitant enrichir leurs applications avec des capacités d’IA sans expertise poussée en IA ni préoccupations liées à la confidentialité des données.
Objectif
Cette page présente les caractéristiques techniques, les capacités et les limites d’AI Endpoints.
Caractéristiques
Fonctionnalités disponibles
Fonctionnalités prévues
Pour connaître les développements à venir, consultez notre roadmap Public Cloud afin de rester informé des nouvelles fonctionnalités et des mises à jour de modèles.
Capacités
Compatibilité avec l’API OpenAI
AI Endpoints est conçu pour être compatible avec l’API OpenAI, ce qui facilite l’intégration avec les applications et workflows existants. Cette compatibilité signifie que vous pouvez tirer parti des capacités d’IA sans avoir à modifier en profondeur votre stack technologique existante, ce qui vous permet de démarrer rapidement et facilement.
Utilisation flexible
Les API d’AI Endpoints sont agnostiques vis-à-vis du langage. Elles permettent aux développeurs d’utiliser le langage de programmation ou la technologie de leur choix pour travailler avec nos API, leur offrant la liberté de créer et d’intégrer des capacités d’IA selon leurs besoins et préférences.
Limites
Limite de débit des modèles
Lors de l’utilisation d’AI Endpoints, les limites de débit suivantes s’appliquent :
- Anonyme : 2 requêtes par minute, par IP et par modèle.
- Authentifié avec une clé d’accès API : 400 requêtes par minute, par projet Public Cloud et par modèle.
Si vous dépassez cette limite, un code d’erreur 429 sera renvoyé.
Limites de taille de payload
Afin de garantir la sécurité et la stabilité, les API d’AI Endpoints appliquent des limites de taille de payload de requête par défaut :
La plupart des endpoints sont limités à 2 Mo par corps de requête. Cela s’applique aux types d’entrée courants tels que les paramètres String et Json. Certains endpoints, comme ceux traitant des fichiers multimédias, sont spécifiquement configurés pour accepter des payloads plus volumineux en raison de leurs cas d’usage.
Les Visual Language Models (VLM) sont limités à 10 Mo par corps de requête. Les endpoints de transcription audio peuvent traiter des fichiers audio plus volumineux, mais restent limités par la taille et la durée du fichier audio. Les limites spécifiques de ces endpoints sont indiquées dans la documentation de leur modèle respectif.
Aucune limite d’utilisation
À ce jour, la plateforme AI Endpoints n’impose aucune limite d’utilisation pour les requêtes API, en dehors des limites de débit et de taille de payload.
Cependant, nous envisageons d’introduire à l’avenir une fonctionnalité de limite d’utilisation. Cette fonctionnalité vous permettra de définir une limite sur le nombre de tokens, de caractères ou de secondes d’audio consommés selon votre usage, offrant un meilleur contrôle et une meilleure gestion de la consommation d’AI Endpoints.
Aller plus loin
Parcourez la documentation AI Endpoints complète pour mieux comprendre les concepts principaux et démarrer.
Pour découvrir comment créer des applications complètes et performantes avec AI Endpoints, explorez nos guides AI Endpoints dédiés.
Pour une formation ou une assistance technique sur la mise en œuvre de nos solutions, contactez votre commercial ou consultez la page Professional Services pour obtenir un devis et faire analyser votre projet par nos experts.
Votre avis nous intéresse !
N’hésitez pas à nous faire part de vos questions, retours et suggestions concernant AI Endpoints :
- Dans le canal #ai-endpoints du serveur Discord OVHcloud, où vous pouvez échanger avec la communauté et les équipes OVHcloud.