For AI agents: the complete documentation index is available at https://docs.ovhcloud.com/fr/llms.txt, the full documentation bundle is available at https://docs.ovhcloud.com/fr/llms-full.txt, and this page is available as Markdown at https://docs.ovhcloud.com/fr/guides/public-cloud/ai-machine-learning/ai-endpoints-troubleshooting.md.

AI Endpoints - Dépannage

Voir en Markdown

Résoudre les problèmes rencontrés lors de l'utilisation d'AI Endpoints

Info

AI Endpoints est couvert par les Conditions particulières OVHcloud Public Cloud (voir l’Annexe 10 – « Conditions spécifiques – AI Endpoints »).

Objectif

Ce tutoriel fournit des conseils pour résoudre les problèmes courants pouvant survenir lors de l’utilisation d’AI Endpoints.

Questions courantes

Qu’est-ce qu’AI Endpoints et comment l’utiliser ?

Toutes les étapes pour démarrer avec AI Endpoints sont décrites dans le guide AI Endpoints - Premiers pas.

Comment puis-je rester informé des changements apportés à la plateforme AI Endpoints ?

Pour rester informé des changements apportés à la plateforme AI Endpoints, vous pouvez suivre nos annonces sur le canal #ai-news du serveur Discord OVHcloud. Nous y proposons un aperçu complet de toutes les modifications apportées à la plateforme, y compris les nouvelles fonctionnalités, les nouveaux modèles, les améliorations, les retraits de modèles et les corrections de bugs.

Codes d’erreur et comportements inattendus

J’essaie d’utiliser les modèles AI Endpoints, mais j’obtiens systématiquement un code d’erreur 401. Pourquoi ?

Un code d’erreur 401 indique généralement que le token d’autorisation spécifié dans l’appel a expiré ou est invalide. Pour résoudre ce problème, vous devrez générer un nouveau token d’autorisation et l’inclure dans les en-têtes de votre requête. Pour plus d’informations sur le processus de création de token, suivez le guide AI Endpoints - Premiers pas.

J’essaie d’utiliser les modèles AI Endpoints, mais j’obtiens systématiquement un code d’erreur 404. Que se passe-t-il ?

Une erreur 404 indique généralement que le modèle auquel vous essayez d’accéder est introuvable. Dans le cas d’AI Endpoints, cela peut signifier que le chemin de requête ou le nom du modèle spécifié dans la requête est incorrect, ou que le modèle a été retiré.

Pourquoi ne puis-je plus utiliser mon modèle ? J’obtiens maintenant une erreur 404.

Si vous ne pouvez plus utiliser un modèle que vous utilisiez auparavant, il est possible qu’il ait été retiré. OVHcloud AI Endpoints suit un processus de cycle de vie des modèles afin de garantir une expérience fluide à nos clients. Comme indiqué dans la documentation liée ci-dessus, nous vous informons de notre décision de retirer un modèle trois mois à l’avance, vous laissant ainsi le temps de préparer votre migration.

J’essaie d’utiliser les modèles AI Endpoints, mais j’obtiens systématiquement un code d’erreur 429. Que signifie-t-il ?

Un code d’erreur 429 indique généralement que vous avez dépassé la limite de débit des modèles AI Endpoints. Lors de l’utilisation d’AI Endpoints, les limites de débit suivantes s’appliquent :

  • Anonyme : 2 requêtes par minute, par IP et par modèle.
  • Authentifié avec une clé d’accès API : 400 requêtes par minute, par projet Public Cloud et par modèle.

Si vous dépassez ces limites de débit, vous recevrez un code d’erreur 429. Dans ce cas, vous pouvez envisager d’optimiser l’utilisation d’AI Endpoints par votre application ou d’espacer davantage vos requêtes dans le temps.

J’essaie d’utiliser les modèles AI Endpoints, mais j’obtiens systématiquement un code d’erreur 413. Que signifie-t-il ?

Si vous dépassez nos limites maximales de taille de payload en entrée, vous recevrez un code d’erreur 413 (texte trop long, image trop volumineuse, fichier audio trop long ou trop volumineux).

Lors de l’utilisation d’AI Endpoints, je rencontre l’erreur « Resource tag 'discovery' is forbidden »

Cette erreur survient lorsque vous essayez d’utiliser AI Endpoints avec une clé d’accès provenant d’un projet Public Cloud en mode Discovery, ce qui signifie que ce projet n’a pas de moyen de paiement associé.

Pour résoudre cette erreur, ajoutez un moyen de paiement à votre projet Public Cloud et réessayez.

Je constate des temps de réponse lents avec certains modèles AI Endpoints. Quelle en est la cause ?

Le délai que vous constatez peut être dû au fait que le modèle que vous utilisez a été retiré. Dans la plupart des cas, nous redirigeons les modèles retirés vers des versions plus récentes (par exemple, de llama 3.0 vers llama 3.1) afin qu’ils puissent continuer à répondre aux requêtes. Cependant, nous ajoutons un délai de 10 secondes avant la réponse du modèle afin de signaler aux utilisateurs que ce modèle n’est plus activement utilisé.

Pour confirmer si ce délai est dû au retrait du modèle, vous pouvez consulter la sortie détaillée (verbose) de votre requête, en ajoutant le flag -v si vous utilisez des commandes cURL. La sortie détaillée affichera un message tel que x-warning: This model is deprecated and will be redirected to LLaMA 3.1 8B Instruct instead.

Cela indique que le modèle est retiré et que vous devriez basculer vers une version plus récente du modèle afin d’éviter tout délai inutile.

Nous voulons vos retours !

N’hésitez pas à nous faire part de vos questions, retours et suggestions concernant AI Endpoints :

  • Dans le canal #ai-endpoints du serveur Discord OVHcloud, où vous pouvez échanger avec la communauté et les équipes OVHcloud.

Si vous avez besoin d'une formation ou d'une assistance technique pour la mise en oeuvre de nos solutions, contactez votre commercial ou cliquez sur ce lien pour obtenir un devis et demander une analyse personnalisée de votre projet à nos experts de l’équipe Professional Services.

Cette page vous a-t-elle aidé ?