AI Endpoints - Intégration avec Hugging Face Inference Providers
Découvrez comment utiliser les AI Endpoints d’OVHcloud via Hugging Face Inference Providers
AI Endpoints est couvert par les Conditions particulières OVHcloud Public Cloud (voir l’Annexe 10 – « Conditions spécifiques – AI Endpoints »).
Nouvelle intégration disponible : nous sommes ravis d'annoncer une nouvelle intégration entre AI Endpoints et Hugging Face Inference Providers. Cette intégration offre un accès simplifié et unifié à des partenaires d'inférence de premier plan, et poursuit notre engagement à intégrer AI Endpoints dans un maximum d'outils open source afin d'en simplifier l'usage.
Objectif
OVHcloud AI Endpoints permet aux développeurs d'ajouter facilement des fonctionnalités d'IA à leurs développements quotidiens.
Dans ce guide, nous allons montrer comment utiliser Hugging Face Inference Providers pour accéder aux modèles OVHcloud AI Endpoints via l'interface unifiée de Hugging Face.
Grâce aux Inference Providers de Hugging Face et à l'infrastructure IA scalable d'OVHcloud, vous pouvez accéder à un large éventail de modèles d'IA en utilisant des API familières, que vous travailliez en Python ou en JavaScript/TypeScript.
Définition
- Hugging Face Inference Providers : une plateforme offrant un accès simplifié et unifié à des centaines de modèles de machine learning, propulsés par des partenaires d'inférence de premier plan. Elle fournit une interface unique pour accéder aux modèles de plusieurs fournisseurs, dont OVHcloud AI Endpoints, avec des stratégies de sélection de fournisseur flexibles.
- AI Endpoints : une plateforme serverless d'OVHcloud offrant un accès simplifié à une variété de modèles d'IA mondialement reconnus, dont Mistral, LLaMA, et bien d'autres. Cette plateforme est conçue pour être simple, sécurisée et intuitive, avec la confidentialité des données comme priorité absolue.
Pourquoi cette intégration est-elle importante ?
Cette nouvelle intégration vous offre plusieurs avantages :
- Accès unifié : accédez à des centaines de modèles via une interface unique et familière.
- Flexibilité : choisissez entre une sélection automatique, basée sur la performance, ou spécifique à un fournisseur.
- Support multi-langage : utilisez Python ou JavaScript/TypeScript avec les mêmes modèles.
- Compatibilité OpenAI : utilisez le SDK OpenAI pour une syntaxe familière.
- Contrôle des coûts : choisissez entre la facturation Hugging Face ou le mode Bring Your Own Key (BYOK) avec OVHcloud AI Endpoints.
Prérequis
Avant de commencer, assurez-vous de disposer des éléments suivants :
- Un compte OVHcloud avec accès à AI Endpoints.
- Un compte Hugging Face (inscrivez-vous sur huggingface.co).
- Un token d'accès Hugging Face avec les permissions « Make calls to Inference Providers » (créez-en un sur huggingface.co/settings/tokens).
- Python 3.8 ou supérieur (pour l'usage en Python) ou Node.js (pour l'usage en JavaScript/TypeScript).
- Optionnellement, une clé API OVHcloud AI Endpoints pour la facturation en mode Bring Your Own Key (BYOK).
En pratique
Installation
Python
Installez les packages nécessaires via pip :
Vous pouvez ensuite vous authentifier avec :
ou ajouter votre clé à la variable d'environnement export HF_TOKEN=....
Vous êtes maintenant prêt à commencer.
JavaScript / TypeScript
Installez les packages nécessaires via npm :
Puis ajoutez votre clé à la variable d'environnement export HF_TOKEN=....
Vous pouvez maintenant commencer.
Configuration de base
Bring Your Own Key (BYOK)
Vous pouvez également utiliser directement votre clé API OVHcloud AI Endpoints afin que la facturation se fasse via OVHcloud plutôt que via Hugging Face. Pour l'activer :
- Rendez-vous dans les paramètres Hugging Face Inference Providers.
- Ajoutez votre clé API OVHcloud AI Endpoints.
- L'usage sera facturé directement sur votre projet OVHcloud PCI.
Utilisation de base
Python - avec le SDK OpenAI
Voici un exemple d'utilisation simple avec le SDK OpenAI :
Python - avec le client Hugging Face Hub
Vous pouvez également utiliser le client natif Hugging Face Hub :
JavaScript - avec le client Hugging Face Inference
Voici un exemple d'utilisation simple en JavaScript :
JavaScript - avec le SDK OpenAI
Vous pouvez également utiliser le SDK OpenAI en JavaScript :
Fonctionnalités avancées
Stratégies de sélection du fournisseur
Hugging Face propose des stratégies de sélection de fournisseur flexibles pour s'adapter à vos besoins :
Sélection automatique (par défaut)
Utilise le premier fournisseur disponible selon votre ordre de préférence :
openai/gpt-oss-120b
Fournisseur spécifique
Force le fournisseur OVHcloud :
openai/gpt-oss-120b:ovhcloud
Sélection basée sur la performance
Sélectionne le fournisseur le plus rapide (débit le plus élevé) :
openai/gpt-oss-120b:fastest
Sélectionne le fournisseur le moins cher (coût par token le plus bas) :
openai/gpt-oss-120b:cheapest
Configurer les préférences de fournisseur
Configurez l'ordre de préférence de vos fournisseurs sur huggingface.co/settings/inference-providers.
Modèles disponibles
OVHcloud AI Endpoints propose un large éventail de modèles accessibles via Hugging Face Inference Providers. Pour la liste complète et à jour, consultez notre catalogue de modèles ou parcourez les modèles OVHcloud sur Hugging Face.
Tarification et facturation
Hugging Face Inference Providers utilise un modèle de facturation à l'usage avec des options de facturation flexibles :
- Facturation Hugging Face : l'usage est facturé directement sur votre compte Hugging Face.
- Aucun coût de mise en place : aucune infrastructure ni engagement requis.
- Contrôle des coûts : suivez votre consommation dans vos paramètres Hugging Face.
- Bring Your Own Key (BYOK) : utilisez votre clé API OVHcloud AI Endpoints pour être facturé directement par OVHcloud plutôt que par Hugging Face. Configurez cela dans les paramètres Hugging Face Inference Providers.
Conclusion
Dans cet article, nous avons exploré comment intégrer OVHcloud AI Endpoints avec Hugging Face Inference Providers afin d'accéder facilement à un large éventail de modèles d'IA via une interface unifiée. Grâce aux Inference Providers de Hugging Face, vous pouvez utiliser des API familières en Python ou en JavaScript/TypeScript, avec des options flexibles de sélection de fournisseur et de facturation, tandis qu'OVHcloud AI Endpoints garantit une infrastructure d'IA sécurisée, scalable et prête pour la production.
Aller plus loin
Vous trouverez plus d'informations sur Hugging Face Inference Providers dans leur documentation officielle. Vous pouvez également parcourir le catalogue AI Endpoints pour découvrir les modèles disponibles.
Pour des informations détaillées sur OVHcloud dans Hugging Face Inference Providers, consultez la documentation du fournisseur OVHcloud.
Parcourez les modèles OVHcloud sur Hugging Face pour découvrir tous les modèles disponibles.
Pour plus d'informations sur la bibliothèque Python Hugging Face Hub, consultez la documentation officielle.
Parcourez la documentation AI Endpoints complète pour mieux comprendre les concepts principaux et démarrer.
Pour une formation ou une assistance technique sur la mise en œuvre de nos solutions, contactez votre commercial ou consultez la page Professional Services pour obtenir un devis et faire analyser votre projet par nos experts.
Votre avis nous intéresse !
N’hésitez pas à nous faire part de vos questions, retours et suggestions concernant AI Endpoints et ses fonctionnalités :
- Dans le canal #ai-endpoints du serveur Discord OVHcloud, où vous pouvez échanger avec la communauté et les équipes OVHcloud.
- Rejoignez la communauté Hugging Face sur Discord pour toute question concernant Hugging Face Inference Providers.