Aller au contenu principal

Hugging Face Hub

Libre WebUI s’intègre à Hugging Face de deux façons :

  • Accès par plugin de fournisseur via Hugging Face Inference Providers.
  • Navigation dans le Hub depuis l’application pour les modèles compatibles, notamment les modèles GGUF récupérables avec Ollama.

Configurer le plugin de fournisseur

Créez un jeton d’accès Hugging Face doté d’un accès à l’inférence, puis ajoutez-le dans les paramètres ou sous forme de variable d’environnement :

HUGGINGFACE_API_KEY=hf_...

Activez le plugin Hugging Face sous Paramètres > Plugins.

Capacités

Selon la disponibilité du modèle et du fournisseur, Hugging Face peut proposer :

  • Des modèles de chat ou de complétion
  • La synthèse vocale
  • La génération d’images
  • Des embeddings
  • La transcription de la parole

La disponibilité, la tarification et le routage de Hugging Face peuvent varier selon le modèle. Consultez la page du modèle et l’interface du fournisseur Hugging Face pour connaître leur état actuel.

Le navigateur intégré à l’application vous permet de :

  • Rechercher par nom de modèle ou par auteur.
  • Filtrer par tâche.
  • Trier par tendance, nombre de téléchargements, mentions J’aime, date de création ou date de mise à jour.
  • Examiner l’état d’accès restreint d’un modèle.
  • Récupérer avec Ollama les fichiers GGUF compatibles lorsque cette opération est prise en charge.

Le navigateur récupère les métadonnées du Hub via le proxy du backend et met les résultats en cache pour améliorer les performances. Le backend exige une session Libre active pour parcourir le Hub et seul un administrateur actuel peut effacer le cache de modèles partagé.

GGUF et Ollama

Pour l’inférence locale, recherchez des modèles au format GGUF. Libre WebUI peut utiliser des références de modèle hf.co/... compatibles avec Ollama lorsqu’un dépôt propose des fichiers GGUF appropriés.

Exemple de syntaxe :

ollama run hf.co/owner/model-repo:tag

Utilisez si possible l’interface : elle réduit les erreurs de copier-coller et maintient les métadonnées du modèle visibles.

Routage par Inference Provider

Le routeur compatible avec OpenAI de Hugging Face accepte les identifiants de modèle du Hub. Certaines routes prennent en charge des suffixes ou des préférences de fournisseur. Ces éléments évoluant au fil du temps, consultez de préférence la documentation Hugging Face à jour et le navigateur de modèles intégré pour obtenir les identifiants exacts.

Modèles à accès restreint

Certains modèles exigent l’acceptation de conditions avant leur utilisation :

  1. Ouvrez la page du modèle sur Hugging Face.
  2. Acceptez la licence ou les conditions.
  3. Vérifiez que votre jeton dispose de l’accès nécessaire.
  4. Réessayez depuis Libre WebUI.

Les modèles à accès restreint peuvent apparaître dans les résultats avant que votre jeton ne soit autorisé à les exécuter.

Dépannage

Non autorisé

  • Vérifiez la valeur du jeton.
  • Vérifiez que le jeton possède les autorisations d’inférence.
  • Si vous utilisez des identifiants propres à l’utilisateur, vérifiez que la clé est enregistrée pour l’utilisateur actuel.

Modèle indisponible

  • Consultez la page du modèle Hugging Face.
  • Essayez une autre route de fournisseur si elle est disponible.
  • Vérifiez que vous avez accepté les conditions d’accès restreint.

Échec de la récupération GGUF

  • Vérifiez que le dépôt contient des fichiers GGUF.
  • Essayez la référence hf.co/... exacte dans un terminal avec Ollama.
  • Utilisez une quantification plus petite si l’espace disque ou la mémoire est limité.

Documentation connexe