Passa al contenuto principale

Hugging Face Hub

Libre WebUI si integra con Hugging Face in due modi:

  • Accesso tramite il plugin del provider agli Inference Providers di Hugging Face.
  • Esplorazione dell'Hub all'interno dell'app per i modelli compatibili, compresi i modelli GGUF che possono essere scaricati tramite Ollama.

Configurare il plugin del provider

Crea un token di accesso Hugging Face con autorizzazione per l'inferenza, quindi aggiungilo nelle Impostazioni oppure come variabile di ambiente:

HUGGINGFACE_API_KEY=hf_...

Abilita il plugin Hugging Face in Impostazioni > Plugin.

Funzionalità

A seconda della disponibilità del modello e del provider, Hugging Face può offrire:

  • Modelli di chat/completamento
  • Sintesi vocale
  • Generazione di immagini
  • Embedding
  • Trascrizione vocale

Disponibilità, prezzi e routing di Hugging Face possono cambiare in base al modello. Controlla la pagina del modello e l'interfaccia dei provider Hugging Face per conoscere lo stato corrente.

Browser dei modelli

Il browser integrato nell'app consente di:

  • Cercare per nome del modello o autore.
  • Filtrare per attività.
  • Ordinare per tendenza, download, Mi piace, data di creazione o data di aggiornamento.
  • Esaminare lo stato di accesso limitato del modello.
  • Scaricare tramite Ollama i file GGUF compatibili, quando supportati.

Il browser recupera i metadati dell'Hub tramite il proxy del backend e memorizza nella cache i risultati per migliorare le prestazioni. Il backend richiede una sessione Libre attiva per l'esplorazione dell'Hub e soltanto un amministratore corrente può cancellare la cache condivisa dei modelli.

GGUF e Ollama

Per l'inferenza locale, cerca modelli in formato GGUF. Libre WebUI può usare riferimenti di modello hf.co/... compatibili con Ollama quando un repository offre file GGUF idonei.

Schema di esempio:

ollama run hf.co/owner/model-repo:tag

Quando possibile, usa l'interfaccia: riduce gli errori di copia e incolla e mantiene visibili i metadati del modello.

Routing degli Inference Provider

Il router compatibile con OpenAI di Hugging Face supporta gli ID dei modelli dell'Hub. Alcune route supportano suffissi o preferenze del provider. Poiché queste caratteristiche cambiano nel tempo, consulta la documentazione aggiornata di Hugging Face e il browser dei modelli nell'app per conoscere gli ID esatti.

Modelli con accesso limitato

Alcuni modelli richiedono di accettare condizioni prima dell'uso:

  1. Apri la pagina del modello su Hugging Face.
  2. Accetta la licenza o le condizioni.
  3. Verifica che il token disponga dell'accesso.
  4. Riprova da Libre WebUI.

I modelli con accesso limitato possono apparire nei risultati prima che il token sia autorizzato a eseguirli.

Risoluzione dei problemi

Non autorizzato

  • Controlla il valore del token.
  • Verifica che il token disponga delle autorizzazioni per l'inferenza.
  • Se usi credenziali per utente, verifica che la chiave sia salvata per l'utente corrente.

Modello non disponibile

  • Controlla la pagina del modello su Hugging Face.
  • Prova la route di un altro provider, se disponibile.
  • Verifica di aver accettato le condizioni di accesso limitato.

Il download GGUF non riesce

  • Verifica che il repository contenga file GGUF.
  • Prova il riferimento hf.co/... esatto in un terminale con Ollama.
  • Usa una quantizzazione più piccola se lo spazio su disco o la memoria sono limitati.

Documentazione correlata