Sari la conținutul principal

Hugging Face Hub

Libre WebUI se integrează în două moduri:

  • Acces prin plugin și Hugging Face Inference Providers.
  • Navigare Hub în aplicație pentru modele compatibile, inclusiv GGUF descărcate prin Ollama.

Configurarea pluginului

Creați token Hugging Face cu acces la inferență și adăugați-l în Settings sau mediu:

HUGGINGFACE_API_KEY=hf_...

Activați pluginul în Settings > Plugins.

Capabilități

În funcție de disponibilitate: chat/completion, text-to-speech, imagini, embeddings și speech-to-text. Disponibilitatea, prețul și rutarea se schimbă; verificați pagina modelului și UI-ul Hugging Face.

Browser de modele

Puteți căuta după nume/autor, filtra după sarcină, sorta după tendință/download/likes/date, inspecta modele restricționate și descărca GGUF prin Ollama. Metadata vine prin proxy backend și se cachează. Este necesară sesiune Libre activă, iar cache-ul comun este șters numai de administrator.

GGUF și Ollama

Pentru inferență locală căutați GGUF. Libre folosește referințe hf.co/... când repository-ul oferă fișiere potrivite.

ollama run hf.co/owner/model-repo:tag

Preferabil folosiți UI-ul pentru a evita erori și a vedea metadata.

Rutare Inference Provider

Routerul compatibil OpenAI acceptă ID-uri Hub și uneori sufixe/preferințe. Folosiți documentația actuală și browserul pentru ID-uri exacte.

Modele restricționate

  1. Deschideți pagina modelului.
  2. Acceptați licența/termenii.
  3. Verificați accesul tokenului.
  4. Reîncercați din Libre.

Pot apărea în discovery înainte ca tokenul să le poată rula.

Depanare

Neautorizat: verificați tokenul, permisiunea de inferență și cheia utilizatorului curent.

Model indisponibil: verificați pagina, altă rută și acceptarea termenilor.

GGUF eșuează: verificați fișierele, referința exactă în terminal și cuantizare mai mică.

Documentație asociată