Hugging Face Hub
Libre WebUI se integrează în două moduri:
- Acces prin plugin și Hugging Face Inference Providers.
- Navigare Hub în aplicație pentru modele compatibile, inclusiv GGUF descărcate prin Ollama.
Configurarea pluginului
Creați token Hugging Face cu acces la inferență și adăugați-l în Settings sau mediu:
HUGGINGFACE_API_KEY=hf_...
Activați pluginul în Settings > Plugins.
Capabilități
În funcție de disponibilitate: chat/completion, text-to-speech, imagini, embeddings și speech-to-text. Disponibilitatea, prețul și rutarea se schimbă; verificați pagina modelului și UI-ul Hugging Face.
Browser de modele
Puteți căuta după nume/autor, filtra după sarcină, sorta după tendință/download/likes/date, inspecta modele restricționate și descărca GGUF prin Ollama. Metadata vine prin proxy backend și se cachează. Este necesară sesiune Libre activă, iar cache-ul comun este șters numai de administrator.
GGUF și Ollama
Pentru inferență locală căutați GGUF. Libre folosește referințe hf.co/... când
repository-ul oferă fișiere potrivite.
ollama run hf.co/owner/model-repo:tag
Preferabil folosiți UI-ul pentru a evita erori și a vedea metadata.
Rutare Inference Provider
Routerul compatibil OpenAI acceptă ID-uri Hub și uneori sufixe/preferințe. Folosiți documentația actuală și browserul pentru ID-uri exacte.
Modele restricționate
- Deschideți pagina modelului.
- Acceptați licența/termenii.
- Verificați accesul tokenului.
- Reîncercați din Libre.
Pot apărea în discovery înainte ca tokenul să le poată rula.
Depanare
Neautorizat: verificați tokenul, permisiunea de inferență și cheia utilizatorului curent.
Model indisponibil: verificați pagina, altă rută și acceptarea termenilor.
GGUF eșuează: verificați fișierele, referința exactă în terminal și cuantizare mai mică.