Hugging Face Hub
O Libre WebUI integra-se ao Hugging Face de duas maneiras:
- Acesso pelo plugin de provedor por meio do Hugging Face Inference Providers.
- Navegação pelo Hub dentro do aplicativo para encontrar modelos compatíveis, inclusive modelos GGUF que podem ser baixados por meio do Ollama.
Configurar o plugin de provedor
Crie um token de acesso do Hugging Face com permissão para inferência e adicione-o nas Configurações ou como variável de ambiente:
HUGGINGFACE_API_KEY=hf_...
Habilite o plugin Hugging Face em Configurações > Plugins.
Recursos
Dependendo da disponibilidade do modelo e do provedor, o Hugging Face pode oferecer:
- Modelos de chat/conclusão
- Conversão de texto em fala
- Geração de imagens
- Embeddings
- Conversão de fala em texto
A disponibilidade, os preços e o roteamento do Hugging Face podem variar conforme o modelo. Consulte a página do modelo e a interface de provedor do Hugging Face para conferir o status atual.
Navegador de modelos
O navegador no aplicativo permite:
- Pesquisar por nome do modelo ou autor.
- Filtrar por tarefa.
- Ordenar por tendências, downloads, curtidas, data de criação ou data de atualização.
- Verificar o status de modelos com acesso restrito.
- Baixar arquivos GGUF compatíveis por meio do Ollama, quando houver suporte.
O navegador busca os metadados do Hub pelo proxy do backend e armazena os resultados em cache para melhorar o desempenho. O backend exige uma sessão ativa do Libre para a descoberta no Hub, e somente um administrador atual pode limpar o cache compartilhado de modelos.
GGUF e Ollama
Para inferência local, procure modelos no formato GGUF. O Libre WebUI pode usar referências de modelo hf.co/... compatíveis com o Ollama quando um repositório disponibiliza arquivos GGUF adequados.
Padrão de exemplo:
ollama run hf.co/owner/model-repo:tag
Use a interface sempre que possível; ela reduz erros de copiar e colar e mantém os metadados do modelo visíveis.
Roteamento do provedor de inferência
O roteador compatível com OpenAI do Hugging Face oferece suporte a IDs de modelo do Hub. Algumas rotas aceitam sufixos ou preferências de provedor. Como isso muda ao longo do tempo, prefira a documentação atual do Hugging Face e o navegador de modelos do aplicativo para obter os IDs exatos.
Modelos com acesso restrito
Alguns modelos exigem a aceitação de termos antes do uso:
- Abra a página do modelo no Hugging Face.
- Aceite a licença ou os termos.
- Confirme que seu token tem acesso.
- Tente novamente no Libre WebUI.
Modelos com acesso restrito podem aparecer na descoberta antes que seu token tenha permissão para executá-los.
Solução de problemas
Não autorizado
- Verifique o valor do token.
- Confirme que o token tem permissões de inferência.
- Se estiver usando credenciais por usuário, confirme que a chave está salva para o usuário atual.
Modelo indisponível
- Consulte a página do modelo no Hugging Face.
- Tente outra rota de provedor, se disponível.
- Confirme que você aceitou os termos de acesso restrito.
Falha ao baixar o GGUF
- Confirme que o repositório contém arquivos GGUF.
- Tente a referência
hf.co/...exata em um terminal com o Ollama. - Use uma quantização menor se o disco ou a memória forem limitados.