Pular para o conteúdo principal

Hugging Face Hub

O Libre WebUI integra-se ao Hugging Face de duas maneiras:

  • Acesso pelo plugin de provedor por meio do Hugging Face Inference Providers.
  • Navegação pelo Hub dentro do aplicativo para encontrar modelos compatíveis, inclusive modelos GGUF que podem ser baixados por meio do Ollama.

Configurar o plugin de provedor

Crie um token de acesso do Hugging Face com permissão para inferência e adicione-o nas Configurações ou como variável de ambiente:

HUGGINGFACE_API_KEY=hf_...

Habilite o plugin Hugging Face em Configurações > Plugins.

Recursos

Dependendo da disponibilidade do modelo e do provedor, o Hugging Face pode oferecer:

  • Modelos de chat/conclusão
  • Conversão de texto em fala
  • Geração de imagens
  • Embeddings
  • Conversão de fala em texto

A disponibilidade, os preços e o roteamento do Hugging Face podem variar conforme o modelo. Consulte a página do modelo e a interface de provedor do Hugging Face para conferir o status atual.

O navegador no aplicativo permite:

  • Pesquisar por nome do modelo ou autor.
  • Filtrar por tarefa.
  • Ordenar por tendências, downloads, curtidas, data de criação ou data de atualização.
  • Verificar o status de modelos com acesso restrito.
  • Baixar arquivos GGUF compatíveis por meio do Ollama, quando houver suporte.

O navegador busca os metadados do Hub pelo proxy do backend e armazena os resultados em cache para melhorar o desempenho. O backend exige uma sessão ativa do Libre para a descoberta no Hub, e somente um administrador atual pode limpar o cache compartilhado de modelos.

GGUF e Ollama

Para inferência local, procure modelos no formato GGUF. O Libre WebUI pode usar referências de modelo hf.co/... compatíveis com o Ollama quando um repositório disponibiliza arquivos GGUF adequados.

Padrão de exemplo:

ollama run hf.co/owner/model-repo:tag

Use a interface sempre que possível; ela reduz erros de copiar e colar e mantém os metadados do modelo visíveis.

Roteamento do provedor de inferência

O roteador compatível com OpenAI do Hugging Face oferece suporte a IDs de modelo do Hub. Algumas rotas aceitam sufixos ou preferências de provedor. Como isso muda ao longo do tempo, prefira a documentação atual do Hugging Face e o navegador de modelos do aplicativo para obter os IDs exatos.

Modelos com acesso restrito

Alguns modelos exigem a aceitação de termos antes do uso:

  1. Abra a página do modelo no Hugging Face.
  2. Aceite a licença ou os termos.
  3. Confirme que seu token tem acesso.
  4. Tente novamente no Libre WebUI.

Modelos com acesso restrito podem aparecer na descoberta antes que seu token tenha permissão para executá-los.

Solução de problemas

Não autorizado

  • Verifique o valor do token.
  • Confirme que o token tem permissões de inferência.
  • Se estiver usando credenciais por usuário, confirme que a chave está salva para o usuário atual.

Modelo indisponível

  • Consulte a página do modelo no Hugging Face.
  • Tente outra rota de provedor, se disponível.
  • Confirme que você aceitou os termos de acesso restrito.

Falha ao baixar o GGUF

  • Confirme que o repositório contém arquivos GGUF.
  • Tente a referência hf.co/... exata em um terminal com o Ollama.
  • Use uma quantização menor se o disco ou a memória forem limitados.

Documentação relacionada