跳到主要内容

Hugging Face Hub

Libre WebUI 通过两种方式集成 Hugging Face:

  • 通过 Hugging Face Inference Providers 使用提供商插件。
  • 在应用内浏览兼容模型,包括可通过 Ollama 拉取的 GGUF 模型。

配置提供商插件

创建具有推理权限的 Hugging Face 访问令牌,然后在设置中或作为环境变量添加:

HUGGINGFACE_API_KEY=hf_...

设置 > 插件中启用 Hugging Face 插件。

能力

根据模型和提供商的可用性,Hugging Face 可以提供:

  • 聊天或补全模型
  • 文字转语音
  • 图像生成
  • 嵌入
  • 语音转文字

Hugging Face 的可用性、价格和路由可能随模型变化。请查看模型页面和提供商界面 了解当前状态。

模型浏览器

应用内浏览器可用于:

  • 按模型名称或作者搜索。
  • 按任务筛选。
  • 按趋势、下载量、点赞数、创建日期或更新日期排序。
  • 检查受限模型状态。
  • 在支持时通过 Ollama 拉取兼容 GGUF 文件。

浏览器通过后端代理获取 Hub 元数据,并缓存结果以提升性能。发现 Hub 内容需要 有效 Libre 会话;只有当前管理员可以清除共享模型缓存。

GGUF 与 Ollama

本地推理请寻找 GGUF 格式模型。当仓库提供合适的 GGUF 文件时,Libre WebUI 可使用 兼容 Ollama 的 hf.co/... 模型引用。

示例模式:

ollama run hf.co/owner/model-repo:tag

尽量使用界面,它可以减少复制粘贴错误并保持模型元数据可见。

Inference Provider 路由

Hugging Face 的 OpenAI 兼容路由器支持 Hub 模型 ID。部分路由支持后缀或提供商偏好。 这些内容会随时间变化,因此应以当前 Hugging Face 文档和应用内浏览器中的精确 ID 为准。

受限模型

部分模型要求先接受条款:

  1. 在 Hugging Face 打开模型页面。
  2. 接受许可证或条款。
  3. 确认令牌拥有访问权限。
  4. 从 Libre WebUI 重试。

受限模型可能在令牌获准运行前就出现在发现结果中。

故障排除

未授权

  • 检查令牌值。
  • 确认令牌有推理权限。
  • 使用用户专属凭据时,确认当前用户已保存密钥。

模型不可用

  • 检查 Hugging Face 模型页面。
  • 如果可用,尝试其他提供商路由。
  • 确认已接受受限条款。

GGUF 拉取失败

  • 确认仓库包含 GGUF 文件。
  • 在终端中使用 Ollama 测试准确的 hf.co/... 引用。
  • 磁盘或内存不足时使用更小的量化。

相关文档