Hugging Face Hub
Libre WebUI 通过两种方式集成 Hugging Face:
- 通过 Hugging Face Inference Providers 使用提供商插件。
- 在应用内浏览兼容模型,包括可通过 Ollama 拉取的 GGUF 模型。
配置提供商插件
创建具有推理权限的 Hugging Face 访问令牌,然后在设置中或作为环境变量添加:
HUGGINGFACE_API_KEY=hf_...
在设置 > 插件中启用 Hugging Face 插件。
能力
根据模型和提供商的可用性,Hugging Face 可以提供:
- 聊天或补全模型
- 文字转语音
- 图像生成
- 嵌入
- 语音转文字
Hugging Face 的可用性、价格和路由可能随模型变化。请查看模型页面和提供商界面 了解当前状态。
模型浏览器
应用内浏览器可用于:
- 按模型名称或作者搜索。
- 按任务筛选。
- 按趋势、下载量、点赞数、创建日期或更新日期排序。
- 检查受限模型状态。
- 在支持时通过 Ollama 拉取兼容 GGUF 文件。
浏览器通过后端代理获取 Hub 元数据,并缓存结果以提升性能。发现 Hub 内容需要 有效 Libre 会话;只有当前管理员可以清除共享模型缓存。
GGUF 与 Ollama
本地推理请寻找 GGUF 格式模型。当仓库提供合适的 GGUF 文件时,Libre WebUI 可使用
兼容 Ollama 的 hf.co/... 模型引用。
示例模式:
ollama run hf.co/owner/model-repo:tag
尽量使用界面,它可以减少复制粘贴错误并保持模型元数据可见。
Inference Provider 路由
Hugging Face 的 OpenAI 兼容路由器支持 Hub 模型 ID。部分路由支持后缀或提供商偏好。 这些内容会随时间变化,因此应以当前 Hugging Face 文档和应用内浏览器中的精确 ID 为准。
受限模型
部分模型要求先接受条款:
- 在 Hugging Face 打开模型页面。
- 接受许可证或条款。
- 确认令牌拥有访问权限。
- 从 Libre WebUI 重试。
受限模型可能在令牌获准运行前就出现在发现结果中。
故障排除
未授权
- 检查令牌值。
- 确认令牌有推理权限。
- 使用用户专属凭据时,确认当前用户已保存密钥。
模型不可用
- 检查 Hugging Face 模型页面。
- 如果可用,尝试其他提供商路由。
- 确认已接受受限条款。
GGUF 拉取失败
- 确认仓库包含 GGUF 文件。
- 在终端中使用 Ollama 测试准确的
hf.co/...引用。 - 磁盘或内存不足时使用更小的量化。