मुख्य कंटेंट तक स्किप करें

Hugging Face Hub

दो तरीके उपलब्ध हैं:

  • Hugging Face Inference Providers प्लगइन;
  • अनुप्रयोग में Hub ब्राउज़र, जिसमें Ollama के लिए GGUF भी है।

प्लगइन विन्यास

Inference अनुमति वाला टोकन बनाएँ:

HUGGINGFACE_API_KEY=hf_...

इसे सेटिंग्स > प्लगइन में सक्रिय करें।

क्षमताएँ

मॉडल और प्रदाता के अनुसार चैट/completion, TTS, चित्र, embedding और STT उपलब्ध होते हैं। वर्तमान मॉडल पृष्ठ और अंतराफलक जाँचें।

मॉडल ब्राउज़र

नाम या लेखक से खोज, कार्य filter, sorting, gated स्थिति और Ollama द्वारा GGUF download उपलब्ध हैं। Metadata server proxy से होकर cache होता है; Libre session आवश्यक है और shared cache केवल administrator साफ कर सकता है।

GGUF और Ollama

स्थानीय inference के लिए GGUF खोजें। Libre hf.co/... संदर्भ स्वीकार करता है:

ollama run hf.co/owner/model-repo:tag

अंतराफलक त्रुटियाँ घटाता और metadata दिखाता है।

Inference Provider routing

OpenAI-compatible router Hub ID तथा कभी-कभी provider suffix/प्राथमिकता स्वीकार करता है। नवीन आधिकारिक documentation देखें।

प्रतिबंधित मॉडल

मॉडल पृष्ठ खोलें, शर्तें स्वीकारें, token जाँचें और पुनः प्रयास करें। अनुमति मिलने से पहले मॉडल दिखाई दे सकता है।

समस्या निवारण

Token और inference permissions, मॉडल पृष्ठ, शर्तें, GGUF की उपलब्धता और सही hf.co/... संदर्भ जाँचें। संसाधन कम हों तो छोटी quantization चुनें।

संबंधित दस्तावेज़