Hugging Face Hub
มีสองวิธี:
- plugin Hugging Face Inference Providers
- browser Hub ในแอป รวม GGUF สำหรับ Ollama
ตั้งค่า Plugin
สร้าง token ที่มีสิทธิ์ inference:
HUGGINGFACE_API_KEY=hf_...
เปิดใช้ใน การตั้งค่า > Plugin
ความสามารถ
Chat/completion, TTS, รูปภาพ, embedding และ STT ขึ้นกับโมเดลและ provider ตรวจหน้าของโมเดลและ UI ล่าสุด
Browser โมเดล
ค้นหาตามชื่อ/ผู้เขียน filter งาน เรียงลำดับ ดูสถานะ gated และ download GGUF ผ่าน Ollama Metadata ผ่าน server proxy และ cache ต้องมีเซสชัน Libre และมีเพียง administrator ที่ล้าง cache ร่วมได้
GGUF และ Ollama
สำหรับ inference local ให้ค้นหา GGUF Libre รองรับอ้างอิง hf.co/...:
ollama run hf.co/owner/model-repo:tag
UI ลดข้อผิดพลาดและแสดง metadata
Routing ของ Inference Provider
Router ที่เข้ากันได้กับ OpenAI รองรับ ID Hub และบางครั้ง suffix/preference ของ provider ใช้เอกสารทางการล่าสุด
โมเดล Gated
เปิดหน้าโมเดล ยอมรับเงื่อนไข ตรวจ token แล้วลองใหม่ โมเดลอาจแสดงก่อนอนุญาต
การแก้ปัญหา
ตรวจ token และสิทธิ์ inference หน้าโมเดล เงื่อนไข GGUF และอ้างอิง hf.co/... ที่ตรง หากทรัพยากรน้อยให้ใช้ quantization เล็กลง