ข้ามไปยังเนื้อหาหลัก

Hugging Face Hub

มีสองวิธี:

  • plugin Hugging Face Inference Providers
  • browser Hub ในแอป รวม GGUF สำหรับ Ollama

ตั้งค่า Plugin

สร้าง token ที่มีสิทธิ์ inference:

HUGGINGFACE_API_KEY=hf_...

เปิดใช้ใน การตั้งค่า > Plugin

ความสามารถ

Chat/completion, TTS, รูปภาพ, embedding และ STT ขึ้นกับโมเดลและ provider ตรวจหน้าของโมเดลและ UI ล่าสุด

Browser โมเดล

ค้นหาตามชื่อ/ผู้เขียน filter งาน เรียงลำดับ ดูสถานะ gated และ download GGUF ผ่าน Ollama Metadata ผ่าน server proxy และ cache ต้องมีเซสชัน Libre และมีเพียง administrator ที่ล้าง cache ร่วมได้

GGUF และ Ollama

สำหรับ inference local ให้ค้นหา GGUF Libre รองรับอ้างอิง hf.co/...:

ollama run hf.co/owner/model-repo:tag

UI ลดข้อผิดพลาดและแสดง metadata

Routing ของ Inference Provider

Router ที่เข้ากันได้กับ OpenAI รองรับ ID Hub และบางครั้ง suffix/preference ของ provider ใช้เอกสารทางการล่าสุด

โมเดล Gated

เปิดหน้าโมเดล ยอมรับเงื่อนไข ตรวจ token แล้วลองใหม่ โมเดลอาจแสดงก่อนอนุญาต

การแก้ปัญหา

ตรวจ token และสิทธิ์ inference หน้าโมเดล เงื่อนไข GGUF และอ้างอิง hf.co/... ที่ตรง หากทรัพยากรน้อยให้ใช้ quantization เล็กลง

เอกสารที่เกี่ยวข้อง