العمل مع نماذج الذكاء الاصطناعي
يستطيع Libre WebUI استخدام نماذج Ollama المحلية والنماذج السحابية المدعومة بالإضافات في مساحة العمل نفسها. يعرض مدير النماذج نماذج Ollama المثبّتة والعاملة، ونتائج مكتبة Ollama المباشرة، ومدخلات GGUF من Hugging Face، ومدخلات Ollama Cloud حيثما توفرت.
اختيار نموذج أول
استخدم هذه النماذج كنقاط بداية، ثم غيّر وفق عتادك ومهمتك:
| النموذج | مناسب لـ | ملاءمة نموذجية |
|---|---|---|
gemma4:12b | محادثة عامة سريعة | 16 GB RAM أو 8 GB VRAM |
qwen3.8:27b | محادثة عامة وبرمجة واستخدام متعدد اللغات | 32 GB RAM أو 16-24 GB VRAM |
gemma4:26b | محادثة قوية مع كفاءة MoE | 24 GB RAM أو 16 GB VRAM |
gemma4:31b | أعلى جودة لمحادثة محلية كثيفة | 32 GB RAM أو 24 GB VRAM |
nomic-embed-text | تضمينات المستندات | نموذج تضمين محلي صغير |
قد تكون النماذج الكبيرة مثل 30B و70B ونماذج MoE ممتازة، لكنها تحتاج إلى ذاكرة أكبر بكثير. إن لم تكن متأكدًا، فابدأ بنموذج صغير وانتقل إلى الأكبر بعد أن يعمل بسلاسة.
مدير النماذج
افتح الإعدادات ← النماذج من أجل:
- سحب نماذج من Ollama بالاسم.
- البحث مباشرة في مكتبة Ollama بدل الاعتماد على قائمة ثابتة.
- عرض النماذج المثبّتة والعاملة.
- تحديث كل نماذج Ollama المثبّتة في عملية واحدة.
- إيقاف النماذج العاملة أو تفريغها.
- حذف النماذج التي لم تعد تحتاج إليها.
- سحب نماذج GGUF من Hugging Face عبر Ollama عندما تكون متوافقة.
- سحب نماذج Ollama Cloud من مرشح السحابة.
تطبّع الواجهة أسماء نماذج Ollama Cloud قبل سحبها. فإذا احتاج نموذج سحابي إلى
اللاحقة :cloud أو -cloud، يطبقها Libre WebUI نيابة عنك ضمن مسار النموذج السحابي.
كتالوج النماذج وإظهارها
يعرض كتالوج النماذج في الإعدادات ← الافتراضيات كل نموذج محادثة يمكنك اختياره، محليًا كان أو مدعومًا بموفّر، مع شارة للموفّر وحقل بحث. اختر النموذج الافتراضي أعلى الكتالوج لتحديد النموذج الذي تبدأ به المحادثات الجديدة.
يمكن للمسؤولين وضع نجمة على نموذج لتثبيته أعلى الكتالوج وأعلى قائمة النموذج الافتراضي. وعند تنجيم عدة نماذج يظهر آخر ما نُجّم منها أولًا؛ وإزالة النجمة تعيد النموذج إلى ترتيبه اليدوي أو ترتيب موفّره.
يحصل المسؤولون على عنصر تحكم إضافي في كل صف: زر عين يخفي النموذج من محددات النماذج لدى الآخرين. يختصر الإخفاء الكتالوجات الطويلة إلى النماذج التي يريد الخادم فعليًا أن يستخدمها الناس؛ وهو تحسين للقائمة لا بوابة تفويض، لذا تعامَل معه كتنسيق للاختيارات لا كحد أمني. يرى المسؤولون دائمًا القائمة كاملة مع تعليم النماذج المخفية.
النماذج المحلية مقابل السحابية
| الوضع | المزايا | التنازلات |
|---|---|---|
| Ollama محلي | خاص، يعمل بلا اتصال بعد التنزيل، وتكلفته متوقعة | يعتمد على CPU وGPU وRAM لديك |
| Ollama Cloud | سير Ollama مألوف بلا قيود العتاد المحلي | يتطلب وصولًا إلى السحابة والشبكة |
| إضافات الموفّرين | وصول إلى نماذج مُدارة من عدة موفّرين | تنطبق مفاتيح API وتسعير الموفّر وسياسة الخصوصية لديه |
يمكنك إبقاء النماذج المحلية للعمل الخاص، وتفعيل إضافات الموفّرين للمهام التي تحتاج إلى نماذج مستضافة أكبر.
نموذج الرؤية الافتراضي
يمكنك التحدث إلى نموذج نصي سريع مع إرسال الصور أيضًا. اختر نموذج رؤية من الإعدادات ← الافتراضيات ← النماذج المتخصصة ← نموذج الرؤية؛ وعندما يتضمن سياق المحادثة الصادر صورًا — مرفقًا جديدًا، أو صورة سابقة في الجلسة، أو سجلًا في محادثة متخفية — تُوجّه تلك المداخلة إلى نموذج الرؤية المعدّ بدل نموذج الجلسة. وتبقى المداخلات النصية فقط على نموذج الجلسة.
الإعداد خاص بكل مستخدم، والتوجيه تلقائي وصامت. يؤدي ترك الاختيار على استخدام نموذج المحادثة الحالي إلى تعطيله. لاحظ أن التحقق يتعلق بوجود الصور لا بقدرات نموذج الجلسة: عند إعداد نموذج رؤية، تستخدمه كل مداخلة تحمل صورة حتى لو كان نموذج الجلسة قادرًا على معالجة الصور بنفسه.
يحفظ الاختيار هوية الموفّر الدقيقة (Ollama أو إضافة محددة) مع اسم النموذج، فلا يستطيع موفّر الاستيلاء على نموذج مطابق في الاسم. وإذا فقد الاختيار المحفوظ تلك الهوية — مثلًا لأن النموذج أو الموفّر لم يعد متاحًا — تفشل المداخلة التي تحمل صورة. أعد اختيار النموذج من الإعدادات ← الافتراضيات ← النماذج المتخصصة ← نموذج الرؤية لإصلاح ذلك. والفشل الصريح مقصود؛ فلا يستبدل Libre WebUI موفّرًا آخر بصمت.
نماذج Work
يحتاج Work إلى نموذج محادثة قادر على استدعاء الأدوات. ويمكنه استخدام:
- نموذج Ollama مثبّت يعلن الإمكانية
tools. - نموذج Ollama Cloud متاح عبر نقطة Ollama المعدّة.
- نموذج تعرضه إضافة محادثة أو إكمال نشطة، مع إعداد بيانات اعتماد للمسؤول الحالي.
تستخدم عمليات Work المدعومة بإضافة محول الموفّر المناسب للإضافة المعدّة: المتوافق مع OpenAI أو Anthropic أو Gemini. يحفظ Libre WebUI نوع الموفّر ومعرّف الإضافة الدقيقين مع المهمة وكل تشغيل، فلا تستطيع إضافة الاستيلاء على نموذج Ollama مطابق في الاسم. وإذا رفض النموذج أو الموفّر المحدد استدعاء الأدوات، يفشل التشغيل بدل التحول بصمت إلى موفّر آخر.
يبقي Ollama المحلي طلبات النماذج على بنية Ollama المعدّة. ومع نموذج بعيد، يتلقى الموفّر مطالبة نظام Work والمحادثة وتعريفات الأدوات ونتائجها. وقد تشمل نتائج الأدوات نص المصدر أو مخرجات الأوامر أو قوائم الأدلة التي طلبها النموذج. تبقى وحدات مساحات العمل وبيانات اعتماد الموفّرين على مضيف الواجهة الخلفية، لكن محتوى ملف قد يغادر ذلك المضيف عند إدراجه في نتيجة أداة.
قد يجري تشغيل Work مستقل واحد عدة استدعاءات للنموذج. راجع سياسات التسعير والاحتفاظ والتدريب لدى الموفّر البعيد قبل استخدام مشروعات حساسة. يعرض Libre WebUI إشعارًا عن الموفّر البعيد في Work يمكن لكل مستخدم إخفاؤه.
دليل العتاد
| النظام | نطاق النماذج العملي | ملاحظات |
|---|---|---|
| CPU فقط، و8-16 GB RAM | 1B-4B | مناسب للمحادثة الخفيفة والاختبار |
| 8 GB VRAM | 4B-8B مكمّمة | نقطة بداية مريحة |
| 12-16 GB VRAM | 8B-14B مكمّمة | نطاق جيد للاستخدام اليومي |
| 24 GB VRAM | 14B-32B مكمّمة | محطة عمل محلية قوية |
| 48 GB+ VRAM أو ذاكرة موحدة كبيرة | 32B-70B مكمّمة | تجربة النماذج الكبيرة |
تستخدم النماذج المكمّمة ذاكرة أقل. يكون تكميم Q4 عادة الخيار العملي الافتراضي؛ ويستخدم Q8 ذاكرة أكثر لجودة أعلى.
توصيات حسب المهمة
| المهمة | اتجاه النموذج |
|---|---|
| محادثة سريعة | gemma4:12b ونماذج حالية صغيرة أخرى |
| البرمجة | Qwen Coder وCodestral ونماذج برمجة الموفّرين |
| الاستدلال | نماذج Qwen وGemma الأكبر ونماذج استدلال الموفّرين |
| الرؤية | نماذج متعددة الوسائط مثل LLaVA وQwen VL أو نماذج رؤية الموفّرين |
| بحث المستندات | nomic-embed-text أو نموذج تضمين آخر |
| تحويل النص إلى كلام | إضافات TTS مثل Qwen3-TTS أو Kyutai TTS |
تتغير أسماء نماذج الموفّرين كثيرًا. استخدم اكتشاف نماذج الموفّر في Libre WebUI حيثما توفر، أو ألصق معرّف النموذج الدقيق من لوحة الموفّر.
المطالبات والإعدادات
- تُجمع عناصر تحكم التوليد، مثل درجة الحرارة وحدود الرموز وطول السياق والعقوبات، تحت إعدادات التوليد المتقدمة وتبقى مغلقة افتراضيًا.
- استخدم درجة حرارة منخفضة (
0.1-0.3) للإجابات الواقعية القابلة للتكرار. - استخدم درجة حرارة متوسطة (
0.5-0.7) لعمل المساعد المعتاد. - استخدم درجة حرارة أعلى (
0.8+) للعصف الذهني والكتابة الإبداعية. - أبقِ طول السياق معقولًا عندما تقترب من حدود الذاكرة.
- استخدم الشخصيات إذا أردت معاملات نموذج دائمة ومطالبة نظام قابلة لإعادة الاستخدام.
استكشاف الأخطاء وإصلاحها
فشل السحب
- تأكد من تشغيل Ollama:
ollama list. - جرّب السحب نفسه في طرفية لرؤية خطأ Ollama الخام.
- تحقق من مساحة القرص قبل سحب نماذج كبيرة.
- إذا كنت تستخدم مرشح السحابة في مدير النماذج، فدع Libre WebUI يتولى لواحق السحابة.
الردود بطيئة
- جرّب نموذجًا أصغر أو تكميمًا أقل.
- استخدم
ollama psلمعرفة ما هو محمّل. - أغلق التطبيقات الأخرى كثيفة الاستخدام لـGPU.
- قلل طول السياق.
نفاد الذاكرة
- انتقل من Q8 إلى Q4.
- استخدم نموذج 8B بدل 14B.
- لا تُبقِ محمّلًا إلا النموذج الذي تحتاج إليه.
- في Docker، تأكد من أن الحاوية تستطيع الوصول إلى GPU أو مثيل Ollama على المضيف.