إنتقل إلى المحتوى الرئيسي

العمل مع نماذج الذكاء الاصطناعي

يستطيع Libre WebUI استخدام نماذج Ollama المحلية والنماذج السحابية المدعومة بالإضافات في مساحة العمل نفسها. يعرض مدير النماذج نماذج Ollama المثبّتة والعاملة، ونتائج مكتبة Ollama المباشرة، ومدخلات GGUF من Hugging Face، ومدخلات Ollama Cloud حيثما توفرت.

اختيار نموذج أول

استخدم هذه النماذج كنقاط بداية، ثم غيّر وفق عتادك ومهمتك:

النموذجمناسب لـملاءمة نموذجية
gemma4:12bمحادثة عامة سريعة16 GB RAM أو 8 GB VRAM
qwen3.8:27bمحادثة عامة وبرمجة واستخدام متعدد اللغات32 GB RAM أو 16-24 GB VRAM
gemma4:26bمحادثة قوية مع كفاءة MoE24 GB RAM أو 16 GB VRAM
gemma4:31bأعلى جودة لمحادثة محلية كثيفة32 GB RAM أو 24 GB VRAM
nomic-embed-textتضمينات المستنداتنموذج تضمين محلي صغير

قد تكون النماذج الكبيرة مثل 30B و70B ونماذج MoE ممتازة، لكنها تحتاج إلى ذاكرة أكبر بكثير. إن لم تكن متأكدًا، فابدأ بنموذج صغير وانتقل إلى الأكبر بعد أن يعمل بسلاسة.

مدير النماذج

افتح الإعدادات ← النماذج من أجل:

  • سحب نماذج من Ollama بالاسم.
  • البحث مباشرة في مكتبة Ollama بدل الاعتماد على قائمة ثابتة.
  • عرض النماذج المثبّتة والعاملة.
  • تحديث كل نماذج Ollama المثبّتة في عملية واحدة.
  • إيقاف النماذج العاملة أو تفريغها.
  • حذف النماذج التي لم تعد تحتاج إليها.
  • سحب نماذج GGUF من Hugging Face عبر Ollama عندما تكون متوافقة.
  • سحب نماذج Ollama Cloud من مرشح السحابة.

تطبّع الواجهة أسماء نماذج Ollama Cloud قبل سحبها. فإذا احتاج نموذج سحابي إلى اللاحقة :cloud أو -cloud، يطبقها Libre WebUI نيابة عنك ضمن مسار النموذج السحابي.

كتالوج النماذج وإظهارها

يعرض كتالوج النماذج في الإعدادات ← الافتراضيات كل نموذج محادثة يمكنك اختياره، محليًا كان أو مدعومًا بموفّر، مع شارة للموفّر وحقل بحث. اختر النموذج الافتراضي أعلى الكتالوج لتحديد النموذج الذي تبدأ به المحادثات الجديدة.

يمكن للمسؤولين وضع نجمة على نموذج لتثبيته أعلى الكتالوج وأعلى قائمة النموذج الافتراضي. وعند تنجيم عدة نماذج يظهر آخر ما نُجّم منها أولًا؛ وإزالة النجمة تعيد النموذج إلى ترتيبه اليدوي أو ترتيب موفّره.

يحصل المسؤولون على عنصر تحكم إضافي في كل صف: زر عين يخفي النموذج من محددات النماذج لدى الآخرين. يختصر الإخفاء الكتالوجات الطويلة إلى النماذج التي يريد الخادم فعليًا أن يستخدمها الناس؛ وهو تحسين للقائمة لا بوابة تفويض، لذا تعامَل معه كتنسيق للاختيارات لا كحد أمني. يرى المسؤولون دائمًا القائمة كاملة مع تعليم النماذج المخفية.

النماذج المحلية مقابل السحابية

الوضعالمزاياالتنازلات
Ollama محليخاص، يعمل بلا اتصال بعد التنزيل، وتكلفته متوقعةيعتمد على CPU وGPU وRAM لديك
Ollama Cloudسير Ollama مألوف بلا قيود العتاد المحلييتطلب وصولًا إلى السحابة والشبكة
إضافات الموفّرينوصول إلى نماذج مُدارة من عدة موفّرينتنطبق مفاتيح API وتسعير الموفّر وسياسة الخصوصية لديه

يمكنك إبقاء النماذج المحلية للعمل الخاص، وتفعيل إضافات الموفّرين للمهام التي تحتاج إلى نماذج مستضافة أكبر.

نموذج الرؤية الافتراضي

يمكنك التحدث إلى نموذج نصي سريع مع إرسال الصور أيضًا. اختر نموذج رؤية من الإعدادات ← الافتراضيات ← النماذج المتخصصة ← نموذج الرؤية؛ وعندما يتضمن سياق المحادثة الصادر صورًا — مرفقًا جديدًا، أو صورة سابقة في الجلسة، أو سجلًا في محادثة متخفية — تُوجّه تلك المداخلة إلى نموذج الرؤية المعدّ بدل نموذج الجلسة. وتبقى المداخلات النصية فقط على نموذج الجلسة.

الإعداد خاص بكل مستخدم، والتوجيه تلقائي وصامت. يؤدي ترك الاختيار على استخدام نموذج المحادثة الحالي إلى تعطيله. لاحظ أن التحقق يتعلق بوجود الصور لا بقدرات نموذج الجلسة: عند إعداد نموذج رؤية، تستخدمه كل مداخلة تحمل صورة حتى لو كان نموذج الجلسة قادرًا على معالجة الصور بنفسه.

يحفظ الاختيار هوية الموفّر الدقيقة (Ollama أو إضافة محددة) مع اسم النموذج، فلا يستطيع موفّر الاستيلاء على نموذج مطابق في الاسم. وإذا فقد الاختيار المحفوظ تلك الهوية — مثلًا لأن النموذج أو الموفّر لم يعد متاحًا — تفشل المداخلة التي تحمل صورة. أعد اختيار النموذج من الإعدادات ← الافتراضيات ← النماذج المتخصصة ← نموذج الرؤية لإصلاح ذلك. والفشل الصريح مقصود؛ فلا يستبدل Libre WebUI موفّرًا آخر بصمت.

نماذج Work

يحتاج Work إلى نموذج محادثة قادر على استدعاء الأدوات. ويمكنه استخدام:

  • نموذج Ollama مثبّت يعلن الإمكانية tools.
  • نموذج Ollama Cloud متاح عبر نقطة Ollama المعدّة.
  • نموذج تعرضه إضافة محادثة أو إكمال نشطة، مع إعداد بيانات اعتماد للمسؤول الحالي.

تستخدم عمليات Work المدعومة بإضافة محول الموفّر المناسب للإضافة المعدّة: المتوافق مع OpenAI أو Anthropic أو Gemini. يحفظ Libre WebUI نوع الموفّر ومعرّف الإضافة الدقيقين مع المهمة وكل تشغيل، فلا تستطيع إضافة الاستيلاء على نموذج Ollama مطابق في الاسم. وإذا رفض النموذج أو الموفّر المحدد استدعاء الأدوات، يفشل التشغيل بدل التحول بصمت إلى موفّر آخر.

يبقي Ollama المحلي طلبات النماذج على بنية Ollama المعدّة. ومع نموذج بعيد، يتلقى الموفّر مطالبة نظام Work والمحادثة وتعريفات الأدوات ونتائجها. وقد تشمل نتائج الأدوات نص المصدر أو مخرجات الأوامر أو قوائم الأدلة التي طلبها النموذج. تبقى وحدات مساحات العمل وبيانات اعتماد الموفّرين على مضيف الواجهة الخلفية، لكن محتوى ملف قد يغادر ذلك المضيف عند إدراجه في نتيجة أداة.

قد يجري تشغيل Work مستقل واحد عدة استدعاءات للنموذج. راجع سياسات التسعير والاحتفاظ والتدريب لدى الموفّر البعيد قبل استخدام مشروعات حساسة. يعرض Libre WebUI إشعارًا عن الموفّر البعيد في Work يمكن لكل مستخدم إخفاؤه.

دليل العتاد

النظامنطاق النماذج العمليملاحظات
CPU فقط، و8-16 GB RAM1B-4Bمناسب للمحادثة الخفيفة والاختبار
8 GB VRAM4B-8B مكمّمةنقطة بداية مريحة
12-16 GB VRAM8B-14B مكمّمةنطاق جيد للاستخدام اليومي
24 GB VRAM14B-32B مكمّمةمحطة عمل محلية قوية
48 GB+ VRAM أو ذاكرة موحدة كبيرة32B-70B مكمّمةتجربة النماذج الكبيرة

تستخدم النماذج المكمّمة ذاكرة أقل. يكون تكميم Q4 عادة الخيار العملي الافتراضي؛ ويستخدم Q8 ذاكرة أكثر لجودة أعلى.

توصيات حسب المهمة

المهمةاتجاه النموذج
محادثة سريعةgemma4:12b ونماذج حالية صغيرة أخرى
البرمجةQwen Coder وCodestral ونماذج برمجة الموفّرين
الاستدلالنماذج Qwen وGemma الأكبر ونماذج استدلال الموفّرين
الرؤيةنماذج متعددة الوسائط مثل LLaVA وQwen VL أو نماذج رؤية الموفّرين
بحث المستنداتnomic-embed-text أو نموذج تضمين آخر
تحويل النص إلى كلامإضافات TTS مثل Qwen3-TTS أو Kyutai TTS

تتغير أسماء نماذج الموفّرين كثيرًا. استخدم اكتشاف نماذج الموفّر في Libre WebUI حيثما توفر، أو ألصق معرّف النموذج الدقيق من لوحة الموفّر.

المطالبات والإعدادات

  • تُجمع عناصر تحكم التوليد، مثل درجة الحرارة وحدود الرموز وطول السياق والعقوبات، تحت إعدادات التوليد المتقدمة وتبقى مغلقة افتراضيًا.
  • استخدم درجة حرارة منخفضة (0.1-0.3) للإجابات الواقعية القابلة للتكرار.
  • استخدم درجة حرارة متوسطة (0.5-0.7) لعمل المساعد المعتاد.
  • استخدم درجة حرارة أعلى (0.8+) للعصف الذهني والكتابة الإبداعية.
  • أبقِ طول السياق معقولًا عندما تقترب من حدود الذاكرة.
  • استخدم الشخصيات إذا أردت معاملات نموذج دائمة ومطالبة نظام قابلة لإعادة الاستخدام.

استكشاف الأخطاء وإصلاحها

فشل السحب

  • تأكد من تشغيل Ollama: ollama list.
  • جرّب السحب نفسه في طرفية لرؤية خطأ Ollama الخام.
  • تحقق من مساحة القرص قبل سحب نماذج كبيرة.
  • إذا كنت تستخدم مرشح السحابة في مدير النماذج، فدع Libre WebUI يتولى لواحق السحابة.

الردود بطيئة

  • جرّب نموذجًا أصغر أو تكميمًا أقل.
  • استخدم ollama ps لمعرفة ما هو محمّل.
  • أغلق التطبيقات الأخرى كثيفة الاستخدام لـGPU.
  • قلل طول السياق.

نفاد الذاكرة

  • انتقل من Q8 إلى Q4.
  • استخدم نموذج 8B بدل 14B.
  • لا تُبقِ محمّلًا إلا النموذج الذي تحتاج إليه.
  • في Docker، تأكد من أن الحاوية تستطيع الوصول إلى GPU أو مثيل Ollama على المضيف.

مستندات ذات صلة