Ana içeriğe geç

Yapay zekâ modelleriyle çalışma

Libre WebUI, yerel Ollama modellerini ve eklentiler üzerinden bulut modellerini tek bir çalışma alanında kullanır. Model yöneticisi; kurulu ve çalışan Ollama modellerini, güncel Ollama Library’yi, Hugging Face GGUF modellerini ve Ollama Cloud’u gösterir.

İlk modelinizi seçme

ModelKullanımYaklaşık kaynak
gemma4:12bHızlı sohbet16 GB RAM veya 8 GB VRAM
qwen3.8:27bSohbet, kod, diller32 GB RAM veya 16–24 GB VRAM
gemma4:26bGüçlü MoE sohbeti24 GB RAM veya 16 GB VRAM
gemma4:31bYüksek kaliteli dense sohbet32 GB RAM veya 24 GB VRAM
nomic-embed-textBelge embedding’iKüçük yerel model

30B, 70B ve MoE modelleri çok daha fazla bellek ister. Daha küçük bir modelle başlayın.

Model yöneticisi

Ayarlar → Modeller bölümünde Ollama modellerini adıyla indirebilir, Library’de arayabilir, modelleri görüntüleyip durdurabilir veya silebilir, kurulu tüm Ollama modellerini tek işlemle güncelleyebilir, Hugging Face GGUF ve Ollama Cloud modellerini indirebilirsiniz. Cloud modelleri için Libre, :cloud veya -cloud son ekini normalleştirir.

Katalog ve görünürlük

Ayarlar → Varsayılanlar altındaki Model Kataloğu, yerel ve sağlayıcı modellerini rozet ve aramayla gösterir. Kataloğun üzerindeki varsayılan model seçimi, yeni sohbetlerin hangi modelle başlayacağını belirler.

Yönetici, bir modeli yıldızlayarak kataloğun ve varsayılan model menüsünün en üstüne sabitleyebilir. Birden çok yıldızda en son yıldızlanan başa gelir; yıldız kaldırıldığında model eski sırasına döner.

Yönetici, bir modeli diğer kullanıcıların seçicilerinden gizleyebilir; bu bir düzenleme özelliğidir, yetkilendirme sınırı değildir. Yönetici her zaman tam listeyi görür.

Yerel ve bulut modelleri

ModAvantajlarÖdünler
Yerel OllamaGizlilik, çevrimdışı çalışma, öngörülebilir maliyetCPU/GPU/RAM
Ollama CloudYerel kaynak sınırı olmadan tanıdık akışAğ ve bulut
EklentilerFarklı sağlayıcılardan yönetilen modellerAPI anahtarları, fiyat ve sağlayıcının gizlilik ilkesi

Varsayılan görsel model

Ayarlar → Varsayılanlar → Uzman modeller → Görsel model bölümünden ayrı bir model seçebilirsiniz. Yeni, önceki veya gizli mod geçmişinden gelen bir görüntü içeren her tur bu modele yönlendirilir; metin turları oturumun modelinde kalır.

Ayar kullanıcıya özeldir ve arka planda uygulanır. Geçerli sohbet modelini kullan seçeneği ayrı yönlendirmeyi kapatır. Ana modelin görsel yeteneği değil, iletide görüntü bulunup bulunmadığı denetlenir.

Sağlayıcının tam kimliği saklanır. Bu kimlik kaybolursa — örneğin model ya da sağlayıcı artık yoksa — görüntü içeren tur başarısız olur. Düzeltmek için modeli Ayarlar → Varsayılanlar → Uzman modeller → Görsel model bölümünden yeniden seçin. Hatanın açıkça verilmesi bilinçlidir; Libre başka bir sağlayıcıya sessizce geçmez.

Work modelleri

Araç destekleyen bir sohbet modeli gerekir:

  • tools yeteneğini bildiren Ollama;
  • Ollama Cloud;
  • tam model ve yönetici kimlik bilgileri bulunan etkin bir chat/completion eklentisi.

Work; OpenAI uyumlu, Anthropic veya Gemini bağdaştırıcısını kullanır ve tür ile eklenti ID’sini saklar. tools reddedilirse yedek geçiş yapılmaz.

Yerel Ollama, istekleri altyapınızda tutar. Uzak sağlayıcı; Work sistem istemini, konuşmayı, tanımları ve dosya, komut veya dizin içerebilen araç sonuçlarını alır. Birimler ve kimlik bilgileri ana bilgisayarda kalır, ancak dosya içeriği araç sonucu olarak dışarı çıkabilir.

Tek bir özerk çalışma çok sayıda model çağrısı yapabilir. Fiyat, saklama ve eğitim koşullarını denetleyin. Libre, uzak sağlayıcı seçildiğinde uyarı gösterir.

Donanım

SistemKullanışlı aralıkNot
CPU, 8–16 GB RAM1B–4BHafif sohbet
8 GB VRAM4B–8B, kuantizeBaşlangıç
12–16 GB VRAM8B–14B, kuantizeGünlük kullanım
24 GB VRAM14B–32B, kuantizeGüçlü iş istasyonu
48 GB+ VRAM/birleşik bellek32B–70B, kuantizeDeneyler

Q4 kullanışlı varsayılandır; Q8 daha kaliteli ve daha ağırdır.

Göreve göre öneriler

Hızlı sohbet için gemma4:12b; kod için Qwen Coder/Codestral; muhakeme için daha büyük Qwen/Gemma; görsel görevler için LLaVA/Qwen VL; belgeler için nomic-embed-text; TTS için Qwen3-TTS veya Kyutai kullanabilirsiniz. Sağlayıcı adları değişebilir; keşfi veya tam ID’yi kullanın.

İstemler ve ayarlar

Gelişmiş üretim parametreleri varsayılan olarak daraltılmıştır. Olgusal yanıtlar için 0.1-0.3, normal asistan çalışması için 0.5-0.7, yaratıcı görevler için 0.8+ sıcaklık uygundur. Bağlamı izleyin ve kalıcı ayarlar için persona’ları kullanın.

Sorun giderme

İndirme hatasında ollama list çıktısını, diski ve ham hata iletisini denetleyin. Yanıt yavaşsa daha küçük bir model seçin, ollama ps çıktısına bakın, GPU kullanan programları kapatın ve bağlamı küçültün. Bellek yetersizse Q8 yerine Q4, 14B yerine 8B, tek model ve Docker’ın GPU/Ollama erişimini kullanın.

İlgili belgeler