Ga naar hoofdinhoud

Pro-tips

Deze pagina verzamelt praktische werkwijzen die Libre WebUI bij dagelijks gebruik sneller, overzichtelijker en betrouwbaarder maken.

Houd een klein dagelijks model geladen

Gebruik een snel lokaal model voor alledaagse taken en stap alleen over op grotere modellen wanneer de taak dat vereist.

Goede voorbeelden voor dagelijks gebruik:

  • gemma4:12b voor snelle alledaagse chats
  • qwen3.8:27b voor krachtiger algemeen werk
  • gemma4:26b voor de MoE-efficiëntie op zwaardere hardware
  • gemma4:31b voor de beste dense lokale kwaliteit
  • nomic-embed-text voor documentembeddings

Open Models om te zien welke modellen actief zijn. Ontlaad modellen die u niet gebruikt wanneer het VRAM krap wordt.

Gebruik incognitochat voor gesprekken die niet mogen worden bewaard

Start een incognitochat via het menu + in de tabbalk, het opdrachtenpalet, de startpagina of de spookknop op het welkomstscherm van de chat. Er is ook een directe URL: /chat?incognito=1.

Een incognitochat wordt nooit bewaard: er wordt geen sessie op de server aangemaakt, geen bericht opgeslagen en de chat verschijnt nooit in de zijbalk of geschiedenis. De chat toont de banner Private Mode ("This conversation won't be saved"). Als u een opgeslagen chat opent, verlaat u de incognitomodus; wanneer u een incognitotabblad herlaadt, begint een nieuwe lege privéchat en zijn de vorige beurten verdwenen.

Let goed op de grens: incognito bepaalt de persistentie, niet wat een provider te zien krijgt. Het geselecteerde model — lokaal of extern — ontvangt nog steeds het volledige gesprek en documentcontext blijft gelden wanneer die is ingeschakeld. Combineer incognito met een lokaal Ollama-model als een gesprek uw infrastructuur niet mag verlaten.

Beheer tabbladen met het contextmenu

Klik met de rechtermuisknop op een tabblad (of druk op Shift + F10 wanneer het tabblad focus heeft) voor:

  • Close tab
  • Close other tabs
  • Close tabs to the right
  • Close all tabs

Home staat altijd als eerste tabblad en kan niet worden gesloten. Beheerders krijgen in het menu + ook rechtstreekse opties voor User Management, System en Provider Usage. Met het speldpictogram in het avatarmenu kunnen ze elk van die drie vastmaken in de voettekst van de zijbalk (naast Settings), zodat ze het menu niet meer nodig hebben.

Met Cmd/Ctrl + K opent u het opdrachtenpalet overal — ook wanneer de invoerveld focus heeft. Het zoekt tolerant in appacties, uw chats en uw Work-taken, zodat ook gedeeltelijke of verkeerd gespelde zoekopdrachten werken: autmtn vindt Automations, "pictures" vindt Imagine en "dark" vindt de themaschakelaar. Vanaf drie tekens zoekt het ook in de inhoud van berichten, notities en documenten (inclusief met u gedeelde notities) en toont het per resultaat een fragment. Dit gebeurt in het geheugen met uw eigen ontsleutelde gegevens; niets wordt als platte tekst op de schijf geïndexeerd. Overeenkomende tekens worden gemarkeerd, resultaten worden op relevantie gerangschikt en zonder zoekopdracht ziet u uw recentste chats en taken. Navigeer met /, open met Enter en sluit met Esc (of nogmaals Cmd/Ctrl + K).

Standaardthema

Nieuwe installaties gebruiken het donkere thema. Dit wordt vóór de eerste weergave toegepast, zodat u geen lichte flits ziet. Een beheerder kan de standaardwaarde voor de hele instantie wijzigen via Settings > Gebruikersbeheer > Standaardthema (Licht, Donker of Puur Zwart). Dat standaardthema kleurt de aanmeldpagina, geldt voor elk nieuw account en wordt gebruikt in elke browser die nog geen eigen thema heeft gekozen; een opgeslagen persoonlijke voorkeur wordt altijd gerespecteerd. Libre WebUI volgt de thema-instelling van het besturingssysteem niet; schakel expliciet met Cmd/Ctrl + D, met de zon/maan-knop of via Settings. De knop wisselt tussen Licht, Donker, Puur Zwart en Hemels.

Hemels volgt de zon: het palet en een levende hemel (zon of maan op haar baan, wolken, sterren na de schemering, een lamp die 's nachts de aanwijzer volgt) verschuiven van minuut tot minuut, terwijl zonsopgang en zonsondergang door het jaar heen bewegen. Kies dit thema in Settings > Weergave; een schuifregelaar daar toont elke minuut van de dag en Klok volgen keert terug naar de echte tijd. Zonder locatie gaat het uit van een dag op gemiddelde breedtegraad; deelt u uw locatie (of typt u coördinaten), dan worden zonsopgang en zonsondergang voor uw werkelijke hemel berekend. De locatie wordt afgerond op ongeveer een kilometer, alleen in die browser bewaard en nooit naar de server gestuurd. Met een locatie kunt u ook Weer volgen inschakelen: de actuele omstandigheden komen rechtstreeks van Open-Meteo naar uw browser en wolken, regen, sneeuw, mist en wind vormen de hemel.

Houd Work-taken gericht

Gebruik voor elk project of onafhankelijk doel een afzonderlijke Work-taak. Elke taak heeft een eigen conversatie, beheerde containeridentiteit en permanente bestanden. De container zelf kan stoppen of opnieuw worden aangemaakt terwijl het benoemde volume behouden blijft. Als u dezelfde taak hergebruikt, blijft de nuttige context behouden; een nieuwe taak schept een duidelijke grens.

Een goede eerste instructie geeft het model:

  • Het gewenste resultaat.
  • Belangrijke technische of ontwerpbeperkingen.
  • De opdracht of het gedrag waarmee voltooiing moet worden gecontroleerd.
  • Bestanden of interfaces die ongewijzigd moeten blijven.

Volg de voortgang in Activity en inspecteer en test het resultaat daarna in Files, Git, Terminal en Preview. De bestandseditor ondersteunt syntaxisaccentuering in lichte en donkere thema's, niet-opgeslagen concepten in de browser en opmaak voor ondersteunde bestandstypen. Gebruik Cmd/Ctrl + S om op te slaan en Shift + Alt + F om op te maken.

Gebruik een geïnstalleerd Ollama-model met toolondersteuning wanneer modelverkeer binnen uw geconfigureerde Ollama-infrastructuur moet blijven. Een extern of cloudmodel kan de druk op het lokale inferentiegeheugen verlagen, maar kan meerdere betaalde oproepen doen en ontvangt opgevraagde toolresultaten, die gegevens uit de werkruimte kunnen bevatten.

Als u een uitvoering of voorbeeld stopt, blijft de werkruimte behouden. Als u een Work-taak verwijdert, wordt de werkruimte definitief verwijderd. Kopieer dus eerst alles wat u nodig hebt.

Gebruik persona's voor herhaalbaar werk

Maak persona's voor werkwijzen die u vaak herhaalt:

  • Een bondige codereviewer met een lage temperatuur.
  • Een tekstredacteur met een duidelijke stijlgids.
  • Een onderzoeksassistent met documentzoeken ingeschakeld.
  • Een ondersteuningsassistent met een vaste toon en antwoordstructuur.

Persona's bewaren het geselecteerde model, de systeemprompt, generatieparameters, avatar/achtergrond en optionele geheugen-/mutatie-instellingen. Ze kunnen ook als JSON worden geëxporteerd en geïmporteerd.

Bewaar duurzame notities naast uw werk

Open Notes vanuit het aanmaakmenu wanneer informatie onafhankelijk moet blijven van één chat of Work-taak. Notities ondersteunen Markdown-voorbeelden, expliciet bewerken, zoeken en automatisch opslaan. In het voorbeeld worden ook inline SVG en eenvoudige HTML uit een notitie weergegeven, na opschoning zodat scripts, gebeurtenishandlers en onveilige URL's nooit worden uitgevoerd. De lade met notitietools voegt revisiegeschiedenis met herstel, bestandsbijlagen, vastmaken, delen per gebruiker (bekijken of bewerken), Markdown-export en een zijbalk voor AI-bewerkingen toe. Elke voorgestelde wijziging wordt als diff getoond voordat ze wordt toegepast. Omdat bij toepassen eerst een momentopname van de vorige versie wordt gemaakt, kan elke AI-bewerking ongedaan worden gemaakt. Notities horen bij een account en worden opgenomen in een volledig gebruikersarchief; revisiegeschiedenis en bijlagen blijven op de instantie en maken geen deel uit van het archief.

Maak artefacten betrouwbaarder

Libre WebUI herkent expliciete artefacttags, omheinde codeblokken, zelfstandige HTML-documenten en gangbare HTML-bundels met meerdere bestanden. Vraag een model voor het beste artefactresultaat om:

Create one complete self-contained HTML file.
Inline the CSS and JavaScript.
Do not rely on external files unless they are CDN URLs.

Geef afzonderlijke blokken duidelijke namen als u die wilt:

```html filename="index.html"
...
```

```css filename="style.css"
...
```

```js filename="app.js"
...
```

Libre WebUI probeert lokale CSS- en JavaScript-blokken te bundelen in het HTML-voorbeeld.

Zet prompts in de wachtrij terwijl een antwoord wordt gestreamd

Als u tijdens het genereren iets verstuurt, wordt de prompt in de wachtrij gezet in plaats van genegeerd. Prompts in de wachtrij verschijnen boven het invoerveld, kunnen worden bewerkt, in een andere volgorde gezet en verwijderd, en worden één voor één verstuurd wanneer elk antwoord klaar is. De wachtrij wordt bij de chat opgeslagen en blijft dus bestaan na herladen of opnieuw verbinden.

Een gesprek afsplitsen

De afsplitsknop bij elk bericht kopieert het gesprek tot dat punt, inclusief varianten, naar een nieuwe chat en legt vast waar die vandaan kwam. Het origineel blijft ongewijzigd, zodat verkennende zijpaden de hoofddraad nooit vervuilen.

Modellen in één beurt vergelijken

Met de kolommenknop naast de toolkiezer stuurt u uw volgende prompt naar maximaal drie extra modellen. Elk antwoord is een afzonderlijke generatie met een eigen modellabel, statistieken en annuleerknop. Trage of falende modellen blokkeren de andere daardoor niet.

Gebruik documentchat doelbewust

Document Chat accepteert PDF-, Office- (DOCX/PPTX/XLSX), Markdown-, HTML-, code- en CSV-bestanden tot 10 MB. Zoeken werkt in twee modi:

  • Zoeken op trefwoorden (BM25) is altijd beschikbaar.
  • Hybride zoeken voegt semantische rangschikking en rangschikking op trefwoorden samen wanneer embeddings in Settings zijn ingeschakeld en een embeddingmodel beschikbaar is.

Installeer nomic-embed-text voor een eenvoudig lokaal embeddingmodel:

ollama pull nomic-embed-text

Upload voor de beste resultaten gerichte documenten per chat in plaats van één enorme gemengde documentverzameling.

Generatie-instellingen afstemmen

InstellingPraktisch gebruik
TemperatureLager voor nauwkeurigheid, hoger voor creatieve verkenning
Top P / Top KLaat de standaardwaarden staan, tenzij u sampling bewust afstemt
Context windowVerhoog alleen voor lange chats als uw model en geheugen dit aankunnen
Max tokensBeperk lange antwoorden of verhoog voor het genereren van code/artefacten
Repeat penaltyVerhoog iets wanneer een model in herhaling valt

Als een model zich slecht gedraagt, verlaagt u eerst de temperatuur, vermindert u daarna de contextdruk en probeert u vervolgens een ander model.

Bepaal hoe intensief een model redeneert

De bediening naast de modelnaam in het invoerveld opent de redeneerniveaus: off, on, low, medium en high. De keuze hoort bij de conversatie, blijft dus behouden na herladen en geldt ook voor opnieuw genereren. Settings > Generation bevat de standaardwaarde voor nieuwe antwoorden en het bedieningspaneel van de chat toont dezelfde waarde.

Laat u de instelling leeg, dan wordt er niets verstuurd, zoals in elke versie vóór deze. Als u een waarde instelt, vertaalt de server die ene waarde voor de provider die antwoordt: Ollama ontvangt hem in de aanvraagbody, OpenAI-achtige providers ontvangen een redeneerintensiteit en Anthropic en Gemini ontvangen een tokenbudget waarin ruimte voor het antwoord is gereserveerd.

Twee zaken zijn belangrijk. Een model waarvan Ollama meldt dat het niet kan redeneren, ontvangt de instelling helemaal niet; de bediening is voor dat model gewoon afwezig. De benoemde niveaus bestaan bovendien alleen bij modellen die ze publiceren, zoals gpt-oss. Bij een model dat redeneert zonder niveaus gedraagt een benoemd niveau zich simpelweg als on, zodat een chat die tussen modellen wisselt nooit een fout veroorzaakt. Wanneer een algemene of vastgemaakte standaardwaarde is ingesteld, toont de knop in het invoerveld het niveau waarmee het volgende antwoord daadwerkelijk wordt uitgevoerd en vermeldt de optie "Default" waarnaar die op dat moment verwijst.

Houd het contextvenster in de gaten

De ring naast de modelnaam vult zich naarmate het gesprek groeit. Houd de aanwijzer erboven om te zien hoe vol het venster is, hoeveel tokens zijn gebruikt en wat de venstergrootte is. De ring wordt amberkleurig boven vier vijfde en rood bij het venster; bij een model met een onbekend venster ziet u een gestreepte ring in plaats van een lege.

De telling omvat wat de volgende aanvraag daadwerkelijk verstuurt: gecomprimeerde geschiedenis en verlaten vertakkingen kosten niets. Ze sluit aan op wat de provider voor het vorige antwoord heeft gemeten, als die een waarde meldde, plus een schatting van één token per vier tekens voor wat daarna aan het gesprek is toegevoegd. Als er nog geen meting bestaat, staat er een ~ bij. Als een venster lager is begrensd dan waarvoor het model is getraind, wordt dat vermeld: de meter meet het venster waarmee de aanvraag echt wordt uitgevoerd. Dat is OLLAMA_MAX_CONTEXT (standaard 32,768), niet de volledige getrainde lengte van het model. Verhoog die variabele en zowel het echte venster als de meter volgen.

Bij providermodellen wordt alleen een venster getoond wanneer de modellenlijst van de provider er een publiceert. Als dat niet zo is, telt de meter de tokens nog steeds, maar heeft hij eenvoudigweg geen getal om ze door te delen.

Laat lange chats zichzelf comprimeren

Beheerders kunnen context compaction inschakelen via Settings > Generation. Zodra de geschatte context van een gesprek de tokendrempel overschrijdt, vraagt de server een model om de oudere berichten samen te vatten en bewaart alleen de recentste letterlijk. De samenvatting verschijnt als een conversatiesamenvattingskaart op de plek waar de geschiedenis is samengevouwen en de samengevatte berichten worden gedimd weergegeven: nog steeds leesbaar, maar niet langer naar het model gestuurd. Als compressie is ingeschakeld, vormt het aantal "recent messages kept" ook het doorlopende venster dat een gesprek verstuurt. Een hogere waarde verbreedt dus werkelijk wat het model ziet.

InstellingWat deze bepaalt
Token thresholdGeschatte contextgrootte die compressie activeert
Recent messages keptHoeveel van de nieuwste berichten altijd letterlijk blijven
Compaction modelWelk model samenvattingen schrijft; standaard het model van de conversatie zelf
Custom summary promptUw eigen instructies, met {{PREVIOUS_SUMMARY}} en {{MESSAGES}}

Compressie is standaard uitgeschakeld en geldt voor elke gebruiker op de server, maar elke chat houdt inspraak: in het bedieningspaneel van de chat kunt u compressie voor één gesprek uitschakelen en elke samenvattingskaart bevat een optie om ongedaan te maken. Herstellen activeert precies de berichten die door die samenvatting zijn vervangen, één compressie tegelijk. Een beurt wordt nooit opgesplitst: de berichten die letterlijk blijven beginnen altijd bij een van uw eigen berichten. Elke nieuwe compressie vouwt de vorige samenvatting in de nieuwe, zodat een gesprek één doorlopende samenvatting heeft. Als de samenvatter faalt, gaat de generatie door met de niet-gecomprimeerde geschiedenis en wordt ze niet geblokkeerd.

Bewaar providersleutels per gebruiker

Providerplug-ins kunnen omgevingssleutels lezen, maar voor gedeelde installaties zijn gebruikersreferenties meestal overzichtelijker. Voeg sleutels toe in Settings, zodat elke gebruiker de eigen providertoegang beheert.

Gebruik backendomgevingsvariabelen voor standaardwaarden voor de hele implementatie of voor geautomatiseerde installaties.

Maak toegang op afstand voorspelbaar

Bind voor toegang via een telefoon of LAN de ontwikkelserver aan de netwerkinterface:

npm run dev:host

Open vervolgens op het andere apparaat het LAN- of Tailscale-IP-adres van de computer op poort 8080 (dev:host levert de frontend op 8080, niet op de standaardpoort van Vite). Stel in productie CORS_ORIGIN en de API-URL van de frontend expliciet in, zodat browsers niet terugvallen op localhost.

Controleer uw versie zonder de app te verlaten

Settings → About vergelijkt uw build met de nieuwste GitHub-release. U ziet of u actueel bent, krijgt een koppeling naar de releasepagina als u achterloopt en ziet het wanneer een -dev-build vóór de vastgelegde release draait. Op dezelfde regel staat de knop View changelog, waarmee u de releaseopmerkingen die u na de upgrade zag opnieuw opent. Als Libre WebUI nuttig voor u is, is de koppeling Star on GitHub daar de eenvoudigste manier om anderen het project te laten vinden.

Houd documentatie en interface gelijk

Het product verandert snel. Geef de voorkeur aan duurzame documentatie die gedrag en werkwijzen beschrijft en laat de interface actuele modellenlijsten van providers tonen. Kopieer geen lange providercatalogi naar de documentatie, tenzij de lijst door de app wordt gegenereerd.

Gerelateerde documentatie