Zum Hauptinhalt springen

Profi-Tipps

Diese Seite bündelt praktische, schnelle und verlässliche Arbeitsweisen.

Kleines Alltagsmodell geladen halten

Nutze schnelle lokale Modelle für Routine und größere nur bei Bedarf: gemma4:12b, qwen3.8:27b, gemma4:26b, gemma4:31b sowie nomic-embed-text für Dokumente. Unter Modelle siehst und entlädst du laufende Modelle.

Inkognito-Chat für nicht persistente Unterhaltungen

Starte ihn über +, Befehlspalette, Startseite, Geisterschaltfläche oder /chat?incognito=1. Es entsteht keine Serversitzung, Nachricht oder Historie; ein Reload beginnt leer. Inkognito verhindert Persistenz, nicht die Übertragung an das ausgewählte Modell. Für rein interne Gespräche kombiniere es mit lokalem Ollama.

Tabs über das Kontextmenü verwalten

Rechtsklick oder Shift + F10 bietet Tab schließen, Andere schließen, Rechts schließen und Alle schließen. Start bleibt offen. Administratoren können Benutzerverwaltung, System und Anbieternutzung direkt über + öffnen oder mit dem Avatar-Pin im Seitenleistenfuß befestigen.

Mit der Befehlspalette navigieren

Cmd/Ctrl + K durchsucht Aktionen, Chats und Work-Aufgaben unscharf; autmtn findet Automatisierungen. Ab drei Zeichen werden auch Nachrichten, Notizen und Dokumente einschließlich geteilter Notizen im entschlüsselten Speicher durchsucht, nie als Klartextindex auf dem Datenträger. Navigation: /, Enter, Esc.

Standarddesign

Neue Installationen verwenden ohne hellen Blitz Dunkel. Admins ändern den instanzweiten Standard unter Einstellungen > Benutzerverwaltung > Standarddesign (Hell, Dunkel, Reines Schwarz); er gilt für Anmeldeseite, neue Konten und Browser ohne eigene Wahl. Gespeichertes persönliches Design wird respektiert. Libre WebUI folgt nicht dem Betriebssystem; wechsle mit Cmd/Ctrl + D, der Sonne/Mond-Schaltfläche oder Einstellungen. Der Umschalter wechselt Hell, Dunkel, Reines Schwarz und Himmlisch.

Himmlisch folgt der Sonne: Palette und ein lebendiger Himmel (Sonne oder Mond auf ihrer Bahn, Wolken, Sterne nach der Dämmerung, nachts eine dem Zeiger folgende Lampe) ändern sich minütlich, Sonnenauf- und -untergang wandern übers Jahr. Wählbar unter Einstellungen > Darstellung; ein Regler zeigt dort jede Minute des Tages, Der Uhr folgen kehrt zur Echtzeit zurück. Ohne Standort gilt ein Tag mittlerer Breite; mit geteiltem Standort (oder eingegebenen Koordinaten) werden Auf- und Untergang für deinen echten Himmel berechnet. Der Standort wird auf rund einen Kilometer gerundet, bleibt nur in diesem Browser und geht nie an den Server. Mit Standort lässt sich zudem Wetter abbilden aktivieren: Die aktuellen Bedingungen kommen direkt von Open-Meteo in den Browser; Wolken, Regen, Schnee, Nebel und Wind formen den Himmel.

Work-Aufgaben fokussiert halten

Nutze je Projekt/Ziel eine Aufgabe. Unterhaltung, Containeridentität und Dateien sind getrennt, benannte Volumes bleiben bei Containerneuerstellung erhalten. Nenne Ergebnis, Einschränkungen, Verifikation und unveränderliche Dateien. Prüfe Aktivität, Dateien, Git, Terminal, Vorschau; Cmd/Ctrl + S speichert, Shift + Alt + F formatiert. Remote-Modelle sparen lokalen Speicher, können aber mehrfach kosten und Toolergebnisse mit Workspace-Daten erhalten. Stoppen erhält, Löschen vernichtet den Workspace.

Personas für wiederholbare Arbeit verwenden

Personas speichern Modell, System-Prompt, Parameter, Avatar/Hintergrund sowie optionale Gedächtnis-/Mutationswerte und lassen sich als JSON austauschen. Beispiele sind Code-Review, Redaktion, Recherche und Support.

Dauerhafte Notizen neben der Arbeit

Notizen sind chatunabhängig, unterstützen Markdown, Suche und Autosave. SVG/HTML werden sicher bereinigt. Werkzeuge bieten Revisionen, Wiederherstellung, Anhänge, Pins, Lese-/Schreibfreigaben, Export und KI-Diffs mit vorherigem Snapshot. Notizen liegen im Benutzerarchiv; Revisionen und Anhänge bleiben nur auf der Instanz.

Artefakte zuverlässiger machen

Libre WebUI erkennt Tags, Codeblöcke, eigenständiges HTML und Mehrdatei-Pakete. Bitte das Modell:

Create one complete self-contained HTML file.
Inline the CSS and JavaScript.
Do not rely on external files unless they are CDN URLs.

Separate Blöcke klar benennen:

```html filename="index.html"
...
```

```css filename="style.css"
...
```

```js filename="app.js"
...
```

Lokales CSS/JavaScript wird nach Möglichkeit in die HTML-Vorschau gebündelt.

Prompts während einer Antwort einreihen

Senden während der Generierung reiht ein. Einträge lassen sich bearbeiten, sortieren und löschen und werden nacheinander gesendet. Die Warteschlange wird mit dem Chat gespeichert.

Unterhaltung verzweigen

Die Verzweigungsschaltfläche kopiert den Verlauf bis zur Nachricht einschließlich Varianten in einen neuen Chat und vermerkt den Ursprung. Das Original bleibt unverändert.

Modelle in einem Turn vergleichen

Die Spaltenschaltfläche sendet den nächsten Prompt an bis zu drei weitere Modelle. Jede Generierung hat eigenes Label, Statistik und Abbruch; langsame Modelle blockieren andere nicht.

Dokumentenchat bewusst einsetzen

Unterstützt PDF, Office (DOCX/PPTX/XLSX), Markdown, HTML, Code und CSV bis 10 MB. BM25 ist immer verfügbar; hybride Suche verbindet semantische und Stichwort-Ranglisten bei aktivierten Embeddings.

ollama pull nomic-embed-text

Lade fokussierte Dokumente statt großer Mischsammlungen.

Generierungseinstellungen abstimmen

EinstellungPraktischer Einsatz
TemperaturNiedrig für Genauigkeit, hoch für Kreativität
Top P / Top KStandard belassen, außer bei bewusstem Sampling
KontextfensterNur bei ausreichendem Modell/Speicher erhöhen
Maximale TokensAntworten begrenzen oder für Code erhöhen
WiederholungsstrafeBei Schleifen leicht erhöhen

Zuerst Temperatur senken, dann Kontextdruck, dann Modell wechseln.

Denkaufwand des Modells wählen

Neben dem Modell stehen aus, an, niedrig, mittel, hoch. Der Wert gehört zum Chat, überlebt Reload und Regenerierung; Einstellungen > Generierung setzt neue Standards. Ungesetzt wird nichts gesendet. Ollama erhält den Wert im Body, OpenAI-artige Anbieter Reasoning Effort, Anthropic/Gemini ein Tokenbudget.

Nicht denkfähige Ollama-Modelle erhalten nichts. Benannte Stufen existieren nur bei Modellen wie gpt-oss; ohne Stufen verhalten sie sich wie an. Bei globalem/pinned Standard zeigt der Editor den tatsächlich wirksamen Wert.

Kontextfenster beobachten

Der Ring zeigt Füllstand, Tokens und Fenster, wird nach vier Fünfteln bernsteinfarben und am Limit rot; unbekannte Fenster sind gestrichelt. Gezählt wird die nächste reale Anfrage: kompaktierter Verlauf und verlassene Zweige zählen nicht. Anbieterwerte plus Schätzung von vier Zeichen je Token werden genutzt, ~ markiert Schätzung. Das effektive Fenster ist OLLAMA_MAX_CONTEXT (standardmäßig 32,768), nicht zwingend die Trainingslänge. Anbieter zeigen nur veröffentlichte Fenster.

Lange Chats selbst kompaktieren lassen

Administratoren aktivieren Kontextkompaktierung unter Einstellungen > Generierung. Oberhalb der Schwelle fasst ein Modell ältere Nachrichten zusammen; jüngste bleiben wörtlich, ältere sichtbar aber nicht gesendet. „Neueste Nachrichten“ ist zugleich das Rollfenster.

EinstellungWirkung
Token-SchwelleLöst Kompaktierung aus
Neueste NachrichtenBleiben wörtlich
KompaktierungsmodellStandardmäßig Chatmodell
Eigener Zusammenfassungs-PromptMit {{PREVIOUS_SUMMARY}} und {{MESSAGES}}

Standard ist aus. Jeder Chat kann deaktivieren und jede Karte schrittweise rückgängig machen. Turns werden nicht geteilt; neue Zusammenfassungen integrieren die alte. Bei Fehler läuft der unkompaktierte Verlauf weiter.

Anbieter-Schlüssel pro Benutzer halten

Benutzerzugänge in Einstellungen sind für geteilte Installationen meist sauberer; Umgebungswerte eignen sich für globale Standards.

Remote-Zugriff vorhersehbar machen

npm run dev:host

Öffne die LAN-/Tailscale-IP auf Port 8080. Setze in Produktion CORS_ORIGIN und Frontend-API explizit. dev:host stellt das Frontend dabei auf Port 8080 bereit.

Version in der Anwendung prüfen

Einstellungen → Über vergleicht mit GitHub, verlinkt neuere Releases, erkennt vorausliegende -dev-Builds und bietet Changelog anzeigen sowie Stern auf GitHub.

Dokumentation und UI synchron halten

Beschreibe dauerhafte Verhaltensweisen und überlasse Live-Modelllisten der UI; kopiere keine langen Anbieterlisten.

Verwandte Dokumentation