본문으로 건너뛰기

고급 활용 팁

이 페이지에는 Libre WebUI를 일상적으로 더 빠르고 깔끔하며 안정적으로 사용하는 실용적인 워크플로를 모았습니다.

작은 일상용 모델을 로드한 상태로 유지하기

일상 작업에는 빠른 로컬 모델을 사용하고 작업에 필요할 때만 더 큰 모델로 전환하세요.

좋은 일상용 모델 예시는 다음과 같습니다.

  • 빠른 일상 채팅에는 gemma4:12b
  • 더 강력한 범용 작업에는 qwen3.8:27b
  • 더 큰 하드웨어에서 MoE 효율을 원하면 gemma4:26b
  • 가장 높은 밀집형 로컬 품질에는 gemma4:31b
  • 문서 임베딩에는 nomic-embed-text

모델을 열어 실행 중인 모델을 확인하세요. VRAM이 부족해지면 사용하지 않는 모델을 언로드합니다.

저장하지 않을 대화에는 시크릿 채팅 사용하기

탭 표시줄의 + 메뉴, 명령 팔레트, 홈 페이지 또는 채팅 시작 화면의 유령 버튼에서 시크릿 채팅을 시작하세요. 직접 URL은 /chat?incognito=1입니다.

시크릿 채팅은 절대 저장되지 않습니다. 서버에 세션이 생성되지 않고 메시지도 저장되지 않으며 사이드바나 기록에도 나타나지 않습니다. 채팅에는 비공개 모드 배너("이 대화는 저장되지 않습니다")가 표시됩니다. 저장된 채팅을 열면 시크릿 모드에서 나갑니다. 시크릿 탭을 새로 고치면 새로운 빈 비공개 채팅이 시작되므로 이전 대화는 사라집니다.

경계를 명확히 이해하세요. 시크릿 모드는 영속성만 제어하며 제공자 노출을 막지 않습니다. 로컬이든 원격이든 선택한 모델에는 여전히 전체 대화가 전달되고, 문서 컨텍스트가 활성화되어 있으면 그대로 적용됩니다. 인프라 밖으로 나가면 안 되는 대화에는 시크릿 모드와 로컬 Ollama 모델을 함께 사용하세요.

컨텍스트 메뉴로 탭 관리하기

탭을 마우스 오른쪽 버튼으로 클릭하거나 포커스된 탭에서 Shift + F10을 누르면 다음 항목이 표시됩니다.

  • 탭 닫기
  • 다른 탭 닫기
  • 오른쪽 탭 닫기
  • 모든 탭 닫기

홈은 항상 첫 번째 탭이며 닫을 수 없습니다. 관리자는 + 메뉴에서 사용자 관리, 시스템, 제공자 사용량으로 바로 이동할 수도 있습니다. 아바타 메뉴의 핀 아이콘으로 이 세 항목 중 원하는 항목을 설정 옆 사이드바 바닥글에 고정하면 다시 메뉴를 열 필요가 없습니다.

명령 팔레트로 빠르게 이동하기

Cmd/Ctrl + K를 누르면 작성기에 포커스가 있을 때를 포함해 어디서나 명령 팔레트가 열립니다. 앱 동작, 채팅, Work 작업을 유사 일치 방식으로 검색하므로 일부만 입력하거나 철자가 틀려도 찾을 수 있습니다. autmtn자동화를, "pictures"는 Imagine을, "dark"는 테마 토글을 찾습니다. 세 글자부터는 메시지, 노트 및 문서 내용(공유받은 노트 포함)도 검색하고 각 결과의 일부를 보여 줍니다. 이 검색은 메모리에서 복호화된 사용자의 데이터만 대상으로 하며 디스크에 평문 인덱스를 만들지 않습니다. 일치 문자는 강조되고 결과는 관련성에 따라 정렬됩니다. 검색어가 없으면 가장 최근 채팅과 작업이 표시됩니다. /로 이동하고 Enter로 열며 Esc 또는 Cmd/Ctrl + K를 다시 눌러 닫습니다.

기본 테마

새 설치에서는 첫 화면을 그리기 전에 어두운 테마를 적용하므로 밝은 화면이 번쩍이지 않습니다. 관리자는 설정 > 사용자 관리 > 기본 테마(라이트, 다크, 퓨어 블랙)에서 인스턴스 전체 기본값을 변경할 수 있습니다. 이 기본값은 로그인 페이지에 적용되고 새 계정의 초기값이 되며 아직 테마를 직접 고르지 않은 브라우저에도 적용됩니다. 저장된 개인 설정은 항상 존중됩니다. Libre WebUI는 운영 체제의 테마 설정을 따르지 않습니다. Cmd/Ctrl + D, 해/달 버튼 또는 설정에서 명시적으로 전환하세요. 이 토글은 라이트, 다크, 퓨어 블랙, 천체를 차례로 순환합니다.

천체 테마는 태양을 따릅니다. 색상과 실시간 하늘(호를 그리며 움직이는 해나 달, 구름, 해가 진 뒤의 별, 밤에 포인터를 따라다니는 불빛)이 분 단위로 바뀌고 일출과 일몰 시각도 계절에 따라 이동합니다. 설정 > 외관에서 선택하세요. 그곳의 하루 중 시간 슬라이더로 하루의 어느 시각이든 미리 볼 수 있고 시계 따라가기를 누르면 실제 시간으로 돌아옵니다. 위치가 없으면 중위도의 하루를 가정합니다. 위치를 공유하거나 좌표를 입력하면 일출과 일몰이 실제 하늘에 맞게 계산됩니다. 위치는 약 1km 단위로 반올림되어 해당 브라우저에만 저장되며 서버로 전송되지 않습니다. 위치가 있으면 날씨 반영도 켤 수 있습니다. 현재 날씨는 Open-Meteo에서 브라우저로 바로 전달되고 구름, 비, 눈, 안개, 바람이 하늘을 만듭니다.

Work 작업의 범위를 명확히 하기

프로젝트나 독립적인 목표마다 별도의 Work 작업을 사용하세요. 모든 작업에는 자체 대화, 관리되는 컨테이너 ID 및 영속 파일이 있습니다. 컨테이너 자체가 중지되거나 다시 생성되어도 명명 볼륨은 유지되므로 같은 작업을 재사용하면 유용한 컨텍스트가 보존되고 새 작업을 시작하면 깨끗한 경계가 만들어집니다.

좋은 첫 지시에는 다음이 포함됩니다.

  • 원하는 결과
  • 중요한 기술 또는 디자인 제약
  • 완료 여부를 검증할 명령이나 동작
  • 변경하면 안 되는 파일이나 인터페이스

활동에서 진행 상황을 확인한 다음 파일, Git, 터미널, 미리보기에서 결과를 검토하고 테스트하세요. 파일 편집기는 밝은/어두운 테마의 구문 강조, 브라우저에 저장되는 미저장 초안 및 지원 파일 형식의 서식 지정을 제공합니다. Cmd/Ctrl + S로 저장하고 Shift + Alt + F로 서식을 지정하세요.

모델 트래픽을 설정한 Ollama 인프라 안에 유지하려면 설치된 도구 지원 Ollama 모델을 사용하세요. 원격 또는 클라우드 모델은 로컬 추론 메모리 부담을 줄일 수 있지만 유료 호출을 여러 번 수행할 수 있고 워크스페이스 데이터가 포함될 수 있는 요청된 도구 결과를 받습니다.

실행이나 미리보기를 중지해도 워크스페이스는 유지됩니다. Work 작업을 삭제하면 워크스페이스가 영구적으로 제거되므로 먼저 필요한 항목을 복사해 두세요.

반복 작업에 페르소나 사용하기

반복하는 워크플로에 맞춰 페르소나를 만드세요.

  • 낮은 temperature를 사용하는 간결한 코드 검토자
  • 명확한 스타일 가이드가 있는 글 편집자
  • 문서 검색이 활성화된 리서치 어시스턴트
  • 고정된 어조와 응답 구조를 사용하는 지원 어시스턴트

페르소나는 선택한 모델, 시스템 프롬프트, 생성 매개변수, 아바타/배경 및 선택적 메모리/변형 설정을 저장합니다. JSON으로 내보내고 가져올 수도 있습니다.

작업 옆에 영속 노트 보관하기

정보가 특정 채팅이나 Work 작업과 독립적으로 남아야 한다면 만들기 메뉴에서 노트를 여세요. 노트는 Markdown 미리보기, 명시적 편집, 검색 및 자동 저장을 지원합니다. 미리보기는 노트에 삽입된 인라인 SVG와 기본 HTML도 렌더링하며, 스크립트, 이벤트 처리기 및 안전하지 않은 URL은 실행되지 않도록 정리됩니다. 노트 도구 서랍에는 복원을 지원하는 리비전 기록, 파일 첨부, 고정, 사용자별 공유(보기 또는 편집), Markdown 내보내기 및 모든 제안을 적용 전에 diff로 미리 보여 주는 AI 편집 사이드바가 있습니다. 적용 전에 이전 버전을 먼저 스냅샷으로 저장하므로 AI 편집을 언제든 되돌릴 수 있습니다. 노트는 계정 범위이며 전체 사용자 아카이브에 포함됩니다. 리비전 기록과 첨부 파일은 인스턴스에 남고 아카이브에는 포함되지 않습니다.

Artifacts의 안정성 높이기

Libre WebUI는 명시적인 artifact 태그, 코드 펜스, 독립형 HTML 문서 및 일반적인 다중 파일 HTML 번들을 감지합니다. 모델에서 가장 좋은 artifact 결과를 얻으려면 다음과 같이 요청하세요.

Create one complete self-contained HTML file.
Inline the CSS and JavaScript.
Do not rely on external files unless they are CDN URLs.

별도의 블록을 원하면 이름을 명확히 지정하세요.

```html filename="index.html"
...
```

```css filename="style.css"
...
```

```js filename="app.js"
...
```

Libre WebUI는 로컬 CSS 및 JavaScript 블록을 HTML 미리보기에 묶으려고 시도합니다.

응답 스트리밍 중 프롬프트 대기열 사용하기

생성 중에 보낸 프롬프트는 사라지지 않고 대기열에 들어갑니다. 대기 중인 프롬프트는 작성기 위에 표시되며 편집, 순서 변경 및 제거할 수 있습니다. 각 응답이 끝날 때마다 하나씩 전송됩니다. 대기열은 채팅과 함께 저장되므로 새로 고치거나 다시 연결해도 유지됩니다.

대화 분기하기

메시지의 분기 버튼은 변형을 포함해 해당 지점까지의 대화를 새 채팅으로 복사하고 출처를 기록합니다. 원본은 그대로 유지되므로 탐색용 곁가지가 기본 대화를 흐리지 않습니다.

한 턴에서 모델 비교하기

도구 선택기 옆의 열 버튼은 다음 프롬프트를 최대 세 개의 추가 모델로 보냅니다. 각 응답은 자체 모델 레이블, 통계 및 취소 제어를 갖는 별도의 생성이므로 느리거나 실패한 모델이 다른 모델을 막지 않습니다.

문서 채팅을 목적에 맞게 사용하기

문서 채팅은 최대 10 MB의 PDF, Office(DOCX/PPTX/XLSX), Markdown, HTML, 코드 및 CSV 파일을 허용합니다. 검색은 두 가지 모드로 작동합니다.

  • 키워드 검색(BM25)은 항상 사용할 수 있습니다.
  • 설정에서 임베딩을 활성화하고 임베딩 모델을 사용할 수 있으면 하이브리드 검색이 시맨틱 및 키워드 순위를 결합합니다.

간편한 로컬 임베딩 모델이 필요하면 nomic-embed-text를 설치하세요.

ollama pull nomic-embed-text

최상의 결과를 얻으려면 하나의 거대한 혼합 문서 세트 대신 채팅마다 범위가 명확한 문서를 업로드하세요.

생성 설정 조정하기

설정실용적인 용도
Temperature정확성을 높이려면 낮추고 창의적 탐색에는 높임
Top P / Top K의도적으로 샘플링을 조정하는 경우가 아니라면 기본값 유지
컨텍스트 창모델과 메모리가 처리할 수 있는 경우에만 긴 채팅에서 늘림
최대 토큰긴 답변을 제한하거나 코드/artifact 생성에 맞춰 늘림
반복 페널티모델이 반복할 때 조금 높임

모델의 동작이 좋지 않으면 먼저 temperature를 낮추고, 컨텍스트 부담을 줄인 다음, 다른 모델을 시도하세요.

모델의 추론 강도 결정하기

작성기에서 모델 이름 옆의 제어를 누르면 추론 수준인 끄기, 켜기, 낮음, 중간, 높음이 열립니다. 선택은 대화에 속하므로 새로 고친 뒤에도 유지되고 재생성에도 적용됩니다. 설정 > 생성에는 새 응답의 기본값이 있으며 채팅 제어 패널에도 같은 값이 표시됩니다.

설정하지 않으면 아무 값도 전송되지 않으며 이전 릴리스의 동작과 같습니다. 값을 설정하면 서버는 응답하는 제공자에 맞게 하나의 값을 변환합니다. Ollama는 요청 본문으로 받고, OpenAI 방식 제공자는 reasoning effort로, Anthropic과 Gemini는 답변 공간을 남긴 토큰 예산으로 받습니다.

두 가지를 알아 두세요. Ollama가 추론할 수 없다고 보고한 모델에는 설정을 전혀 보내지 않으므로 제어도 표시되지 않습니다. 그리고 이름 있는 수준은 gpt-oss처럼 이를 게시하는 모델에만 존재합니다. 수준 없이 추론하는 모델에서는 이름 있는 수준이 단순히 켜기처럼 작동하므로 모델을 바꾸는 채팅에서도 오류가 발생하지 않습니다. 전역 또는 고정된 기본값이 설정되면 작성기 버튼은 다음 응답이 실제로 사용할 수준을 보여 주고, "기본값" 항목은 현재 해석되는 값을 표시합니다.

컨텍스트 창 확인하기

모델 이름 옆의 원은 대화가 길어질수록 채워집니다. 마우스를 올리면 창의 사용 비율, 사용된 토큰 및 기준 창 크기를 볼 수 있습니다. 5분의 4를 넘으면 황색, 창 한계에서는 빨간색으로 바뀝니다. 창 크기를 알 수 없는 모델에는 빈 원 대신 점선 원이 표시됩니다.

카운트는 다음 요청에서 실제로 보낼 내용을 기준으로 합니다. 압축된 기록과 버려진 분기는 비용에 포함되지 않습니다. 제공자가 마지막 응답에서 토큰 수를 보고했다면 그 측정값을 기준으로 삼고, 이후 대화에 추가된 내용은 토큰당 4자로 추정합니다. 아직 측정값이 없으면 ~가 표시됩니다. 모델의 학습 크기보다 낮게 제한된 창은 그 사실을 표시합니다. 미터는 모델의 전체 학습 길이가 아니라 요청이 실제로 실행되는 창을 측정하며, 이는 기본값 32,768인 OLLAMA_MAX_CONTEXT입니다. 변수를 높이면 실제 창과 미터가 함께 변경됩니다.

제공자 모델은 모델 목록에서 창 크기를 게시할 때만 창이 표시됩니다. 게시하지 않아도 미터는 토큰을 계속 세지만 나눌 기준이 없습니다.

긴 채팅을 자동으로 압축하기

관리자는 설정 > 생성에서 컨텍스트 압축을 켤 수 있습니다. 대화의 추정 컨텍스트가 토큰 임계값을 넘으면 서버가 모델에 이전 메시지의 요약을 요청하고 가장 최근 메시지만 원문 그대로 유지합니다. 요약은 기록이 접힌 지점에 대화 요약 카드로 나타나고 요약된 메시지는 흐리게 표시됩니다. 계속 읽을 수 있지만 모델에는 더 이상 전송되지 않습니다. 압축을 켜면 "유지할 최근 메시지" 수가 대화가 보내는 롤링 창이 되므로 값을 높이면 모델이 실제로 더 많은 내용을 봅니다.

설정제어 대상
토큰 임계값압축을 시작하는 추정 컨텍스트 크기
유지할 최근 메시지항상 원문 그대로 유지할 최신 메시지 수
압축 모델요약을 작성할 모델. 기본값은 대화 자체 모델
사용자 지정 요약 프롬프트{{PREVIOUS_SUMMARY}}{{MESSAGES}}를 포함하는 사용자 지시

압축은 기본적으로 꺼져 있고 서버의 모든 사용자에게 적용되지만 각 채팅에서 선택할 수 있습니다. 채팅 제어 패널에서 특정 대화의 압축을 끌 수 있고 모든 요약 카드에는 실행 취소가 있습니다. 복원하면 한 번의 압축마다 해당 요약이 대체한 메시지만 정확히 다시 활성화됩니다. 턴 중간을 나누지 않으며 원문으로 유지하는 메시지는 항상 사용자의 메시지에서 시작합니다. 새 압축은 이전 요약을 새 요약에 포함하므로 대화에는 하나의 누적 요약만 유지됩니다. 요약 모델이 실패하면 생성이 막히지 않고 압축되지 않은 기록으로 계속됩니다.

제공자 키를 사용자별로 관리하기

제공자 플러그인은 환경 키를 읽을 수 있지만 공유 설치에서는 사용자 수준 자격 증명이 대개 더 깔끔합니다. 설정에서 키를 추가해 각 사용자가 자신의 제공자 접근을 제어하게 하세요.

배포 전체 기본값이나 자동화된 설치에는 백엔드 환경 변수를 사용하세요.

원격 접근을 예측 가능하게 만들기

휴대폰이나 LAN에서 접근하려면 개발 서버를 네트워크 인터페이스에 바인딩하세요.

npm run dev:host

그런 다음 다른 기기에서 컴퓨터의 LAN 또는 Tailscale IP 포트 8080을 여세요(dev:host는 Vite 기본 포트가 아니라 8080에서 프런트엔드를 제공합니다). 프로덕션에서는 브라우저가 localhost로 대체하지 않도록 CORS_ORIGIN과 프런트엔드 API URL을 명시적으로 설정하세요.

앱을 떠나지 않고 버전 확인하기

설정 → 정보는 빌드를 최신 GitHub 릴리스와 비교합니다. 최신 상태인지 알려 주고, 뒤처진 경우 릴리스 페이지로 연결하며, -dev 빌드가 고정된 릴리스보다 앞서 실행 중일 때도 표시합니다. 같은 줄의 변경 기록 보기 버튼은 업그레이드 후 보았던 릴리스 노트를 다시 엽니다. Libre WebUI가 유용하다면 그곳의 GitHub에서 별표 표시 링크가 다른 사람이 프로젝트를 찾도록 돕는 가장 쉬운 방법입니다.

문서와 UI를 일치시키기

제품은 빠르게 변합니다. 동작과 워크플로를 설명하는 오래 유지될 문서를 우선하고 제공자의 실시간 모델 목록은 UI에서 보여 주게 하세요. 앱에서 생성한 목록이 아니라면 긴 제공자 카탈로그를 문서에 복사하지 마세요.

관련 문서