⚡ HomelabVergleich

Paperless-ngx einrichten: Schritt-für-Schritt-Anleitung (2026)

Stapelweise Papierkram, verlegte Rechnungen und die ewige Suche nach „diesem einen Beleg": Mit Paperless-ngx digitalisierst du deine Dokumente, machst sie per Volltextsuche durchsuchbar und räumst deinen Schreibtisch auf – komplett selbst gehostet und ohne Cloud-Abo. In dieser Schritt-für-Schritt-Anleitung zeigen wir dir, wie du Paperless-ngx per Docker einrichtest, deinen Scanner anbindest und deine Ablage automatisierst.

Was ist Paperless-ngx?

Paperless-ngx ist ein quelloffenes Dokumenten-Management-System, das Papierdokumente digitalisiert, archiviert und durchsuchbar macht. Es ist der aktiv gepflegte Nachfolger des ursprünglichen Paperless-Projekts und steht unter der GPL-3.0-Lizenz – du kannst es also kostenlos und ohne Herstellerbindung auf eigener Hardware betreiben.

Der Kern des Systems: Du legst Dokumente als Scan oder PDF in einen Überwachungsordner, und Paperless-ngx übernimmt den Rest. Es extrahiert den Text per OCR (optische Zeichenerkennung), erkennt Datum und Korrespondenten und sortiert die Datei automatisch in dein Archiv ein. Über die Weboberfläche durchsuchst du später alle Dokumente in Sekunden statt in Aktenordnern zu blättern.

Warum deine Belege digitalisieren?

Der praktische Nutzen zeigt sich vor allem bei der Volltextsuche. Statt jede Rechnung von Hand zu wälzen, tippst du einfach „Stromrechnung 2025" in die Suche – Paperless-ngx findet das Dokument, weil es den kompletten Inhalt indexiert hat. Das funktioniert auch bei gescannten Dokumenten, da der OCR-Text mitgespeichert wird.

Dazu kommen weitere Vorteile:

Installation per Docker

Der schnellste Weg führt über Docker Compose. Paperless-ngx besteht aus mehreren Diensten, die zusammenarbeiten: dem Webserver selbst, einem Redis-Broker für die Warteschlange sowie Gotenberg und Apache Tika für die Verarbeitung von Office-Dateien. Speichere folgende Konfiguration als docker-compose.yml:


services:
  broker:
    image: docker.io/library/redis:7
    restart: unless-stopped
    volumes:
      - redisdata:/data

  webserver:
    image: ghcr.io/paperless-ngx/paperless-ngx:latest
    restart: unless-stopped
    depends_on:
      - broker
      - gotenberg
      - tika
    ports:
      - "8000:8000"
    volumes:
      - data:/usr/src/paperless/data
      - media:/usr/src/paperless/media
      - ./export:/usr/src/paperless/export
      - ./consume:/usr/src/paperless/consume
    environment:
      PAPERLESS_REDIS: redis://broker:6379
      PAPERLESS_OCR_LANGUAGE: deu
      PAPERLESS_SECRET_KEY: bitte-aendern
      PAPERLESS_TIME_ZONE: Europe/Berlin

  gotenberg:
    image: docker.io/gotenberg/gotenberg:8
    restart: unless-stopped
    command:
      - "gotenberg"
      - "--chromium-disable-javascript=true"

  tika:
    image: ghcr.io/paperless-ngx/tika:latest
    restart: unless-stopped

volumes:
  data:
  media:
  redisdata:

Gestartet wird der Stack mit:


docker compose up -d

Danach erreichst du die Oberfläche unter http://deine-ip:8000. Beim ersten Start legst du ein Admin-Konto an. Wie Docker grundsätzlich funktioniert, erklärt unser [Docker-Einsteiger-Guide](docker-einsteiger.md). Wichtig: Ersetze den Platzhalter bei PAPERLESS_SECRET_KEY durch einen langen, zufälligen Wert – er schützt deine Sitzungen.

Erste Schritte: Scanner, Tags und Dokumenttypen

Nach der Anmeldung richtest du die Grundstruktur ein, bevor die ersten Dokumente eintreffen:

1. Korrespondenten anlegen: Das sind die Absender oder Empfänger deiner Dokumente, etwa „Stadtwerke" oder „Versicherung".

2. Dokumenttypen definieren: Beispiele sind Rechnung, Vertrag, Kontoauszug oder Bescheid.

3. Tags vergeben: Tags bündeln Dokumente themenübergreifend, etwa „Steuer 2026" oder „Wohnung".

Diese drei Bausteine nutzt Paperless-ngx, um eingehende Dokumente automatisch zu kategorisieren. Anschließend richtest du die Konsumenten ein, die bestimmen, woher neue Dokumente kommen. Der einfachste Weg ist der Überwachungsordner ./consume: Alles, was du dort ablegst, wird automatisch importiert. Viele Nutzer koppeln daran ein Netzwerkverzeichnis ihres Scanners – so genügt ein Knopfdruck am Gerät, und das Dokument landet direkt im Archiv.

OCR für gescannte Dokumente

Damit gescannte Briefe durchsuchbar werden, läuft die Texterkennung über Tesseract. Über die Variable PAPERLESS_OCR_LANGUAGE: deu ist bereits die deutsche Spracherkennung aktiviert; für mehrsprachige Dokumente kannst du mehrere Sprachen kombiniert angeben (etwa deu+eng). Gescannte PDFs und Bilder werden beim Import automatisch per OCR verarbeitet, der erkannte Text wird mit dem Dokument gespeichert und indexiert.

Für Office-Dateien wie Word- oder Excel-Dokumente sind Gotenberg und Tika zuständig: Sie wandeln die Dateien in PDFs um und extrahieren den Text, damit auch diese Formate voll durchsuchbar sind.

Konsumenten und Speicherpfade

Neben dem Überwachungsordner bringt Paperless-ngx weitere Konsumenten mit. Per E-Mail-Konsument kannst du Dokumente als Anhang an eine eigene Mail-Adresse senden, die automatisch verarbeitet werden. Über die REST-API bindest du eigene Skripte oder Apps an.

Die Speicherpfade legst du über die Volumes in der Compose-Datei fest. Die Medien selbst liegen im Volume media, die Suchdatenbank und Konfiguration in data. Der Export-Ordner hält deine Original-PDFs für ein einfaches Backup bereit – sichere diese Verzeichnisse regelmäßig, etwa mit einem Cron-Job.

Fazit

Paperless-ngx ist die ideale Lösung, um deine Papierflut dauerhaft in den Griff zu bekommen: selbst gehostet, kostenlos und mit mächtiger Volltextsuche. Dank Docker Compose steht der komplette Stack in wenigen Minuten, und mit Scanner-Anbindung, Tags und OCR läuft die Ablage danach weitgehend automatisch.

FAQ

Ist Paperless-ngx kostenlos?

Ja. Paperless-ngx ist Open Source unter der GPL-3.0-Lizenz und kann ohne Lizenzkosten auf eigener Hardware betrieben werden.

Welche Hardware brauche ich?

Paperless-ngx läuft bereits auf einem Raspberry Pi 4 oder einem kleinen Mini-PC. Der größte Bedarf entsteht durch die OCR-Verarbeitung, daher helfen bei vielen Scans 2 bis 4 GB RAM.

Kann ich Dokumente auch von unterwegs erreichen?

Ja, über einen VPN-Zugang wie [WireGuard](wireguard-homelab.md) oder einen abgesicherten Reverse-Proxy mit HTTPS. Den Dienst selbst solltest du nicht ungeschützt ins Internet stellen.

Was passiert mit meinen Originaldokumenten?

Deine Scans werden im media-Volume gespeichert und bleiben vollständig in deiner Hand. Nach der Digitalisierung kannst du die Papieroriginale entsorgen – viele Nutzer heben sie aber aus rechtlichen Gründen zusätzlich auf.

Erkennt Paperless-ngx handschriftliche Dokumente?

Die OCR über Tesseract ist auf gedruckten Text optimiert. Handschrift wird nur unzuverlässig erkannt; für gute Ergebnisse eignen sich maschinell erstellte Dokumente am besten.