Paperless-ngx einrichten: Schritt-für-Schritt-Anleitung (2026)
Stapelweise Papierkram, verlegte Rechnungen und die ewige Suche nach „diesem einen Beleg": Mit Paperless-ngx digitalisierst du deine Dokumente, machst sie per Volltextsuche durchsuchbar und räumst deinen Schreibtisch auf – komplett selbst gehostet und ohne Cloud-Abo. In dieser Schritt-für-Schritt-Anleitung zeigen wir dir, wie du Paperless-ngx per Docker einrichtest, deinen Scanner anbindest und deine Ablage automatisierst.
Was ist Paperless-ngx?
Paperless-ngx ist ein quelloffenes Dokumenten-Management-System, das Papierdokumente digitalisiert, archiviert und durchsuchbar macht. Es ist der aktiv gepflegte Nachfolger des ursprünglichen Paperless-Projekts und steht unter der GPL-3.0-Lizenz – du kannst es also kostenlos und ohne Herstellerbindung auf eigener Hardware betreiben.
Der Kern des Systems: Du legst Dokumente als Scan oder PDF in einen Überwachungsordner, und Paperless-ngx übernimmt den Rest. Es extrahiert den Text per OCR (optische Zeichenerkennung), erkennt Datum und Korrespondenten und sortiert die Datei automatisch in dein Archiv ein. Über die Weboberfläche durchsuchst du später alle Dokumente in Sekunden statt in Aktenordnern zu blättern.
Warum deine Belege digitalisieren?
Der praktische Nutzen zeigt sich vor allem bei der Volltextsuche. Statt jede Rechnung von Hand zu wälzen, tippst du einfach „Stromrechnung 2025" in die Suche – Paperless-ngx findet das Dokument, weil es den kompletten Inhalt indexiert hat. Das funktioniert auch bei gescannten Dokumenten, da der OCR-Text mitgespeichert wird.
Dazu kommen weitere Vorteile:
- Kein Papierchaos: Post, Belege und Verträge landen direkt im Scanner und danach im digitalen Archiv.
- Volle Datenhoheit: Deine sensiblen Unterlagen bleiben auf deinem eigenen Server statt bei einem Cloud-Anbieter.
- Automatische Ablage: Tags, Dokumenttypen und Korrespondenten werden anhand deiner Regeln vergeben.
- Kostenlos erweiterbar: Durch die offene Architektur lassen sich Workflows an deine Bedürfnisse anpassen.
Installation per Docker
Der schnellste Weg führt über Docker Compose. Paperless-ngx besteht aus mehreren Diensten, die zusammenarbeiten: dem Webserver selbst, einem Redis-Broker für die Warteschlange sowie Gotenberg und Apache Tika für die Verarbeitung von Office-Dateien. Speichere folgende Konfiguration als docker-compose.yml:
services:
broker:
image: docker.io/library/redis:7
restart: unless-stopped
volumes:
- redisdata:/data
webserver:
image: ghcr.io/paperless-ngx/paperless-ngx:latest
restart: unless-stopped
depends_on:
- broker
- gotenberg
- tika
ports:
- "8000:8000"
volumes:
- data:/usr/src/paperless/data
- media:/usr/src/paperless/media
- ./export:/usr/src/paperless/export
- ./consume:/usr/src/paperless/consume
environment:
PAPERLESS_REDIS: redis://broker:6379
PAPERLESS_OCR_LANGUAGE: deu
PAPERLESS_SECRET_KEY: bitte-aendern
PAPERLESS_TIME_ZONE: Europe/Berlin
gotenberg:
image: docker.io/gotenberg/gotenberg:8
restart: unless-stopped
command:
- "gotenberg"
- "--chromium-disable-javascript=true"
tika:
image: ghcr.io/paperless-ngx/tika:latest
restart: unless-stopped
volumes:
data:
media:
redisdata:
Gestartet wird der Stack mit:
docker compose up -d
Danach erreichst du die Oberfläche unter http://deine-ip:8000. Beim ersten Start legst du ein Admin-Konto an. Wie Docker grundsätzlich funktioniert, erklärt unser [Docker-Einsteiger-Guide](docker-einsteiger.md). Wichtig: Ersetze den Platzhalter bei PAPERLESS_SECRET_KEY durch einen langen, zufälligen Wert – er schützt deine Sitzungen.
Erste Schritte: Scanner, Tags und Dokumenttypen
Nach der Anmeldung richtest du die Grundstruktur ein, bevor die ersten Dokumente eintreffen:
1. Korrespondenten anlegen: Das sind die Absender oder Empfänger deiner Dokumente, etwa „Stadtwerke" oder „Versicherung".
2. Dokumenttypen definieren: Beispiele sind Rechnung, Vertrag, Kontoauszug oder Bescheid.
3. Tags vergeben: Tags bündeln Dokumente themenübergreifend, etwa „Steuer 2026" oder „Wohnung".
Diese drei Bausteine nutzt Paperless-ngx, um eingehende Dokumente automatisch zu kategorisieren. Anschließend richtest du die Konsumenten ein, die bestimmen, woher neue Dokumente kommen. Der einfachste Weg ist der Überwachungsordner ./consume: Alles, was du dort ablegst, wird automatisch importiert. Viele Nutzer koppeln daran ein Netzwerkverzeichnis ihres Scanners – so genügt ein Knopfdruck am Gerät, und das Dokument landet direkt im Archiv.
OCR für gescannte Dokumente
Damit gescannte Briefe durchsuchbar werden, läuft die Texterkennung über Tesseract. Über die Variable PAPERLESS_OCR_LANGUAGE: deu ist bereits die deutsche Spracherkennung aktiviert; für mehrsprachige Dokumente kannst du mehrere Sprachen kombiniert angeben (etwa deu+eng). Gescannte PDFs und Bilder werden beim Import automatisch per OCR verarbeitet, der erkannte Text wird mit dem Dokument gespeichert und indexiert.
Für Office-Dateien wie Word- oder Excel-Dokumente sind Gotenberg und Tika zuständig: Sie wandeln die Dateien in PDFs um und extrahieren den Text, damit auch diese Formate voll durchsuchbar sind.
Konsumenten und Speicherpfade
Neben dem Überwachungsordner bringt Paperless-ngx weitere Konsumenten mit. Per E-Mail-Konsument kannst du Dokumente als Anhang an eine eigene Mail-Adresse senden, die automatisch verarbeitet werden. Über die REST-API bindest du eigene Skripte oder Apps an.
Die Speicherpfade legst du über die Volumes in der Compose-Datei fest. Die Medien selbst liegen im Volume media, die Suchdatenbank und Konfiguration in data. Der Export-Ordner hält deine Original-PDFs für ein einfaches Backup bereit – sichere diese Verzeichnisse regelmäßig, etwa mit einem Cron-Job.
Fazit
Paperless-ngx ist die ideale Lösung, um deine Papierflut dauerhaft in den Griff zu bekommen: selbst gehostet, kostenlos und mit mächtiger Volltextsuche. Dank Docker Compose steht der komplette Stack in wenigen Minuten, und mit Scanner-Anbindung, Tags und OCR läuft die Ablage danach weitgehend automatisch.
FAQ
Ist Paperless-ngx kostenlos?
Ja. Paperless-ngx ist Open Source unter der GPL-3.0-Lizenz und kann ohne Lizenzkosten auf eigener Hardware betrieben werden.
Welche Hardware brauche ich?
Paperless-ngx läuft bereits auf einem Raspberry Pi 4 oder einem kleinen Mini-PC. Der größte Bedarf entsteht durch die OCR-Verarbeitung, daher helfen bei vielen Scans 2 bis 4 GB RAM.
Kann ich Dokumente auch von unterwegs erreichen?
Ja, über einen VPN-Zugang wie [WireGuard](wireguard-homelab.md) oder einen abgesicherten Reverse-Proxy mit HTTPS. Den Dienst selbst solltest du nicht ungeschützt ins Internet stellen.
Was passiert mit meinen Originaldokumenten?
Deine Scans werden im media-Volume gespeichert und bleiben vollständig in deiner Hand. Nach der Digitalisierung kannst du die Papieroriginale entsorgen – viele Nutzer heben sie aber aus rechtlichen Gründen zusätzlich auf.
Erkennt Paperless-ngx handschriftliche Dokumente?
Die OCR über Tesseract ist auf gedruckten Text optimiert. Handschrift wird nur unzuverlässig erkannt; für gute Ergebnisse eignen sich maschinell erstellte Dokumente am besten.