Die Bilder des Beitrags sind mit KI generiert.

Paperless-ngx ist ein selbst betreibbares Dokumentenmanagementsystem. Es nimmt digitale Dokumente und Scans entgegen, verarbeitet deren Inhalt, macht sie durchsuchbar und unterstützt ihre Ordnung mit Metadaten wie Schlagwörtern, Korrespondenten und Dokumenttypen. Das Projekt ist ein gemeinschaftlich betreuter Nachfolger von Paperless und Paperless-ng.

 

Paperless-ngx im Überblick
Zweck Dokumente erfassen, erschließen, suchen und verwalten
Betriebsmodell Selbst gehostete Anwendung, unter anderem mit Docker Compose installierbar
Wichtige Bestandteile Weboberfläche, Dokumentenverarbeitung, Datenbank, Dateispeicher und Redis-kompatibler Nachrichten-Broker
Lizenz GPL-3.0 laut Projektverzeichnis

Die Angaben zu Betrieb, Komponenten und Lizenz beruhen auf der Projektdokumentation und dem offiziellen Repository.

Wie Paperless-ngx arbeitet

Ein typischer Ablauf beginnt mit einer Datei, die über die Weboberfläche hochgeladen oder in ein überwachtes Eingangsverzeichnis gelegt wird. Paperless-ngx verarbeitet sie im Hintergrund. Bei gescannten Seiten ist die optische Zeichenerkennung (OCR) besonders wichtig: Sie gewinnt Text aus dem Bild, sodass sich ein Scan später anhand seines Inhalts finden lässt. Für die OCR-Verarbeitung nennt die Installationsdokumentation unter anderem OCRmyPDF und Tesseract. OCR kann allerdings nur den erkennbaren Inhalt erschließen; schiefe, unscharfe oder abgeschnittene Scans bleiben eine mögliche Fehlerquelle.

Zur Ordnung dienen beispielsweise Korrespondenten für Absender oder Geschäftspartner, Dokumenttypen für Arten von Unterlagen sowie Schlagwörter für frei wählbare Themen. Speicherpfade können die Ablage der Dateien strukturieren. Solche Metadaten ergänzen die Inhaltssuche: Ein Dokument kann etwa über einen Begriff im Text oder über seine Zuordnung gefunden werden. Für wiederkehrende Vorgänge stehen automatische Zuordnungen und Workflows zur Verfügung; deren Ergebnisse sollten bei wichtigen Unterlagen kontrolliert werden.

Erfassung und Organisation in der Praxis

Bausteine eines dokumentierten Arbeitsablaufs
Baustein Nutzen Worauf zu achten ist
Web-Upload Einzelne vorhandene Dateien direkt hinzufügen Nach dem Import Titel, Datum und Zuordnungen prüfen
Eingangsverzeichnis Scans oder Dateien aus einem festgelegten Ordner automatisch übernehmen Der Dienst benötigt passende Dateirechte; bei manchen Netzlaufwerken ist statt Dateisystembenachrichtigungen ein Abfrageintervall nötig
E-Mail-Verarbeitung Dokumente über konfigurierte E-Mail-Konten und Regeln zuführen Postfachzugang und Auswahlregeln sorgfältig festlegen
Metadaten und Workflows Wiederkehrende Zuordnungen und Bearbeitungsschritte vereinheitlichen Regeln zunächst mit Beispieldokumenten prüfen

Das Eingangsverzeichnis und die Besonderheit von Dateisystemen ohne inotify-Unterstützung sind in der Installationsanleitung beschrieben. Die Dokumentation behandelt außerdem E-Mail-Regeln, automatische Zuordnung und Workflows.

Für einen übersichtlichen Start genügt oft ein kleines Ordnungsschema: wenige klar unterschiedene Dokumenttypen, eindeutige Korrespondenten und Schlagwörter, nach denen tatsächlich gesucht werden soll. Bevor größere Altbestände importiert werden, empfiehlt sich ein Probelauf mit verschiedenartigen Scans und bereits digitalen Dateien. So lassen sich OCR-Sprache, Benennung und Zugriffsrechte prüfen, ohne eine große Sammlung nachträglich korrigieren zu müssen.

Installation und technische Voraussetzungen

Die Projektdokumentation beschreibt sowohl eine Installation mit Docker Compose als auch eine Installation ohne Container. Für neue Installationen empfiehlt sie PostgreSQL als Datenbank-Backend. Zusätzlich benötigt Paperless-ngx einen Redis-kompatiblen Broker für Hintergrund- und geplante Aufgaben; in den mitgelieferten Compose-Dateien wird dafür standardmäßig Valkey verwendet. Die Anwendung braucht außerdem dauerhaften Speicher für Dokumente und Anwendungsdaten.

Bei der Compose-Installation werden die Projektdateien für das gewählte Datenbank-Backend heruntergeladen, Verzeichnisse und Einstellungen angepasst und die Container anschließend gestartet. Nach dem ersten Aufruf der Weboberfläche wird ein Superuser-Konto angelegt. Wichtig ist, die Pfade für Eingangsordner, Mediendateien und Daten bewusst zu wählen: Dateien innerhalb eines flüchtigen Containers sind kein geeigneter dauerhafter Dokumentenspeicher. Für den Zugriff des Containers auf Host-Verzeichnisse beschreibt die Anleitung unter anderem die Einstellungen USERMAP_UID und USERMAP_GID.

Die OCR-Sprache sollte zu den überwiegend verarbeiteten Dokumenten passen. Die Dokumentation nennt dafür PAPERLESS_OCR_LANGUAGE; zusätzlich müssen die benötigten Sprachdaten verfügbar sein. Einstellungen können je nach Installationsart an unterschiedlichen Stellen liegen. Bei Docker verweist das Projekt auf die Compose-Umgebungsdatei statt auf paperless.conf.

Suche, Benutzer und Schnittstellen

Paperless-ngx bietet eine Weboberfläche für die tägliche Arbeit und eine dokumentierte REST-API für Integrationen. Über die API lassen sich Funktionen beispielsweise aus eigenen Skripten ansprechen; dafür sind Authentifizierung und die jeweiligen Berechtigungen zu beachten. API-Zugangsdaten sollten wie andere Geheimnisse geschützt werden.

Bei mehreren Benutzern unterscheidet das System zwischen globalen Berechtigungen für Anwendungsbereiche und objektbezogenen Berechtigungen für einzelne Dokumente oder Metadaten. Superuser können alle Dokumente und Bereiche sehen. Eine wichtige Besonderheit: Dokumente, die über das Eingangsverzeichnis erfasst werden, erhalten laut Dokumentation standardmäßig keinen Eigentümer und keine zusätzlichen Berechtigungen; dies lässt sich über Workflows steuern. Wer vertrauliche Unterlagen verschiedener Personen trennt, sollte dieses Verhalten vor dem produktiven Einsatz prüfen. Die Berechtigung eines Schlagworts überträgt sich nicht automatisch auf Dokumente mit diesem Schlagwort.

Datenschutz und Absicherung

Selbsthosting gibt Betreibern Kontrolle über den gewählten Server und Speicherort, verlagert aber auch die Verantwortung für Updates, Zugriffsrechte, Sicherungen und die Netzwerksicherheit auf sie. Besonders sensible Dokumente sollten nicht ohne durchdachtes Zugangskonzept über das öffentliche Internet erreichbar sein. Für öffentlich erreichbare Installationen weist die Konfigurationsdokumentation ausdrücklich auf die Einstellung erlaubter Hostnamen hin; sie warnt ebenso davor, die automatische Anmeldung in diesem Fall zu aktivieren. Bei einer Anmeldung über vorgeschaltete Systeme müssen weitergereichte Benutzer-Header vor Manipulation geschützt werden.

Ein starkes, dauerhaft verwahrtes PAPERLESS_SECRET_KEY ist für den Betrieb erforderlich. Werden Dokumente über eine öffentlich erreichbare Verbindung aufgerufen, ist außerdem eine sichere HTTPS-Konfiguration des Zugangs wichtig. Im Alltag sollten normale Benutzerkonten nur die nötigen Rechte erhalten; insbesondere ist die anwendungsweite Konfigurationsberechtigung laut Dokumentation als Administratorrecht zu behandeln.

Datensicherung, Wiederherstellung und Updates

Eine Sicherung muss Dokumentdateien und zugehörige Daten erfassen. Die Projektverwaltung beschreibt dafür mehrere Wege: den Dokumenten-Exporter, die Sicherung der Docker-Volumes oder – bei anderen Installationsarten – die Sicherung der Anwendungsverzeichnisse samt gegebenenfalls separat betriebener Datenbank. Ein Export enthält Dokumente, Vorschaubilder, Metadaten und Datenbankinhalte; API-Tokens sind davon ausgenommen und müssen nach einem Import neu erzeugt werden.

Eine erstellte Sicherung ist erst dann verlässlich, wenn ihre Wiederherstellung geprüft wurde. Dabei ist eine Einschränkung des Exporters wichtig: Laut Dokumentation lässt sich sein Export nicht in eine abweichende Paperless-Version importieren, weil er ein exaktes Abbild des jeweiligen Datenbankstands enthält. Vor Updates empfiehlt das Projekt, laufende Dokumentenverarbeitung abzuwarten und eine Sicherung anzulegen. Für ein Upgrade auf Version 3 verweist es ausdrücklich auf einen eigenen Migrationsleitfaden mit vorbereitenden Anforderungen.

Grenzen und geeignete Einsatzfälle

Paperless-ngx eignet sich besonders für Bestände, die regelmäßig eingehen und später nach Inhalt oder Metadaten wiedergefunden werden sollen – etwa Rechnungen, Verträge oder Schriftverkehr. Der praktische Nutzen hängt jedoch von lesbaren Vorlagen, einer passenden OCR-Konfiguration und einer konsequenten Prüfung der erfassten Daten ab. Es ersetzt weder eine getestete Backup-Strategie noch organisatorische Entscheidungen darüber, wer Unterlagen sehen oder verändern darf. Auch die Frage, ob ein Papieroriginal weiterhin aufbewahrt werden muss, ist außerhalb der Software zu klären.

Der Betrieb verlangt laufende Pflege. Wer eine Installation aktualisiert, sollte Versionshinweise und gegebenenfalls Migrationsanleitungen lesen, statt Container-Images ungeprüft auszutauschen. Nach dem Import oder einem Update helfen Stichproben: Lassen sich Dokumente öffnen, stimmt der erkannte Text, funktionieren Suche und Berechtigungen, und lässt sich eine Sicherung wiederherstellen?

Einordnung zum Recherchestand

Die offizielle GitHub-Releaseübersicht führte bei der Recherche v3.2.1 als obersten Eintrag und datierte dessen Veröffentlichung auf den 20. September 2026. Eine Versionsnummer beschreibt allerdings nur den Stand der Software zu einem Zeitpunkt; für konkrete Installations- oder Upgradeentscheidungen sollten stets die Hinweise zur tatsächlich eingesetzten und zur angestrebten Version geprüft werden.