Es gibt eine neue Version von Paperless-ngx, einer Webanwendung zur Dokumentenverwaltung, die Papierdokumente in digitale Dokumente umwandelt, die volltextdurchsuchbar, herunterladbar und online speicherbar sind. Der Code wurde in Python unter Verwendung des Django-Frameworks geschrieben und steht unter der GPLv3-Lizenz. Um die Funktionen des Systems kennenzulernen, wurde eine Demoseite erstellt: demo.paperless-ngx.com (Benutzername/Passwort — demo/demo).
Paperless-ngx ist ein Fork des Projekts paperless-ng, das seinerseits von dem ursprünglichen Projekt paperless abzweigte (Forks wurden erstellt, um die Entwicklung nach dem Ende der Unterstützung durch die vorherigen Entwickler fortzusetzen). Nach dem Hochladen eines gescannten Dokuments durch jegliche verfügbare Methode (per FTP, über die Weboberfläche, über die Android-App, per E-Mail über IMAP) führt das Programm eine optische Zeichenerkennung (OCR) aus, wobei die Tesseract-Engine verwendet wird. Anschließend steht im Interface eine Tagging-Funktion zur Verfügung (einschließlich automatischer Tagging-Funktionen mithilfe von maschinellem Lernen), eine Volltextsuche und das Hochladen von Dokumentversionen im PDF/A-Format oder in Büroformaten.
In der neuen Version:
- Pre-/Post-Processing-Skripte verwenden Umgebungsvariablen anstelle von Befehlszeilenargumenten.
- Die Miniaturen in der Weboberfläche wurden in das WebP-Format und nicht in PNG konvertiert.
- Die Einstellungen der Weboberfläche werden in einer Datenbank gespeichert.
- Wenn die Sprache des Dokuments geändert wird, erscheint im Interface ein Hinweis, dass die Seite neu geladen werden muss.
- Im Falle eines Verbindungsfehlers mit Redis wird eine detailliertere Information angezeigt.
- In der Weboberfläche wurde die Möglichkeit hinzugefügt, die Warteschlange der zu verarbeitenden Dokumente anzusehen.

Quelle: opennet.ru
