Nach Update auf Paperless V3.1.3: Gescannte Dateien werden nicht übernommen

Hallo zusammen,

ich habe seit kurzem folgendes Problem:

Nach dem Update von V3.0.4 auf V3.1.3 funktioniert das Übernehmen von pdf-Dateien, die vom Scanner im /consume - Verzeichnis abgelegt werden, nicht mehr. Als Fehlermeldung wirft das System folgende Melduung aus:

[ERROR] [paperless.tasks] [99be2355] ConsumeTaskPlugin failed: XXXXXXscan09222026.pdf: Error occurred while consuming document XXXXXXscan09222026.pdf: InputFileError:.

Schiebe ich die PDF-Datei aus dem /consume - Verzeichnis direkt auf das WEB-UI, wird die Datei übernommen (ebenso, wenn sie als eMail-Anhang gesendet wird).

Ich habe schon etwas recherchiert und z.B: das PULLING_DELAY eingetragen - es funktioniert einfach nicht!!

Starte ich das System neu, so werden alle im /consume - Verzeichnis alten pdfs eingepflegt. Neue aber nicht mehr.

Es wäre super, wenn mir jemand eine Tipp, vielleicht sogar eine schnell Lösung, geben könnte.

Danke im voraus!

Dirk

Aktualisiere bitte erstmal auf die neuste Version 3.2.1 und schau dann noch einmal.

Schon mal in der Warteschlange geguckt was dort als fehler angezeigt wird ?

Die datei muss da ja angezeigt werden.

Wie umfangreich is der Scan und hast du es schon mal mit ner einzelnen Seite versucht ?

Das Problem kann auch nur zufällig entstanden sein.

Magst vielleicht mal was zu deinem Setup sagen ? evtl. N Ugreen NAS ?

Hallo,

sorry, das hatte ich vergessen: Das Update auf 3.2.1 habe ich auch schon versucht

Die Datei war noch nicht vollständig geschrieben, als Paperless sie aufgegriffen hat (Race Condition beim Upload).
setze einmal diesen Befehl in deine docker-compose.env

PAPERLESS_CONSUMER_STABILITY_DELAY=15

Hier noch die Übersetzung aus der Paperless-Doku

Legt die Zeit in Sekunden fest, die eine Datei unverändert bleiben muss (gleiche Größe und Änderungszeit), bevor „paperless“ mit ihrer Verarbeitung beginnt.

Erhöhen Sie diesen Wert, wenn Probleme auftreten, dass Dateien verarbeitet werden, bevor sie vollständig geschrieben sind, insbesondere bei langsameren Netzwerkspeichern oder bei bestimmten Eigenheiten von Scannern.

CONSUMER_POLLING_DELAY Removed Use CONSUMER_STABILITY_DELAY

Hallo,

Was den Umfang des Scans angeht, so habe ich zum Testen verschieden große Dokumente verwendet.

Zu meinem Setup : Paperless läuft auf einer Proxmox-Installation. Die Dokumente werden über einen HP OfficeJet Pro 9010e über mein Netzwerk an Paperless gesendet.

Nochmals zum Fehlerbild: Wird das Dokument als PDF auf die Startseite gezogen, wird es sofort übernommen, schicke ich es als eMail-Anhang wird es auch übernommen, starte ich paperless neu, werden alle PDFs, die sich im Consume-Verzeichnis angesammelt haben eingelesen und übernommen. Alle danach einzulesenden Dateien erzeugen aber wieder diese Fehlermeldung.

Als Mitteilung vom System erhalte ich folgendes:

EINGABEDATEN:

{
  "filename": "191912scan09232026.pdf",
  "mime_type": "application/pdf",
  "overrides": {
    "remote_ocr": false,
    "skip_asn_if_exists": false
  }
}

ERGEBNISDATEN:

{
  "traceback": "  File \"/usr/local/lib/python3.14/site-packages/celery/app/trace.py\", line 585, in trace_task\n    R = retval = fun(*args, **kwargs)\n                 ~~~^^^^^^^^^^^^^^^^^\n  File \"/usr/local/lib/python3.14/site-packages/celery/app/trace.py\", line 858, in __protected_call__\n    return self.run(*args, **kwargs)\n           ~~~~~~~~^^^^^^^^^^^^^^^^^\n  File \"/usr/local/lib/python3.14/site-packages/asgiref/sync.py\", line 361, in main_wrap\n    raise exc_info[1]\n  File \"/usr/src/paperless/src/documents/tasks.py\", line 243, in consume_file\n    msg = plugin.run()\n  File \"/usr/src/paperless/src/documents/consumer.py\", line 566, in run\n    self._fail(\n    ~~~~~~~~~~^\n        str(e),\n        ^^^^^^^\n    ...<2 lines>...\n        exception=e,\n        ^^^^^^^^^^^^\n    )\n    ^\n  File \"/usr/src/paperless/src/documents/consumer.py\", line 236, in _fail\n    raise ConsumerError(f\"{self.filename}: {log_message or message}\") from exception\n",
  "error_type": "ConsumerError",
  "error_message": "191912scan09232026.pdf: Error occurred while consuming document 191912scan09232026.pdf: InputFileError: "
}

Vielleicht helfen diese Infos ja weiter.

Besten Dank für die Hilfe!!

Hallo,

leider hat das auch nicht geholfen!

Trotzdem Danke!

hatte das bisher immer funktioniert in der Version 2 ? Hast du deine docker-compose.env auch auf die Version 3 angepasst falls du noch weitere Paperless Befehle hast? Nach den Änderungen in deiner docker-compose hast du auch Paperless einmal neu gestartet.

PAPERLESS_SECRET_KEY Jetzt Pflicht – gesetzt
PAPERLESS_DBENGINE Pflicht für PostgreSQL/MariaDB
PAPERLESS_OCR_MODE / OCR_SKIP_ARCHIVE_FILE Alte Werte entfernt
CONSUMER_BARCODE_SCANNER Setting entfernt

Vielleicht sollten wir erstmal genau klären wie Du installiert hast.

Paperless läuft auf einer Proxmox Installation ist wenig hilfreich.
Hast Du direkt auf der Proxmox Maschine Paperless als Anwendung installiert?

Hast Du ein Linux Container mit einem Linuxbetriebssystem genommen und dort Paperless installiert?

Hast Du eine VM mit der Docker Software und hast Paperless als Docker Container am laufen?

Du siehst es gibt tausend Varianten. Hilf uns bitte um Dir helfen zu können.

Hallo zusammen,

das Problem konnte ich mit eurer Hilfe lösen.

Ich habe den PAPERLESS_CONSUMER_STABILITY_DELAY eingefügt, den Wert allerdings noch etwas nach oben gesetzt und das ganze System nochmals neu gestartet. Siehe da: ES FUNKTIONIERT!

Auch die Anpassungen in docker-compose.env habe ich wie beschrieben vorgenommen.

Wie gesagt: FUNKTIONIERT.

Vielen Dank an alle für eure Tipps!

DIRK

Klasse.

Ich würde gerne verstehen woher so ein Problem bei einigen entsteht, ist das n typisches Proxmox/VM Problem weil da alles etwas träger geht oder wie entstehen solche Fehler ?

Ich habe auf meiner 918+ auch schon größere Dokumenten rüber geschoben und noch nie sowas gehabt… Allerdings auch kein VM-„Gedöns“

@IhDuepfe Ich glaube es geht darum das beim Scannen von größeren Dokumenten es zu problemen kommen kann wenn direkt in den consume ordner (scaninput) gescannt wird.Außerdem ist es vielleicht auch abhängig was für ein Scanner/Kombi Drucker und Scanner verwendet wird.

Normalerweise meldet ein Linuxkernel System das eine Datei fertig geschrieben ist. Dies geschieht über Events. Das ganze fällt unter das Thema inotify. Da sollte man auch was konfigurieren können in Paperless.
Wenn aber das darunter liegende Filesystem das nicht unterstützt, dann muss man mit den Werten für die Consumer ENV arbeiten.

Müsste das bei meinem NFS auch machen.

Unter normalen Umständen darf das Scannen größerer Dokumentem-Stapel keinerlei probleme machen selbst wenn der Scanner via WLAN mit 802.11 g angebunden ist und auf nen Raspberry übertragen wird.

@CoolTux welches Dateisystem hat dieses Problem nicht ?

Hab nur Debian mit ext4 und Synology auf ich glaub ext4 oder gar btrfs.

Ich weiß nur das die ext Dateisysteme das unterstützen und btrfs sowie ZFS und xfs. NFS kann das wi gesagt nicht, gehört aber auch zu den Network Filesystemen, muss man fairer Weise dazu sagen.