paperless-gpt 0.29: Zusammengehörige Dokumente verknüpfen sich jetzt selbst

9. Oktober 2026 · 7 Min. · Tobi

Schwere Eisenketten, die in einem zentralen Ring zusammenlaufen – paperless-gpt 0.29 verknüpft zusammengehörige Dokumente in Paperless-ngx

Eine Zahlungserinnerung kommt rein und landet natürlich auch in deinem Paperless-ngx – aber wo ist nochmal die dazugehörige Rechnung? Du suchst die Rechnungsnummer im Archiv, gleichst ab, suchst den Lieferschein dazu. In Paperless-ngx geht das schnell, bleibt aber Handarbeit, die bei jedem Folgeschreiben wieder anfällt.

Genau hier setzt das neue Release von paperless-gpt an. Version 0.29.0 ist am 5. Oktober 2026 erschienen und trägt den Beinamen „The Connection Expansion“: paperless-gpt erkennt Referenznummern in Dokumenten und verknüpft Zahlungserinnerung, Rechnung und Lieferschein automatisch miteinander. Wir haben das Release in einer Testumgebung mit Paperless-ngx 3.3 ausprobiert – alle Screenshots in diesem Artikel stammen von dort. Inzwischen kannst du die neue Version auch bei uns als Add-on „KI-Funktionen“ dazu buchen.

Das Wichtigste in Kürze

  • Automatische Dokumentverknüpfung: paperless-gpt liest Rechnungs-, Bestell-, Vertrags- oder Aktenzeichen aus und füllt damit ein Zusatzfeld vom Typ Dokumentenverknüpfung in Paperless-ngx.
  • Kein Raten: Das Sprachmodell liefert nur die Nummern. Welches Dokument dazu passt, sucht paperless-gpt selbst – per exaktem Treffer, mit mehreren Schutzregeln.
  • Einrichtung in zwei Schritten, beide in der Weboberfläche: Zusatzfeld in Paperless-ngx anlegen, in paperless-gpt auswählen.
  • Drei Fehler mit stillem Datenverlust behoben: Zusatzfelder, für den API-Nutzer unsichtbare Tags und ein hängender Fehler-Tag.
  • Lesbarer Verlauf: Die History zeigt Namen statt IDs, und das Rückgängigmachen von Tag-Änderungen funktioniert wieder.
  • PDFium statt MuPDF für die PDF-Darstellung – wichtig vor allem für die Lizenz, im Alltag merkst du davon kaum etwas.

Das Kernfeature: Dokumente finden, die zusammengehören

Viele Geschäftsdokumente kommen als Kette: Lieferschein, Rechnung, Zahlungserinnerung. Ein Vertragsnachtrag nennt die Vertragsnummer, jeder Brief vom Finanzamt dasselbe Aktenzeichen. Die Verbindung ist immer eine Nummer, die auf beiden Dokumenten steht.

Paperless-gpt nutzt genau das. Paperless-ngx kennt seit einiger Zeit Zusatzfelder vom Datentyp „Dokumentenverknüpfung“ – bislang musstest du die aber von Hand befüllen. Jetzt übernimmt paperless-gpt das. Paperless-ngx zeigt die Verknüpfung auf beiden Seiten an: Die Rechnung kennt ihre Mahnung, die Mahnung ihre Rechnung.

Schaubild: Eine Zahlungserinnerung nennt die Rechnungsnummer RE-2026-11934, das Sprachmodell extrahiert die Nummer, paperless-gpt sucht sie im Archiv und schreibt die Verknüpfung – mit Schutzregeln gegen Fehltreffer

Spannend ist die Arbeitsteilung. Das Sprachmodell soll keine Dokument-IDs erraten, sondern nur die Referenznummern auflisten. Die Suche danach erledigt paperless-gpt selbst über die Paperless-API, und zwar als exakter Treffer auf das ganze Wort – R123 passt also nicht auf R1234. Dazu kommen Schutzregeln, denn eine falsche Verknüpfung richtet mehr Schaden an als eine fehlende:

  • Nummern mit weniger als vier Zeichen werden ignoriert.
  • Taucht eine Nummer in mehr als drei Dokumenten auf, gilt sie als zu allgemein – typischer Fall ist deine eigene Kundennummer, die auf jedem Brief desselben Lieferanten steht.
  • Ein Dokument wird nie mit sich selbst verknüpft.
  • Findet sich kein klarer Treffer, bleibt das Feld leer, statt mit einer Vermutung befüllt zu werden.

So richtest du die Verknüpfung ein

Neue Umgebungsvariablen braucht es nicht, alles läuft über die Weboberflächen. Damit funktioniert der Weg auch bei einer managed Paperless-ngx-Instanz mit paperless-gpt, ganz ohne Serverzugriff.

1. Zusatzfeld in Paperless-ngx anlegen. Unter „Verwaltung“ → „Attribute“ → „Zusatzfelder“ legst du über „Feld hinzufügen“ ein neues Feld an, zum Beispiel „Zugehörige Dokumente“, und wählst als Datentyp „Dokumentenverknüpfung“.

2. Feld in paperless-gpt auswählen. Die Oberfläche von paperless-gpt gibt es nur auf Englisch. Unter „Settings“ findest du den Bereich „Custom Fields“: Dort aktivierst du „Automatically generate custom fields“, setzt bei „Fields to process“ den Haken beim neuen Feld und speicherst.

Einstellungen in paperless-gpt: Bereich „Custom Fields“ mit aktivierter automatischer Generierung, den drei Schreibmodi Append, Update und Replace sowie dem ausgewählten Feld „Zugehörige Dokumente“

Wichtig: Achte auf den Schreibmodus („Write Mode“). Die Doku zum Feature rät von „Replace“ ab, weil Paperless-ngx jede Verknüpfung auf das Zieldokument spiegelt und „Replace“ diesen gespiegelten Link später überschreiben kann. In unserem Test hatte aber auch „Append“ einen Haken: Die Zahlungserinnerung wurde zuerst verarbeitet, Paperless-ngx spiegelte den Link auf die Rechnung – und weil das Feld dort damit schon existierte, ließ „Append“ es unangetastet. Der vorgeschlagene Link von der Rechnung zum Lieferschein ging so verloren. Mit „Update“ wurde die bestehende Verknüpfung ergänzt, und die ganze Kette stand.

Wie das in der Praxis aussieht

Für unseren Test haben wir drei fiktive Belege eines Käsegroßhändlers eingescannt: einen Lieferschein, die zugehörige Rechnung (sie nennt die Lieferscheinnummer) und eine Zahlungserinnerung (sie nennt die Rechnungsnummer). Alle drei bekamen den Tag paperless-gpt und landeten in der Prüfansicht.

Neben Titel, Tags, Korrespondent und Dokumenttyp schlägt paperless-gpt jetzt auch die Verknüpfung vor. In der Prüfansicht erscheint sie vorerst als Dokument-ID – „5“ ist die Rechnung, „8,9“ sind Lieferschein und Zahlungserinnerung. Wie bei den anderen Feldern entscheidest du per Häkchen, ob der Vorschlag übernommen wird.

Prüfansicht von paperless-gpt 0.29 mit zwei Dokumenten: Neben Titel, Tags, Korrespondent und Dokumenttyp schlägt paperless-gpt im Bereich „Custom fields“ die zugehörigen Dokumente vor

Nach dem Übernehmen zeigt Paperless-ngx bei der Rechnung beide Verknüpfungen mit Titel an. Ein Klick genügt, um zum Lieferschein oder zur Mahnung zu springen.

Detailansicht einer Rechnung in Paperless-ngx: Im Zusatzfeld „Zugehörige Dokumente“ stehen der passende Lieferschein und die Zahlungserinnerung, rechts die Vorschau der Rechnung mit Rechnungs- und Lieferscheinnummer

Zwei Voraussetzungen solltest du kennen: Das referenzierte Dokument muss schon im Archiv liegen und lesbaren Text haben. Kommt die Mahnung vor der eingescannten Rechnung, gibt es noch nichts zu verknüpfen – eine erneute Verarbeitung der Mahnung holt das später nach. Und berücksichtigt werden nur Dokumente, die der Benutzer hinter dem API-Token sehen darf.

Praxis-Tipp: Wer seine Ablage nach den Best Practices für Tags und Dokumenttypen organisiert, bekommt damit eine zweite Ordnungsebene: nicht nur „was ist das?“, sondern auch „wozu gehört das?“.

Die weiteren Neuerungen in 0.29

Verhindern von „stillem“ Datenverlust

Weniger sichtbar, aber wichtig sind drei Korrekturen für Fälle, in denen paperless-gpt unbemerkt Daten entfernt hat:

  • Zusatzfelder im Modus „Append“: Bei automatisch verarbeiteten Dokumenten konnte paperless-gpt alle Zusatzfelder entfernen, die nicht in der Auswahl standen. Jetzt werden die vorhandenen Felder des Dokuments berücksichtigt.
  • Unsichtbare Tags: Arbeitet paperless-gpt mit einem eingeschränkten API-Token, konnten Tags anderer Nutzer:innen beim Aktualisieren verschwinden. Mit dieser neusten Änderungen bleiben sie jetzt unverändert.
  • Fehler-Tag ohne Grund: Konnte das Modell kein Datum ermitteln, landete das Dokument dauerhaft mit paperless-gpt-failed im Archiv. Das passiert nur noch bei Feldern, die Paperless-ngx tatsächlich ablehnt.

Verlauf mit Namen und funktionierender „undo“-Funktion

Im Verlauf („History“) standen bei Tag-Änderungen bisher nur Zahlen. Jetzt siehst du Namen – auch bei Korrespondent und Dokumenttyp. Das Rückgängigmachen einzelner Tag-Änderungen, das zuletzt bei jedem Eintrag mit einem Fehler abbrach, funktioniert wieder.

Verlauf in paperless-gpt 0.29: Änderungen an Korrespondent, Dokumenttyp, Titel, Datum und Tags eines Lieferscheins, Tags erscheinen mit ihren Namen, daneben je ein Undo-Button

Bessere Korrespondenten und robustere OCR

Kleinere Modelle haben gelegentlich die Person als Korrespondent vorgeschlagen, um die es im Brief geht, statt des Absenders. Der Standard-Prompt schließt das jetzt aus. Hast du die Prompts schon einmal angepasst, bleibt deine Fassung erhalten – den Unterschied kannst du mit der Vorlage default_prompts/correspondent_prompt.tmpl im Repository abgleichen.

Außerdem kommt die KI-Texterkennung jetzt mit Originalen klar, die keine PDFs sind, etwa Handyfotos von Belegen.

PDFium statt MuPDF

Unter der Haube rendert paperless-gpt PDF-Seiten jetzt mit PDFium (Apache-2.0, die Engine hinter dem PDF-Viewer von Chrome) statt mit MuPDF (AGPL-3.0) – damit besteht das MIT-lizenzierte Projekt nur noch aus freizügig lizenzierten Komponenten. Laut Release Notes bleibt die Ausgabe gleich. Als bekannte Einschränkung nennt das Projekt, dass PDFium bei manchen eingebetteten Schriften Textzeilen auslassen kann; das betrifft nur die KI-OCR.

Häufige Fragen zu paperless-gpt 0.29

Funktioniert das auch mit älteren Paperless-ngx-Versionen? Laut Doku ja: Die Suche nutzt den Datenbankfilter von Paperless-ngx statt des Volltextindex und arbeitet deshalb mit 2.x und 3.x gleichermaßen.

Werden bereits archivierte Dokumente nachträglich verknüpft? Nur, wenn du sie erneut durch paperless-gpt schickst, also wieder mit paperless-gpt oder paperless-gpt-auto taggst. Verknüpft wird immer beim Verarbeiten des Dokuments, das auf ein anderes verweist.

Läuft bei mir schon die 0.29? Die Versionsnummer steht unten auf der Seite „Settings“ in paperless-gpt. Wie du paperless-gpt bei server.camp nutzt, beschreibt unsere Doku zu paperless-gpt.

Fazit

Mit 0.29 geht paperless-gpt über die reine Verschlagwortung hinaus: Es erkennt nicht nur, was ein Dokument ist, sondern auch, worauf es sich bezieht. Wer Rechnungsketten, Verträge oder Vorgänge mit Aktenzeichen verwaltet, spart damit Sucharbeit. Weil das Modell nur Nummern liefert und die Suche deterministisch läuft, bleiben die Verknüpfungen nachvollziehbar. Beim Schreibmodus war „Update“ in unserem Szenario die bessere Wahl.

Die Bug-Fixes gegen versehentlichen Datenverlust und der lesbare Verlauf machen das Release auch für alle interessant, die die Verknüpfung gar nicht nutzen wollen. Wenn du paperless-gpt noch nicht kennst, findest du in unserer Einführung zu paperless-gpt den Überblick über Tags, Prüfansicht und KI-OCR.

Jetzt starten

Rechnung, Mahnung, Lieferschein – verknüpft

Paperless-ngx gibt es bei server.camp managed und DSGVO-konform in der EU – mit dem Add-on „KI-Funktionen“ inklusive paperless-gpt und einem Sprachmodell bei Scaleway in Paris. 30 Tage kostenlos testen.

Paperless-ngx mit KI testen
30 Tage kostenlos testen Unterstützung bei der Migration Hosting in DE (DSGVO-konform)