Auftragserfassung aus Mail und PDF: Die Grund-Spalte zählt mehr als die Automatisierungsquote

By
Bodo Buschick
4/10/26
•
5 Min
Auftragserfassung aus Mail und PDF: Die Grund-Spalte zählt mehr als die Automatisierungsquote

Das ist der Bauplan für eine Auftragserfassung aus Mail und PDF. So bauen wir sie. Kein Modell-Vergleich. Keine Werbung. Ein Lese-Agent, eine Prüfliste, eine Spalte mit dem Grund. Genau diese Spalte entscheidet, ob das System nach drei Monaten noch vertraut wird.

Warum das Lesen nicht mehr das Problem ist

Speditionen bekommen Aufträge als Mailtext. Oder als PDF-Anhang. Oder als Excel-Tabelle. Oder als Portal-Export. Ein Kunde schickt eine feste Vorlage. Der nächste schickt ein Foto vom Lieferschein. Ein dritter tippt den Auftrag direkt in den Mailtext, ohne Anhang. Jede Variante ist für sich lösbar. Das Problem ist die Variante Nummer 37. Die hat noch niemand gesehen.

Lesen allein ist mittlerweile Commodity. LIS hat im Februar 2026 seine Plattform WinSped Web erweitert. Neu ist eine KI-Erfassung. Sie liest PDF, Fax, Lieferschein und handschriftliche Aufträge. Ohne feste Vorlage (LOGISTRA, 09.02.2026). Wenn das in einem Standard-TMS steckt, ist Lesefähigkeit kein Vorteil mehr. Der Unterschied liegt woanders. Er liegt in dem, was mit einem Auftrag passiert. Den das System nicht sicher lesen konnte.

Genau da liegt die Schwachstelle der Branche. Strategy& und die BVL haben im Herbst 2025 115 Logistikbetriebe befragt. 96 Prozent haben die digitale Transformation gestartet. Nur 10 Prozent skalieren sie über einzelne Projekte hinaus. 54 Prozent nennen die Datenqualität als größte Hürde. Noch vor Budget und Personal (Verkehrsrundschau, BVL-Studie 2025/26). Das deckt sich mit unseren Projekten. Nicht das Lesen bricht ab. Die Stammdaten kennen die Ladestelle nicht. Oder die Kundennummer im Dokument passt nicht zur Kundennummer im TMS.

Die drei Stationen eines Auftrags

Ein Lese-Agent führt jeden Auftrag durch drei Schritte.

Erstens die Extraktion. Der Agent liest Mailtext, Anhang oder Portal-Export. Er zieht die Felder heraus: Kunde, Ladestelle, Entladestelle, Termin, Referenz, Menge. Zu jedem Feld gehört ein Konfidenzwert. Nicht nur zum ganzen Dokument, sondern zu jedem einzelnen Feld. Ein Dokument kann bei der Kundennummer sicher sein und beim Termin unsicher. Etwa, weil zwei Datumsangaben im Text stehen.

Zweitens der Datenabgleich. Jedes Feld wird gegen das TMS geprüft. Die Kundennummer muss existieren. Die Ladestelle muss zur Kundenadresse passen. Oder als bekannte Ausnahme hinterlegt sein. Unser Wissensnetz zeigt einen passenden Fall. Ein Konverter holt für eine Spedition den Plan direkt aus der Mailbox. Er importiert ihn ins TMS, ohne dass jemand eine Zeile abtippt. Die Fehlerquelle war nie das Lesen der Datei. Sie war der Abgleich. Genau dann, wenn ein Fahrer- oder Kundenname nicht eindeutig zu einer ID passte.

Drittens die Entscheidung. Liegen alle Felder über der Schwelle? Dann legt der Agent den Auftrag im TMS an. Reißt eine Schwelle, geht der Auftrag in die Prüfliste. Der Grund steht im Klartext dabei. Zum Beispiel "Ladestelle nicht zugeordnet" oder "Layout unbekannt". Oder "Menge weicht ab" und "Referenz doppelt". Kein Auftrag verschwindet ohne Begründung. Und keiner wird angelegt, wenn die Maschine selbst unsicher ist.

Was im Protokoll steht

Jeder Auftrag hinterlässt eine Spur. Eingang, Extraktion mit Konfidenz je Feld, Ergebnis des Datenabgleichs, Entscheidung. Bei Prüffällen zusätzlich die Rückmeldung an die Disposition. Der Monitor zeigt das als Zeile pro Auftrag. Nicht als Sammelmeldung am Tagesende. Wurde ein Auftrag falsch angelegt, zeigt das Protokoll genau die Stelle. Dort war die Maschine zu sicher. Das ist der Unterschied zu einer reinen OCR-Lösung ohne Protokoll. Dort sieht niemand, warum ein Auftrag kippte. Bis der Kunde anruft.

Ändert ein Kunde sein PDF-Layout, sinkt die Konfidenz für seine Aufträge über Nacht. Der Agent legt trotzdem nichts falsch an. Er schiebt mehr Aufträge in die Prüfliste. Mit dem Grund "Layout unbekannt" oder "Extraktion unsicher". Die Disposition sieht die Häufung am selben Tag. Nicht erst nach einer Woche voller falscher Lieferscheine.

Warum die Grund-Spalte wichtiger ist als die Quote

Eine Quote ist eine hübsche Zahl für die Geschäftsleitung. Für die Disposition ist sie fast wertlos. Sie sagt nicht, was zu tun ist. Die Grund-Spalte der Prüfliste sagt es. Sie zeigt, welcher Kunde regelmäßig ein unsicheres Layout schickt. Eins, das der Agent nicht sicher einordnet. Sie zeigt, ob eine Ladestelle fehlt, weil sie neu ist. Oder weil sie nie sauber angelegt wurde. Sie zeigt, ob ein Fehler systematisch ist oder ein Einzelfall.

Genau das macht die Grund-Spalte zum Thema. Vor dem Agenten wusste niemand, wie oft ein Kunde ein kaputtes PDF schickt. Jeder Fall ging einzeln in der Handarbeit unter. Mit der Prüfliste ist die Häufigkeit sichtbar. Mit Datum und Kunde. Das ist ein Gespräch mit dem Kunden: "Ihr PDF-Export ändert sich alle drei Wochen. Können wir eine feste Vorlage vereinbaren?" Diese Frage stellte vorher niemand. Es fehlten die Daten dafür.

Was in der Disposition wegfällt und was bleibt

Weg fällt das Abtippen. Und zwar bei jedem Auftrag, den der Agent sicher liest. Und der den Datenabgleich besteht. Je nach Kundenmix ist das der Großteil des Volumens. Bleiben bleibt die Prüfliste. Sie ist Arbeit mit Kontext, statt Arbeit ohne. Statt eine PDF von vorne zu lesen, sieht die Disponentin: welches Feld war unsicher. Und warum. Sie bestätigt oder korrigiert ein Feld. Statt den ganzen Auftrag neu zu erfassen.

Der Tagesablauf ändert sich in der Reihenfolge. Statt Aufträge nach Eingangszeit abzuarbeiten, geht die Disposition die Liste nach Grund durch. Erst die Fälle mit knappem Termin. Dann die mit unklarer Menge. Zuletzt die Layout-Fälle, die ohnehin gesammelt an den Vertrieb gehen. Diese Sortierung gibt es erst, seit der Grund im System steht.

Wo eine Quote in die Irre führt

Eine hohe Quote ohne Grund-Verteilung kann zwei ganz verschiedene Systeme beschreiben. Im einen Fall sinkt die Prüfliste, weil die Stammdaten besser werden. Weniger Aufträge sind dann tatsächlich unklar. Im anderen Fall sinkt sie, weil die Schwelle zu niedrig gesetzt wurde. Der Agent legt dann Aufträge an. Aufträge, bei denen er es besser gelassen hätte. Ohne Grund-Spalte lässt sich das von außen nicht unterscheiden. Mit ihr schon. Steigt der Anteil falsch angelegter Aufträge im Nachgang? Bleibt die Quote dabei gleich? Dann ist die Schwelle das Problem. Nicht die Datenqualität.

Der Prozess-Check

Kostet die Auftragserfassung aus Mail und PDF Ihre Disposition am meisten Zeit? Hier ein Vorschlag. Schicken Sie uns ein Beispiel-PDF, das Ihr System heute nicht sauber verarbeitet. Anonymisiert. Wir zeigen das Protokoll unseres Lese-Agenten für genau diesen Fall. Mit Konfidenz, Datenabgleich und dem Grund, den er in die Prüfliste schreiben würde. Der verlinkte Beitrag zeigt das im Detail. Er beschreibt unseren Import-Agenten für den Dispoplan aus Excel und SharePoint.