Parashift/Datenextraktion
Funktion · Extraktion

Daten aus Dokumenten auslesen, ohne Vorlage pro Layout.

Rechnungen, Verträge, Formulare und Ausweise enthalten die Werte, die Ihre Systeme brauchen. Parashift liest sie inhaltlich aus, Feld für Feld, mit Konfidenzwert je Wert statt unstrukturiertem Volltext.

Zero-Shot, ohne AnlernphasePositionszeilen als TabelleC5 · SOC 2 · ISO 27001
Lieferantenrechnung · Seite 1/3Extrahiert
LieferantMuster Handels AG
Rechnungsnummer2026-04417
NettobetragCHF 12 840.00
Konfidenz99%
12 Kopffelder und 24 Positionszeilen erkannt
Der Prozess heute

Abtippen ist der teuerste Schritt im Prozess.

In den meisten Häusern liest ein Mensch das Dokument und überträgt die Werte ins System. Das ist langsam, fehleranfällig und skaliert nur über zusätzliche Köpfe.

Vorlagenbasierte Extraktion verschiebt den Aufwand nur: statt abzutippen pflegt jemand Zonen und Regeln. Jeder neue Absender, jedes neue Layout kostet wieder Zeit, bevor überhaupt ein Wert herauskommt.

Funktionsumfang

Was die Extraktion leistet.

Felder je Dokumenttyp

Sie legen fest, welche Felder ein Dokumenttyp liefern soll. Die Erkennung sucht sie im Dokument, egal wo sie stehen.

Positionszeilen als Tabelle

Artikel, Menge, Einzelpreis und Betrag kommen als strukturierte Zeilen zurück, nicht als Textblock.

Konfidenz je Feld

Jeder Wert trägt einen Sicherheitswert. Sie entscheiden, ab welcher Schwelle automatisch weiterverarbeitet wird.

Validierung gegen Stammdaten

Ausgelesene Werte lassen sich gegen Lieferanten-, Kunden- oder Artikelstammdaten prüfen, bevor sie ins Zielsystem gehen.

Handschrift, Fax, schlechte Scans

Schräglagen, Faxqualität und handschriftliche Ergänzungen sind Normalbetrieb, nicht Ausnahme.

Zero-Shot bei neuen Layouts

Ein Layout, das nie gesehen wurde, wird beim ersten Durchlauf gelesen. Es gibt keine Anlernphase pro Absender.

Ablauf

Vom Dokument zum strukturierten Datensatz.

01 · EINGANG

Beliebige Quelle

API, Posteingang, Scanner oder Ordnerüberwachung.

02 · KLASSIFIKATION

Typ je Seite

Erst steht fest, was das Dokument ist, dann welche Felder gesucht werden.

03 · EXTRAKTION

Felder und Positionen

Kopffelder und Positionszeilen werden ausgelesen und mit Konfidenzwerten versehen.

04 · ÜBERGABE

Zielsystem

Strukturierte Daten gehen per API ins ERP, DMS oder den Workflow, unsichere Werte in die Prüfung.

Vergleich

Vorlagenbasierte Extraktion und Parashift.

VorlagenbasiertParashift
Neuer AbsenderZonen und Regeln anlegenWird ohne Einrichtung gelesen
Layoutwechsel beim BestandslieferantenVorlage bricht, Ausfall bis zur KorrekturLäuft weiter
PositionszeilenOft nur Kopffelder zuverlässigPositionen als strukturierte Zeilen
Unsichere WerteStiller Fehler im ZielsystemKonfidenzwert je Feld, Prüfung ab Schwelle
Handschrift und FaxHäufig AusfallTeil des Normalbetriebs
Aufwand über die ZeitWächst mit jedem AbsenderBleibt bei der Zahl der Dokumenttypen
Effekt

Was sich in der Erfassung ändert.

70%

kürzere Bearbeitungszeit im Schnitt

Referenz: Raiffeisen
400+

vorkonfigurierte Dokumenttypen mit Feldern

Parashift Plattform
0

Vorlagen pro Absender zu pflegen

Parashift Architektur

Extraktion ist der zweite Schritt.

Erst wird der Dokumenttyp erkannt, dann werden die passenden Felder ausgelesen. Beides zusammen ergibt den digitalen Posteingang.

Digitalen Posteingang ansehen
Häufige Fragen

Datenextraktion, kurz beantwortet.

Was bedeutet Zero-Shot bei der Datenextraktion?
Die Erkennung braucht kein Beispiel und keine Vorlage für ein Layout, das sie noch nie gesehen hat. Ein neues Rechnungsformular wird beim ersten Durchlauf gelesen, nicht nach einer Anlernphase.
Welche Felder kann ich auslesen lassen?
Sie definieren die Felder je Dokumenttyp. Typisch sind Kopffelder wie Lieferant, Nummer, Datum und Betrag sowie Positionszeilen mit Artikel, Menge und Preis. Eigene Felder kommen ohne Programmierung dazu.
Werden Tabellen und Positionszeilen korrekt erkannt?
Ja. Positionen werden als strukturierte Zeilen übergeben, nicht als Textblock. Damit können Prüfregeln direkt darauf rechnen.
Woher weiss ich, ob ein Wert stimmt?
Jedes Feld kommt mit einem Konfidenzwert. Unterhalb Ihrer Schwelle geht der Wert in die Prüfoberfläche, statt ungeprüft ins Zielsystem zu laufen.
Funktioniert das bei schlechter Scanqualität und Handschrift?
Ja. Faxqualität, Schräglagen und handschriftliche Ergänzungen sind in echten Posteingängen der Normalfall und Teil der Verarbeitung.
Wie kommen die Daten in unser ERP oder DMS?
Über eine dokumentierte REST-API oder Webhooks. Übergeben werden strukturierte, validierte Felder samt Konfidenzwert, nicht Bilddateien.

Daten automatisiert aus Dokumenten auslesen.

Buchen Sie ein unverbindliches Briefing: Wir zeigen die Extraktion an Ihren eigenen Dokumenten.

Antwort am selben Werktag · kein Verkaufsdruck