In diesem Dokument wird beschrieben, wie Sie vorhandene Dokumente mit neu verarbeiteten Ergebnissen eines anderen Document AI-Prozessors aktualisieren.
Aktuelle Beschränkungen
Die Pipeline „ProcessWithDocAi“ kann nur mit Dokumenten verwendet werden, die während der Aufnahme verarbeitet wurden. In zukünftigen Versionen der Pipeline wird diese auf Dokumente erweitert, die noch nicht verarbeitet wurden. Weitere Informationen finden Sie in unseren Versionshinweisen.
Schemazuordnung im Dokumentschema konfigurieren (nur für Administratoren)
Im Dokument Schemas mit Zuordnung festlegen wird beschrieben, wie Sie neue oder vorhandene Attribute eines Document AI Warehouse-Schemas so konfigurieren, dass sie den extrahierten Entitäten aus Document AI zugeordnet werden. Wir zeigen Ihnen, wie Sie das in der Document AI Warehouse Admin-Konsole tun.
Document AI Warehouse Admin-Konsole aufrufen
Prüfen Sie, ob Sie Administratorzugriff haben. Dann können Sie die Admin Konsole aufrufen.

Neues Schema mit Schemazuordnung erstellen
Sie können ein neues Schema mit Schemazuordnung erstellen. Die gleichen Schritte können auch auf vorhandene Schemas angewendet werden, indem Sie Schemas in der Ansicht mit den Schemadetails aktualisieren. Beachten Sie jedoch, dass die Funktionen zur Schemaaktualisierung derzeit eingeschränkt sind. Das Entfernen oder Ändern vorhandener Attribute wird nicht unterstützt.
Klicken Sie auf dem Tab „Schema Manager“ (Schema Manager) auf Add new (Neu hinzufügen):

Geben Sie einen Anzeigenamen und eine Beschreibung ein.

Der Anzeigename kann nach der Erstellung nicht mehr geändert werden. Die Beschreibung ist optional und kann nach der Erstellung aktualisiert werden.
Klicken Sie auf Weiter. Der JSON-Editor des Schemas wird angezeigt, einschließlich des Anzeigenamens und der Beschreibung, die Sie im vorherigen Schritt eingegeben haben.

Fügen Sie in diesem Beispiel der Liste property_definitions (Attributdefinitionen) das Attribut total_amount (Gesamtbetrag) hinzu:
{ "name": "total_amount", "display_name": "Total Amount", "is_repeatable": false, "is_filterable": true, "is_searchable": true, "is_metadata": false, "is_required": false, "float_type_options": {}, "schema_sources": [ { "name": "total_amount", "processor_type": "INVOICE_PROCESSOR" } ] }Das Attribut ist so konfiguriert, dass es dem Feld
total_amountzugeordnet wird, das vonINVOICE_PROCESSORextrahiert wurde. Die vollständige Liste der Prozessortypen können Sie mit der API „fetchProcessorTypes“ abrufen.Klicken Sie auf Fertig, um ein Schema zu erstellen. Nach Abschluss wird eine Bestätigungsmeldung angezeigt:

Sie können sich das Schema im Detail ansehen.

Beispiel: Rechnungs-Prozessor für die OCR-verarbeiteten Dokumente verwenden
Mit der im Schema definierten Attributzuordnung können Sie die OCR-verarbeiteten Dokumente mit einem Rechnungs-Prozessor noch einmal verarbeiten. Dieser hat das Attribut total_amount, das aus den geparsten Ergebnissen zugeordnet wurde.
Wählen Sie die Dokumente aus, die Sie noch einmal verarbeiten möchten.
Wählen Sie die Dokumente aus, auf die Sie einen anderen Prozessor anwenden möchten. Klicken Sie dann in der Aktionsleiste auf Extract with Document AI (Mit Document AI extrahieren).

Das Pop-up-Dialogfeld enthält drei Eingabefelder:
Prozessor-ID: Die Prozessor-ID, die Sie zum Verarbeiten der Dokumente verwenden möchten.
Export file path (Pfad der Exportdatei): Ein Pfad zu einem Staging-Bucket, in dem die Dokumente vorübergehend gespeichert werden.
Processor results folder path (Ordnerpfad für Prozessergebnisse): Ein Bucket-Pfad zum Speichern der vom Prozessor geparsten Dokumente.

Rufen Sie die Rechnungs-Prozessor-ID ab.
Ähnlich wie beim Erstellen des OCR-Parsers im Leitfaden für den Bulk-Upload, können Sie in der Prozessorgalerie einen Rechnungs-Prozessor erstellen.

Die ID finden Sie auf der Seite „Processor Details“ (Prozessordetails):

Lösen Sie die Pipeline aus und verfolgen Sie den Status.
Nachdem Sie die ID und zwei Bucket-Pfade in das Dialogfeld eingegeben haben, können Sie auf Extract (Extrahieren) klicken, um die Pipeline auszulösen:

Nach dem Auslösen der Pipeline wird eine Seite zur Statusverfolgung angezeigt:

Derzeit ist auf der Seite keine Verfolgung des Fortschritts möglich. Auf der Statusseite wird „Pending“ (Ausstehend) angezeigt, bis der Job abgeschlossen ist.
Sehen Sie sich die aktualisierten Ergebnisse an.
Sobald der Job abgeschlossen ist, können Sie auf das Dokument klicken, um zu prüfen, ob die Extraktionsergebnisse korrekt aktualisiert wurden.

Sie sehen, dass das Attribut
total_amountaus den geparsten Ergebnissen zugeordnet wurde.
In der AI-Ansicht finden Sie die vollständige Liste der extrahierten Entitäten:

Nächster Schritt
Folgen Sie der nächsten Anleitung, um die Dokumente in Document AI Workbench zu einem benutzerdefinierten Dokument Extraktor zu exportieren.