Zum Hauptinhalt springen

KI-Dokumentenparser mit Klassifizierung

Was dieser Leitfaden umfasst

KI-Dokumentenparser. Klassifizieren. ermöglicht es einem Analyzer, mehrere Dokumentvarianten in einem einzigen Aufruf zu verarbeiten. Sie definieren einen Analysator-IDFüge dann eins hinzu Diagramm pro Variante (Kunde ABC, Kunde XYZ, Standardrechnung, Standardbestellung). Jedes Schema enthält eine Klassifizierungsname, A Klassifizierungsaufforderung in natürlicher Sprache und ein Dokumentenschema Die zu extrahierenden Felder werden beschrieben. Zur Laufzeit gleicht die KI die eingehenden Daten ab. PDF Anhand jeder Klassifizierungsabfrage des Schemas wird die am besten passende Klassifizierung ausgewählt und sowohl der entsprechende Klassifizierungsname als auch die extrahierten Felder zurückgegeben. Dieselbe Analyzer-ID funktioniert von allen Seiten. REST API und jede unterstützte Automatisierungsplattform.

Verwandte Blog-Beiträge(4)
KI-gestütztes Extrahieren und intelligentes Umbenennen beliebiger PDFs in Make: Ein 4-Modul-Dropbox-Workflow mit PDF4me AI – Dokumentenparser
Szenario mit vier Modulen: Eine Lieferanten-PDF-Datei aus Dropbox abrufen, den KI-Dokumentenparser mit der Standard-Rechnungsextraktion ausführen, das JSON parsen, um den Lieferantennamen zu extrahieren, und die Datei anschließend mit dem Namen „Lieferantenname.pdf“ erneut hochladen. Echte Screenshots, exakte Feldwerte, keine manuelle Dateneingabe.
Beitrag lesen
KI-gestütztes Umbenennen von Lieferantenrechnungen in Zapier: Ein 5-stufiger Workflow mit Dropbox und PDF4me
Fünf-Schritte-Zap: Dropbox Neue Datei im Ordner → Dropbox Datei suchen → PDF4me AI – Dokumentenparser → Code von Zapier JavaScript ausführen → Dropbox Datei hochladen. Extrahiert den Kundennamen mithilfe von KI und verwendet ihn als Ausgabedateinamen. Echte Screenshots, exakte Feldwerte, kein Code außer einer zweizeiligen JSON.parse-Anweisung.
Beitrag lesen
Alle Lieferantenrechnungen in Zapier nach Lieferantennamen umbenennen: Ein 5-stufiger Dropbox- und PDF4me-KI-Workflow
Fünf-Schritte-Zap für Ihre Buchhaltung. Dropbox überwacht Ihren Rechnungseingangsordner, PDF4me AI – Document Parser extrahiert den Lieferantennamen aus jeder PDF-Datei, Code by Zapier wandelt die Parser-Ausgabe in zuordnungsfähige Token um, und Dropbox lädt die Datei mit dem Lieferantennamen als Dateinamen wieder hoch. Echte Screenshots, exakte Feldwerte und die in dieser Anleitung verwendete Beispielrechnung (sample-vendor-invoice.pdf) stehen zum Download bereit.
Beitrag lesen

Authentifizierung Ihrer Einrichtung

Klassifizierungsanalysatoren werden in der PDF4me Entwickler-Dashboard. Melden Sie sich mit Ihrem Konto an und erstellen oder kopieren Sie anschließend ein API Schlüssel für den KI-Parser API Aufrufe, die sich auf den hier erstellten Analyzer beziehen.

Dashboard-URLs, die Sie in dieser Anleitung verwenden werden:

Wichtige Fakten, die Sie nicht verpassen sollten

Ein Analysator, viele Schemata (eines pro Variante)
Classify wurde für die reale Welt entwickelt, in der die Rechnungen von Kunde ABC anders aussehen als die von Kunde XYZ. Fügen Sie so viele Schemas hinzu, wie Sie Varianten haben. Jedes Schema ist ein in sich abgeschlossenes Paket aus Klassifizierungsname, Eingabeaufforderung und Dokumentschema.
Die Klassifizierungsaufforderung ist das Routing-Gehirn
Verfassen Sie es in einfachem Englisch. Nennen Sie konkrete Hinweise wie den Firmennamen oben, die Kontakt-E-Mail-Adresse, Layout-Hinweise und Wörter, die nur in dieser Variante verwendet werden. Je klarer die Aufforderung, desto reibungsloser die Weiterleitung.
Die Funktion „Klassifizieren“ gibt sowohl die Bezeichnung als auch die Daten zurück.
Im Gegensatz zu einem reinen Klassifikator enthält die Antwort den übereinstimmenden Klassifizierungsnamen. Und Alle Felder aus dem Dokumentschema dieses Schemas. Ein einziger Aufruf liefert die Routing-Entscheidung und die extrahierten Daten. JSON zusammen.

Schritt 1: Öffnen Sie den AI Document Parser im Dashboard.

  1. Anmelden unter dev.pdf4me.comDie
  2. Klicken Sie in der Seitenleiste des Dashboards auf KI-DokumentenparserDie
  3. Die Listenseite zeigt alle vorhandenen Analyzer in drei Spalten an: Analysator-ID, Analysatortyp (Parse or Classify), und AktionenDie
  4. Klicken Sie auf das Blaue + Hinzufügen Schaltfläche zum Starten eines neuen Analysators.
PDF4me AI Document Parser Dashboard-Listenansicht mit dem rot hervorgehobenen Seitenleisteneintrag AI Document Parser, einer blauen Schaltfläche "Hinzufügen" oben im Hauptfenster und einer leeren Tabelle mit den Spaltenüberschriften "Analyzer-ID", "Analyzer-Typ" und "Aktionen".

Listenansicht des KI-Dokumentenparsers. Klicken Sie auf „+ Hinzufügen“, um einen neuen Analysator zu starten.

Schritt 2: Erstellen Sie einen Klassifizierungsanalysator

Es erscheint eine neue Zeile mit drei Steuerelementen:

  1. Analyzer-ID-EingabeGeben Sie eine beliebige eindeutige Kennung ein, die Sie sich merken können, zum Beispiel client_invoices, Vendor Documents, oder incoming-ordersEs gibt keine Einschränkungen hinsichtlich des Namensformats. Snake Case, Camel Case, Kebab Case, einfache Wörter mit Leerzeichen – alles funktioniert gleich. Das folgende Beispiel verwendet … client_invoicesDie
  2. Dropdown-Liste für Analysetyp. wählen Klassifizieren (diese Anleitung) oder Parse (siehe die Parse-Leitfaden).
  3. Speichern / Abbrechen Schaltflächen. Speichern erstellt den Analysator; Abbrechen verwirft die Zeile.
PDF4me AI Document Parser: Eine neue Zeile ist geöffnet. Das Feld „Analyzer-ID“ ist mit „client_invoices“ ausgefüllt. Im Dropdown-Menü „Analyzer-Typ“ ist „Klassifizieren“ über „Parsen“ hervorgehoben. In der Zeile ist ein Wert für „Klassifizieren“ ausgewählt. Rechts daneben befinden sich die Schaltflächen „Speichern“ und „Abbrechen“.

Zeile hinzufügen: Geben Sie die Analyzer-ID ein (hier Kundenrechnungen), wählen KlassifizierenDann speichern.

Schritt 3: Öffnen Sie den Analysator und fügen Sie das erste Schema hinzu.

Klicken Sie auf die neue Zeile, um die Detailseite zu öffnen. Das URL-Muster lautet:

https://dev.pdf4me.com/ai-document-parser/?id=<your-analyzer-guid>

Das Dashboard generiert beim ersten Öffnen eine GUID pro Analysator. Speichern Sie diese URL als Lesezeichen, um beim nächsten Mal direkt zum selben Klassifizierungsanalysator zurückzukehren.

Auf der Detailseite wird Folgendes angezeigt:

  • Informationen klassifizieren (links) zeigt die Analyzer-ID, die Sie in Schritt 2 eingegeben haben (hier client_invoicesDieses Panel ist schreibgeschützt.
  • Schemas (rechts). Standardmäßig leer. Jedes Schema ist eine Dokumentvariante. Klicken Sie auf + Schaltfläche oben rechts zum Hinzufügen des ersten Schemas.
  • Änderungen speichern (oben links). Alle Änderungen, die Sie auf dieser Seite vornehmen, bleiben erhalten.
  • Zurückkehrt zurück zum AnalysatorlisteDie
Die Detailseite des PDF4me AI Document Parsers für einen Klassifizierungsanalysator. Der blaue Hero-Banner trägt die Aufschrift „AI Document Parser“ mit dem Untertitel „Automatische Extraktion von Rechnungsdaten mithilfe von KI mit schneller, präziser und strukturierter Ausgabe“. Darunter befinden sich ein Zurück-Button und ein blauer Button zum Speichern der Änderungen. Im Bereich „Klassifizierungsinformationen“ auf der linken Seite wird die Analysator-ID „client_invoices“ angezeigt. Der Abschnitt „Schemas“ auf der rechten Seite ist leer; ganz rechts befindet sich ein blaues Pluszeichen zum Hinzufügen eines neuen Schemas.

Detailseite. Informationen klassifizieren Links befindet sich die Analyzer-ID. Klicken Sie auf die blaue Schaltfläche „+“, um ein Schema hinzuzufügen.

Schritt 4: Klassifizierungsname, Aufgabenstellung und Dokumentenschema ausfüllen

Jedes Schema stellt eine Dokumentvariante dar, die der Analysator verarbeiten muss. Jedes Schema verfügt über drei erforderliche Eingaben und eine bekannte Schnellausfüllzeile am Ende.

Schemafelder (erforderlich)

FeldZweckBeispiel
Classification NameThe label returned by the API when this Schema matches. Use a short, business-friendly name.Client ABC
Classification PromptNatural-language description of how to recognise this variant. Mention company name, email, layout cues, distinguishing phrases. This is what the AI uses to route.The invoice has the company name ABC at the top, followed by the contact email [email protected].
Document SchemaJSON object with a description and a fields array. Each field has fieldName, fieldType, and fieldDescription, plus an optional fieldMethod such as generate for derived values.{ "description": "Extract invoice detail for ABC invoices", "fields": [ ... ] }

Beispielschema: Kunde ABC

Der PDF4me AI Document Parser-Editor für Klassifizierungsschemas zeigt das erste Schema mit dem Titel „Kunde ABC“. Im linken Bereich „Klassifizierungsinformationen“ befindet sich die Analyse-ID „client_invoices“. Die Schemakarte verfügt über ein rotes Papierkorbsymbol zum Löschen, ein Feld „Klassifizierungsname“ mit dem Wert „Kunde ABC“, ein Feld „Klassifizierungsaufforderung“ mit dem Text „Der Rechnungsname oben enthält den Namen des Unternehmens ABC, gefolgt von der E-Mail-Adresse für Kundenrechnungen von abc.com“. Ein JSON-Editor für Dokumentschemas zeigt die Beschreibung „Rechnungsdetails für ABC-Rechnungen extrahieren“ und ein Array von Feldern, beginnend mit „invoiceNumber“ (Rechnungsnummer, Belegnummer) und „invoiceDate“ (Erstellungsdatum). Unterhalb des Editors befinden sich Schaltflächen zum Schnellausfüllen von Rechnungen und Bestellungen.

Erstes Schema. Klassifizierungsname, Klassifizierungsaufforderung und Dokumentschema beschreiben zusammen eine Dokumentvariante.

Client ABC. Document Schema
{
"description": "Extract invoice detail for ABC invoices",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldMethod": "generate",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4-digit year not found then consider 2-digit year at the end of extracted date."
}
]
}

Die Klassifizierungsaufforderung für Client ABC ist der natürlichsprachliche Hinweis, der die KI zu diesem Schema führt:

„Auf der Rechnung steht oben der Firmenname ABC, gefolgt von der Kontakt-E-Mail-Adresse.“ [email protected]"

Schritt 5: Weitere Schemas hinzufügen und Änderungen speichern

Klicken Sie auf das Blaue + Klicken Sie erneut auf die Schaltfläche, um ein Schema für die nächste Variante hinzuzufügen. Jedes neue Schema erhält einen eigenen Klassifizierungsnamen, eine eigene Klassifizierungsabfrage und ein eigenes Dokumentschema. Die Felder können sich zwischen den Schemas vollständig unterscheiden. Kunde ABC hat möglicherweise keine Spalte für Kundenreferenzen, Kunde XYZ hingegen schon.

Zweites Beispielschema: Kunde XYZ

PDF4me AI Document Parser: Klassifizieren Sie die zweite Schemakarte mit dem Titel „Kunde XYZ“. Klassifizierungsname: Kunde XYZ. Klassifizierungsaufforderung: Das Dokument ist eine Rechnung mit dem Namen der Firma XYZ, gefolgt von der E-Mail-Adresse support@xyz.com und der Adresse. Ein JSON-Editor für das Dokumentschema zeigt die Beschreibung: „Rechnungsdaten aus der Rechnung der Firma XYZ extrahieren“. Die Felder des Editors beginnen mit „invoiceNumber“ und „invoiceDate“. Unterhalb des Editors befinden sich Schnellzugriffsschaltflächen für Rechnungen und Bestellungen.

Zweites Schema für denselben Analyzer. Beide Schemas befinden sich nun unter KundenrechnungenDie

Client XYZ. Document Schema
{
"description": "Extract Invoice data from company XYZ's Invoice",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldMethod": "generate",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4-digit year not found then consider 2-digit year at the end of extracted date."
}
]
}

Die Schemaliste wird nach dem Speichern ausgeblendet.

Sobald beide Schemata importiert sind, wird jedes Schema als ausklappbare Karte angezeigt. Links befindet sich der Klassifizierungsname, rechts ein Pfeil zum Einklappen. Klicken Sie auf eine Karte, um sie später erneut zu bearbeiten.

Die Detailseite des PDF4me AI Document Parsers für einen Klassifizierungsanalysator zeigt beide Schemas in der reduzierten Listenansicht. Im linken Bereich „Klassifizierungsinformationen“ wird die Analysator-ID „client_invoices“ angezeigt. Im Abschnitt „Schemas“ rechts werden die Kunden ABC und XYZ als zwei reduzierte Akkordeonkarten mit Chevron-Pfeilen zum Erweitern aufgelistet. Über eine blaue Plus-Schaltfläche in der oberen rechten Ecke können weitere Schemas hinzugefügt werden.

Beide Schemas wurden gespeichert. Klicken Sie auf eine beliebige Karte, um sie zu erweitern und zu bearbeiten; verwenden Sie das Pluszeichen (+), um weitere Varianten hinzuzufügen.

Klicken Änderungen speichern Oben links können Sie jedes hinzugefügte Schema speichern. Der Analyzer ist jetzt live und bereit, Daten zu empfangen. PDFsDie

Optionen auf Feldebene innerhalb des Dokumentschemas

AttributErforderlich?Was es tut
fieldNameRequiredThe name of the field and how it will appear in the response JSON.
fieldTypeRequiredThe type of data to extract. One of string, number, date, or table.
fieldDescriptionRequiredNatural-language description of what needs to be extracted and where to find it. Include alternate labels and example formats so the AI matches correctly.
fieldMethodOptional (default extract)How the AI fills the value. extract takes the value verbatim from the document. generate tells the AI to derive or normalise it (useful for dates, computed totals, or cleaned-up IDs). Omit for default extract behaviour.
fieldsRequired when fieldType is tableNested array describing the columns of the table. Each entry takes the same attributes as a top-level field (fieldName, fieldType, fieldDescription, fieldMethod). Cannot itself be table.

Schema mit einem Tabellenfeld (verschachtelte Zeilen)

Verwenden Feldtyp: "Tabelle" Wenn ein Schema wiederholte Zeilen wie Rechnungspositionen extrahieren muss, enthält jedes Tabellenfeld seine eigene verschachtelte Struktur. Felder Array, das die Spalten beschreibt.

{
"description": "Invoice data extractor",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4 digit year not found then consider 2 digit year at the end of extracted date.",
"fieldMethod": "generate"
},
{
"fieldName": "lineItems",
"fieldType": "table",
"fieldDescription": "All product / service rows from the invoice table. Be careful, sometimes a row can be part of the next item like when description goes over one line, but it's of a single item.",
"fields": [
{
"fieldName": "itemNumber",
"fieldType": "string",
"fieldDescription": "Product number, product id number or product code"
},
{
"fieldName": "hsnCode",
"fieldType": "string",
"fieldDescription": "HSN / SAC code (4 to 8 digit)"
}
]
}
]
}

Schnellfüll-Schaltflächen (als Ausgangspunkt verwenden)

Der Schema-Editor bietet Rechnung Und Auftragsbestätigung Voreingestellte Schaltflächen am unteren Rand der Dokumentschema-Karte. Nutzen Sie sie als Ausgangspunkt Klicken Sie auf eine Option, um ein typisches Schema für diese Dokumentfamilie zu erstellen. Passen Sie anschließend Feldnamen, -typen, -methoden und -beschreibungen an die von Ihnen konfigurierte Variante an. Die Voreinstellungen dienen als Gerüst und stellen nicht die endgültige Form dar.

Verwenden Sie den Klassifizierungsanalysator in API oder automatisierte Anrufe

Nach dem Speichern kann dieselbe Analyzer-ID überall per Referenz verwendet werden. Sie müssen die Schemas nicht auf jeder Plattform neu erstellen.

FeldQuelleZweck
AnalyzerIdDie Zeichenkette, die Sie in Schritt 2 eingegeben haben (client_invoices)Stabile Kennung für den Klassifikationsanalysator.
docNameQuelle PDF DateinameWird zur Nachverfolgung und für Fehlermeldungen verwendet.
docContentQuelle PDF kodiert als Base64Das Dokument, das klassifiziert und aus dem extrahiert werden soll.
asyncfalse für synchrone true für UmfragenSteuert die Übermittlung von Antworten.

Beispiel REST Anfragetext:

{
"docName": "incoming_invoice.pdf",
"docContent": "BASE64_ENCODED_PDF_CONTENT",
"AnalyzerId": "client_invoices",
"async": false
}

Die Antwort enthält den übereinstimmenden Klassifizierungsnamen sowie die im Dokumentschema des jeweiligen Schemas definierten Felder. Ein als Mandant ABC erkanntes Dokument liefert die Felder von Mandant ABC; ein als Mandant XYZ erkanntes Dokument liefert die Felder von Mandant XYZ. Ein Aufruf, beide Entscheidungen.

Gängige Arbeitsabläufe

Typische Muster des KlassifizierungsanalysatorsHow a Classify Analyzer with multiple Schemas runs in production.
Multi-Client-AP-Posteingang
  1. Rechnungen von Kunden ABC, Kunden XYZ und einigen anderen treffen in einem einzigen Briefkasten ein.
  2. Make, Zapier, Power Automate, oder n8n ruft den KI-Parser auf mit AnalyzerId: client_invoicesDie
  3. Die Antwort enthält den Klassifizierungsnamen (Kunde ABC, Kunde XYZ usw.) und die extrahierten Felder.
  4. Ein Schaltschritt leitet jedes Ergebnis an das entsprechende ERP Kundendatensatz mit dem Klassifizierungsnamen; die extrahierten Felder werden direkt in den Rechnungsdatensatz übernommen.
Lieferantenintegration ohne Neuaufbau
  1. Ein neuer Lieferant sendet zum ersten Mal eine Rechnung mit einem anderen Layout.
  2. Der Betrieb öffnet die bestehenden Kundenrechnungen Analysator im Dashboard und klicken +Die
  3. Es wird ein neues Schema hinzugefügt mit einem Klassifizierungsnamen (dem Namen des Anbieters), einer Klassifizierungsaufforderung, die das Layout beschreibt, und einem Dokumentschema für die relevanten Felder.
  4. Der nächste eingehende PDF Die Weiterleitung an das neue Schema erfolgt automatisch. Es ist keine Neuverdrahtung der Automatisierung erforderlich.
Triage gemischter Dokumente
  1. One Analyzer deckt Rechnungen, Bestellungen und Gutschriften ab.
  2. Die Klassifizierungsaufforderung jedes Schemas beschreibt die Unterscheidungsmerkmale ("enthält") Gesetzesentwurf für und ein zu zahlender Gesamtbetrag" vs. "enthält eine Bestellnummer und eine Lieferadresse").
  3. Das Dokumentschema extrahiert pro Schema die für diesen Dokumenttyp relevanten Felder.
  4. Die nachgelagerten Routing-Verzweigungen basieren auf dem Klassifizierungsnamen; jede Verzweigung schreibt in das entsprechende System.

Best Practices für Schemas zur Klassifizierung

  • Ein Schema pro stabiler Dokumentvariante. Zwei Anbieter mit sehr unterschiedlichen Layouts sollten zwei separate Schemas haben, nicht ein einziges mit sich überschneidenden Regeln.
  • Die Klassifizierungsaufforderung ist Ihre Routing-Regel. Formulieren Sie sie in einfachem Englisch und verwenden Sie konkrete Kennzeichnungen (Firmenname, E-Mail-Adresse, charakteristische Formulierungen, Layouthinweise).
  • Wählen Sie einen kurzen, geschäftsfreundlichen und aussagekräftigen Klassifizierungsnamen. Dieser dient als Grundlage für Ihre nachgelagerten Routing-Verzweigungen.
  • Nutzen Sie die Schnellfüllbuttons für Rechnungen und Bestellungen als Ausgangspunkt und präzisieren Sie anschließend die Feldbeschreibungen für jede Variante.
  • Hinzufügen fieldMethod: "generate" bei Datumsangaben, berechneten Summen oder Feldern, bei denen die KI den Wert normalisieren und nicht wortgetreu kopieren soll.
  • Testen Sie jedes Schema anhand eines realen Beispiels, bevor Sie es in Betrieb nehmen: Eine offensichtliche Rechnung des Kunden ABC sollte immer an das Schema des Kunden ABC weitergeleitet werden, nicht an das Schema des Kunden XYZ.
  • Klicken Änderungen speichern Nach jeder Bearbeitungsrunde gehen nicht gespeicherte Schemas bei der Navigation verloren.

Ähnliche Aktionen

KI-Dokumentenparser mit Parse
Gleiches Dashboard, ein einzelnes Schema pro Analyzer. Verwenden Sie diese Option, wenn alle verarbeiteten Dokumente dieselbe Layoutfamilie verwenden.
KI - Dokumentenparser in Make
Verwenden Sie Ihre gespeicherte Classify Analyzer-ID von einem Make Szenario. Kombinieren Sie es mit beliebigen Datenquellen- und Speichermodulen, um Routing und Extraktion in visuellen Workflows zu verteilen.
KI - Dokumentenparser in Power Automate
Führen Sie denselben Klassifikationsanalysator von einem Power Automate Fluss. Verbindet sich auf natürliche Weise mit SharePoint, Excel, Dataverse, Und OutlookDie
KI - Dokumentenparser in n8n
Selbst gehostet oder Cloud n8n Workflows. Das Dropdown-Menü „KI-Analysator-ID“ lädt Ihre gespeicherten Analysatoren direkt aus Ihrem Konto.
KI - Dokumentenparser in Zapier
Trigger-KI-Extraktion aus über 6.000 Quellen SaaS Apps und Webhooks. Geben Sie Ihre gespeicherte Classify Analyzer-ID in das Feld „KI-Analyzer-Name“ ein.

Häufig gestellte Fragen

How is Classify different from Parse in AI Document Parser?+
Parse holds a single Document Schema and returns its extracted fields. Classify holds multiple Schemas, one per document variant, each with its own Classification Prompt and Document Schema. At runtime the AI picks the best-matching Schema and returns its fields plus the Classification Name. Use Classify when one Analyzer must handle several layouts.
What is the Classification Prompt?+
A natural-language description of the markers that identify this document variant. Mention the company name printed at the top, the contact email, layout cues, anything distinctive. The AI compares every Schema Classification Prompt against the incoming PDF to pick the best match.
Can each Schema have different fields?+
Yes. Each Schema has its own Document Schema, so Client ABC can extract invoiceNumber and invoiceDate while Client XYZ extracts invoiceNumber, customerRef, and PONumber. The response contains exactly the fields defined in the matched Schema.
What does fieldMethod: generate do?+
Inside a Document Schema, fieldMethod controls how the AI fills the value. generate tells the AI to derive or normalize the value rather than copy a substring verbatim. Useful for dates (normalize multiple formats), totals (compute or normalize), and identifiers that may need cleanup. Omit fieldMethod for straight extraction.
How many Schemas can I add to one Analyzer?+
No hard cap published. In practice, 5 to 20 well-described Schemas per Analyzer perform best. If you need dozens, group similar variants under broader Classification Names and let the Document Schema handle the small differences.
Does the Analyzer Id change after Save Changes?+
No. The Analyzer Id is the string you typed in the Add row in Step 2 (for example client_invoices). It stays stable across edits and is the value every API call and automation module uses.
Do I need to upload a sample PDF when setting up the Analyzer?+
No. The AI Analyzer does not need a sample for setup. You describe each variant in natural language via the Classification Prompt; the AI engine applies the prompts to whatever document you send at runtime.
What happens if the incoming PDF does not match any Schema confidently?+
The AI still returns its best guess. To handle ambiguous cases, add a catch-all Schema with a generic Classification Prompt and a minimal Document Schema, or route low-confidence responses to a manual review queue in your automation.

Hilfe erhalten