Passa al contenuto principale

AI - Analizzatore di documenti in n8n

Cosa fa questo nodo

PDF4me Analizzatore di documenti basato sull'IA estrae dati strutturati da qualsiasi documento eseguendo un processo salvato AI Analizzatore dal tuo PDF4me conto rispetto al file. A differenza dei parser fissi (AI-Invoice Parser, AI-Process Contract), si sceglie il AI ID analizzatore da un menu a tendina di analizzatori configurati nel PDF4me dashboard, quindi lo stesso nodo gestisce fatture, ordini di acquisto, ricevute, moduli personalizzati, rapporti di laboratorio, modelli interni, qualsiasi cosa tu descriva in uno schema. Usa un Analizza Analizzatore per un singolo schema o un Classificare Analizzatore per numerose varianti di documenti in una sola chiamata. Restituisce risultati dinamici. JSON indicizzato dal tuo schema più un _metadati blocco, nessun file binario.

Articoli correlati del blog
Non ci sono ancora post sul blog dedicati a questa funzionalità — in arrivo a breve.
Nel frattempo, dai un'occhiata al blog di PDF4me per trovare tutorial e procedure operative su tutte le piattaforme.
Visita il blog

Esempio di fattura per test

Utilizza questa fattura di esempio del fornitore per confermare che il nodo funzioni end-to-end prima di indirizzare il flusso di lavoro ai dati reali. Mappala come input binario e selezionalo default_invoice_extraction come il AI ID analizzatore.

Autenticazione del tuo API Richiesta

Ogni PDF4me nodo in n8n richiede un valido Credenziali per connettersi con. Crea o selezionane uno che contenga il tuo PDF4me API chiave affinché il flusso di lavoro possa autenticarsi AI richieste di estrazione in modo sicuro. Le stesse credenziali alimentano anche AI ID analizzatore menu a tendina tramite GetAnalyzerId API.

Configura prima il tuo analizzatore

URL delle dashboard che utilizzerai in questa guida:
Crea innanzitutto il tuo Analyzer (necessario per ogni piattaforma)
AI - Document Parser esegue un Analyzer salvato dalla dashboard per sviluppatori di PDF4me. Scegli "Parse" per uno schema di documento singolo oppure "Classify" per indirizzare diverse varianti (Cliente ABC, Cliente XYZ, fattura generica) in un'unica chiamata. Lo stesso ID dell'Analyzer funziona su Make, Zapier, Power Automate, n8n e l'API REST.

Informazioni importanti da non perdere

Hai configurato l'analizzatore nella dashboard, il nodo fa solo riferimento ad esso
Definisci schema, campi e prompt una volta nel Elenco degli analizzatori E Dettagli dell'analizzatore pagine (Analizza per uno schema, classifica per molte varianti). Il n8n il nodo carica i tuoi analizzatori nel AI ID analizzatore Il menu a tendina esegue l'opzione selezionata. La modifica dello schema in un secondo momento non richiede di intervenire sul flusso di lavoro.
L'output è dinamico JSONnessun file binario
Le chiavi di primo livello corrispondono ai nomi dei campi definiti nell'Analizzatore (stringa, numero, data o righe di tabella). _metadati L'oggetto viene sempre aggiunto con successo, messaggio, timestamp, nome del file sorgente, ID dell'analizzatore e operazione. Non c'è Nome del campo binario di output.
La scelta tra Parse e Classify è decisa dall'Analizzatore, non dal nodo.
Stesso nodo, due modalità di analisi. A Analizza L'analizzatore restituisce i campi dal suo schema singolo. Classificare L'analizzatore instrada il documento allo schema più corrispondente e restituisce il suo nome di classificazione. più i campi estratti dello schema corrispondente. Cambia comportamento cambiando l'ID.
Il nodo n8n del parser di documenti AI mostra le credenziali Pdf4me, l'estrazione delle risorse, le operazioni di estrazione del parser di documenti AI, il tipo di dati di input Dati binari, il campo binario di input dati, il nome del documento document.pdf e il menu a tendina ID dell'analizzatore AI non impostato (evidenziato come necessario).

Pannello nodo completo: Estrai → AI Analizzatore di documenti con input di dati binari. Scegli un AI ID analizzatore prima di correre.

Parametri

URL delle dashboard che utilizzerai in questa guida:

Richiesto nel n8n Interfaccia utente: Credenziali di connessione, Tipo di dati di input, Nome del documento, AI ID analizzatore. I campi obbligatori condizionali (campo binario di input, contenuto del documento Base64 o URL del documento) vengono visualizzati solo quando viene scelto il tipo di dati di input corrispondente. Non c'è Nome del campo binario di output e no Opzioni avanzate / Profili personalizzati su questa operazione.

ParametroNecessarioCosa faEsempio
Input Data TypeYesHow the document is supplied. Binary Data reads from a previous node (default, most common). Base64 String accepts an encoded document. URL downloads the document from a public link.Binary Data
Input Binary FieldConditionalName of the binary property on the incoming n8n item that holds the document. Required when Input Data Type is Binary Data. Defaults to data. Error reports which property was missing when the name is wrong.data
Base64 Document ContentConditionalBase64-encoded document. Required when Input Data Type is Base64 String. Data-URL style prefixes (text before the comma) are stripped automatically.JVBERi0xLjQK...
Document URLConditionalPublicly reachable HTTPS URL to the document. Required when Input Data Type is URL. Must be a valid full URL.https://example.com/document.pdf
Document NameYesFilename used by PDF4me for processing. Default document.pdf. With Binary Data, the uploaded file name is used for upload but your explicit Document Name value takes precedence in the API call when set. Use a real extension (.pdf, .png, .jpg, etc.) so PDF4me handles the file correctly.document.pdf
AI Analyzer IdYesThe saved Analyzer that controls extraction. Create Analyzers at https://dev.pdf4me.com/dashboard/#/ai-document-parser/ (+ Add), then edit schemas on https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>. Dropdown populated via GetAnalyzerId API. Sent as customisationNote. Pick Parse for one schema or Classify for many variants.aaaa133

Opzioni del tipo di dati di input

Scegli come il documento entra nel nodo. I campi successivi cambieranno in base a questa scelta.

Menu a tendina Tipo di dati di input nel nodo n8n PDF4me AI Document Parser che mostra tre opzioni: Dati binari evidenziati con descrizione Utilizza il file del documento dal nodo precedente, Stringa Base64 con descrizione Fornisci il contenuto del documento come stringa codificata in base64, URL con descrizione Fornisci l'URL del file del documento

Tipo di dati di input. Dati binari (predefinito), stringa Base64 o URL.

Dati binariPredefinito: file dal nodo precedente
Legge il documento direttamente da un nodo precedente come Google Drive Download, HTTP Richiesta, lettura file binario o nodo allegato e-mail. Imposta Campo binario di input al nome del campo binario (predefinito) datiIl nome del file caricato viene utilizzato a meno che non si sovrascriva il nome del documento.
Stringa Base64Documento codificato in linea
Incolla o mappa una stringa base64 in Contenuto del documento in Base64I prefissi in stile URL dati (testo prima della virgola) vengono rimossi automaticamente. Nome reale con l'estensione corretta guida il rilevamento del formato.
URLScarica da un link pubblico
Fornire un pubblico HTTPS URL In Documenti. PDF4me recupera direttamente il documento. Il nome del file per l'elaborazione viene preso da URL percorso quando possibile, oppure dal nome del documento.

AI Menu a tendina ID analizzatore

Il menu a tendina viene popolato dal tuo PDF4me account tramite il GetAnalyzerId API quando apri il campo. Ogni opzione è un Analizzatore che hai salvato nel PDF4me dashboard. Scegli quella il cui schema corrisponde al tipo di documento che stai elaborando.

Apri il menu a tendina ID dell'analizzatore AI nel nodo n8n PDF4me AI Document Parser che mostra tre opzioni di esempio dell'analizzatore: aaaa133, TestTenantProject, TestTenant

AI Menu a tendina ID analizzatore caricato dal tuo PDF4me account.

Analizzatore di analisi sintattica
Schema di un documento. Il nodo restituisce esattamente i campi definiti in quello schema. Ideale quando ogni documento elaborato condivide la stessa famiglia di layout. Vedi il Guida alla configurazione di Parse per le regole dello schema incluse Tipo di campo: "tabella" per righe annidate e metodo di campo (estrai predefinito, genera per derivare/normalizzare).
Analizzatore di classificazione
Molti schemi, uno per variante di documento. AI instrada il documento in entrata allo schema più corrispondente utilizzando il prompt di classificazione di ciascuno schema, quindi restituisce il nome della classificazione corrispondente più i relativi campi. Vedi il Guida alla configurazione di Classify.

Menu a tendina vuoto? Il nodo mostra "GetAnalyzerId non ha restituito alcuna opzione di analizzatore" quando il tuo account non ha analizzatori o quando le credenziali non riescono a raggiungere il API. Apri il Elenco degli analizzatori e aggiungere almeno un analizzatore sul Dettagli dell'analizzatore pagina, quindi verifica la API chiave nel tuo n8n credenziale.

Campi di output

Una corsa di successo restituisce uno n8n articolo con JSON solo, nessun file binario. Le chiavi di livello superiore corrispondono allo schema dell'analizzatore; un _metadata L'oggetto viene sempre aggiunto in coda.

CampoTipoCosa contiene
Top-level extracted fieldsDynamicOne key per field defined in your Analyzer schema (string, number, date, or nested table rows). Names match fieldName exactly.
_metadata.successBooleantrue on a successful parse.
_metadata.messageString"Document parsed successfully using AI Document Parser".
_metadata.processingTimestampStringISO timestamp of the parse.
_metadata.sourceFileNameStringDocument name used for processing.
_metadata.aiAnalyzerIdStringThe Analyzer Id you selected (sent as customisationNote to the API).
_metadata.operationString"aiDocumentParser".
rawContent (fallback only)StringIf the API returns plain text instead of JSON and parsing fails, the node wraps the response as { "rawContent": "<api response string>" } at the top level.

Configurazione rapida

  1. Costruisci prima il tuo analizzatore. Apri il Elenco degli analizzatori, clicca + Aggiungi, digita un ID analizzatore chiaro, scegli Analizza O Classificare, salva la riga, quindi aggiungi uno schema di documento su Dettagli dell'analizzatore pagina. Vedi la Guida alla configurazione di Parse O Guida alla configurazione di Classify per le regole complete dello schema, incluso fieldType: "table" per righe annidate e fieldMethod (estrarre o generare).
  2. Nel tuo n8n flusso di lavoro, clicca + e cercare PDF4me. Impostato Risorsa A Estrarre E Operazioni di estrazione A Analizzatore di documenti basato sull'IA.
  3. In Credenziali per connettersi con, seleziona il tuo PDF4me credenziali o incolla un API chiave.
  4. Impostato Tipo di dati di inputI dati binari (impostazione predefinita) vengono letti dal nodo precedente e sono i più comuni.
  5. Inserisci il campo di input corrispondente (Campo binario di input, Contenuto del documento in Base64, O Documenti).
  6. Nome reale. Sovrascrivi l'impostazione predefinita document.pdf utilizzare il nome file reale con l'estensione corretta.
  7. Scegli un AI ID analizzatore dal menu a tendina (caricato dal tuo account).
  8. Esegui il nodo. L'elemento di output contiene i campi analizzati al livello superiore più _metadataInstrada i dati verso Set, Code, Google Sheets, Airtable, un database, un'e-mail o qualsiasi nodo successivo.

Configurazioni tipiche

Esempi di flusso di lavoroCommon n8n workflow patterns using AI Document Parser.
Allegato via email a Fogli Google
  1. Il trigger di posta elettronica (IMAP) si attiva su un nuovo messaggio con PDF allegato.
  2. AI Il parser del documento viene eseguito con il tipo di dati di input Dati binari, il nome del documento impostato sul nome del file allegato, AI ID dell'analizzatore impostato sul tuo analizzatore di fatture Analizzatore.
  3. Fogli Google Aggiungere Scrive il numero della fattura, il nome del fornitore, l'importo totale e la data di scadenza nel sistema di monitoraggio dei fornitori.
Casella di posta multi-venditore con Classify
  1. La cartella monitorata riceve risultati misti PDFs dal Cliente ABC, dal Cliente XYZ e da una lunga coda.
  2. AI Il parser del documento è impostato su un ID dell'analizzatore di classificazione (uno schema per fornitore).
  3. Un nodo Switch si dirama in base al nome di classificazione corrispondente restituito nella risposta, inviando ciascun risultato alla tabella a valle corrispondente.
Documento ospitato da URL
  1. Il webhook riceve un link a un documento dal tuo portale.
  2. AI Il parser del documento viene eseguito con il tipo di dati di input URL e l'ID del tuo analizzatore di moduli personalizzati.
  3. Produzione JSON viene mappato in una scrittura Dataverse/Airtable/Postgres per creare un nuovo record.
Scansiona, ritaglia automaticamente, quindi analizza
  1. L'output dello scanner viene salvato in una cartella con bordi spessi.
  2. Ritaglio automatico del documento tramite IA (Risorsa AI) ritaglia i bordi.
  3. AI Document Parser viene eseguito sul file binario ritagliato con l'ID dell'analizzatore corrispondente.
  4. Analizzato JSON Il flusso a valle procede come di consueto.
Convalida e poi arricchisci
  1. AI Il parser del documento restituisce i campi strutturati.
  2. Un nodo Codice convalida i campi obbligatori e applica le regole aziendali.
  3. Se valido, un HTTP La richiesta viene arricchita con i dati del fornitore presenti nel tuo CRM; in caso contrario, viene inviato un avviso a Slack per una revisione manuale.

Consigli pratici

Set up the Analyzer in PDF4me first
The node does not define extraction rules. It runs whatever your selected Analyzer specifies. Build it in the dashboard before configuring the node.
Use Document Name with the real extension
PDF4me uses the extension for format detection. Even on Binary Data, an explicit Document Name with the correct extension is safest.
No Output Binary Field Name and no Advanced Options
Unlike AI Auto Crop Document, this operation has neither. The output is JSON only; there is nothing to write back as a binary file.
Plain-text fallback wraps as rawContent
If the API returns plain text instead of JSON and parsing fails, the node wraps the response as { "rawContent": "<string>" } so the workflow does not break.
Combine with AI Auto Crop Document for scans
Scans with wide borders parse better after cropping. Chain AI Auto Crop Document (Resource AI) before this node.
Use AI-Invoice Parser / AI-Process Contract for built-in schemas
When you only need standard invoice or contract fields, the dedicated nodes are simpler. AI Document Parser shines when you have a custom schema.

Risoluzione dei problemi

"AI È richiesto l'ID dell'analizzatore.

Selezionare un analizzatore dal menu a tendina prima di avviare il programma. Il campo non può rimanere vuoto.

"Nessun dato binario trovato nella proprietà '…'"

Allineare Campo binario di input con il nodo precedente (spesso datiL'errore segnala quale proprietà mancava.

"È necessario fornire il contenuto del documento"

File base64 vuoto o mancante. Fornire il contenuto nel campo Tipo di dati di input corrispondente.

"Non valido URL formato"

Controllo Documenti è un documento completo e valido URL (schema + host + percorso).

"GetAnalyzerId non ha restituito alcuna opzione di analizzatore"

Nessun analizzatore sull'account o un problema di credenziali. Crea un analizzatore nell' PDF4me dashboard o verificare il API chiave nel n8n credenziale.

Foglio riassuntivo

CampoValore
ResourceExtract
OperationAI Document Parser
Input Data TypeBinary Data
Input Binary Fielddata
Document Nameform.pdf (with the real extension)
AI Analyzer Id(pick from the dropdown loaded from your account)
CredentialsPDF4me API credential

Domande frequenti

Where does the AI Analyzer Id list come from?+
The dropdown is populated from your PDF4me account via the GetAnalyzerId API. Each option is an Analyzer you created at https://dev.pdf4me.com/dashboard/#/ai-document-parser/ with schemas on https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>. The node sends the selected value as customisationNote to the AiDocumentParser API.
What does "GetAnalyzerId returned no analyzer options" mean?+
The account has no Analyzers configured, or the credentials cannot reach the GetAnalyzerId endpoint. Open https://dev.pdf4me.com/dashboard/#/ai-document-parser/ and create at least one Analyzer (Parse or Classify) on the Analyzer detail page, or verify the API key in your n8n credential.
How is this different from AI-Invoice Parser, AI-Process Contract, AI-Process Bank Cheque?+
Those nodes use fixed schemas tuned to those document types. AI Document Parser is schema-driven: it runs whatever Analyzer you select, so the same node handles invoices, purchase orders, receipts, custom forms, lab reports, anything you describe in a schema. Pick AI Document Parser whenever you need a custom layout or document type.
What shape does the output have?+
Top-level keys match the field names in your Analyzer schema (for example customerName, invoiceNumber, totalAmount, lineItems). Nested objects and table arrays follow the same shape you defined. A _metadata object is always appended with success, message, processingTimestamp, sourceFileName, aiAnalyzerId, and operation. No binary file is returned.
Does this work on scanned PDFs?+
Yes. The AI engine handles OCR internally, so scanned PDFs and image formats work the same as native PDFs. If borders are large, chain AI Auto Crop Document (Resource AI) before this node for cleaner extraction.
Can I change the Analyzer schema without rebuilding the workflow?+
Yes. The workflow only references the Analyzer Id. Edit the schema in the PDF4me dashboard and the next run picks up the new shape automatically. Output keys follow your latest schema, so any downstream Set / Code / Sheets nodes that assume specific keys may need updating after a breaking schema change.
Can I switch between Parse and Classify Analyzers without rewiring the node?+
Yes. Both Analyzer types are listed in the AI Analyzer Id dropdown. Pick a Classify Analyzer when you want one node to handle several document variants; pick a Parse Analyzer for a single fixed schema. The output shape adapts to whichever you choose.
What happens when the API returns plain text instead of JSON?+
The node tries to parse it; if parsing fails, the response is wrapped as { "rawContent": "<api response string>" } at the top level so the workflow does not break. Useful for inspecting unexpected responses during development.

Azioni correlate

Stessa attività su altre piattaforme

Richiedi assistenza