Passa al contenuto principale

Estrai allegato da PDF utilizzando n8n azione

PDF4me Estrai allegato da PDF estrae i file incorporati da PDF Documenti tramite n8n Flussi di lavoro automatizzati. Processo PDFs via n8n trigger, dati binari, stringhe base64 o pubblico URLper rilevare ed estrarre automaticamente documenti allegati, immagini, fogli di calcolo, file di dati e altri contenuti incorporati con integrità dei file preservata, conservazione dei metadati e supporto multiformato (PDF(ad esempio, DOC, XLS, immagini, ecc.). Questa soluzione è ideale per l'analisi di documenti, il recupero di file, l'estrazione di prove, la gestione degli allegati, i flussi di lavoro di estrazione dati e l'elaborazione completa di documenti che richiedono un'estrazione affidabile di file incorporati con integrazione perfetta.

Articoli correlati del blog
Non ci sono ancora post sul blog dedicati a questa funzionalità — in arrivo a breve.
Nel frattempo, dai un'occhiata al blog di PDF4me per trovare tutorial e procedure operative su tutte le piattaforme.
Visita il blog

Impostare

Aggiungi il PDF4me "Estrai allegato da PDF" nodo al tuo n8n flusso di lavoro e configurare i parametri richiesti. Per le istruzioni di configurazione iniziale, consultare il nostro n8n Guida all'integrazione.

Prerequisiti:

  • PDF4me API credenziali
  • n8n accesso al flusso di lavoro

Configurazione:

  1. Aggiungere PDF4me nodo al flusso di lavoro
  2. Seleziona "Estrai allegato da PDF"azione
  3. Configura i parametri di input (vedi sotto)
Estrai l'allegato dal PDF

Parametri

Elenco completo dei parametri per Estrai allegato da PDF azione. Configura questi parametri per controllare l'estrazione degli allegati.

Importante: I parametri contrassegnati da un asterisco (***) sono obbligatori e devono essere forniti affinché l'azione funzioni correttamente.

ParametroTipoDescrizioneEsempio
Tipo di dati di input***StringPDF Selezione del formato di input
• Scegli il formato del tuo PDF immissione dati
PDF4me supporta più tipi di input
• Opzioni: Dati binari, Base64 Corda o URL
Binary Data
Campo binario di inputBinarioBinario PDF Inserimento file (Obbligatorio se si tratta di dati binari)
• Riferimento PDF file da precedente n8n caricamento del nodo o del file
PDF4me processi binari PDF file con rilevamento automatico del formato
• Obbligatorio quando il tipo di dati di input è "Dati binari"
{{ $binary.data }}
Contenuto del documento in Base64StringBase64 Codificato PDF Input (Obbligatorio se Base64 Corda)
• Fornire PDF dati come stringa codificata in base64
PDF4me decodifica ed elabora automaticamente il PDF contenuto
• Obbligatorio quando il tipo di dati di input è "Base64 Corda"
UEsDBBQABgAI...
Server di fileStringpubblico PDF URL Input (Obbligatorio se URL)
• Fornire un'autorizzazione pubblica/aperta URL per il PDF file
PDF4me scarica ed elabora il file da URL
• Obbligatorio quando il tipo di dati di input è "URL"
https://abc.com/sample.pdf
Nome del documento***StringFonte PDF Riferimento
• Specificare il nome della fonte PDF file
• A fini di riferimento e tracciamento nell'estrazione
• Aiuta con il tracciamento dell'elaborazione
document.pdf

Opzioni avanzate

Nella sezione Opzioni avanzate sono disponibili i seguenti parametri, che sono facoltativi:

ParametroTipoDescrizioneEsempio
Profili personalizzatiObjectConfigurazione di estrazione
• Oggetto di configurazione avanzata per personalizzare il comportamento di estrazione
• Supporta formati di output e opzioni di elaborazione
JSON formato per la specifica flessibile dei parametri
• Opzionale per esigenze specifiche
{"outputDataFormat": "json", "extractMetadata": true}

Tipi di allegati supportati

CategoriaTipi di fileDescrizione
DocumentiPDF, DOC, DOCX, TXT, RTF, ODTDocumenti di testo e file d'ufficio
ImmaginiJPG, JPEG, PNG, GIF, BMP, TIFF, SVGFile immagine e grafica
Fogli di calcoloXLS, XLSX, CSV, ODSFile di dati e fogli di calcolo
DatiJSON, XML, HTML, CSSFile web e di dati

Produzione

Parametri di output

ParametroTipoDescrizioneEsempio
DocumentiArrayPDF4me riferimento al documento di input - Riferimento ai documenti di input originali elaborati per l'estrazione. Null per questo tipo di operazionenull
outputDocumentiArrayPDF4me raccolta allegati estratti - Array di oggetti allegati estratti correttamente contenenti dati del file, metadati e proprietà dalla sorgente PDF documento[{"fileName": "sample.txt", "barcodeText": null, "docText": null, "image": null}]
traceIdStringPDF4me identificatore della traccia di elaborazione - ID di tracciamento univoco per il tracciamento della richiesta di estrazione tramite PDF4mepipeline di elaborazione per scopi di debug e verificanull
jobIdStringPDF4me identificatore di lavoro - ID univoco del job per l'operazione di estrazione. Nullo per le operazioni sincrone, popolato per l'elaborazione asincrona.null
statusUrlStringPDF4me monitoraggio dello stato URL - URL per verificare lo stato delle operazioni di estrazione asincrone. Null per le operazioni sincrone.null
Utilizzo dell'abbonamentoObjectPDF4me dati sull'utilizzo dell'abbonamento - Informazioni su API utilizzo e consumo di abbonamento per l'operazione di estrazionenull
_metadatiObjectPDF4me metadati dell'operazione - Oggetto metadati completo contenente informazioni sull'elaborazione, timestamp e dettagli dell'operazione{"success": true, "message": "Attachments extracted successfully"}
_metadati.successoBooleanPDF4me indicatore dello stato di estrazione - Boolean Indicatore che segnala il successo o il fallimento del processo di estrazione dell'attaccamento. PDF4me resi true per estrazioni riuscite e false per eventuali erroritrue
_metadata.messageStringPDF4me messaggio sullo stato dell'estrazione - Messaggio di stato leggibile dall'uomo che fornisce dettagli sul risultato del processo di estrazione. Include la conferma di successo o i dettagli di errore per la risoluzione dei problemi.Attachments extracted successfully
_metadata.processingTimestampStringPDF4me timestamp di elaborazione - Timestamp ISO 8601 che indica quando l'operazione di estrazione è stata completata da PDF4memotore di estrazione2025-09-23T20:04:09.290Z
_metadata.sourceFileNameStringPDF4me nome del file del documento sorgente - Nome file originale del PDF documento elaborato per l'estrazione degli allegatidocument.pdf
_operazione sui metadati.StringPDF4me tipo di operazione - Tipo di operazione eseguita da PDF4me'S API, sempre "extractAttachmentFromPdf" per questa azioneextractAttachmentFromPdf

Struttura dell'oggetto allegato estratto

CampoTipoDescrizioneEsempio
Nome fileStringPDF4me nome del file estratto - Nome file originale dell'allegato estratto così come appare nel codice sorgente PDF documentosample.txt
testo del codice a barreStringPDF4me contenuto del codice a barre - Contenuto testuale estratto da eventuali codici a barre presenti nell'allegato. Valore nullo se non sono presenti codici a barre.null
docTextStringPDF4me contenuto testuale del documento - Contenuto testuale estratto dal file allegato. Valore nullo se l'allegato non è un documento di testo.null
immagineStringPDF4me dati dell'immagine - Base64 Dati dell'immagine codificati se l'allegato è un file immagine. Null per allegati non immagine.null

N8N Risposta all'azione

IL PDF4me Estrai allegato da PDF API Restituisce una risposta che può essere visualizzata in diversi formati. Scegli la visualizzazione più adatta alle tue esigenze:

JSON Formato di risposta

Il grezzo JSON risposta da API:

[
{
"documents": null,
"outputDocuments": [
{
"fileName": "sample.txt",
"barcodeText": null,
"docText": null,
"image": null
}
],
"traceId": null,
"jobId": null,
"statusUrl": null,
"subscriptionUsage": null,
"_metadata": {
"success": true,
"message": "Attachments extracted successfully",
"processingTimestamp": "2025-09-23T20:04:09.290Z",
"sourceFileName": "document.pdf",
"operation": "extractAttachmentFromPdf"
}
}
]

Casi d'uso

Recupero del contenuto del documento

  • Ripristino di file incorporati: Utilizzare il outputDocuments matrice per recuperare i file incorporati PDF documenti, ripristinando l'accesso ai materiali di origine
  • Recupero del nome del file: Estrai i nomi dei file originali dal fileName campo per mantenere una corretta identificazione e organizzazione dei file
  • Recupero documenti smarriti: Ripristina i documenti che erano stati precedentemente incorporati in PDFma non sono più disponibili nei loro formati originali

Elaborazione e analisi dei contenuti

  • Analisi degli allegati: Elabora i singoli file dal outputDocuments raccolta per analizzare il contenuto, estrarre dati o eseguire operazioni specifiche su ciascun tipo di file
  • Elaborazione dei codici a barre: Utilizzare il barcodeText campo per estrarre ed elaborare le informazioni del codice a barre dagli allegati a fini di inventario, tracciamento o identificazione
  • Estrazione del contenuto testuale: Sfrutta il docText campo per estrarre contenuto testuale dagli allegati dei documenti per flussi di lavoro di ricerca, analisi o elaborazione dati

Automazione e integrazione dei flussi di lavoro

  • Distribuzione dei file: Distribuisce automaticamente gli allegati estratti ai sistemi, alle cartelle o agli utenti appropriati in base al tipo di file e all'analisi del contenuto.
  • Archiviazione dei contenuti: Utilizzare il _metadata.traceId e i risultati dell'estrazione per mantenere le tracce di controllo durante l'organizzazione dei file estratti in sistemi di archiviazione strutturati
  • Integrazione multisistemaIntegrare i file estratti con sistemi esterni di gestione documentale, piattaforme di archiviazione cloud o applicazioni aziendali.

Richiedi assistenza