Passa al contenuto principale

Estrai risorse da PDF utilizzando n8n azione

PDF4me Estrarre risorse estrae il contenuto testuale e le immagini incorporate da PDF Documenti tramite n8n Flussi di lavoro automatizzati. Processo PDFs via n8n trigger, dati binari, stringhe base64 o pubblico URLConsente di estrarre automaticamente testo, immagini, grafica ed elementi visivi con targeting specifico per pagina, opzioni di estrazione selettiva (solo testo, solo immagini o entrambi) e formattazione strutturata dell'output. Questa soluzione è ideale per flussi di lavoro di riutilizzo dei contenuti, estrazione di immagini, analisi del testo, digitalizzazione di documenti, migrazione di contenuti e recupero di risorse che richiedono un'estrazione accurata dei contenuti con targeting flessibile e integrazione perfetta.

Articoli correlati del blog
Non ci sono ancora post sul blog dedicati a questa funzionalità — in arrivo a breve.
Nel frattempo, dai un'occhiata al blog di PDF4me per trovare tutorial e procedure operative su tutte le piattaforme.
Visita il blog

Impostare

Aggiungi il PDF4me nodo "Estrai risorse" al tuo n8n flusso di lavoro e configurare i parametri richiesti. Per le istruzioni di configurazione iniziale, consultare il nostro n8n Guida all'integrazione.

Prerequisiti:

  • PDF4me API credenziali
  • n8n accesso al flusso di lavoro

Configurazione:

  1. Aggiungere PDF4me nodo al flusso di lavoro
  2. Seleziona l'azione "Estrai risorse".
  3. Configura i parametri di input (vedi sotto)
Configurazione delle risorse estraibili

Parametri

Elenco completo dei parametri per l'azione Estrai risorse. Configura questi parametri per controllare l'estrazione delle risorse.

Importante: I parametri contrassegnati da un asterisco (***) sono obbligatori e devono essere forniti affinché l'azione funzioni correttamente.

ParametroTipoDescrizioneEsempio
Tipo di dati di input***StringPDF Selezione del formato di input
• Scegli il formato del tuo PDF immissione dati
PDF4me supporta più tipi di input
• Opzioni: Dati binari, Base64 Corda o URL
Binary Data
Campo binario di inputBinarioBinario PDF Inserimento file (Obbligatorio se si tratta di dati binari)
• Riferimento PDF file da precedente n8n caricamento del nodo o del file
PDF4me processi binari PDF file con rilevamento automatico del formato
• Obbligatorio quando il tipo di dati di input è "Dati binari"
{{ $binary.data }}
Contenuto PDF in formato Base64StringBase64 Codificato PDF Input (Obbligatorio se Base64 Corda)
• Fornire PDF contenuto come stringa codificata in base64
PDF4me decodifica ed elabora automaticamente il PDF contenuto
• Obbligatorio quando il tipo di dati di input è "Base64 Corda"
JVBERi0x...
URL del PDFStringpubblico PDF URL Input (Obbligatorio se URL)
• Fornire un'autorizzazione pubblica/aperta URL per il PDF file
PDF4me scarica ed elabora il file da URL
• Obbligatorio quando il tipo di dati di input è "URL"
https://abc.com/xyz.pdf
Nome del documento***StringNome del file di input
• Specificare il nome dell'input PDF file
• Utilizzato per il rilevamento del formato e l'ottimizzazione dell'elaborazione
• Deve includere l'estensione .pdf
document.pdf
Testo estrattoBooleanAttiva/disattiva estrazione testo
• Attiva o disattiva l'estrazione del contenuto testuale
• Quando abilitata, estrae tutto il contenuto testuale leggibile
• Mantiene le informazioni di formattazione
true
Estrai immaginiBooleanAttiva/disattiva estrazione immagine
• Abilita o disabilita l'estrazione delle immagini
• Quando abilitata, estrae tutte le immagini e la grafica incorporate
• Elementi visivi salvati come file separati
true

Opzioni avanzate

Nella sezione Opzioni avanzate sono disponibili i seguenti parametri, che sono facoltativi:

ParametroTipoDescrizioneEsempio
PagineStringSpecifiche dell'intervallo di pagine
• Definire quali pagine elaborare per l'estrazione delle risorse
• Utilizzare "all" per l'intero documento, per numeri specifici o per intervalli.
• Esempi: "1,3,5" (pagine specifiche), "1-5,10-15" (intervalli)
all
Profili personalizzatiStringProfili di configurazione personalizzati
• Imposta opzioni aggiuntive utilizzando profili personalizzati
JSON-formato simile contenente parametri predefiniti
• Consente impostazioni avanzate per l'elaborazione dell'estrazione
• Opzionale per esigenze specifiche
{ "outputDataFormat": "json" }

Produzione

Parametri di output

ParametroTipoDescrizioneEsempio
Nome fileStringPDF4me nome file generato - Il nome completo del file del documento elaborato correttamente, con estensione e data/ora appropriate. PDF4me Garantisce una denominazione univoca e convalida la conformità del formato dei file per una perfetta integrazione con i processi a valle.extracted_resources_1756999816629.json
tipo mimeStringPDF4me MIME tipo di dizionario - Lo standardizzato MIME tipo per il file di contenuto estratto, in genere application/json per dati strutturati o application/zip per più file. Ciò garantisce una corretta gestione e riconoscimento dei file in tutti i sistemi e le applicazioni.application/json
Dimensione fileNumeroPDF4me dimensione del file in byte - La dimensione esatta in byte del file di contenuto estratto, fornita per la pianificazione dello storage, l'ottimizzazione della larghezza di banda e il monitoraggio del trasferimento dei file. Essenziale per la gestione documentale aziendale e l'automazione dei flussi di lavoro.1945
successoBooleanPDF4me indicatore dello stato di estrazione - Flag booleano che indica il successo o il fallimento del processo di estrazione delle risorse. Restituisce true per estrazioni riuscite e false per eventuali errori, consentendo una gestione degli errori efficace nei flussi di lavoro automatizzatitrue
messaggioStringPDF4me messaggio sullo stato dell'estrazione - Messaggio descrittivo che indica il risultato del processo di estrazione delle risorse. Fornisce messaggi di stato chiari per le estrazioni riuscite e informazioni dettagliate sugli errori a scopo di risoluzione dei problemi.Resource extraction completed successfully
docNameStringPDF4me riferimento al nome del documento originale - Il nome del file originale dell'input PDF file elaborato. Questo riferimento viene mantenuto per scopi di audit trail, debug e tracciamento dell'origine del contenuto estratto nei flussi di lavoro aziendali.document.pdf

N8N Risposta all'azione

IL PDF4me Estrarre risorse API Restituisce una risposta che può essere visualizzata in diversi formati. Scegli la visualizzazione più adatta alle tue esigenze:

JSON Formato di risposta

Il grezzo JSON risposta da API:

{
"fileName": "extracted_resources_1756999816629.json",
"mimeType": "application/json",
"fileSize": 1945,
"success": true,
"message": "Resource extraction completed successfully",
"docName": "document.pdf"
}

Casi d'uso

Sistemi di gestione dei contenuti: Estrai testo e immagini da PDF documenti per repository di contenuti centralizzati, che consentono la creazione di database ricercabili di contenuti documentali.

Pipeline di elaborazione dati: Estrarre automaticamente dati strutturati da PDF Report, fatture e moduli per l'integrazione con strumenti di business intelligence e piattaforme di analisi.

Analisi del documento: Elaborare grandi volumi di PDF documenti per estrarre informazioni specifiche ai fini del monitoraggio della conformità, della ricerca e della creazione di report automatizzati.

Digitalizzazione dell'archivio: Convertire il sistema legacy PDF trasforma gli archivi in dati strutturati e ricercabili per i moderni sistemi di gestione dei contenuti e di scoperta della conoscenza.

Richiedi assistenza