Estrai risorse da PDF utilizzando n8n azione
PDF4me Estrarre risorse estrae il contenuto testuale e le immagini incorporate da PDF Documenti tramite n8n Flussi di lavoro automatizzati. Processo PDFs via n8n trigger, dati binari, stringhe base64 o pubblico URLConsente di estrarre automaticamente testo, immagini, grafica ed elementi visivi con targeting specifico per pagina, opzioni di estrazione selettiva (solo testo, solo immagini o entrambi) e formattazione strutturata dell'output. Questa soluzione è ideale per flussi di lavoro di riutilizzo dei contenuti, estrazione di immagini, analisi del testo, digitalizzazione di documenti, migrazione di contenuti e recupero di risorse che richiedono un'estrazione accurata dei contenuti con targeting flessibile e integrazione perfetta.
Impostare
Aggiungi il PDF4me nodo "Estrai risorse" al tuo n8n flusso di lavoro e configurare i parametri richiesti. Per le istruzioni di configurazione iniziale, consultare il nostro n8n Guida all'integrazione.
Prerequisiti:
- PDF4me API credenziali
- n8n accesso al flusso di lavoro
Configurazione:
- Aggiungere PDF4me nodo al flusso di lavoro
- Seleziona l'azione "Estrai risorse".
- Configura i parametri di input (vedi sotto)

Parametri
Elenco completo dei parametri per l'azione Estrai risorse. Configura questi parametri per controllare l'estrazione delle risorse.
Importante: I parametri contrassegnati da un asterisco (***) sono obbligatori e devono essere forniti affinché l'azione funzioni correttamente.
| Parametro | Tipo | Descrizione | Esempio |
|---|---|---|---|
| Tipo di dati di input*** | String | PDF Selezione del formato di input • Scegli il formato del tuo PDF immissione dati • PDF4me supporta più tipi di input • Opzioni: Dati binari, Base64 Corda o URL | Binary Data |
| Campo binario di input | Binario | Binario PDF Inserimento file (Obbligatorio se si tratta di dati binari) • Riferimento PDF file da precedente n8n caricamento del nodo o del file • PDF4me processi binari PDF file con rilevamento automatico del formato • Obbligatorio quando il tipo di dati di input è "Dati binari" | {{ $binary.data }} |
| Contenuto PDF in formato Base64 | String | Base64 Codificato PDF Input (Obbligatorio se Base64 Corda) • Fornire PDF contenuto come stringa codificata in base64 • PDF4me decodifica ed elabora automaticamente il PDF contenuto • Obbligatorio quando il tipo di dati di input è "Base64 Corda" | JVBERi0x... |
| URL del PDF | String | pubblico PDF URL Input (Obbligatorio se URL) • Fornire un'autorizzazione pubblica/aperta URL per il PDF file • PDF4me scarica ed elabora il file da URL • Obbligatorio quando il tipo di dati di input è "URL" | https://abc.com/xyz.pdf |
| Nome del documento*** | String | Nome del file di input • Specificare il nome dell'input PDF file • Utilizzato per il rilevamento del formato e l'ottimizzazione dell'elaborazione • Deve includere l'estensione .pdf | document.pdf |
| Testo estratto | Boolean | Attiva/disattiva estrazione testo • Attiva o disattiva l'estrazione del contenuto testuale • Quando abilitata, estrae tutto il contenuto testuale leggibile • Mantiene le informazioni di formattazione | true |
| Estrai immagini | Boolean | Attiva/disattiva estrazione immagine • Abilita o disabilita l'estrazione delle immagini • Quando abilitata, estrae tutte le immagini e la grafica incorporate • Elementi visivi salvati come file separati | true |
Opzioni avanzate
Nella sezione Opzioni avanzate sono disponibili i seguenti parametri, che sono facoltativi:
| Parametro | Tipo | Descrizione | Esempio |
|---|---|---|---|
| Pagine | String | Specifiche dell'intervallo di pagine • Definire quali pagine elaborare per l'estrazione delle risorse • Utilizzare "all" per l'intero documento, per numeri specifici o per intervalli. • Esempi: "1,3,5" (pagine specifiche), "1-5,10-15" (intervalli) | all |
| Profili personalizzati | String | Profili di configurazione personalizzati • Imposta opzioni aggiuntive utilizzando profili personalizzati • JSON-formato simile contenente parametri predefiniti • Consente impostazioni avanzate per l'elaborazione dell'estrazione • Opzionale per esigenze specifiche | { "outputDataFormat": "json" } |
Produzione
Parametri di output
| Parametro | Tipo | Descrizione | Esempio |
|---|---|---|---|
| Nome file | String | PDF4me nome file generato - Il nome completo del file del documento elaborato correttamente, con estensione e data/ora appropriate. PDF4me Garantisce una denominazione univoca e convalida la conformità del formato dei file per una perfetta integrazione con i processi a valle. | extracted_resources_1756999816629.json |
| tipo mime | String | PDF4me MIME tipo di dizionario - Lo standardizzato MIME tipo per il file di contenuto estratto, in genere application/json per dati strutturati o application/zip per più file. Ciò garantisce una corretta gestione e riconoscimento dei file in tutti i sistemi e le applicazioni. | application/json |
| Dimensione file | Numero | PDF4me dimensione del file in byte - La dimensione esatta in byte del file di contenuto estratto, fornita per la pianificazione dello storage, l'ottimizzazione della larghezza di banda e il monitoraggio del trasferimento dei file. Essenziale per la gestione documentale aziendale e l'automazione dei flussi di lavoro. | 1945 |
| successo | Boolean | PDF4me indicatore dello stato di estrazione - Flag booleano che indica il successo o il fallimento del processo di estrazione delle risorse. Restituisce true per estrazioni riuscite e false per eventuali errori, consentendo una gestione degli errori efficace nei flussi di lavoro automatizzati | true |
| messaggio | String | PDF4me messaggio sullo stato dell'estrazione - Messaggio descrittivo che indica il risultato del processo di estrazione delle risorse. Fornisce messaggi di stato chiari per le estrazioni riuscite e informazioni dettagliate sugli errori a scopo di risoluzione dei problemi. | Resource extraction completed successfully |
| docName | String | PDF4me riferimento al nome del documento originale - Il nome del file originale dell'input PDF file elaborato. Questo riferimento viene mantenuto per scopi di audit trail, debug e tracciamento dell'origine del contenuto estratto nei flussi di lavoro aziendali. | document.pdf |
N8N Risposta all'azione
IL PDF4me Estrarre risorse API Restituisce una risposta che può essere visualizzata in diversi formati. Scegli la visualizzazione più adatta alle tue esigenze:
- JSON
- Table
- Schema
- Binary
JSON Formato di risposta
Il grezzo JSON risposta da API:
{
"fileName": "extracted_resources_1756999816629.json",
"mimeType": "application/json",
"fileSize": 1945,
"success": true,
"message": "Resource extraction completed successfully",
"docName": "document.pdf"
}
Visualizzazione tabella
Dati di risposta in formato tabellare strutturato:
| Parametro | Valore |
|---|---|
| fileName | extracted_resources_1756999816629.json |
| mimeType | application/json |
| fileSize | 1945 |
| success | true |
| docName | document.pdf |
| message | Resource extraction completed successfully |
Vista dello schema
Struttura dei dati e tipologie di risposta:
fileName: AB extracted_resources_1756999816629.json
mimeType: AB application/json
fileSize: # 1945
success: ✓ true
docName: AB document.pdf
message: AB Resource extraction completed successfully
Indicatori di tipo:
AB= String#= Numerico✓= Boolean
Visualizzazione dei dati binari
Dati e metadati del contenuto effettivamente estratti:
data
─────────────────────────────────────────
File Name: extracted_resources_1756999816629.json
File Extension: json
Mime Type: application/json
File Size: 1.9 KB
Casi d'uso
Sistemi di gestione dei contenuti: Estrai testo e immagini da PDF documenti per repository di contenuti centralizzati, che consentono la creazione di database ricercabili di contenuti documentali.
Pipeline di elaborazione dati: Estrarre automaticamente dati strutturati da PDF Report, fatture e moduli per l'integrazione con strumenti di business intelligence e piattaforme di analisi.
Analisi del documento: Elaborare grandi volumi di PDF documenti per estrarre informazioni specifiche ai fini del monitoraggio della conformità, della ricerca e della creazione di report automatizzati.
Digitalizzazione dell'archivio: Convertire il sistema legacy PDF trasforma gli archivi in dati strutturati e ricercabili per i moderni sistemi di gestione dei contenuti e di scoperta della conoscenza.