Passa al contenuto principale

PDF Estrai collegamenti ipertestuali in Make

Cosa fa questo modulo

PDF4me, PDF - Estrazione dei collegamenti ipertestuali legge ogni collegamento ipertestuale cliccabile da un PDF e li restituisce come dati strutturati, URL, testo di ancoraggio e numero di pagina per ogni collegamento, senza modificare il documento. Completamente non distruttivo. Mentre piattaforme come n8n è necessaria un'azione separata di PDF.co per ottenere questi dati, PDF4me lo fornisce nativamente come singolo Make modulo senza extra API o servizio richiesto.

Articoli correlati del blog
Non ci sono ancora post sul blog dedicati a questa funzionalità — in arrivo a breve.
Nel frattempo, dai un'occhiata al blog di PDF4me per trovare tutorial e procedure operative su tutte le piattaforme.
Visita il blog

Autenticazione della richiesta API

Ogni PDF4me modulo in Make richiede un valido Connessione. Crea o selezionane uno che contenga il tuo PDF4me API chiave affinché lo scenario possa richiamare in modo sicuro il servizio di estrazione dei collegamenti.

Informazioni importanti da non perdere

Tre campi per collegamento

Ogni elemento nell'array di output ti dà la destinazione URL, il visibile Link Text il lettore avrebbe cliccato e il Page Number appare su. Mappa uno o tutti e tre nel modulo successivo.

Completamente non distruttivo

Questo modulo legge soltanto, non restituisce un modificato PDFIl tuo documento originale, archiviato su Dropbox, Google Drive o in qualsiasi altra posizione, rimane completamente invariato. Puoi utilizzarlo liberamente all'inizio di qualsiasi flusso di lavoro di gestione dei link.

Eseguilo prima di eliminare il collegamento ipertestuale

Per prima cosa, estrai il file per registrare esattamente quali collegamenti sono presenti, quindi passa lo stesso file a Delete Hyperlink per la rimozione. Otterrai una traccia di controllo completa di ogni collegamento rimosso, utile per la conformità e le revisioni delle modifiche.

Il modulo PDF4me PDF Extract Hyperlinks mostra il campo Connessione vuoto con il pulsante Aggiungi, File impostato su Dropbox - Scarica un file con l'opzione Mappa qui sotto e il campo Sequenza pagina impostato su 2 con il suggerimento Inserisci i numeri di pagina da cui estrarre il collegamento ipertestuale, per più pagine inserisci come 2,5,6 o 1-2 o tutti

Inserisci una singola pagina, un elenco separato da virgole, un intervallo o all per scansionare ogni collegamento presente nell'intero documento.

Parametri

Necessario: Tutti e tre i parametri, Connection, File, E Page Sequence, deve essere fornito affinché il modulo funzioni.

ParametroNecessarioCosa faEsempio
ConnectionYesPDF4me API connection used to authenticate extraction requests. Click Add to create one with your API key.Your PDF4me connection
FileYesSource PDF to scan. Choose Dropbox - Download a File for a direct Dropbox trigger, or Map to supply the filename and binary content from a prior module.Dropbox - Download a File
Page SequenceYesWhich pages to scan for hyperlinks. Accepts a single page, comma-separated list, a range, or all to read the entire document at once.2 or 2,5,6 or 1-2 or all

Produzione

Il modulo restituisce un Hyperlinks array. Ogni elemento dell'array contiene:

CampoTipoDescrizione
HyperlinksArrayThe full collection of link objects returned by the module: one item per hyperlink found.
URLStringThe destination address of the hyperlink: a web URL or mailto address.
Link TextStringThe visible anchor text the reader would click on in the document.
Page NumberIntegerThe page in the PDF where the link appears.

Mappa uno qualsiasi di questi campi in una riga di Fogli Google, in un record di Airtable, HTTP richiesta o una condizione di filtro nella tua Make scenario.

Configurazione rapida

  1. Aggiungere PDF4mePDF - Estrazione dei collegamenti ipertestuali al tuo Make scenario.
  2. Seleziona Connection (oppure fai clic) Aggiungere per crearne uno con il tuo API chiave).
  3. Impostato File A Dropbox - Scarica un file O Mappa da un modulo precedente che produce un output PDF binario
  4. Inserisci le pagine da scansionare Page Sequence: utilizzo all per leggere tutti i link presenti nel documento contemporaneamente.
  5. Salva e clicca Eseguire una volta. L'output contiene un Hyperlinks array: aggiungi un Iteratore dopo questo modulo per scorrere ogni collegamento individualmente.

Esempi di flusso di lavoro

Esempi di flusso di lavoroCommon Make scenario patterns that use PDF - Extract Hyperlinks for auditing, cataloguing, and link management.
Individuare i collegamenti interrotti in una raccolta di documenti
  1. Google Drive attiva lo scenario quando un PDF viene aggiunto alla cartella "Report".
  2. PDF - Estrazione dei collegamenti ipertestuali scansioni con Page Sequence impostato su all.
  3. Un iteratore scorre il Hyperlinks vettore.
  4. HTTP fa un HEAD richiesta a ciascuno URL e un filtro verifica la presenza di risposte diverse da 200.
  5. Slack pubblica un avviso con il guasto URL e la pagina in cui è stato trovato.
Crea un catalogo di link ricercabile a partire dai PDF caricati
  1. Dropbox si attiva quando un nuovo file viene aggiunto alla cartella "Documenti condivisi".
  2. PDF - Estrazione dei collegamenti ipertestuali legge tutti i link presenti in ogni pagina.
  3. Un iteratore scorre il Hyperlinks vettore.
  4. Google Sheets aggiunge una riga per ogni collegamento, nome del documento, URL, Link Text, Page Numbere data estratta.
Prima di rimuovere i collegamenti, crea una traccia di controllo.
  1. Un webhook si attiva quando un documento viene approvato per la distribuzione esterna.
  2. PDF - Estrazione dei collegamenti ipertestuali registra ogni collegamento a un foglio Google, URL, Link Text, Page Numbere timestamp.
  3. PDF - Elimina collegamento ipertestuale quindi rimuove tutti i link da ogni pagina.
  4. Gmail invia il testo sanificato PDF al destinatario con una registrazione permanente di ciò che è stato rimosso.

Domande frequenti

What data does each extracted hyperlink contain?+
Each link object in the output array has three fields: URL (destination address), Link Text (the visible anchor text), and Page Number (which page it appears on). Map all three or just the ones your workflow needs.
Does it extract internal PDF bookmark links and table-of-contents navigation?+
No. The module focuses on URL hyperlinks: web addresses and mailto links. PDF bookmarks that power the navigation panel or table-of-contents click-through are not included in the output.
What page formats does Page Sequence accept?+
Single page like 2, comma-separated list like 2,5,6, a range like 1-2, or all to scan the entire document in one pass.
Is the output a flat list or grouped by page?+
Flat array. Each link object includes a Page Number field so you can group or filter in Make using an iterator and aggregator, or export to a spreadsheet and sort by page there.
Is my original PDF changed in any way?+
No. This module is purely read-only: it extracts link data without modifying or returning a new version of the document. Your source file in Dropbox, Google Drive, or any other location is completely untouched.

Moduli correlati

Richiedi assistenza