Aller au contenu principal

PDF Extraire les hyperliens dans Make

Que fait ce module ?

PDF4me, PDF - Extraire les hyperliens lit chaque lien hypertexte cliquable à partir d'un PDF et les renvoie sous forme de données structurées, URL, le texte d'ancrage et le numéro de page de chaque lien, sans modifier le document. Entièrement non destructif. Alors que des plateformes comme n8n nécessitent une action PDF.co distincte pour obtenir ces données, PDF4me le fournit nativement en tant que simple Make module sans supplément API ou service requis.

Articles de blog connexes
Il n'y a pas encore d'article de blog consacré à cette fonctionnalité — à venir prochainement.
En attendant, n'hésitez pas à consulter le blog de PDF4me pour découvrir des tutoriels et des procédures de travail adaptés à toutes les plateformes.
Consultez le blog

Authentification de votre requête API

Chaque PDF4me module dans Make nécessite un numéro valide ConnexionCréez ou sélectionnez-en un qui contient votre PDF4me API clé permettant au scénario d'appeler le service d'extraction de liens de manière sécurisée.

Informations importantes à ne pas manquer

Trois champs par lien

Chaque élément du tableau de sortie vous donne la destination URL, le visible Link Text le lecteur cliquerait, et le Page Number Il apparaît. Attribuez-en un ou plusieurs, voire les trois, au module suivant.

Totalement non destructif

Ce module effectue uniquement une lecture, il ne renvoie pas de valeur modifiée. PDFVotre document source, qu'il soit stocké sur Dropbox, Google Drive ou ailleurs, reste inchangé. Vous pouvez l'utiliser librement au début de n'importe quel processus de gestion de liens.

Exécutez-le avant de supprimer le lien hypertexte

Commencez par extraire le fichier pour consigner précisément les liens existants, puis transmettez-le à Delete Hyperlink pour suppression. Vous obtenez ainsi un historique complet de chaque lien supprimé, précieux pour la conformité et les revues de modifications.

Le module d'extraction de liens hypertextes de PDF4me affiche le champ Connexion vide avec un bouton Ajouter, le fichier sélectionné est Dropbox - Télécharger un fichier avec l'option Carte en dessous, et le champ Séquence de pages est défini sur 2 avec l'indication « Saisissez les numéros de page à partir desquels extraire le lien hypertexte ». Pour plusieurs pages, saisissez 2, 5, 6 ou 1-2 ou toutes les pages.

Saisissez une seule page, une liste séparée par des virgules, une plage de valeurs ou all analyser chaque lien dans l'ensemble du document.

Paramètres

Requis: Les trois paramètres, Connection, File, et Page Sequence, doit être fourni pour que le module puisse s'exécuter.

ParamètreRequisCe que cela faitExemple
ConnectionYesPDF4me API connection used to authenticate extraction requests. Click Add to create one with your API key.Your PDF4me connection
FileYesSource PDF to scan. Choose Dropbox - Download a File for a direct Dropbox trigger, or Map to supply the filename and binary content from a prior module.Dropbox - Download a File
Page SequenceYesWhich pages to scan for hyperlinks. Accepts a single page, comma-separated list, a range, or all to read the entire document at once.2 or 2,5,6 or 1-2 or all

Sortir

Le module renvoie un Hyperlinks tableau. Chaque élément du tableau contient :

ChampTaperDescription
HyperlinksArrayThe full collection of link objects returned by the module: one item per hyperlink found.
URLStringThe destination address of the hyperlink: a web URL or mailto address.
Link TextStringThe visible anchor text the reader would click on in the document.
Page NumberIntegerThe page in the PDF where the link appears.

Associez n'importe lequel de ces champs à une ligne Google Sheet ou à un enregistrement Airtable. HTTP requête, ou une condition de filtre dans votre requête Make scénario.

Configuration rapide

  1. Ajouter PDF4mePDF - Extraire les hyperliens à votre Make scénario.
  2. Sélectionner Connection (ou cliquez Ajouter pour en créer un avec votre API clé).
  3. Ensemble File à Dropbox - Télécharger un fichier ou Carte d'un module précédent qui produit un PDF binaire.
  4. Saisissez les pages à numériser Page Sequence: utiliser all lire tous les liens du document en une seule fois.
  5. Sauvegarder et cliquez Exécuter une foisLe résultat contient un Hyperlinks tableau : ajouter un Itérateur après ce module, pour parcourir chaque lien individuellement.

Exemples de flux de travail

Exemples de flux de travailCommon Make scenario patterns that use PDF - Extract Hyperlinks for auditing, cataloguing, and link management.
Détecter les liens brisés dans une bibliothèque de documents
  1. Google Drive déclenche ce scénario lorsqu'un PDF est ajouté au dossier « Rapports ».
  2. PDF - Extraire les hyperliens scans avec Page Sequence défini à all.
  3. Un itérateur parcourt les Hyperlinks tableau.
  4. HTTP fait un HEAD demande à chaque URL et un filtre vérifie les réponses autres que 200.
  5. Slack publie une alerte concernant la panne. URL et la page sur laquelle il a été trouvé.
Créer un catalogue de liens consultable à partir de fichiers PDF téléchargés
  1. Dropbox se déclenche lorsqu'un nouveau fichier arrive dans le dossier « Documents partagés ».
  2. PDF - Extraire les hyperliens lit tous les liens sur chaque page.
  3. Un itérateur parcourt les Hyperlinks tableau.
  4. Google Sheets ajoute une ligne pour chaque lien, nom de document, URL, Link Text, Page Numberet la date extraite.
Créez un historique des modifications avant de supprimer les liens.
  1. Un webhook se déclenche lorsqu'un document est approuvé pour diffusion externe.
  2. PDF - Extraire les hyperliens enregistre chaque lien dans une feuille Google. URL, Link Text, Page Numberet l'horodatage.
  3. PDF - Supprimer le lien hypertexte puis supprime tous les liens de chaque page.
  4. Gmail envoie les données nettoyées PDF au destinataire, avec une trace permanente de ce qui a été enlevé.

Foire aux questions

What data does each extracted hyperlink contain?+
Each link object in the output array has three fields: URL (destination address), Link Text (the visible anchor text), and Page Number (which page it appears on). Map all three or just the ones your workflow needs.
Does it extract internal PDF bookmark links and table-of-contents navigation?+
No. The module focuses on URL hyperlinks: web addresses and mailto links. PDF bookmarks that power the navigation panel or table-of-contents click-through are not included in the output.
What page formats does Page Sequence accept?+
Single page like 2, comma-separated list like 2,5,6, a range like 1-2, or all to scan the entire document in one pass.
Is the output a flat list or grouped by page?+
Flat array. Each link object includes a Page Number field so you can group or filter in Make using an iterator and aggregator, or export to a spreadsheet and sort by page there.
Is my original PDF changed in any way?+
No. This module is purely read-only: it extracts link data without modifying or returning a new version of the document. Your source file in Dropbox, Google Drive, or any other location is completely untouched.

Modules associés

Obtenez de l'aide