Zum Hauptinhalt springen

PDF Hyperlinks extrahieren in Make

Was dieses Modul bewirkt

PDF4me, PDF - Hyperlinks extrahieren liest jeden anklickbaren Hyperlink von einem PDF und gibt sie als strukturierte Daten zurück. URLAnkertext und Seitenzahl für jeden Link, ohne das Dokument zu verändern. Vollständig nicht-destruktiv. Plattformen wie n8n Für den Abruf dieser Daten ist eine separate Aktion auf PDF.co erforderlich. PDF4me liefert es nativ als einzelne Make Modul ohne zusätzliche API oder Service erforderlich.

Verwandte Blog-Beiträge
Zu dieser Funktion gibt es noch keinen Blogbeitrag – folgt in Kürze.
Schauen Sie sich in der Zwischenzeit im PDF4me-Blog Tutorials und Arbeitsabläufe für alle Plattformen an.
Besuchen Sie den Blog

Authentifizierung Ihrer API-Anfrage

Jeder PDF4me Modul in Make erfordert eine gültige VerbindungErstellen oder wählen Sie einen Eintrag aus, der Ihre Daten enthält. PDF4me API Schlüssel, damit das Szenario den Link-Extraktionsdienst sicher aufrufen kann.

Wichtige Fakten, die Sie nicht verpassen sollten

Drei Felder pro Link

Jedes Element im Ausgabearray gibt Ihnen das Ziel an URL, das Sichtbare Link Text Der Leser würde klicken, und Page Number Es erscheint auf. Ordnen Sie eine oder alle drei dem nächsten Modul zu.

Völlig zerstörungsfrei.

Dieses Modul liest nur, es gibt keine veränderten Daten zurück. PDFIhr Quelldokument in Dropbox, Google Drive oder einem anderen Speicherort bleibt vollständig unverändert. Sie können es bedenkenlos zu Beginn jedes Linkmanagement-Workflows verwenden.

Führen Sie es aus, bevor Sie den Hyperlink löschen.

Zuerst extrahieren Sie die Datei, um genau zu protokollieren, welche Links vorhanden sind. Anschließend übergeben Sie dieselbe Datei an „Hyperlink löschen“, um die Links zu entfernen. Sie erhalten einen vollständigen Prüfpfad aller entfernten Links, der für Compliance- und Änderungsprüfungen wertvoll ist.

Das Modul „PDF4me PDF Extract Hyperlinks“ zeigt ein leeres Verbindungsfeld mit der Schaltfläche „Hinzufügen“ an. Die Datei ist auf „Dropbox – Datei mit Map-Option herunterladen“ eingestellt, und das Feld „Seitenreihenfolge“ ist auf 2 mit dem Hinweis „Geben Sie die Seitenzahlen ein, aus denen der Hyperlink extrahiert werden soll. Geben Sie bei mehreren Seiten 2, 5, 6 oder 1–2 oder alle ein“ ein.

Geben Sie eine einzelne Seite, eine durch Kommas getrennte Liste, einen Bereich oder all um jeden Link im gesamten Dokument zu scannen.

Parameter

Erforderlich: Alle drei Parameter, Connection, File, Und Page Sequence, muss für die Ausführung des Moduls bereitgestellt werden.

ParameterErforderlichWas es tutBeispiel
ConnectionYesPDF4me API connection used to authenticate extraction requests. Click Add to create one with your API key.Your PDF4me connection
FileYesSource PDF to scan. Choose Dropbox - Download a File for a direct Dropbox trigger, or Map to supply the filename and binary content from a prior module.Dropbox - Download a File
Page SequenceYesWhich pages to scan for hyperlinks. Accepts a single page, comma-separated list, a range, or all to read the entire document at once.2 or 2,5,6 or 1-2 or all

Ausgabe

Das Modul gibt einen Wert zurück Hyperlinks Array. Jedes Element im Array enthält:

FeldTypBeschreibung
HyperlinksArrayThe full collection of link objects returned by the module: one item per hyperlink found.
URLStringThe destination address of the hyperlink: a web URL or mailto address.
Link TextStringThe visible anchor text the reader would click on in the document.
Page NumberIntegerThe page in the PDF where the link appears.

Ordnen Sie beliebige dieser Felder einer Google Sheet-Zeile oder einem Airtable-Datensatz zu. HTTP Anfrage oder eine Filterbedingung in Ihrer Make Szenario.

Schnellkonfiguration

  1. Hinzufügen PDF4mePDF - Hyperlinks extrahieren zu Ihrem Make Szenario.
  2. Wählen Connection (oder klicken Sie hier) Hinzufügen um einen mit Ihrem API Schlüssel).
  3. Satz File Zu Dropbox – Datei herunterladen oder Karte von einem vorherigen Modul, das eine Ausgabe erzeugt PDF Binär.
  4. Geben Sie die zu scannenden Seiten ein. Page Sequence: verwenden all Alle Links im Dokument gleichzeitig lesen.
  5. Speichern und klicken Einmal ausführenDie Ausgabe enthält ein Hyperlinks Array: Füge ein Iterator Im Anschluss daran soll jedes Link einzeln durchlaufen werden.

Workflow-Beispiele

Workflow-BeispieleCommon Make scenario patterns that use PDF - Extract Hyperlinks for auditing, cataloguing, and link management.
Erkennen defekter Links in einer Dokumentenbibliothek
  1. Google Drive löst das Szenario aus, wenn ein PDF wird dem Ordner „Berichte“ hinzugefügt.
  2. PDF – Hyperlinks extrahieren Scans mit Page Sequence eingestellt auf allDie
  3. Ein Iterator durchläuft die Hyperlinks Array.
  4. HTTP macht ein HEAD Bitte an jeden URL und ein Filter prüft auf Antworten, die nicht mit 200 übereinstimmen.
  5. Slack sendet eine Benachrichtigung mit dem defekten Fehler. URL und die Seite, auf der es gefunden wurde.
Erstellen Sie einen durchsuchbaren Linkkatalog aus hochgeladenen PDFs
  1. Dropbox wird ausgelöst, wenn eine neue Datei im Ordner „Gemeinsame Dokumente“ landet.
  2. PDF – Hyperlinks extrahieren Liest alle Links auf jeder Seite.
  3. Ein Iterator durchläuft die Hyperlinks Array.
  4. Google Sheets fügt für jeden Link und Dokumentnamen eine Zeile hinzu. URL, Link Text, Page Numberund Datum der Datenextraktion.
Erstellen Sie einen Prüfpfad, bevor Sie Links entfernen.
  1. Ein Webhook wird ausgelöst, wenn ein Dokument zur externen Verteilung freigegeben wird.
  2. PDF – Hyperlinks extrahieren Protokolliert jeden Link zu einem Google Sheet. URL, Link Text, Page Numberund Zeitstempel.
  3. PDF – Hyperlink löschen Anschließend werden alle Links von jeder Seite entfernt.
  4. Gmail sendet die bereinigte PDF an den Empfänger mit einer dauerhaften Aufzeichnung darüber, was entfernt wurde.

Häufig gestellte Fragen

What data does each extracted hyperlink contain?+
Each link object in the output array has three fields: URL (destination address), Link Text (the visible anchor text), and Page Number (which page it appears on). Map all three or just the ones your workflow needs.
Does it extract internal PDF bookmark links and table-of-contents navigation?+
No. The module focuses on URL hyperlinks: web addresses and mailto links. PDF bookmarks that power the navigation panel or table-of-contents click-through are not included in the output.
What page formats does Page Sequence accept?+
Single page like 2, comma-separated list like 2,5,6, a range like 1-2, or all to scan the entire document in one pass.
Is the output a flat list or grouped by page?+
Flat array. Each link object includes a Page Number field so you can group or filter in Make using an iterator and aggregator, or export to a spreadsheet and sort by page there.
Is my original PDF changed in any way?+
No. This module is purely read-only: it extracts link data without modifying or returning a new version of the document. Your source file in Dropbox, Google Drive, or any other location is completely untouched.

Verwandte Module

Hilfe erhalten