PDF Hyperlinks extrahieren in Make
Was dieses Modul bewirkt
PDF4me, PDF - Hyperlinks extrahieren liest jeden anklickbaren Hyperlink von einem PDF und gibt sie als strukturierte Daten zurück. URLAnkertext und Seitenzahl für jeden Link, ohne das Dokument zu verändern. Vollständig nicht-destruktiv. Plattformen wie n8n Für den Abruf dieser Daten ist eine separate Aktion auf PDF.co erforderlich. PDF4me liefert es nativ als einzelne Make Modul ohne zusätzliche API oder Service erforderlich.
Authentifizierung Ihrer API-Anfrage
Jeder PDF4me Modul in Make erfordert eine gültige VerbindungErstellen oder wählen Sie einen Eintrag aus, der Ihre Daten enthält. PDF4me API Schlüssel, damit das Szenario den Link-Extraktionsdienst sicher aufrufen kann.
Wichtige Fakten, die Sie nicht verpassen sollten
Jedes Element im Ausgabearray gibt Ihnen das Ziel an URL, das Sichtbare Link Text Der Leser würde klicken, und Page Number Es erscheint auf. Ordnen Sie eine oder alle drei dem nächsten Modul zu.
Dieses Modul liest nur, es gibt keine veränderten Daten zurück. PDFIhr Quelldokument in Dropbox, Google Drive oder einem anderen Speicherort bleibt vollständig unverändert. Sie können es bedenkenlos zu Beginn jedes Linkmanagement-Workflows verwenden.
Zuerst extrahieren Sie die Datei, um genau zu protokollieren, welche Links vorhanden sind. Anschließend übergeben Sie dieselbe Datei an „Hyperlink löschen“, um die Links zu entfernen. Sie erhalten einen vollständigen Prüfpfad aller entfernten Links, der für Compliance- und Änderungsprüfungen wertvoll ist.

Geben Sie eine einzelne Seite, eine durch Kommas getrennte Liste, einen Bereich oder all um jeden Link im gesamten Dokument zu scannen.
Parameter
Erforderlich: Alle drei Parameter, Connection, File, Und Page Sequence, muss für die Ausführung des Moduls bereitgestellt werden.
| Parameter | Erforderlich | Was es tut | Beispiel |
|---|---|---|---|
| Connection | Yes | PDF4me API connection used to authenticate extraction requests. Click Add to create one with your API key. | Your PDF4me connection |
| File | Yes | Source PDF to scan. Choose Dropbox - Download a File for a direct Dropbox trigger, or Map to supply the filename and binary content from a prior module. | Dropbox - Download a File |
| Page Sequence | Yes | Which pages to scan for hyperlinks. Accepts a single page, comma-separated list, a range, or all to read the entire document at once. | 2 or 2,5,6 or 1-2 or all |
Ausgabe
Das Modul gibt einen Wert zurück Hyperlinks Array. Jedes Element im Array enthält:
| Feld | Typ | Beschreibung |
|---|---|---|
| Hyperlinks | Array | The full collection of link objects returned by the module: one item per hyperlink found. |
| URL | String | The destination address of the hyperlink: a web URL or mailto address. |
| Link Text | String | The visible anchor text the reader would click on in the document. |
| Page Number | Integer | The page in the PDF where the link appears. |
Ordnen Sie beliebige dieser Felder einer Google Sheet-Zeile oder einem Airtable-Datensatz zu. HTTP Anfrage oder eine Filterbedingung in Ihrer Make Szenario.
Schnellkonfiguration
- Hinzufügen PDF4me → PDF - Hyperlinks extrahieren zu Ihrem Make Szenario.
- Wählen Connection (oder klicken Sie hier) Hinzufügen um einen mit Ihrem API Schlüssel).
- Satz File Zu Dropbox – Datei herunterladen oder Karte von einem vorherigen Modul, das eine Ausgabe erzeugt PDF Binär.
- Geben Sie die zu scannenden Seiten ein. Page Sequence: verwenden
allAlle Links im Dokument gleichzeitig lesen. - Speichern und klicken Einmal ausführenDie Ausgabe enthält ein Hyperlinks Array: Füge ein Iterator Im Anschluss daran soll jedes Link einzeln durchlaufen werden.
Workflow-Beispiele
Workflow-BeispieleCommon Make scenario patterns that use PDF - Extract Hyperlinks for auditing, cataloguing, and link management.
- Google Drive löst das Szenario aus, wenn ein PDF wird dem Ordner „Berichte“ hinzugefügt.
- PDF – Hyperlinks extrahieren Scans mit Page Sequence eingestellt auf allDie
- Ein Iterator durchläuft die Hyperlinks Array.
- HTTP macht ein HEAD Bitte an jeden URL und ein Filter prüft auf Antworten, die nicht mit 200 übereinstimmen.
- Slack sendet eine Benachrichtigung mit dem defekten Fehler. URL und die Seite, auf der es gefunden wurde.
- Dropbox wird ausgelöst, wenn eine neue Datei im Ordner „Gemeinsame Dokumente“ landet.
- PDF – Hyperlinks extrahieren Liest alle Links auf jeder Seite.
- Ein Iterator durchläuft die Hyperlinks Array.
- Google Sheets fügt für jeden Link und Dokumentnamen eine Zeile hinzu. URL, Link Text, Page Numberund Datum der Datenextraktion.
- Ein Webhook wird ausgelöst, wenn ein Dokument zur externen Verteilung freigegeben wird.
- PDF – Hyperlinks extrahieren Protokolliert jeden Link zu einem Google Sheet. URL, Link Text, Page Numberund Zeitstempel.
- PDF – Hyperlink löschen Anschließend werden alle Links von jeder Seite entfernt.
- Gmail sendet die bereinigte PDF an den Empfänger mit einer dauerhaften Aufzeichnung darüber, was entfernt wurde.