Lewati ke konten utama

PDF Ekstrak tautan hiperteks di Make

Fungsi modul ini

PDF4me, PDF - Ekstrak tautan hiperteks membaca setiap hyperlink yang dapat diklik dari PDF dan mengembalikannya sebagai data terstruktur, URL, teks jangkar, dan nomor halaman untuk setiap tautan, tanpa memodifikasi dokumen. Sepenuhnya tidak merusak. Sementara platform seperti n8n memerlukan tindakan PDF.co terpisah untuk mendapatkan data ini, PDF4me mengirimkannya secara native sebagai satu kesatuan Make modul tanpa tambahan API atau layanan yang dibutuhkan.

Postingan Blog Terkait
Belum ada postingan blog untuk fitur ini — akan segera hadir.
Sementara itu, jelajahi blog PDF4me untuk menemukan tutorial dan alur kerja di berbagai platform.
Kunjungi blog ini

Mengautentikasi Permintaan API Anda

Setiap PDF4me modul di Make memerlukan validitas KoneksiBuat atau pilih salah satu yang sesuai dengan kebutuhan Anda. PDF4me API kunci agar skenario dapat memanggil layanan ekstraksi tautan dengan aman.

Fakta Penting yang Tidak Boleh Anda Lewatkan

Tiga kolom per tautan

Setiap item dalam larik keluaran memberi Anda tujuan. URL, yang terlihat Link Text pembaca akan mengklik, dan Page Number muncul. Petakan salah satu atau ketiganya ke modul berikutnya.

Sama sekali tidak merusak

Modul ini hanya membaca, tidak mengembalikan data yang telah dimodifikasi. PDFDokumen sumber Anda di Dropbox, Google Drive, atau lokasi lain mana pun tidak akan berubah sama sekali. Gunakan dokumen tersebut secara bebas di awal alur kerja manajemen tautan apa pun.

Jalankan terlebih dahulu sebelum menghapus hyperlink.

Ekstrak terlebih dahulu untuk mencatat secara tepat tautan apa saja yang ada, kemudian berikan file yang sama ke fungsi Hapus Hyperlink untuk penghapusan. Anda akan mendapatkan jejak audit lengkap dari setiap tautan yang telah dihapus, yang sangat berharga untuk kepatuhan dan tinjauan perubahan.

Buat modul PDF4me PDF Extract Hyperlinks menampilkan kolom Koneksi kosong dengan tombol Tambah, File diatur ke Dropbox - Unduh File dengan opsi Peta di bawahnya, dan kolom Urutan Halaman diatur ke 2 dengan petunjuk Masukkan nomor halaman dari mana hyperlink akan diekstrak, untuk beberapa halaman masukkan sebagai 2,5,6 atau 1-2 atau semua

Masukkan satu halaman, daftar yang dipisahkan koma, rentang, atau all untuk memindai setiap tautan di seluruh dokumen.

Parameter

Diperlukan: Ketiga parameter tersebut, Connection, File, Dan Page Sequence, harus disediakan agar modul dapat berjalan.

ParameterDiperlukanApa fungsinya?Contoh
ConnectionYesPDF4me API connection used to authenticate extraction requests. Click Add to create one with your API key.Your PDF4me connection
FileYesSource PDF to scan. Choose Dropbox - Download a File for a direct Dropbox trigger, or Map to supply the filename and binary content from a prior module.Dropbox - Download a File
Page SequenceYesWhich pages to scan for hyperlinks. Accepts a single page, comma-separated list, a range, or all to read the entire document at once.2 or 2,5,6 or 1-2 or all

Keluaran

Modul tersebut mengembalikan sebuah Hyperlinks array. Setiap item dalam array berisi:

BidangJenisKeterangan
HyperlinksArrayThe full collection of link objects returned by the module: one item per hyperlink found.
URLStringThe destination address of the hyperlink: a web URL or mailto address.
Link TextStringThe visible anchor text the reader would click on in the document.
Page NumberIntegerThe page in the PDF where the link appears.

Petakan salah satu kolom ini ke dalam baris Google Sheet, catatan Airtable, HTTP permintaan, atau kondisi filter dalam Make skenario.

Pengaturan Cepat

  1. Menambahkan PDF4mePDF - Ekstrak tautan hiperteks untuk Anda Make skenario.
  2. Pilih Connection (atau klik) Menambahkan untuk membuat satu dengan milikmu API kunci).
  3. Mengatur File ke Dropbox - Unduh File atau Peta dari modul sebelumnya yang menghasilkan PDF biner.
  4. Masukkan halaman yang akan dipindai Page Sequence: menggunakan all untuk membaca setiap tautan dalam dokumen sekaligus.
  5. Menyimpan lalu klik Jalankan sekaliOutput tersebut berisi sebuah Hyperlinks array: tambahkan sebuah Iterator Setelah modul ini, lakukan perulangan pada setiap tautan secara individual.

Contoh Alur Kerja

Contoh Alur KerjaCommon Make scenario patterns that use PDF - Extract Hyperlinks for auditing, cataloguing, and link management.
Mendeteksi tautan rusak di seluruh pustaka dokumen.
  1. Google Drive memicu skenario tersebut ketika sebuah PDF ditambahkan ke folder "Laporan".
  2. PDF - Ekstrak Tautan Hyperlink pemindaian dengan Page Sequence diatur ke all.
  3. Iterator melakukan perulangan pada Hyperlinks susunan.
  4. HTTP membuat HEAD permintaan kepada masing-masing URL dan sebuah Filter memeriksa respons yang bukan berupa kode 200.
  5. Slack memposting peringatan tentang kerusakan tersebut. URL dan halaman tempat informasi itu ditemukan.
Buat katalog tautan yang dapat dicari dari PDF yang diunggah.
  1. Dropbox akan memicu notifikasi saat ada file baru masuk ke folder "Dokumen Bersama".
  2. PDF - Ekstrak Tautan Hyperlink Membaca semua tautan di setiap halaman.
  3. Iterator melakukan perulangan pada Hyperlinks susunan.
  4. Google Sheets menambahkan baris untuk setiap tautan, nama dokumen, URL, Link Text, Page Number, dan tanggal diekstrak.
Buat jejak audit sebelum menghapus tautan.
  1. Webhook akan aktif ketika sebuah dokumen disetujui untuk didistribusikan secara eksternal.
  2. PDF - Ekstrak Tautan Hyperlink mencatat setiap tautan ke Google Sheet, URL, Link Text, Page Number, dan cap waktu.
  3. PDF - Hapus Tautan Hyperlink lalu menghapus semua tautan dari setiap halaman.
  4. Gmail mengirimkan data yang sudah disensor. PDF kepada penerima dengan catatan permanen tentang apa yang telah dihapus.

Pertanyaan yang Sering Diajukan

What data does each extracted hyperlink contain?+
Each link object in the output array has three fields: URL (destination address), Link Text (the visible anchor text), and Page Number (which page it appears on). Map all three or just the ones your workflow needs.
Does it extract internal PDF bookmark links and table-of-contents navigation?+
No. The module focuses on URL hyperlinks: web addresses and mailto links. PDF bookmarks that power the navigation panel or table-of-contents click-through are not included in the output.
What page formats does Page Sequence accept?+
Single page like 2, comma-separated list like 2,5,6, a range like 1-2, or all to scan the entire document in one pass.
Is the output a flat list or grouped by page?+
Flat array. Each link object includes a Page Number field so you can group or filter in Make using an iterator and aggregator, or export to a spreadsheet and sort by page there.
Is my original PDF changed in any way?+
No. This module is purely read-only: it extracts link data without modifying or returning a new version of the document. Your source file in Dropbox, Google Drive, or any other location is completely untouched.

Modul Terkait

Dapatkan Bantuan