Saltar al contenido principal

PDF Extraer hipervínculos en Make

Lo que hace este módulo

PDF4me, PDF - Extraer hipervínculos lee todos los hipervínculos clicables de un PDF y los devuelve como datos estructurados, URL, texto de anclaje y número de página para cada enlace, sin modificar el documento. Completamente no destructivo. Mientras que plataformas como n8n Se requiere una acción separada de PDF.co para obtener estos datos, PDF4me lo entrega de forma nativa como un único Make módulo sin extra API o servicio requerido.

Entradas de blog relacionadas
Aún no hay ninguna entrada de blog sobre esta función; estará disponible próximamente.
Mientras tanto, echa un vistazo al blog de PDF4me para encontrar tutoriales y flujos de trabajo para todas las plataformas.
Visita el blog

Autenticando su solicitud de API

Cada PDF4me módulo en Make requiere un válido Conexión. Crea o selecciona uno que contenga tu PDF4me API clave para que el escenario pueda llamar al servicio de extracción de enlaces de forma segura.

Datos importantes que no debes perderte

Tres campos por enlace

Cada elemento en la matriz de salida le da el destino URL, lo visible Link Text el lector haría clic y el Page Number aparece en. Asigne cualquiera de los tres o los tres al siguiente módulo.

Completamente no destructivo

Este módulo solo lee, no devuelve un modificado PDFTu documento original en Dropbox, Google Drive o cualquier otra ubicación permanece completamente sin cambios. Úsalo libremente al inicio de cualquier flujo de trabajo de gestión de enlaces.

Ejecútalo antes de eliminar el hipervínculo.

Primero, extraiga el archivo para registrar con precisión qué enlaces existen y, a continuación, páselo a la función Eliminar hipervínculo para su eliminación. Obtendrá un registro de auditoría completo de cada enlace eliminado, lo cual resulta valioso para el cumplimiento normativo y las revisiones de cambios.

El módulo PDF4me PDF Extract Hyperlinks muestra el campo Conexión vacío con el botón Agregar, Archivo configurado en Dropbox - Descargar un archivo con la opción Mapa a continuación, y el campo Secuencia de páginas configurado en 2 con la sugerencia Ingrese los números de página de los que se extraerá el hipervínculo; para varias páginas, ingrese 2, 5, 6 o 1-2 o todos.

Introduzca una sola página, una lista separada por comas, un rango o all escanear todos los enlaces en todo el documento.

Parámetros

Requerido: Los tres parámetros, Connection, File, y Page Sequence, debe proporcionarse para que el módulo funcione.

ParámetroRequeridoLo que haceEjemplo
ConnectionYesPDF4me API connection used to authenticate extraction requests. Click Add to create one with your API key.Your PDF4me connection
FileYesSource PDF to scan. Choose Dropbox - Download a File for a direct Dropbox trigger, or Map to supply the filename and binary content from a prior module.Dropbox - Download a File
Page SequenceYesWhich pages to scan for hyperlinks. Accepts a single page, comma-separated list, a range, or all to read the entire document at once.2 or 2,5,6 or 1-2 or all

Producción

El módulo devuelve un Hyperlinks matriz. Cada elemento de la matriz contiene:

CampoTipoDescripción
HyperlinksArrayThe full collection of link objects returned by the module: one item per hyperlink found.
URLStringThe destination address of the hyperlink: a web URL or mailto address.
Link TextStringThe visible anchor text the reader would click on in the document.
Page NumberIntegerThe page in the PDF where the link appears.

Asigne cualquiera de estos campos a una fila de Google Sheets, registro de Airtable, HTTP solicitud o una condición de filtro en su Make escenario.

Configuración rápida

  1. Agregar PDF4mePDF - Extraer hipervínculos a tu Make escenario.
  2. Seleccionar Connection (o haga clic Agregar para crear uno con tu API llave).
  3. Colocar File a Dropbox - Descargar un archivo o Mapa de un módulo anterior que genera un PDF binario.
  4. Introduzca las páginas que desea escanear. Page Sequence: usar all leer todos los enlaces del documento a la vez.
  5. Ahorrar y haga clic Correr una vez. La salida contiene un Hyperlinks matriz: agregar un Iterador Después de este módulo, iterar sobre cada enlace individualmente.

Ejemplos de flujo de trabajo

Ejemplos de flujo de trabajoCommon Make scenario patterns that use PDF - Extract Hyperlinks for auditing, cataloguing, and link management.
Detectar enlaces rotos en una biblioteca de documentos
  1. Google Drive activa el escenario cuando un PDF se agrega a la carpeta "Informes".
  2. PDF - Extraer hipervínculos escaneos con Page Sequence establecido a all.
  3. Un iterador recorre el Hyperlinks matriz.
  4. HTTP hace un HEAD solicitud a cada URL y un filtro comprueba si hay respuestas distintas de 200.
  5. Slack publica una alerta con el error URL y la página en la que se encontró.
Crea un catálogo de enlaces con función de búsqueda a partir de los archivos PDF subidos.
  1. Dropbox se activa cuando un nuevo archivo llega a la carpeta "Documentos compartidos".
  2. PDF - Extraer hipervínculos Lee todos los enlaces de cada página.
  3. Un iterador recorre el Hyperlinks matriz.
  4. Google Sheets agrega una fila por cada enlace, nombre del documento, URL, Link Text, Page Numbery fecha extraída.
Cree un registro de auditoría antes de eliminar los enlaces.
  1. Un webhook se activa cuando un documento es aprobado para su distribución externa.
  2. PDF - Extraer hipervínculos registra cada enlace a una hoja de cálculo de Google, URL, Link Text, Page Numbery marca de tiempo.
  3. PDF - Eliminar hipervínculo Luego elimina todos los enlaces de cada página.
  4. Gmail envía el sanitizado PDF al destinatario con un registro permanente de lo que se retiró.

Preguntas frecuentes

What data does each extracted hyperlink contain?+
Each link object in the output array has three fields: URL (destination address), Link Text (the visible anchor text), and Page Number (which page it appears on). Map all three or just the ones your workflow needs.
Does it extract internal PDF bookmark links and table-of-contents navigation?+
No. The module focuses on URL hyperlinks: web addresses and mailto links. PDF bookmarks that power the navigation panel or table-of-contents click-through are not included in the output.
What page formats does Page Sequence accept?+
Single page like 2, comma-separated list like 2,5,6, a range like 1-2, or all to scan the entire document in one pass.
Is the output a flat list or grouped by page?+
Flat array. Each link object includes a Page Number field so you can group or filter in Make using an iterator and aggregator, or export to a spreadsheet and sort by page there.
Is my original PDF changed in any way?+
No. This module is purely read-only: it extracts link data without modifying or returning a new version of the document. Your source file in Dropbox, Google Drive, or any other location is completely untouched.

Módulos relacionados

Obtén ayuda