Pular para o conteúdo principal

PDF Extrair hiperlinks em Make

O que este módulo faz

PDF4me, PDF - Extrair hiperlinks Lê todos os hiperlinks clicáveis de um PDF e os retorna como dados estruturados, URL, texto âncora e número da página para cada link, sem modificar o documento. Completamente não destrutivo. Enquanto plataformas como n8n É necessário realizar uma ação separada no PDF.co para obter esses dados. PDF4me entrega-o nativamente como um único Make módulo sem extras API ou serviço necessário.

Artigos relacionados no blogue
Ainda não há nenhuma publicação no blogue sobre esta funcionalidade — em breve.
Entretanto, explore o blogue da PDF4me para encontrar tutoriais e fluxos de trabalho para todas as plataformas.
Visite o blogue

Autenticando sua solicitação de API

Todo PDF4me módulo em Make requer um válido ConexãoCrie ou selecione um que contenha o seu PDF4me API chave para que o cenário possa chamar o serviço de extração de links com segurança.

Fatos importantes que você não deve perder

Três campos por link

Cada item na matriz de saída fornece o destino. URL, o visível Link Text o leitor clicaria, e o Page Number Aparece em. Mapeie qualquer um ou todos os três para o próximo módulo.

Completamente não destrutivo

Este módulo apenas lê, não retorna um arquivo modificado. PDFSeu documento original no Dropbox, Google Drive ou em qualquer outro local permanece completamente inalterado. Use-o livremente no início de qualquer fluxo de trabalho de gerenciamento de links.

Execute este comando antes de excluir o hiperlink.

Primeiro, extraia o arquivo para registrar exatamente quais links existem e, em seguida, passe o mesmo arquivo para a função "Excluir Hiperlink" para removê-los. Você obterá um registro completo de auditoria de todos os links removidos, o que é valioso para fins de conformidade e revisões de alterações.

Configure o módulo PDF4me PDF Extract Hyperlinks para exibir o campo Conexão vazio com o botão Adicionar, o arquivo definido como Dropbox - Baixe um arquivo com a opção Mapa abaixo e o campo Sequência de Páginas definido como 2 com a dica Insira os números das páginas das quais o hiperlink deve ser extraído; para várias páginas, insira 2, 5, 6 ou 1-2 ou todas

Insira uma única página, uma lista separada por vírgulas, um intervalo ou all Analisar cada link em todo o documento.

Parâmetros

Obrigatório: Todos os três parâmetros, Connection, File, e Page Sequence, deve ser fornecido para que o módulo seja executado.

ParâmetroObrigatórioO que fazExemplo
ConnectionYesPDF4me API connection used to authenticate extraction requests. Click Add to create one with your API key.Your PDF4me connection
FileYesSource PDF to scan. Choose Dropbox - Download a File for a direct Dropbox trigger, or Map to supply the filename and binary content from a prior module.Dropbox - Download a File
Page SequenceYesWhich pages to scan for hyperlinks. Accepts a single page, comma-separated list, a range, or all to read the entire document at once.2 or 2,5,6 or 1-2 or all

Saída

O módulo retorna um Hyperlinks matriz. Cada item na matriz contém:

CampoTipoDescrição
HyperlinksArrayThe full collection of link objects returned by the module: one item per hyperlink found.
URLStringThe destination address of the hyperlink: a web URL or mailto address.
Link TextStringThe visible anchor text the reader would click on in the document.
Page NumberIntegerThe page in the PDF where the link appears.

Mapeie qualquer um desses campos em uma linha do Google Sheets ou em um registro do Airtable. HTTP solicitação, ou uma condição de filtro em seu Make cenário.

Configuração rápida

  1. Adicionar PDF4mePDF - Extrair hiperlinks para o seu Make cenário.
  2. Selecione Connection (ou clique) Adicionar para criar um com o seu API chave).
  3. Definir File para Dropbox - Baixar um arquivo ou Mapa de um módulo anterior que gera um PDF binário.
  4. Insira as páginas que deseja digitalizar. Page Sequence: usar all Para ler todos os links do documento de uma só vez.
  5. Salvar e clique Executar uma vezA saída contém um Hyperlinks matriz: adicione um Iterador Após este módulo, percorra cada link individualmente.

Exemplos de fluxo de trabalho

Exemplos de fluxo de trabalhoCommon Make scenario patterns that use PDF - Extract Hyperlinks for auditing, cataloguing, and link management.
Detectar links quebrados em uma biblioteca de documentos.
  1. O Google Drive desencadeia esse cenário quando um PDF é adicionado à pasta "Relatórios".
  2. PDF - Extrair Hiperlinks digitalizações com Page Sequence definido para all.
  3. Um iterador percorre o Hyperlinks variedade.
  4. HTTP faz um HEAD solicitação para cada URL e um filtro verifica respostas diferentes de 200.
  5. O Slack publica um alerta com o problema. URL e a página onde foi encontrado.
Crie um catálogo de links pesquisável a partir de PDFs carregados.
  1. O Dropbox é acionado quando um novo arquivo é adicionado à pasta "Documentos Compartilhados".
  2. PDF - Extrair Hiperlinks Lê todos os links em todas as páginas.
  3. Um iterador percorre o Hyperlinks variedade.
  4. O Google Sheets adiciona uma linha para cada link, nome do documento, URL, Link Text, Page Numbere data extraída.
Crie um registro de auditoria antes de remover links.
  1. Um webhook é acionado quando um documento é aprovado para distribuição externa.
  2. PDF - Extrair Hiperlinks Registra todos os links em uma planilha do Google. URL, Link Text, Page Numbere carimbo de data/hora.
  3. PDF - Excluir Hiperlink Em seguida, remove todos os links de todas as páginas.
  4. O Gmail envia a versão higienizada. PDF Ao destinatário, será fornecido um registro permanente do que foi removido.

Perguntas frequentes

What data does each extracted hyperlink contain?+
Each link object in the output array has three fields: URL (destination address), Link Text (the visible anchor text), and Page Number (which page it appears on). Map all three or just the ones your workflow needs.
Does it extract internal PDF bookmark links and table-of-contents navigation?+
No. The module focuses on URL hyperlinks: web addresses and mailto links. PDF bookmarks that power the navigation panel or table-of-contents click-through are not included in the output.
What page formats does Page Sequence accept?+
Single page like 2, comma-separated list like 2,5,6, a range like 1-2, or all to scan the entire document in one pass.
Is the output a flat list or grouped by page?+
Flat array. Each link object includes a Page Number field so you can group or filter in Make using an iterator and aggregator, or export to a spreadsheet and sort by page there.
Is my original PDF changed in any way?+
No. This module is purely read-only: it extracts link data without modifying or returning a new version of the document. Your source file in Dropbox, Google Drive, or any other location is completely untouched.

Módulos relacionados

Obtenha ajuda