Pular para o conteúdo principal

Extrair dados de formulário de PDF em n8n

Extrair dados de formulário de PDF é um PDF4me ação do nó em n8n que lê os valores preenchidos de um campo preenchível PDF e os retorna como uma estrutura formData JSON objeto. Use-o para transformar formulários de inscrição devolvidos, fichas de admissão assinadas ou pesquisas PDFs em linhas do banco de dados sem que ninguém precise digitar as respostas novamente.

O que este nó faz

PDF4meExtrair dados do formulário de PDF requer um formulário preenchível completo. PDF de Dados Binários, um Base64 Stringou um URL, lê sua camada de formulário interativo e retorna cada campo como um par nome-valor dentro de um único dados do formulário objeto. Entradas de texto, caixas de seleção, botões de opção e seleções suspensas são reunidas, prontas para serem mapeadas em uma linha da planilha. CRM registro, ou uma ramificação condicional no fluxo de trabalho.

Artigos relacionados no blogue(1)

Autenticando seu API Solicitar

Todo PDF4me nó em n8n requer um válido Credencial para se conectar comCrie ou selecione um que contenha o seu PDF4me API chave para que o fluxo de trabalho possa autenticar solicitações de extração com segurança.

Fatos importantes que você não deve perder

O PDF deve conter campos de formulário reais
Este nó lê a camada interativa AcroForm. Uma página digitalizada ou uma imagem achatada. PDF não possui mais objetos de campo para ler, então direcione-os para um OCR ou AI em vez disso, analise o nó.
Campos em branco ainda aparecem na saída.
Um campo não preenchido retorna uma string vazia em vez de ser omitido, portanto, verifique se há valores vazios posteriormente em vez de presumir que a chave está ausente.
Os nomes dos campos são fornecidos pelo autor do formulário.
As chaves correspondem a qualquer coisa. PDF O designer nomeou cada campo, e as caixas de seleção retornam seu valor de exportação em vez de um valor garantido de verdadeiro ou falso. Execute um arquivo de exemplo primeiro e inspecione a saída real.
O nó PDF4me no n8n está configurado com a ação "Extrair dados do formulário do PDF", o tipo de dados de entrada "Dados binários", o campo de entrada "dados binários", o nome do documento "document.pdf" e perfis personalizados em Opções avançadas.

PDF4me Extrair dados de formulário de PDF painel de parâmetros em n8n

Extração de dados de formulário versus extração de texto simples

Ambas as abordagens extraem conteúdo de um PDFMas apenas um deles fornece campos nomeados. Essa distinção define qual nó pertence ao seu fluxo de trabalho.

AbordagemO que você recebe de voltaMelhor ajuste
Extract Form Data From PDFNamed field and value pairs from the interactive form layerGenuine fillable PDFs where every answer already sits in a named field
Plain text extractionThe visible page content as one flat string, with no field namesStatic PDFs with no form layer, where you will parse the text yourself
AI document parsingModel-inferred fields from any layout, including scansScanned, flattened, or wildly inconsistent documents with no usable form structure

Quais parâmetros são utilizados para extrair dados do formulário? PDF Precisar?

Obrigatório: Ação, Tipo de dados de entrada, o campo correspondente a esse tipo de entrada e Nome do documento. Perfis personalizados em Opções avançadas são opcionais.

ParâmetroObrigatórioO que fazExemplo
ActionRequiredSelects the PDF4me node action to run. Choose Extract Form Data From PDF.Extract Form Data From PDF
Input Data TypeRequiredFormat of the source PDF input. Choose Binary Data (from a previous node), Base64 String, or URL.Binary Data
Input Binary FieldConditionalName of the binary property on the incoming n8n item that holds the filled PDF. Required when Input Data Type is Binary Data. Defaults to data.data
Base64 Document ContentConditionalBase64-encoded content of the filled PDF. Required when Input Data Type is Base64 String.JVBERi0xLjQK...
File URLConditionalPublicly reachable HTTPS URL to the filled PDF. Required when Input Data Type is URL.https://example.com/application_form.pdf
Document NameRequiredFilename of the source PDF, used for reference and tracking in the extraction request. Include the .pdf extension.application_form.pdf
Custom ProfilesOptionalAdvanced Options field for extra processing settings, supplied in a JSON-like format. Leave blank unless you have a specific profile to apply.{ 'outputDataFormat': 'json' }

Campos de saída

Uma corrida bem-sucedida retorna um n8n item que contém os valores do formulário extraído como JSON.

CampoTipoO que contém
formDataObjectEvery form field read from the PDF, as a set of field name and field value pairs.
formData.<fieldName>StringThe name of an individual field exactly as the PDF author defined it, for example name, email, or country.
formData.<fieldValue>String, Number, or BooleanThe value entered or selected for that field. Blank fields return an empty string, and checkboxes return their export value.

Um corpo de resposta típico tem a seguinte aparência:

{
"formData": {
"name": "PDF4me",
"email": "",
"country": "USA"
}
}

Como faço para configurar a extração de dados de formulário de PDF em n8n?

  1. Adicionar PDF4me para o seu n8n fluxo de trabalho e escolha o Extrair dados de formulário de PDF Ação.
  2. Em Credencial para se conectar com, selecione o seu PDF4me credencial ou clique Criar nova credencial e cole o seu API chave.
  3. Definir Tipo de dados de entrada para Dados binários (padrão), Base64 String, ou URL e fornecer o formulário preenchido correspondente PDF campo.
  4. Definir Nome do documento para o nome do arquivo de origem, por exemplo application_form.pdf.
  5. Deixar Perfis personalizados sob Opções avançadas Em branco, a menos que você precise de um perfil de processamento específico.
  6. Execute o nó e, em seguida, mapeie os valores retornados. formData Insira o objeto na próxima etapa do seu fluxo de trabalho.

Configurações típicas

Exemplos de fluxo de trabalhoCommon n8n workflow patterns using Extract Form Data From PDF.
Os formulários de inscrição foram enviados por e-mail para uma planilha.
  1. Um alerta de e-mail é acionado quando uma inscrição é concluída. PDF chega.
  2. Extrair dados de formulário de PDF Lê o anexo e o armazena em um objeto formData.
  3. Uma planilha do Google ou Excel O nó adiciona uma linha, mapeando cada nome de campo para uma coluna.
CRM Geração de leads a partir de formulários de inscrição
  1. Um gatilho de armazenamento em nuvem é acionado quando um novo dado é carregado. PDF.
  2. Extrair dados de formulário de PDF Extrai os dados de contato da camada do formulário.
  3. A CRM O nó cria ou atualiza o registro usando os valores extraídos de nome, e-mail e empresa.
Encaminhamento de aprovação condicional
  1. Um webhook recebe um formulário de solicitação assinado de um portal externo.
  2. Extrair dados de formulário de PDF Retorna os campos de valor e departamento solicitados.
  3. Um nó IF direciona o fluxo para o aprovador correto com base nesses valores.
Digitalização em lote de um arquivo
  1. Um nó "Loop Over Items" itera sobre uma lista de formulários arquivados. URLs.
  2. Extrair dados de formulário de PDF executa com o Tipo de Dados de Entrada definido como URL para cada arquivo.
  3. Cada objeto formData é gravado em uma tabela de banco de dados indexada pelo nome do documento de origem.

Dicas práticas

Run one sample file before you map anything
Field names and checkbox export values are set by whoever designed the form, so inspect the real formData output first instead of guessing the key names.
Test for empty strings, not missing keys
Unfilled fields are still present in the output with an empty value, so a simple key existence check will not tell you whether the user answered.
Check the PDF is not flattened
A form that looks fillable in a viewer may have been flattened on save, which strips the field layer. If formData comes back empty, that is usually why.
Send scans to an AI parser instead
Scanned paper forms have no interactive fields at all. Route those to Parse Document rather than expecting this node to read them.
Keep Document Name meaningful
It is used for reference and tracking on the request, so passing the real source filename makes execution logs far easier to audit later.
Validate before writing to a system of record
Add a check on required fields after extraction so an incomplete submission is flagged rather than silently creating a half-empty CRM record.

Folha de dicas

CampoValor
ActionExtract Form Data From PDF
Input Data TypeBinary Data
Input Binary Fielddata
Document Namedocument.pdf
Custom Profiles{ 'outputDataFormat': 'json' }
CredentialsPDF4me API credential
ReturnsformData object of field name and value pairs

Perguntas frequentes

Does Extract Form Data From PDF work on a scanned or flattened PDF?+
No. This node reads values from real interactive form fields, the AcroForm layer described in the ISO 32000 PDF specification. A scanned page is just an image, and a flattened PDF has had its fields painted into static content, so in both cases there are no field objects left to read. For those files use an OCR or AI parsing node instead, such as Parse Document.
What do empty form fields return?+
A field the user left blank still appears in the formData object, with an empty string as its value. The key set reflects the fields defined in the PDF, not only the ones that were filled in, so downstream nodes should test for empty values rather than assume a missing key.
How are checkboxes and radio buttons returned?+
Checkbox and radio button fields return their underlying export value as defined in the PDF, not always a literal true or false. Common values include Yes, Off, or a named choice set by whoever built the form. Run the node once on a sample filled PDF and inspect the actual output before writing comparison logic against it.
Can I send extracted PDF form data straight to Excel or a database?+
Yes. The formData object is standard JSON, so any node that accepts item fields can consume it. Map formData keys onto columns in a spreadsheet, database, or CRM node placed after the PDF4me node, using the standard n8n data mapping approach.
What is the difference between extracting form data and extracting text from a PDF?+
Extracting form data reads named field values from the interactive form layer, so you get reliable key and value pairs such as email mapped to its entered address. Extracting text returns the visible page content as a flat string with no field names attached, leaving you to parse it. Prefer form data extraction whenever the PDF is a genuine fillable form.

Ações relacionadas

Mesma tarefa em outras plataformas

Obtenha ajuda