Extrair dados de formulário de PDF em n8n
Extrair dados de formulário de PDF é um PDF4me ação do nó em n8n que lê os valores preenchidos de um campo preenchível PDF e os retorna como uma estrutura formData JSON objeto. Use-o para transformar formulários de inscrição devolvidos, fichas de admissão assinadas ou pesquisas PDFs em linhas do banco de dados sem que ninguém precise digitar as respostas novamente.
O que este nó faz
PDF4meExtrair dados do formulário de PDF requer um formulário preenchível completo. PDF de Dados Binários, um Base64 Stringou um URL, lê sua camada de formulário interativo e retorna cada campo como um par nome-valor dentro de um único dados do formulário objeto. Entradas de texto, caixas de seleção, botões de opção e seleções suspensas são reunidas, prontas para serem mapeadas em uma linha da planilha. CRM registro, ou uma ramificação condicional no fluxo de trabalho.
Autenticando seu API Solicitar
Todo PDF4me nó em n8n requer um válido Credencial para se conectar comCrie ou selecione um que contenha o seu PDF4me API chave para que o fluxo de trabalho possa autenticar solicitações de extração com segurança.
Fatos importantes que você não deve perder

PDF4me Extrair dados de formulário de PDF painel de parâmetros em n8n
Extração de dados de formulário versus extração de texto simples
Ambas as abordagens extraem conteúdo de um PDFMas apenas um deles fornece campos nomeados. Essa distinção define qual nó pertence ao seu fluxo de trabalho.
| Abordagem | O que você recebe de volta | Melhor ajuste |
|---|---|---|
| Extract Form Data From PDF | Named field and value pairs from the interactive form layer | Genuine fillable PDFs where every answer already sits in a named field |
| Plain text extraction | The visible page content as one flat string, with no field names | Static PDFs with no form layer, where you will parse the text yourself |
| AI document parsing | Model-inferred fields from any layout, including scans | Scanned, flattened, or wildly inconsistent documents with no usable form structure |
Quais parâmetros são utilizados para extrair dados do formulário? PDF Precisar?
Obrigatório: Ação, Tipo de dados de entrada, o campo correspondente a esse tipo de entrada e Nome do documento. Perfis personalizados em Opções avançadas são opcionais.
| Parâmetro | Obrigatório | O que faz | Exemplo |
|---|---|---|---|
| Action | Required | Selects the PDF4me node action to run. Choose Extract Form Data From PDF. | Extract Form Data From PDF |
| Input Data Type | Required | Format of the source PDF input. Choose Binary Data (from a previous node), Base64 String, or URL. | Binary Data |
| Input Binary Field | Conditional | Name of the binary property on the incoming n8n item that holds the filled PDF. Required when Input Data Type is Binary Data. Defaults to data. | data |
| Base64 Document Content | Conditional | Base64-encoded content of the filled PDF. Required when Input Data Type is Base64 String. | JVBERi0xLjQK... |
| File URL | Conditional | Publicly reachable HTTPS URL to the filled PDF. Required when Input Data Type is URL. | https://example.com/application_form.pdf |
| Document Name | Required | Filename of the source PDF, used for reference and tracking in the extraction request. Include the .pdf extension. | application_form.pdf |
| Custom Profiles | Optional | Advanced Options field for extra processing settings, supplied in a JSON-like format. Leave blank unless you have a specific profile to apply. | { 'outputDataFormat': 'json' } |
Campos de saída
Uma corrida bem-sucedida retorna um n8n item que contém os valores do formulário extraído como JSON.
| Campo | Tipo | O que contém |
|---|---|---|
formData | Object | Every form field read from the PDF, as a set of field name and field value pairs. |
formData.<fieldName> | String | The name of an individual field exactly as the PDF author defined it, for example name, email, or country. |
formData.<fieldValue> | String, Number, or Boolean | The value entered or selected for that field. Blank fields return an empty string, and checkboxes return their export value. |
Um corpo de resposta típico tem a seguinte aparência:
{
"formData": {
"name": "PDF4me",
"email": "",
"country": "USA"
}
}
Como faço para configurar a extração de dados de formulário de PDF em n8n?
- Adicionar PDF4me para o seu n8n fluxo de trabalho e escolha o Extrair dados de formulário de PDF Ação.
- Em Credencial para se conectar com, selecione o seu PDF4me credencial ou clique Criar nova credencial e cole o seu API chave.
- Definir Tipo de dados de entrada para Dados binários (padrão), Base64 String, ou URL e fornecer o formulário preenchido correspondente PDF campo.
- Definir Nome do documento para o nome do arquivo de origem, por exemplo
application_form.pdf. - Deixar Perfis personalizados sob Opções avançadas Em branco, a menos que você precise de um perfil de processamento específico.
- Execute o nó e, em seguida, mapeie os valores retornados.
formDataInsira o objeto na próxima etapa do seu fluxo de trabalho.
Configurações típicas
Exemplos de fluxo de trabalhoCommon n8n workflow patterns using Extract Form Data From PDF.
- Um alerta de e-mail é acionado quando uma inscrição é concluída. PDF chega.
- Extrair dados de formulário de PDF Lê o anexo e o armazena em um objeto formData.
- Uma planilha do Google ou Excel O nó adiciona uma linha, mapeando cada nome de campo para uma coluna.
- Um gatilho de armazenamento em nuvem é acionado quando um novo dado é carregado. PDF.
- Extrair dados de formulário de PDF Extrai os dados de contato da camada do formulário.
- A CRM O nó cria ou atualiza o registro usando os valores extraídos de nome, e-mail e empresa.
- Um webhook recebe um formulário de solicitação assinado de um portal externo.
- Extrair dados de formulário de PDF Retorna os campos de valor e departamento solicitados.
- Um nó IF direciona o fluxo para o aprovador correto com base nesses valores.
- Um nó "Loop Over Items" itera sobre uma lista de formulários arquivados. URLs.
- Extrair dados de formulário de PDF executa com o Tipo de Dados de Entrada definido como URL para cada arquivo.
- Cada objeto formData é gravado em uma tabela de banco de dados indexada pelo nome do documento de origem.
Dicas práticas
Folha de dicas
| Campo | Valor |
|---|---|
| Action | Extract Form Data From PDF |
| Input Data Type | Binary Data |
| Input Binary Field | data |
| Document Name | document.pdf |
| Custom Profiles | { 'outputDataFormat': 'json' } |
| Credentials | PDF4me API credential |
| Returns | formData object of field name and value pairs |