Pular para o conteúdo principal

IA - Analisador de Documentos em n8n

O que este nó faz

PDF4me Analisador de documentos com IA Extrai dados estruturados de qualquer documento executando um comando salvo. AI Analisador do seu PDF4me conta em relação ao arquivo. Ao contrário dos analisadores fixos (AI-Invoice Parser, AI-Process Contract), você escolhe o AI ID do analisador a partir de um menu suspenso de analisadores configurados no PDF4me painel de controle, de forma que o mesmo nó lide com faturas, pedidos de compra, recibos, formulários personalizados, relatórios de laboratório, modelos internos, qualquer coisa que você descreva em um esquema. Use um Analisar Analisador para um único esquema ou um Classificar Analisador para várias variantes de documentos em uma única chamada. Retorna resultados dinâmicos. JSON indexado pelo seu esquema mais um _metadados bloco, nenhum arquivo binário.

Artigos relacionados no blogue
Ainda não há nenhuma publicação no blogue sobre esta funcionalidade — em breve.
Entretanto, explore o blogue da PDF4me para encontrar tutoriais e fluxos de trabalho para todas as plataformas.
Visite o blogue

Exemplo de fatura para testes

Use esta fatura de fornecedor de exemplo para confirmar se o nó funciona de ponta a ponta antes de direcionar seu fluxo de trabalho para dados reais. Mapeie-a como entrada binária e selecione. default_invoice_extraction como o AI ID do analisador.

Autenticando seu API Solicitar

Todo PDF4me nó em n8n requer um válido Credencial para se conectar comCrie ou selecione um que contenha o seu PDF4me API chave para que o fluxo de trabalho possa autenticar AI solicitações de extração com segurança. A mesma credencial também alimenta o AI ID do analisador menu suspenso através do GetAnalyzerId API.

Primeiro, configure seu analisador.

URLs do painel que irá utilizar neste guia:
Crie primeiro o seu Analyzer (obrigatório para todas as plataformas)
O AI - Document Parser executa um Analyzer guardado a partir do painel de controlo do programador do PDF4me. Selecione «Parse» para um esquema de documento ou «Classify» para encaminhar várias variantes (Cliente ABC, Cliente XYZ, fatura genérica) numa única chamada. O mesmo ID do Analyzer funciona no Make, no Zapier, no Power Automate, no n8n e na API REST.

Fatos importantes que você não deve perder

Você configurou o analisador no painel de controle; o nó apenas faz referência a ele.
Defina o esquema, os campos e os prompts uma única vez no Lista de analisadores e Detalhes do analisador páginas (Analisar para um esquema, Classificar para várias variantes). O n8n O nó carrega seus analisadores no AI ID do analisador A lista suspensa executa a opção escolhida. Editar o esquema posteriormente não requer alterações no fluxo de trabalho.
A saída é dinâmica JSON, nenhum arquivo binário
As chaves de nível superior correspondem aos nomes de campo que você definiu no Analisador (string, número, data ou linhas de tabela). _metadados O objeto é sempre complementado com sucesso, mensagem, carimbo de data/hora, nome do arquivo de origem, ID do analisador e operação. Não há Nome do campo binário de saída.
A decisão entre analisar ou classificar é tomada pelo analisador, não pelo nó.
Mesmo nó, dois modos de análise. Um Analisar O analisador retorna os campos de seu esquema único. Classificar O analisador encaminha o documento para o esquema mais adequado e retorna seu nome de classificação. mais Os campos extraídos do esquema correspondente. Alterne o comportamento alterando o ID.
O nó n8n do analisador de documentos de IA mostra as opções Credential Pdf4me, Resource Extract, Extract Operations AI Document Parser, Input Data Type Binary Data, Input Binary Field data, Document Name document.pdf e AI Analyzer Id dropdown undefined (destacado como obrigatório).

Painel de nós completo: Extrair → AI Analisador de documentos com entrada de dados binários. Selecione um AI ID do analisador antes de correr.

Parâmetros

URLs do painel que irá utilizar neste guia:

Obrigatório no n8n Interface do usuário: Credencial de conexão, Tipo de dados de entrada, Nome do documento, AI ID do analisador. Os campos obrigatórios condicionais (Campo Binário de Entrada, Conteúdo do Documento Base64 ou URL do Documento) aparecem somente quando o Tipo de Dados de Entrada correspondente é selecionado. Não há Nome do campo binário de saída e não Opções avançadas / Perfis personalizados nesta operação.

ParâmetroObrigatórioO que fazExemplo
Input Data TypeYesHow the document is supplied. Binary Data reads from a previous node (default, most common). Base64 String accepts an encoded document. URL downloads the document from a public link.Binary Data
Input Binary FieldConditionalName of the binary property on the incoming n8n item that holds the document. Required when Input Data Type is Binary Data. Defaults to data. Error reports which property was missing when the name is wrong.data
Base64 Document ContentConditionalBase64-encoded document. Required when Input Data Type is Base64 String. Data-URL style prefixes (text before the comma) are stripped automatically.JVBERi0xLjQK...
Document URLConditionalPublicly reachable HTTPS URL to the document. Required when Input Data Type is URL. Must be a valid full URL.https://example.com/document.pdf
Document NameYesFilename used by PDF4me for processing. Default document.pdf. With Binary Data, the uploaded file name is used for upload but your explicit Document Name value takes precedence in the API call when set. Use a real extension (.pdf, .png, .jpg, etc.) so PDF4me handles the file correctly.document.pdf
AI Analyzer IdYesThe saved Analyzer that controls extraction. Create Analyzers at https://dev.pdf4me.com/dashboard/#/ai-document-parser/ (+ Add), then edit schemas on https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>. Dropdown populated via GetAnalyzerId API. Sent as customisationNote. Pick Parse for one schema or Classify for many variants.aaaa133

Opções de tipo de dados de entrada

Escolha como o documento entra no nó. Os campos subsequentes mudam de acordo com essa escolha.

O menu suspenso Tipo de Dados de Entrada no nó do analisador de documentos de IA do n8n PDF4me mostra três opções: Dados Binários (destacado com a descrição: Usar o arquivo de documento do nó anterior), String Base64 (com a descrição: Fornecer o conteúdo do documento como uma string codificada em base64) e URL (com a descrição: Fornecer a URL do arquivo de documento).

Tipo de dados de entrada. Dados binários (padrão), string Base64 ou URL.

Dados bináriosPadrão: arquivo do nó anterior
Lê o documento diretamente de um nó anterior, como o Google Drive Download. HTTP Solicitar, ler arquivo binário ou um nó de anexo de e-mail. Configurar Campo binário de entrada para o nome do campo binário (padrão) dadosO nome do arquivo carregado será usado, a menos que você o substitua pelo nome do documento.
String Base64Documento codificado em linha
Cole ou mapeie uma string base64 em Conteúdo do documento Base64Os prefixos no estilo Data-URL (texto antes da vírgula) são removidos automaticamente. Nome do documento com detecção correta do formato das unidades de extensão.
URLBaixar a partir de um link público
Disponibilizar um público HTTPS URL em URL do documento. PDF4me Obtém o documento diretamente. O nome do arquivo para processamento é obtido do URL Quando possível, utilize o caminho como referência ou o nome do documento.

AI Menu suspenso de ID do analisador

A lista suspensa é preenchida a partir do seu PDF4me conta através do ObterID do Analisador API Ao abrir o campo, cada opção é um analisador que você salvou no arquivo. PDF4me painel. Selecione aquele cujo esquema corresponda ao tipo de documento que você está processando.

A lista suspensa de IDs do Analisador de IA abre no nó do analisador de documentos de IA do n8n PDF4me, mostrando três opções de exemplo do analisador: aaaa133, TestTenantProject, TestTenant.

AI A lista suspensa de ID do analisador foi carregada a partir do seu PDF4me conta.

Analisador de análise sintática
Um esquema de documento. O nó retorna exatamente os campos definidos nesse esquema. É ideal quando todos os documentos processados compartilham a mesma família de layout. Veja o Guia de configuração do Parse para regras de esquema incluindo fieldType: "table" para linhas aninhadas e método de campo (extrair o valor padrão, gerar para derivar/normalizar).
Analisador de classificação
Vários esquemas, um por variante de documento. O AI Encaminha o documento recebido para o esquema mais adequado usando o prompt de classificação de cada esquema e, em seguida, retorna o nome da classificação correspondente, além de seus campos. Consulte o Guia de configuração do Classify.

Menu suspenso vazio? O nó mostra "GetAnalyzerId não retornou opções de analisador" quando sua conta não possui analisadores ou quando as credenciais não conseguem alcançar o APIAbra o Lista de analisadores e adicione pelo menos um analisador no Detalhes do analisador página, depois verifique o API digite sua n8n credencial.

Campos de saída

Uma corrida bem-sucedida retorna um n8n item com JSON apenas, sem arquivo binário. As chaves de nível superior correspondem ao seu esquema do Analyzer; um _metadata O objeto é sempre anexado.

CampoTipoO que contém
Top-level extracted fieldsDynamicOne key per field defined in your Analyzer schema (string, number, date, or nested table rows). Names match fieldName exactly.
_metadata.successBooleantrue on a successful parse.
_metadata.messageString"Document parsed successfully using AI Document Parser".
_metadata.processingTimestampStringISO timestamp of the parse.
_metadata.sourceFileNameStringDocument name used for processing.
_metadata.aiAnalyzerIdStringThe Analyzer Id you selected (sent as customisationNote to the API).
_metadata.operationString"aiDocumentParser".
rawContent (fallback only)StringIf the API returns plain text instead of JSON and parsing fails, the node wraps the response as { "rawContent": "<api response string>" } at the top level.

Configuração rápida

  1. Primeiro, construa seu analisador. Abra o Lista de analisadores, clique + AdicionarDigite um ID de analisador claro e selecione Analisar ou ClassificarSalve a linha e, em seguida, adicione um esquema de documento ao Detalhes do analisador página. Veja a Guia de configuração do Parse ou Guia de configuração do Classify para regras de esquema completas, incluindo fieldType: "table" para linhas aninhadas e fieldMethod (extrair ou gerar).
  2. Em seu n8n fluxo de trabalho, clique + e procure por PDF4me. Definir Recurso para Extrair e Operações de Extração para Analisador de documentos com IA.
  3. Em Credencial para se conectar com, selecione o seu PDF4me credencial ou cole um API chave.
  4. Definir Tipo de dados de entradaOs dados binários (padrão) são lidos de um nó anterior e são os mais comuns.
  5. Preencha o campo de entrada correspondente (Campo binário de entrada, Conteúdo do documento Base64, ou URL do documento).
  6. Nome do documentoSubstituir o padrão document.pdf Para usar o nome de arquivo real com a extensão correta.
  7. Escolha um AI ID do analisador a partir do menu suspenso (carregado da sua conta).
  8. Execute o nó. O item de saída contém os campos analisados no nível superior, além de _metadataEncaminhar para Conjunto de Dados, Código, Planilhas Google, Airtable, um banco de dados, um e-mail ou qualquer nó subsequente.

Configurações típicas

Exemplos de fluxo de trabalhoCommon n8n workflow patterns using AI Document Parser.
Anexo de e-mail para Planilhas Google
  1. O gatilho de e-mail (IMAP) é acionado em uma nova mensagem com PDF anexo.
  2. AI O analisador de documentos é executado com o tipo de dados de entrada "Dados binários" e o nome do documento definido como o nome do arquivo anexo. AI O ID do analisador deve ser o seu. analisador_de_faturas Analisador.
  3. Planilhas Google Acrescentar Grava o número da fatura, o nome do fornecedor, o valor total e a data de vencimento no rastreador de contas a pagar.
Caixa de entrada com vários fornecedores e sistema de classificação.
  1. A pasta monitorada recebe resultados mistos. PDFs do Cliente ABC, do Cliente XYZ e de uma longa lista de clientes já cada vez mais numerosos.
  2. AI O analisador de documentos está configurado para um ID de analisador de classificação (um esquema por fornecedor).
  3. Um nó Switch ramifica-se com base no nome de classificação correspondente retornado na resposta, enviando cada resultado para a tabela downstream correspondente.
Documento hospedado por URL
  1. O webhook recebe um link para um documento do seu portal.
  2. AI O analisador de documentos é executado com o tipo de dados de entrada. URL e o ID do seu analisador de formulário personalizado.
  3. Saída JSON é mapeado para uma gravação no Dataverse / Airtable / Postgres para criar um novo registro.
Digitalize, recorte automaticamente e, em seguida, analise.
  1. Os dados digitalizados são salvos em uma pasta com bordas largas.
  2. Documento de recorte automático por IA (Recurso AI) apara as bordas.
  3. AI O analisador de documentos é executado no arquivo binário recortado com o ID do analisador correspondente.
  4. Analisado JSON flui rio abaixo como de costume.
Valide e depois enriqueça.
  1. AI O analisador de documentos retorna os campos estruturados.
  2. Um nó de código valida os campos obrigatórios e aplica as regras de negócio.
  3. Se válido, um HTTP A solicitação é enriquecida com dados do fornecedor do seu CRM; caso contrário, um alerta é enviado ao Slack para revisão manual.

Dicas práticas

Set up the Analyzer in PDF4me first
The node does not define extraction rules. It runs whatever your selected Analyzer specifies. Build it in the dashboard before configuring the node.
Use Document Name with the real extension
PDF4me uses the extension for format detection. Even on Binary Data, an explicit Document Name with the correct extension is safest.
No Output Binary Field Name and no Advanced Options
Unlike AI Auto Crop Document, this operation has neither. The output is JSON only; there is nothing to write back as a binary file.
Plain-text fallback wraps as rawContent
If the API returns plain text instead of JSON and parsing fails, the node wraps the response as { "rawContent": "<string>" } so the workflow does not break.
Combine with AI Auto Crop Document for scans
Scans with wide borders parse better after cropping. Chain AI Auto Crop Document (Resource AI) before this node.
Use AI-Invoice Parser / AI-Process Contract for built-in schemas
When you only need standard invoice or contract fields, the dedicated nodes are simpler. AI Document Parser shines when you have a custom schema.

Solução de problemas

"AI É necessário o ID do analisador.

Selecione um analisador no menu suspenso antes de executar. O campo não pode ficar vazio.

"Nenhum dado binário encontrado na propriedade '…'"

Alinhar Campo binário de entrada com o nó anterior (frequentemente) dadosO erro indica qual propriedade estava faltando.

"O conteúdo do documento é obrigatório"

Base64 vazio ou arquivo ausente. Forneça conteúdo no campo Tipo de dados de entrada correspondente.

"Inválido" URL formato"

Verificar URL do documento é um documento completo e válido. URL (esquema + host + caminho).

"GetAnalyzerId não retornou opções de analisador"

Não há analisadores na conta ou o problema está nas credenciais. Crie um analisador no PDF4me painel de controle ou verifique o API chave no n8n credencial.

Folha de dicas

CampoValor
ResourceExtract
OperationAI Document Parser
Input Data TypeBinary Data
Input Binary Fielddata
Document Nameform.pdf (with the real extension)
AI Analyzer Id(pick from the dropdown loaded from your account)
CredentialsPDF4me API credential

Perguntas frequentes

Where does the AI Analyzer Id list come from?+
The dropdown is populated from your PDF4me account via the GetAnalyzerId API. Each option is an Analyzer you created at https://dev.pdf4me.com/dashboard/#/ai-document-parser/ with schemas on https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>. The node sends the selected value as customisationNote to the AiDocumentParser API.
What does "GetAnalyzerId returned no analyzer options" mean?+
The account has no Analyzers configured, or the credentials cannot reach the GetAnalyzerId endpoint. Open https://dev.pdf4me.com/dashboard/#/ai-document-parser/ and create at least one Analyzer (Parse or Classify) on the Analyzer detail page, or verify the API key in your n8n credential.
How is this different from AI-Invoice Parser, AI-Process Contract, AI-Process Bank Cheque?+
Those nodes use fixed schemas tuned to those document types. AI Document Parser is schema-driven: it runs whatever Analyzer you select, so the same node handles invoices, purchase orders, receipts, custom forms, lab reports, anything you describe in a schema. Pick AI Document Parser whenever you need a custom layout or document type.
What shape does the output have?+
Top-level keys match the field names in your Analyzer schema (for example customerName, invoiceNumber, totalAmount, lineItems). Nested objects and table arrays follow the same shape you defined. A _metadata object is always appended with success, message, processingTimestamp, sourceFileName, aiAnalyzerId, and operation. No binary file is returned.
Does this work on scanned PDFs?+
Yes. The AI engine handles OCR internally, so scanned PDFs and image formats work the same as native PDFs. If borders are large, chain AI Auto Crop Document (Resource AI) before this node for cleaner extraction.
Can I change the Analyzer schema without rebuilding the workflow?+
Yes. The workflow only references the Analyzer Id. Edit the schema in the PDF4me dashboard and the next run picks up the new shape automatically. Output keys follow your latest schema, so any downstream Set / Code / Sheets nodes that assume specific keys may need updating after a breaking schema change.
Can I switch between Parse and Classify Analyzers without rewiring the node?+
Yes. Both Analyzer types are listed in the AI Analyzer Id dropdown. Pick a Classify Analyzer when you want one node to handle several document variants; pick a Parse Analyzer for a single fixed schema. The output shape adapts to whichever you choose.
What happens when the API returns plain text instead of JSON?+
The node tries to parse it; if parsing fails, the response is wrapped as { "rawContent": "<api response string>" } at the top level so the workflow does not break. Useful for inspecting unexpected responses during development.

Ações relacionadas

Mesma tarefa em outras plataformas

Obtenha ajuda