Pular para o conteúdo principal

Analisador de documentos com IA usando Classify

O que este guia abrange

Analisador de documentos com IA. Classificar. Permite que um único analisador processe várias variantes de documentos em uma única chamada. Você define um ID do analisador, depois adicione um Diagrama por variante (Cliente ABC, Cliente XYZ, fatura genérica, pedido de compra genérico). Cada esquema contém um Nome da classificação, um Instruções de classificação em linguagem natural, e um Esquema do documento descrevendo os campos a serem extraídos. Em tempo de execução, a IA compara os dados recebidos. PDF Para cada solicitação de classificação de esquema, seleciona a melhor correspondência e retorna o nome da classificação correspondente e os campos extraídos. O mesmo ID do analisador funciona a partir do REST API e todas as plataformas de automação compatíveis.

Artigos relacionados no blogue(4)
Extração e renomeação inteligente de qualquer PDF com IA no Make: um fluxo de trabalho de 4 módulos no Dropbox com PDF4me AI - Analisador de Documentos
Cenário de quatro módulos no Make: extrair um PDF de um fornecedor do Dropbox, executar o analisador de documentos com IA e extrair a fatura padrão, analisar o JSON para expor o nome do fornecedor e, em seguida, reenviar o arquivo com o nome do fornecedor (vendorName.pdf). Capturas de tela reais, valores exatos dos campos, sem entrada manual de dados.
Ler publicação
Renomeie faturas de fornecedores com IA no Zapier: um fluxo de trabalho de 5 etapas com Dropbox e PDF4me
Zap em cinco etapas: Novo arquivo na pasta do Dropbox → Localizar arquivo no Dropbox → PDF4me AI - Analisador de documentos → Código do Zapier Executar JavaScript → Upload do arquivo para o Dropbox. Extrai o nome do cliente com IA e o utiliza como nome do arquivo de saída. Capturas de tela reais, valores exatos dos campos, sem código além de uma análise JSON de duas linhas.
Ler publicação
Renomeie todas as faturas de fornecedores pelo nome do fornecedor no Zapier: um fluxo de trabalho de IA de 5 etapas com Dropbox + PDF4me
Execução simplificada em cinco etapas para equipes de contas a pagar. O Dropbox monitora sua pasta de entrada de faturas, o PDF4me AI - Document Parser extrai o nome do fornecedor de cada PDF, o Code by Zapier transforma a saída do analisador em tokens mapeáveis e o Dropbox envia o arquivo de volta com o nome do fornecedor como nome do arquivo. Capturas de tela reais, valores exatos dos campos e o mesmo arquivo sample-vendor-invoice.pdf usado neste passo a passo estão disponíveis para download.
Ler publicação

Autenticando sua configuração

Os analisadores de classificação são criados no PDF4me Painel do desenvolvedor. Faça login com sua conta e, em seguida, crie ou copie um API chave para o analisador de IA API chamadas que fazem referência ao analisador que você criou aqui.

URLs do painel que irá utilizar neste guia:

Fatos importantes que você não deve perder

Um analisador, vários esquemas (um por variante)
O Classify foi desenvolvido para o mundo real, onde as faturas do Cliente ABC são diferentes das do Cliente XYZ. Adicione quantos Esquemas forem necessários para cada variante. Cada Esquema é um conjunto independente contendo Nome da Classificação + Prompt + Esquema do Documento.
O prompt de classificação é o cérebro do roteamento.
Escreva em linguagem simples e direta. Mencione elementos concretos como o nome da empresa no cabeçalho, o e-mail de contato, dicas de layout e palavras-chave específicas desta variante. Quanto mais clara a instrução, mais fácil será o roteamento.
A função Classificar retorna TANTO o rótulo quanto os dados.
Ao contrário de um classificador puro, a resposta inclui o nome da classificação correspondente. e todos os campos do Esquema de Documento desse Schema. Uma única chamada fornece a decisão de roteamento e os dados extraídos. JSON junto.

Passo 1: Abra o Analisador de Documentos de IA no painel de controle.

  1. Faça login em dev.pdf4me.com.
  2. Na barra lateral do painel de controle, clique em Analisador de documentos com IA.
  3. A página de lista exibe todos os analisadores existentes em três colunas: ID do analisador, Tipo de analisador (Analisar ou Classificar), e Ações.
  4. Clique no azul + Adicionar botão para iniciar um novo analisador.
Visualização em lista do painel do analisador de documentos com IA do PDF4me, com o item "Analisador de documentos com IA" destacado em vermelho na barra lateral, um botão "Adicionar" azul na parte superior do painel principal e uma tabela vazia com os cabeçalhos de coluna "ID do Analisador", "Tipo de Analisador" e "Ações".

Visualização em lista do analisador de documentos com IA. Clique em + Adicionar para iniciar um novo analisador.

Etapa 2: Criar um Analisador de Classificação

Uma nova linha aparece com três controles:

  1. Entrada de ID do analisadorDigite qualquer identificador claro que você se lembre, por exemplo client_invoices, Vendor Documents, ou incoming-ordersNão há restrição quanto ao formato dos nomes. Snake_case, camelCase, kebab-case, palavras simples com espaços, tudo funciona da mesma forma. O exemplo abaixo usa client_invoices.
  2. Menu suspenso Tipo de analisador. escolha Classificar (este guia) ou Analisar (ver o Guia de análise sintática).
  3. Salvar / Cancelar botões. Salvar cria o analisador; Cancelar descarta a linha.
O analisador de documentos PDF4me AI adiciona uma linha com o campo ID do analisador preenchido com client_invoices, o menu suspenso Tipo de analisador mostrando Classificar destacado acima de Analisar e um valor de Classificar selecionado na linha, com os botões Salvar e Cancelar à direita.

Adicionar linha: insira o ID do analisador (aqui) faturas_de_clientes), escolha ClassificarEm seguida, salve.

Passo 3: Abra o Analisador e adicione o primeiro Esquema.

Clique na nova linha para abrir a página de detalhes. O padrão da URL é:

https://dev.pdf4me.com/ai-document-parser/?id=<your-analyzer-guid>

O painel de controle gera um GUID para cada Analisador na primeira vez que você o abre. Adicione este URL aos seus favoritos para acessar diretamente o mesmo Analisador de Classificação na próxima vez.

A página de detalhes mostra:

  • Classificar informações (à esquerda). Mostra o ID do analisador que você digitou na Etapa 2 (aqui) client_invoicesEste painel é somente leitura.
  • Esquemas (direita). Vazio por padrão. Cada esquema é uma variante de documento. Clique no + Botão no canto superior direito para adicionar o primeiro esquema.
  • Salvar alterações (canto superior esquerdo). Persiste a cada edição feita nesta página.
  • Voltar. retorna ao Lista de analisadores.
Página de detalhes do Analisador de Documentos com IA do PDF4me para um Analisador de Classificação. O banner azul principal exibe "Analisador de Documentos com IA" com o subtítulo "Extraia automaticamente dados de faturas usando IA com saída rápida, precisa e estruturada". Abaixo, encontram-se um botão "Voltar" e um botão azul "Salvar alterações". O painel "Informações de Classificação" à esquerda mostra o ID do Analisador: client_invoices. A seção "Esquemas" à direita está vazia, com um botão azul de adição (+) no canto superior direito para adicionar um novo esquema.

Página de detalhes. Classificar informações À esquerda, encontra-se o ID do analisador. Clique no botão azul + para adicionar um esquema.

Etapa 4: Preencha o nome da classificação, o prompt e o esquema do documento.

Cada esquema representa uma variante de documento que o analisador deve processar. Cada esquema possui três entradas obrigatórias e uma linha de preenchimento rápido na parte inferior.

Campos do esquema (obrigatórios)

CampoPropósitoExemplo
Classification NameThe label returned by the API when this Schema matches. Use a short, business-friendly name.Client ABC
Classification PromptNatural-language description of how to recognise this variant. Mention company name, email, layout cues, distinguishing phrases. This is what the AI uses to route.The invoice has the company name ABC at the top, followed by the contact email [email protected].
Document SchemaJSON object with a description and a fields array. Each field has fieldName, fieldType, and fieldDescription, plus an optional fieldMethod such as generate for derived values.{ "description": "Extract invoice detail for ABC invoices", "fields": [ ... ] }

Exemplo de esquema: Cliente ABC

O editor de esquema de classificação do analisador de documentos PDF4me AI exibe o primeiro esquema intitulado "Cliente ABC". O painel de informações de classificação à esquerda contém o ID do analisador "client_invoices". O cartão do esquema possui um ícone de lixeira vermelha para excluir, um campo "Nome da Classificação" com o valor "Cliente ABC", um campo "Solicitação de Classificação" com o texto "O nome da fatura no topo conterá o nome da empresa ABC e, em seguida, o e-mail para as faturas do cliente em abc.com". Há também um editor JSON de esquema de documento exibindo a descrição "Extrair detalhes da fatura para faturas da ABC" e uma matriz de campos começando com a string "invoiceNumber" (número da fatura, número da nota fiscal, número do recibo) e a data de geração da fatura "invoiceDate". Abaixo do editor, encontram-se os botões de preenchimento rápido para faturas e pedidos de compra.

Primeiro esquema. O nome da classificação, o prompt da classificação e o esquema do documento descrevem juntos uma variante do documento.

Client ABC. Document Schema
{
"description": "Extract invoice detail for ABC invoices",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldMethod": "generate",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4-digit year not found then consider 2-digit year at the end of extracted date."
}
]
}

A sugestão de classificação para o cliente ABC é a dica em linguagem natural que guia a IA até este esquema:

"A fatura tem o nome da empresa ABC no topo, seguido do e-mail de contato." [email protected]"

Etapa 5: Adicione mais esquemas e salve as alterações.

Clique no azul + Pressione o botão novamente para adicionar um Esquema para a próxima variante. Cada novo Esquema recebe seu próprio Nome de Classificação, Prompt de Classificação e Esquema de Documento. Os campos podem ser completamente diferentes entre os Esquemas. O Cliente ABC pode não ter uma coluna de referência do cliente, enquanto o Cliente XYZ tem.

Exemplo do segundo esquema: Cliente XYZ

O analisador de documentos com IA do PDF4me classifica o segundo cartão de esquema intitulado "Cliente XYZ". Nome da classificação: Cliente XYZ. Descrição da classificação: O documento é uma fatura com o nome da empresa XYZ no topo, seguido pelo e-mail support@xyz.com, o endereço e um editor JSON de esquema de documento com a descrição "Extrair dados da fatura da empresa XYZ com um array de campos começando com invoiceNumber e invoiceDate". Abaixo do editor, encontram-se os botões de preenchimento rápido para Fatura e Pedido de Compra.

Segundo esquema para o mesmo analisador. Ambos os esquemas agora residem em faturas_de_clientes.

Client XYZ. Document Schema
{
"description": "Extract Invoice data from company XYZ's Invoice",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldMethod": "generate",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4-digit year not found then consider 2-digit year at the end of extracted date."
}
]
}

A lista de esquemas desaparece após você salvar.

Depois de ambos os esquemas serem inseridos, a lista exibe cada um como um cartão recolhível com o nome da classificação à esquerda e uma seta para expandir à direita. Clique em um cartão para editá-lo novamente mais tarde.

Página de detalhes do analisador de documentos PDF4me AI para um Analisador de Classificação, mostrando ambos os Esquemas na visualização de lista recolhida. O painel Informações de Classificação à esquerda exibe o ID do Analisador client_invoices. A seção Esquemas à direita lista o Cliente ABC e o Cliente XYZ como dois cartões sanfonados recolhidos com setas de expansão. Um botão azul de adição (+) está localizado no canto superior direito para adicionar mais Esquemas.

Ambos os esquemas foram salvos. Clique em qualquer cartão para expandir e editar; use o sinal de + para adicionar mais variantes.

Clique Salvar alterações No canto superior esquerdo, para persistir todos os esquemas adicionados. O analisador agora está ativo e pronto para receber. PDFs.

Opções de nível de campo dentro do Esquema de Documento

AtributoObrigatório?O que faz
fieldNameRequiredThe name of the field and how it will appear in the response JSON.
fieldTypeRequiredThe type of data to extract. One of string, number, date, or table.
fieldDescriptionRequiredNatural-language description of what needs to be extracted and where to find it. Include alternate labels and example formats so the AI matches correctly.
fieldMethodOptional (default extract)How the AI fills the value. extract takes the value verbatim from the document. generate tells the AI to derive or normalise it (useful for dates, computed totals, or cleaned-up IDs). Omit for default extract behaviour.
fieldsRequired when fieldType is tableNested array describing the columns of the table. Each entry takes the same attributes as a top-level field (fieldName, fieldType, fieldDescription, fieldMethod). Cannot itself be table.

Esquema com um campo de tabela (linhas aninhadas)

Usar fieldType: "table" Quando um esquema precisa extrair linhas repetidas, como itens de fatura, cada campo da tabela possui seu próprio aninhamento. campos matriz que descreve as colunas.

{
"description": "Invoice data extractor",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4 digit year not found then consider 2 digit year at the end of extracted date.",
"fieldMethod": "generate"
},
{
"fieldName": "lineItems",
"fieldType": "table",
"fieldDescription": "All product / service rows from the invoice table. Be careful, sometimes a row can be part of the next item like when description goes over one line, but it's of a single item.",
"fields": [
{
"fieldName": "itemNumber",
"fieldType": "string",
"fieldDescription": "Product number, product id number or product code"
},
{
"fieldName": "hsnCode",
"fieldType": "string",
"fieldDescription": "HSN / SAC code (4 to 8 digit)"
}
]
}
]
}

Botões de preenchimento rápido (use como ponto de partida)

O editor de esquemas oferece Fatura e Ordem de Compra Botões predefinidos na parte inferior do cartão de Esquema do Documento. Use-os como ponto de partida. Clique em um para preencher um esquema típico para essa família de documentos e, em seguida, ajuste os nomes dos campos, tipos, métodos e descrições para corresponder à variante específica que você está configurando. Os modelos predefinidos são apenas uma estrutura básica, não o formato final.

Use o Analisador de Classificação em API ou chamadas de automação

Uma vez salvo, o mesmo ID do analisador funciona em qualquer lugar por referência. Você não precisa recriar os esquemas em cada plataforma.

CampoFontePropósito
AnalyzerIdA sequência que você digitou na Etapa 2 (client_invoices)Identificador estável para o Analisador de Classificação.
docNameFonte PDF nome do arquivoUtilizado para rastreamento e mensagens de erro.
docContentFonte PDF codificado como Base64O documento a ser classificado e do qual se devem extrair informações.
asyncfalse para síncrono, true para votaçãoControla a entrega da resposta.

Exemplo REST Corpo da requisição:

{
"docName": "incoming_invoice.pdf",
"docContent": "BASE64_ENCODED_PDF_CONTENT",
"AnalyzerId": "client_invoices",
"async": false
}

A resposta contém o Nome de Classificação correspondente, além dos campos definidos no Esquema de Documento desse Esquema. Um documento reconhecido como Cliente ABC retorna os campos do Cliente ABC; um documento reconhecido como Cliente XYZ retorna os campos do Cliente XYZ. Uma única chamada, ambas as decisões.

Fluxos de trabalho comuns

Padrões típicos do Analisador de ClassificaçãoHow a Classify Analyzer with multiple Schemas runs in production.
Caixa de entrada AP multi-cliente
  1. As faturas de fornecedores do Cliente ABC, do Cliente XYZ e de alguns outros chegam em uma única caixa de correio.
  2. Make, Zapier, Power Automate, ou n8n chama o analisador de IA com ID do analisador: faturas_do_cliente.
  3. A resposta contém o Nome da Classificação (Cliente ABC, Cliente XYZ, etc.) e os campos extraídos.
  4. Uma etapa de comutação direciona cada resultado para a correspondência. ERP Registro do cliente usando o Nome da Classificação; os campos extraídos preenchem diretamente o registro da fatura.
Integração de fornecedores sem reconstruções
  1. Um novo fornecedor envia uma fatura com um layout diferente pela primeira vez.
  2. As operações abrem o existente faturas_de_clientes Analisador no painel e clique +.
  3. Um novo esquema é adicionado com um nome de classificação (o nome do fornecedor), um prompt de classificação descrevendo o layout e um esquema de documento para os campos relevantes.
  4. O próximo a chegar PDF é roteado automaticamente para o novo esquema. Nenhuma reconfiguração da automação é necessária.
Triagem de documentos mistos
  1. O One Analyzer abrange faturas, pedidos de compra e notas de crédito.
  2. O prompt de classificação de cada esquema descreve os marcadores distintivos ("contém Projeto de lei para e um total a pagar" em vez de "contém um número de pedido de compra e um endereço de entrega".
  3. O esquema de documento por esquema extrai os campos relevantes para aquele tipo de documento.
  4. O roteamento a jusante se ramifica com base no Nome de Classificação; cada ramificação grava no sistema correspondente.

Melhores práticas de esquema para classificação

  • Um esquema por variante estável de documento. Dois fornecedores com layouts muito diferentes devem ter dois esquemas, não um com regras sobrepostas.
  • O Guia de Classificação é a sua regra de roteamento. Escreva-o em linguagem simples e inclua marcadores concretos (nome da empresa, e-mail, frases distintivas, dicas de layout).
  • Mantenha o nome da classificação curto, amigável para o negócio e estável. É a partir dele que o roteamento subsequente se ramifica.
  • Use os botões de preenchimento rápido de Fatura e Pedido de Compra como ponto de partida e, em seguida, refine as descrições dos campos para cada variante.
  • Adicionar fieldMethod: "generate" para datas, totais calculados ou campos onde a IA deve normalizar o valor em vez de copiá-lo literalmente.
  • Teste cada esquema com uma amostra real antes de implementá-lo: uma fatura óbvia do Cliente ABC deve sempre ser encaminhada para o esquema do Cliente ABC, e não para o do Cliente XYZ.
  • Clique Salvar alterações Após cada rodada de edição, os esquemas não salvos são perdidos na navegação.

Ações relacionadas

Analisador de documentos com IA usando Parse
Mesmo painel de controle, um único esquema por analisador. Use quando todos os documentos processados compartilharem a mesma família de layout.
IA - Analisador de Documentos em Make
Use o ID do Classify Analyzer que você salvou de um Make cenário. Combine-o com quaisquer módulos de fonte de dados e armazenamento para distribuir o roteamento e a extração em fluxos de trabalho visuais.
IA - Analisador de Documentos em Power Automate
Execute o mesmo Analisador de Classificação a partir de um Power Automate Fluidez. Conecta-se naturalmente a SharePoint, Excel, Dataverse, e Outlook.
IA - Analisador de Documentos em n8n
Hospedado localmente ou na nuvem. n8n fluxos de trabalho. O menu suspenso ID do Analisador de IA carrega seus analisadores salvos diretamente da sua conta.
IA - Analisador de Documentos em Zapier
Acione a extração de IA de qualquer uma das mais de 6.000 opções. SaaS Aplicativos e webhooks. Digite o ID do Classify Analyzer salvo no campo Nome do AI Analyzer.

Perguntas frequentes

How is Classify different from Parse in AI Document Parser?+
Parse holds a single Document Schema and returns its extracted fields. Classify holds multiple Schemas, one per document variant, each with its own Classification Prompt and Document Schema. At runtime the AI picks the best-matching Schema and returns its fields plus the Classification Name. Use Classify when one Analyzer must handle several layouts.
What is the Classification Prompt?+
A natural-language description of the markers that identify this document variant. Mention the company name printed at the top, the contact email, layout cues, anything distinctive. The AI compares every Schema Classification Prompt against the incoming PDF to pick the best match.
Can each Schema have different fields?+
Yes. Each Schema has its own Document Schema, so Client ABC can extract invoiceNumber and invoiceDate while Client XYZ extracts invoiceNumber, customerRef, and PONumber. The response contains exactly the fields defined in the matched Schema.
What does fieldMethod: generate do?+
Inside a Document Schema, fieldMethod controls how the AI fills the value. generate tells the AI to derive or normalize the value rather than copy a substring verbatim. Useful for dates (normalize multiple formats), totals (compute or normalize), and identifiers that may need cleanup. Omit fieldMethod for straight extraction.
How many Schemas can I add to one Analyzer?+
No hard cap published. In practice, 5 to 20 well-described Schemas per Analyzer perform best. If you need dozens, group similar variants under broader Classification Names and let the Document Schema handle the small differences.
Does the Analyzer Id change after Save Changes?+
No. The Analyzer Id is the string you typed in the Add row in Step 2 (for example client_invoices). It stays stable across edits and is the value every API call and automation module uses.
Do I need to upload a sample PDF when setting up the Analyzer?+
No. The AI Analyzer does not need a sample for setup. You describe each variant in natural language via the Classification Prompt; the AI engine applies the prompts to whatever document you send at runtime.
What happens if the incoming PDF does not match any Schema confidently?+
The AI still returns its best guess. To handle ambiguous cases, add a catch-all Schema with a generic Classification Prompt and a minimal Document Schema, or route low-confidence responses to a manual review queue in your automation.

Obtenha ajuda