Pular para o conteúdo principal

Dividir PDF por texto usando n8n Ação

PDF4me Dividir PDF por texto divide PDF documentos baseados em padrões de texto e conteúdo detectados por meio de n8n Fluxos de trabalho de automação. Processo PDFs via n8n gatilhos, dados binários, strings base64 ou públicos URLs Para encontrar automaticamente sequências de texto específicas, dividir documentos em locais de texto e organizar arquivos usando o conteúdo detectado para nomeação inteligente de arquivos. Esta solução é ideal para separação de faturas, divisão de contratos, processamento em lote de documentos, organização baseada em conteúdo, arquivamento automatizado e fluxos de trabalho de classificação de documentos baseados em texto que exigem detecção precisa de texto com divisão inteligente de documentos e integração perfeita.

Artigos relacionados no blogue
Ainda não há nenhuma publicação no blogue sobre esta funcionalidade — em breve.
Entretanto, explore o blogue da PDF4me para encontrar tutoriais e fluxos de trabalho para todas as plataformas.
Visite o blogue

Configurar

Adicione o PDF4me "Dividir PDF pelo nó "Texto" para o seu n8n fluxo de trabalho e configure os parâmetros necessários. Para obter instruções de configuração inicial, consulte nosso n8n Guia de integração.

Pré-requisitos:

  • PDF4me API credenciais
  • n8n acesso ao fluxo de trabalho

Configuração:

  1. Adicionar PDF4me nó para fluxo de trabalho
  2. Selecione "Dividir" PDF ação "por texto"
  3. Configure os parâmetros de entrada (veja abaixo)
Dividir PDF por texto

Parâmetros

Lista completa de parâmetros para o Split PDF Por ação de texto. Configure esses parâmetros para controlar ações baseadas em texto. PDF divisão.

Importante: Os parâmetros marcados com um asterisco (***) são obrigatórios e devem ser fornecidos para que a ação funcione corretamente.

ParâmetroTipoDescriçãoExemplo
Tipo de dados de entrada***StringPDF Seleção do formato de entrada
• Escolha o formato do seu PDF entrada de dados
PDF4me Suporta vários tipos de entrada
• Opções: Dados binários, string Base64 ou URL
Binary Data
Nome da propriedade bináriaStringBinário PDF Entrada de arquivo (Obrigatório se os dados forem binários)
• Referência PDF arquivo do anterior n8n upload de nó ou arquivo
PDF4me processos binários PDF arquivos com detecção automática de formato
• Obrigatório quando o tipo de dados de entrada for "Dados binários"
data
Conteúdo do documento Base64StringBase64 Codificado PDF Entrada (Obrigatório se for uma string Base64)
• Fornecer PDF dados como string codificada em base64
PDF4me decodifica e processa automaticamente o PDF contente
• Obrigatório quando o tipo de dados de entrada for "Base64 Corda"
UEsDBBQABgAI...
URL do arquivoStringPúblico PDF URL Entrada (Obrigatório se for URL)
• Fornecer uma permissão pública/aberta URL para o PDF arquivo
PDF4me baixa e processa o arquivo de URL
• Obrigatório quando o tipo de dados de entrada for "URL"
https://abc.com/sample.pdf
Texto para pesquisar***StringEspecificação de pesquisa de texto
• Especifique a sequência de texto exata que deseja pesquisar dentro do PDF
PDF4me usa este texto como ponto de divisão do documento.
• Correspondência que diferencia maiúsculas de minúsculas para detecção precisa de texto
page 1, line 10.
Página de texto dividido***StringSeleção de posição dividida
• Escolha onde dividir o PDF em relação ao texto detectado
• Opções: Depois (dividir após a página), Antes (dividir antes da página)
PDF4me proporciona posicionamento dividido flexível
After
Nomeação de Arquivos***StringConvenção de nomenclatura de arquivos de saída
• Escolha como a divisão será gerada PDF Os arquivos devem ser nomeados
• Opções: Nome conforme o pedido (sequencial), Nome conforme a página (com números de página)
• Ajuda a organizar os arquivos de saída
Name As Per Order
Nome do arquivo***StringEspecificação do nome do arquivo de saída
• Especifique o nome para a divisão gerada PDF arquivo
• Deve incluir a extensão .pdf
PDF4me garante a validação exclusiva de nomes e formatos.
output.pdf
Nome do campo binário de saída***StringMapeamento de dados binários
• Defina o nome da variável para acessar a divisão gerada PDF dados
• Utilizado em ações subsequentes do fluxo de trabalho
• Essencial para o fluxo de dados do fluxo de trabalho
data

Opções avançadas

Os seguintes parâmetros estão disponíveis na seção Opções Avançadas e são opcionais:

ParâmetroTipoDescriçãoExemplo
Perfis personalizadosStringPerfis de configuração personalizados
• Defina opções adicionais usando perfis personalizados
JSONformato semelhante a - contendo parâmetros predefinidos
• Suporta outputDataFormat, preserveMetadata, etc.
• Opcional para requisitos específicos
{ "outputDataFormat": "base64", "preserveMetadata": true, "optimizeForPrinting": false, "compressionLevel": "medium" }

Saída

Parâmetros de saída

ParâmetroTipoDescriçãoExemplo
sucessoBooleanPDF4me indicador de status da operação de divisão de texto - Boolean bandeira indicando o sucesso ou fracasso da PDF processo de divisão de texto. PDF4me retornos true para operações bem-sucedidas e false para quaisquer erros, permitindo um tratamento robusto de erros em fluxos de trabalho automatizados.true
mensagemStringPDF4me mensagem de status da operação de divisão de texto - Mensagem de status legível que fornece detalhes sobre o resultado do processo de divisão do texto. Inclui confirmação de sucesso ou detalhes de erro para solução de problemas.PDF split by text successfully
nome_do_arquivoStringPDF4me divisão gerada PDF nome do arquivo - O nome completo do arquivo dividido gerado com sucesso PDF Documento com a extensão .pdf correta. PDF4me Garante nomes exclusivos e valida a conformidade do formato do arquivo para uma integração perfeita com os processos subsequentes.text_split_output.pdf
tipo mimeStringPDF4me saída MIME tipo - MIME tipo do gerado PDF arquivo, sempre "application/pdf" para PDF documentos. Útil para validação de tipo de conteúdo e manipulação adequada de arquivos em aplicações web.application/pdf
tamanho do arquivoNúmeroPDF4me dividir PDF tamanho do arquivo em bytes - O tamanho exato da divisão gerada PDF arquivo em bytes, fornecido por PDF4me Para planejamento de armazenamento, otimização de largura de banda e monitoramento de transferência de arquivos. Essencial para gerenciamento de documentos corporativos e automação de fluxo de trabalho.125430
nomeDoDocumentoStringPDF4me referência ao nome do documento - O nome do documento dividido processado para fins de referência e rastreamento. Isso corresponde ao fileName para garantir a consistência nos fluxos de trabalho de gerenciamento de documentostext_split_output.pdf
textoDivididoConcluídoBooleanPDF4me confirmação de conclusão da divisão de texto - Boolean bandeira confirmando que o PDF A operação de divisão de texto foi concluída com sucesso. Útil para verificar se a divisão baseada em texto foi aplicada corretamente.true
textoCorrespondênciasEncontradasNúmeroPDF4me contagem de correspondências de texto detectadas - O número de correspondências de texto que foram encontradas com sucesso e usadas como pontos de divisão no PDF documento. Útil para monitorar a eficácia da detecção de texto e a precisão da divisão.3
arquivosGeradosNúmeroPDF4me contagem de arquivos divididos gerados - O número de indivíduos PDF Arquivos gerados com sucesso a partir da operação de divisão de texto. Útil para acompanhar a integridade da divisão e os resultados da segmentação de documentos.4

N8N Resposta à ação

O PDF4me Dividir PDF por texto API Retorna uma resposta que pode ser visualizada em vários formatos. Escolha a visualização que melhor se adapta às suas necessidades:

JSON Formato de resposta

O bruto JSON resposta do API:

[
{
"success": true,
"message": "PDF split by text successfully",
"fileName": "text_split_output.pdf",
"mimeType": "application/pdf",
"fileSize": 125430,
"docName": "text_split_output.pdf",
"textSplitCompleted": true,
"textMatchesFound": 3,
"filesGenerated": 4
}
]

Casos de uso

Processamento de Documentos e Gestão de Conteúdo

  • Divida documentos grandes em marcadores de texto específicos ou cabeçalhos de seção para criar arquivos organizados e gerenciáveis para diferentes departamentos ou processos.
  • Processar documentos jurídicos dividindo-os em marcadores de cláusulas específicos ou divisores de seção para criar arquivos individuais para cada seção jurídica.
  • Automatize a separação de relatórios e manuais com base nos títulos dos capítulos ou cabeçalhos das seções para uma melhor organização do conteúdo.

Automação de Processos de Negócio

  • Divida lotes de faturas pesquisando padrões de texto específicos, como "Número da Fatura" ou "Valor a Pagar", para criar arquivos de fatura individuais para cada transação.
  • Processe contratos e acordos dividindo-os em marcadores de texto específicos, como "Seção" ou "Artigo", para criar arquivos separados para cada seção.
  • Automatize a organização de documentos financeiros dividindo-os em padrões de texto como "Relatório Trimestral" ou "Resumo Anual" para diferentes períodos de relatório.

Distribuição de conteúdo e gerenciamento de fluxo de trabalho

  • Divida documentos confidenciais em marcadores de texto específicos para criar arquivos separados para diferentes partes interessadas, com base em seus requisitos de acesso.
  • Processe materiais de treinamento dividindo-os em padrões de texto como "Módulo" ou "Lição" para criar módulos de aprendizagem individuais para diferentes públicos.
  • Automatize a organização da documentação técnica dividindo-a em marcadores de texto como "Referência da API" ou "Guia do Usuário" para diferentes tipos de usuário.

Obtenha ajuda