Dividir PDF por texto usando n8n Ação
PDF4me Dividir PDF por texto divide PDF documentos baseados em padrões de texto e conteúdo detectados por meio de n8n Fluxos de trabalho de automação. Processo PDFs via n8n gatilhos, dados binários, strings base64 ou públicos URLs Para encontrar automaticamente sequências de texto específicas, dividir documentos em locais de texto e organizar arquivos usando o conteúdo detectado para nomeação inteligente de arquivos. Esta solução é ideal para separação de faturas, divisão de contratos, processamento em lote de documentos, organização baseada em conteúdo, arquivamento automatizado e fluxos de trabalho de classificação de documentos baseados em texto que exigem detecção precisa de texto com divisão inteligente de documentos e integração perfeita.
Configurar
Adicione o PDF4me "Dividir PDF pelo nó "Texto" para o seu n8n fluxo de trabalho e configure os parâmetros necessários. Para obter instruções de configuração inicial, consulte nosso n8n Guia de integração.
Pré-requisitos:
- PDF4me API credenciais
- n8n acesso ao fluxo de trabalho
Configuração:
- Adicionar PDF4me nó para fluxo de trabalho
- Selecione "Dividir" PDF ação "por texto"
- Configure os parâmetros de entrada (veja abaixo)

Parâmetros
Lista completa de parâmetros para o Split PDF Por ação de texto. Configure esses parâmetros para controlar ações baseadas em texto. PDF divisão.
Importante: Os parâmetros marcados com um asterisco (***) são obrigatórios e devem ser fornecidos para que a ação funcione corretamente.
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| Tipo de dados de entrada*** | String | PDF Seleção do formato de entrada • Escolha o formato do seu PDF entrada de dados • PDF4me Suporta vários tipos de entrada • Opções: Dados binários, string Base64 ou URL | Binary Data |
| Nome da propriedade binária | String | Binário PDF Entrada de arquivo (Obrigatório se os dados forem binários) • Referência PDF arquivo do anterior n8n upload de nó ou arquivo • PDF4me processos binários PDF arquivos com detecção automática de formato • Obrigatório quando o tipo de dados de entrada for "Dados binários" | data |
| Conteúdo do documento Base64 | String | Base64 Codificado PDF Entrada (Obrigatório se for uma string Base64) • Fornecer PDF dados como string codificada em base64 • PDF4me decodifica e processa automaticamente o PDF contente • Obrigatório quando o tipo de dados de entrada for "Base64 Corda" | UEsDBBQABgAI... |
| URL do arquivo | String | Público PDF URL Entrada (Obrigatório se for URL) • Fornecer uma permissão pública/aberta URL para o PDF arquivo • PDF4me baixa e processa o arquivo de URL • Obrigatório quando o tipo de dados de entrada for "URL" | https://abc.com/sample.pdf |
| Texto para pesquisar*** | String | Especificação de pesquisa de texto • Especifique a sequência de texto exata que deseja pesquisar dentro do PDF • PDF4me usa este texto como ponto de divisão do documento. • Correspondência que diferencia maiúsculas de minúsculas para detecção precisa de texto | page 1, line 10. |
| Página de texto dividido*** | String | Seleção de posição dividida • Escolha onde dividir o PDF em relação ao texto detectado • Opções: Depois (dividir após a página), Antes (dividir antes da página) • PDF4me proporciona posicionamento dividido flexível | After |
| Nomeação de Arquivos*** | String | Convenção de nomenclatura de arquivos de saída • Escolha como a divisão será gerada PDF Os arquivos devem ser nomeados • Opções: Nome conforme o pedido (sequencial), Nome conforme a página (com números de página) • Ajuda a organizar os arquivos de saída | Name As Per Order |
| Nome do arquivo*** | String | Especificação do nome do arquivo de saída • Especifique o nome para a divisão gerada PDF arquivo • Deve incluir a extensão .pdf • PDF4me garante a validação exclusiva de nomes e formatos. | output.pdf |
| Nome do campo binário de saída*** | String | Mapeamento de dados binários • Defina o nome da variável para acessar a divisão gerada PDF dados • Utilizado em ações subsequentes do fluxo de trabalho • Essencial para o fluxo de dados do fluxo de trabalho | data |
Opções avançadas
Os seguintes parâmetros estão disponíveis na seção Opções Avançadas e são opcionais:
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| Perfis personalizados | String | Perfis de configuração personalizados • Defina opções adicionais usando perfis personalizados • JSONformato semelhante a - contendo parâmetros predefinidos • Suporta outputDataFormat, preserveMetadata, etc. • Opcional para requisitos específicos | { "outputDataFormat": "base64", "preserveMetadata": true, "optimizeForPrinting": false, "compressionLevel": "medium" } |
Saída
Parâmetros de saída
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| sucesso | Boolean | PDF4me indicador de status da operação de divisão de texto - Boolean bandeira indicando o sucesso ou fracasso da PDF processo de divisão de texto. PDF4me retornos true para operações bem-sucedidas e false para quaisquer erros, permitindo um tratamento robusto de erros em fluxos de trabalho automatizados. | true |
| mensagem | String | PDF4me mensagem de status da operação de divisão de texto - Mensagem de status legível que fornece detalhes sobre o resultado do processo de divisão do texto. Inclui confirmação de sucesso ou detalhes de erro para solução de problemas. | PDF split by text successfully |
| nome_do_arquivo | String | PDF4me divisão gerada PDF nome do arquivo - O nome completo do arquivo dividido gerado com sucesso PDF Documento com a extensão .pdf correta. PDF4me Garante nomes exclusivos e valida a conformidade do formato do arquivo para uma integração perfeita com os processos subsequentes. | text_split_output.pdf |
| tipo mime | String | PDF4me saída MIME tipo - MIME tipo do gerado PDF arquivo, sempre "application/pdf" para PDF documentos. Útil para validação de tipo de conteúdo e manipulação adequada de arquivos em aplicações web. | application/pdf |
| tamanho do arquivo | Número | PDF4me dividir PDF tamanho do arquivo em bytes - O tamanho exato da divisão gerada PDF arquivo em bytes, fornecido por PDF4me Para planejamento de armazenamento, otimização de largura de banda e monitoramento de transferência de arquivos. Essencial para gerenciamento de documentos corporativos e automação de fluxo de trabalho. | 125430 |
| nomeDoDocumento | String | PDF4me referência ao nome do documento - O nome do documento dividido processado para fins de referência e rastreamento. Isso corresponde ao fileName para garantir a consistência nos fluxos de trabalho de gerenciamento de documentos | text_split_output.pdf |
| textoDivididoConcluído | Boolean | PDF4me confirmação de conclusão da divisão de texto - Boolean bandeira confirmando que o PDF A operação de divisão de texto foi concluída com sucesso. Útil para verificar se a divisão baseada em texto foi aplicada corretamente. | true |
| textoCorrespondênciasEncontradas | Número | PDF4me contagem de correspondências de texto detectadas - O número de correspondências de texto que foram encontradas com sucesso e usadas como pontos de divisão no PDF documento. Útil para monitorar a eficácia da detecção de texto e a precisão da divisão. | 3 |
| arquivosGerados | Número | PDF4me contagem de arquivos divididos gerados - O número de indivíduos PDF Arquivos gerados com sucesso a partir da operação de divisão de texto. Útil para acompanhar a integridade da divisão e os resultados da segmentação de documentos. | 4 |
N8N Resposta à ação
O PDF4me Dividir PDF por texto API Retorna uma resposta que pode ser visualizada em vários formatos. Escolha a visualização que melhor se adapta às suas necessidades:
- JSON
- Table
- Schema
- Binary
JSON Formato de resposta
O bruto JSON resposta do API:
[
{
"success": true,
"message": "PDF split by text successfully",
"fileName": "text_split_output.pdf",
"mimeType": "application/pdf",
"fileSize": 125430,
"docName": "text_split_output.pdf",
"textSplitCompleted": true,
"textMatchesFound": 3,
"filesGenerated": 4
}
]
Visualização em tabela
Dados de resposta em formato de tabela estruturada:
| Parâmetro | Valor |
|---|---|
| success | true |
| message | PDF split by text successfully |
| fileName | text_split_output.pdf |
| mimeType | application/pdf |
| fileSize | 125430 |
| docName | text_split_output.pdf |
| textSplitCompleted | true |
| textMatchesFound | 3 |
| filesGenerated | 4 |
Visão do esquema
A estrutura de dados e os tipos de resposta:
1 item
success: ☑ true
message: AB PDF split by text successfully
fileName: AB text_split_output.pdf
mimeType: AB application/pdf
fileSize: # 125430
docName: AB text_split_output.pdf
textSplitCompleted: ☑ true
textMatchesFound: # 3
filesGenerated: # 4
Indicadores de tipo:
AB= String#= Número☑= Boolean
Visualização de Dados Binários
Os dados e metadados reais do arquivo PDF dividido:
data
─────────────────────────────
File Name: text_split_output.pdf
File Extension: pdf
Mime Type: application/pdf
File Size: 122.5 KB
Acesso a dados binários:
- n8n Objeto Binário:
$binary.data.data - Base64 ContenteDisponível para uso direto.
- Operações com arquivosPronto para download, envio por e-mail ou armazenamento.
Casos de uso
Processamento de Documentos e Gestão de Conteúdo
- Divida documentos grandes em marcadores de texto específicos ou cabeçalhos de seção para criar arquivos organizados e gerenciáveis para diferentes departamentos ou processos.
- Processar documentos jurídicos dividindo-os em marcadores de cláusulas específicos ou divisores de seção para criar arquivos individuais para cada seção jurídica.
- Automatize a separação de relatórios e manuais com base nos títulos dos capítulos ou cabeçalhos das seções para uma melhor organização do conteúdo.
Automação de Processos de Negócio
- Divida lotes de faturas pesquisando padrões de texto específicos, como "Número da Fatura" ou "Valor a Pagar", para criar arquivos de fatura individuais para cada transação.
- Processe contratos e acordos dividindo-os em marcadores de texto específicos, como "Seção" ou "Artigo", para criar arquivos separados para cada seção.
- Automatize a organização de documentos financeiros dividindo-os em padrões de texto como "Relatório Trimestral" ou "Resumo Anual" para diferentes períodos de relatório.
Distribuição de conteúdo e gerenciamento de fluxo de trabalho
- Divida documentos confidenciais em marcadores de texto específicos para criar arquivos separados para diferentes partes interessadas, com base em seus requisitos de acesso.
- Processe materiais de treinamento dividindo-os em padrões de texto como "Módulo" ou "Lição" para criar módulos de aprendizagem individuais para diferentes públicos.
- Automatize a organização da documentação técnica dividindo-a em marcadores de texto como "Referência da API" ou "Guia do Usuário" para diferentes tipos de usuário.