Pular para o conteúdo principal

Extrair metadados de um documento do Word usando n8n Ação

PDF4me Extrair metadados de um documento do Word Permite extrair metadados e propriedades abrangentes de documentos do Word através de n8n Fluxos de trabalho automatizados com recursos detalhados de análise de documentos. Este poderoso recurso de extração de metadados oferece suporte a propriedades de documentos integradas, propriedades personalizadas, estatísticas de documentos, informações do autor, datas de criação e controle de revisões com formatação específica para cada cultura e suporte à localização, ideal para gerenciamento de documentos, controle de conformidade e fluxos de trabalho de análise de conteúdo.

Artigos relacionados no blogue
Ainda não há nenhuma publicação no blogue sobre esta funcionalidade — em breve.
Entretanto, explore o blogue da PDF4me para encontrar tutoriais e fluxos de trabalho para todas as plataformas.
Visite o blogue

Configurar

Adicione o PDF4me Adicione o nó "Extrair metadados de um documento do Word" ao seu projeto. n8n fluxo de trabalho e configure os parâmetros necessários. Para obter instruções de configuração inicial, consulte nosso n8n Guia de integração.

Pré-requisitos:

  • PDF4me API credenciais
  • n8n acesso ao fluxo de trabalho

Configuração:

  1. Adicionar PDF4me nó para fluxo de trabalho
  2. Selecione a ação "Extrair metadados do documento do Word".
  3. Configure os parâmetros de entrada (veja abaixo)
Extrair metadados de um documento do Word

Parâmetros

Lista completa de parâmetros para a ação Extrair Metadados de Documento do Word. Configure esses parâmetros para controlar o comportamento da extração de metadados.

Importante: Os parâmetros marcados com um asterisco (***) são obrigatórios. Os parâmetros avançados fornecem controle preciso sobre a formatação dos metadados.

ParâmetroTipoDescriçãoExemplo
Tipo de dados de entrada***StringSeleção do formato de entrada do documento do Word
• Escolha o formato de entrada de dados do seu documento Word
PDF4me Suporta vários tipos de entrada
• Opções: Dados binários, Base64 Corda, ou URL
Binary Data
Campo binário de entrada***BinárioEntrada de arquivo de palavras binárias (Obrigatório se os dados forem binários)
• Arquivo Word de referência (.docx, .doc) do documento anterior n8n upload de nó ou arquivo
PDF4me Processa arquivos binários do Word com detecção automática de formato.
• Obrigatório quando o tipo de dados de entrada for "Dados binários"
{{ $binary.data }}
Conteúdo em Base64***StringBase64 Entrada de palavras codificadas (Obrigatório se for uma string Base64)
• Forneça o conteúdo do Word (.docx, .doc) como uma string codificada em base64 para transmissão segura.
PDF4me Decodifica e processa automaticamente o conteúdo do Word.
• Obrigatório quando o tipo de dados de entrada for "String Base64"
UEsDBBQABgAI...
URL do documento Word***StringDocumento público do Word URL Entrada (Obrigatório se for URL)
• Fornecer uma permissão pública/aberta URL ao arquivo Word (.docx, .doc) a ser processado
PDF4me Baixa e processa o arquivo Word fornecido. URL
• Obrigatório quando o Tipo de Dados de Entrada for "URL"
https://abc.com/document.docx
Nome do documento Word***StringNome do arquivo de entrada do documento do Word
• Especifique o nome do arquivo Word de entrada com a extensão correta (.docx, .doc)
PDF4me Isso é usado para detecção de formato e otimização de processamento.
document.docx
Nome da culturaStringCultura/Localidade do Documento
• Código cultural para formatação de data/hora (por exemplo, "en-US", "de-DE", "fr-FR")
• Padrão: InvariantCulture (formatação consistente)
• Afeta o formato de exibição de data/hora nos metadados.
en-US

Saída

Parâmetros de saída

ParâmetroTipoDescriçãoExemplo
nome_do_arquivoStringNome do arquivo original do documento Word - O nome do arquivo do documento Word de entradamyWordFile.docx
sucessoBooleanPDF4me status da operação - Boolean Sinalizador indicando o sucesso ou a falha da operação de extração de metadados. PDF4me retornos true para operações bem-sucedidas e false para quaisquer errostrue
nome_da_culturaStringCódigo de cultura/localidade - Código cultural usado para formatação de data/hora (por exemplo, "en-US", "de-DE", "fr-FR")en-US
metadadosObjectObjeto de metadados aninhado - Contém a estrutura de metadados do documento com objetos de metadados aninhados contendo todas as propriedades do documento, incluindo Autor, Título, Assunto, Palavras-chave, Comentários, Categoria, Empresa, Gerente, Data de Criação, Data da Última Modificação, Data da Última Impressão, Número da Revisão, Tempo Total de Edição, Páginas, Palavras, Caracteres e Parágrafos.{"metadata": {"Author": "Ynoox Testtwo", "Company": "HP Inc.", "Words": 921}}
mensagemStringMensagem da operação - Mensagem descritiva indicando o resultado da operação de extração de metadadosWord metadata extracted successfully

N8N Resposta à ação

O PDF4me Extrair metadados de um documento do Word API Retorna uma resposta que pode ser visualizada em vários formatos. Escolha a visualização que melhor se adapta às suas necessidades:

JSON Formato de resposta

O bruto JSON resposta do API:

[
{
"fileName": "myWordFile.docx",
"success": true,
"cultureName": "en-US",
"metadata": {
"document": null,
"fileName": null,
"success": true,
"errorMessage": null,
"metadata": {
"Author": "Ynoox Testtwo",
"Title": "",
"Subject": "",
"Keywords": "",
"Comments": "",
"Category": "",
"Company": "HP Inc.",
"Manager": "",
"Created": "5/16/2019 6:04:00 AM",
"LastModified": "8/7/2024 7:04:00 AM",
"LastPrinted": "5/16/2019 6:04:00 AM",
"RevisionNumber": 5,
"TotalEditingTime": 2,
"Pages": 3,
"Words": 921,
"Characters": 5256,
"Paragraphs": 12
}
},
"message": "Word metadata extracted successfully"
}
]

Casos de uso

Automação de Documentos Empresariais

  • Gestão de DocumentosExtrair metadados para organização e catalogação de documentos.
  • Rastreamento de ConformidadeRastrear propriedades de documentos para fins de conformidade regulatória
  • Análise de ConteúdoAnalisar estatísticas e propriedades do documento.
  • Pesquisa de documentosUtilizar metadados para pesquisa e recuperação de documentos.

Processamento de documentos com inteligência artificial

  • Suporte a múltiplos formatosProcessar documentos do Word nos formatos .docx e .doc
  • Processamento MultilíngueSuporte para diferentes idiomas e regiões.
  • Extração Inteligente de MetadadosExtração automática de todas as propriedades do documento.

Inteligência de Negócios e Análise

  • Análise de DocumentosAnalisar propriedades e estatísticas do documento
  • Monitoramento de ConformidadeGarantir que os documentos atendam aos requisitos de metadados.
  • Métricas de desempenhoMonitorar a precisão e a eficiência do processamento.

Obtenha ajuda