Extrair metadados de um documento do Word usando n8n Ação
PDF4me Extrair metadados de um documento do Word Permite extrair metadados e propriedades abrangentes de documentos do Word através de n8n Fluxos de trabalho automatizados com recursos detalhados de análise de documentos. Este poderoso recurso de extração de metadados oferece suporte a propriedades de documentos integradas, propriedades personalizadas, estatísticas de documentos, informações do autor, datas de criação e controle de revisões com formatação específica para cada cultura e suporte à localização, ideal para gerenciamento de documentos, controle de conformidade e fluxos de trabalho de análise de conteúdo.
Configurar
Adicione o PDF4me Adicione o nó "Extrair metadados de um documento do Word" ao seu projeto. n8n fluxo de trabalho e configure os parâmetros necessários. Para obter instruções de configuração inicial, consulte nosso n8n Guia de integração.
Pré-requisitos:
- PDF4me API credenciais
- n8n acesso ao fluxo de trabalho
Configuração:
- Adicionar PDF4me nó para fluxo de trabalho
- Selecione a ação "Extrair metadados do documento do Word".
- Configure os parâmetros de entrada (veja abaixo)

Parâmetros
Lista completa de parâmetros para a ação Extrair Metadados de Documento do Word. Configure esses parâmetros para controlar o comportamento da extração de metadados.
Importante: Os parâmetros marcados com um asterisco (***) são obrigatórios. Os parâmetros avançados fornecem controle preciso sobre a formatação dos metadados.
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| Tipo de dados de entrada*** | String | Seleção do formato de entrada do documento do Word • Escolha o formato de entrada de dados do seu documento Word • PDF4me Suporta vários tipos de entrada • Opções: Dados binários, Base64 Corda, ou URL | Binary Data |
| Campo binário de entrada*** | Binário | Entrada de arquivo de palavras binárias (Obrigatório se os dados forem binários) • Arquivo Word de referência (.docx, .doc) do documento anterior n8n upload de nó ou arquivo • PDF4me Processa arquivos binários do Word com detecção automática de formato. • Obrigatório quando o tipo de dados de entrada for "Dados binários" | {{ $binary.data }} |
| Conteúdo em Base64*** | String | Base64 Entrada de palavras codificadas (Obrigatório se for uma string Base64) • Forneça o conteúdo do Word (.docx, .doc) como uma string codificada em base64 para transmissão segura. • PDF4me Decodifica e processa automaticamente o conteúdo do Word. • Obrigatório quando o tipo de dados de entrada for "String Base64" | UEsDBBQABgAI... |
| URL do documento Word*** | String | Documento público do Word URL Entrada (Obrigatório se for URL) • Fornecer uma permissão pública/aberta URL ao arquivo Word (.docx, .doc) a ser processado • PDF4me Baixa e processa o arquivo Word fornecido. URL • Obrigatório quando o Tipo de Dados de Entrada for "URL" | https://abc.com/document.docx |
| Nome do documento Word*** | String | Nome do arquivo de entrada do documento do Word • Especifique o nome do arquivo Word de entrada com a extensão correta (.docx, .doc) • PDF4me Isso é usado para detecção de formato e otimização de processamento. | document.docx |
| Nome da cultura | String | Cultura/Localidade do Documento • Código cultural para formatação de data/hora (por exemplo, "en-US", "de-DE", "fr-FR") • Padrão: InvariantCulture (formatação consistente) • Afeta o formato de exibição de data/hora nos metadados. | en-US |
Saída
Parâmetros de saída
| Parâmetro | Tipo | Descrição | Exemplo |
|---|---|---|---|
| nome_do_arquivo | String | Nome do arquivo original do documento Word - O nome do arquivo do documento Word de entrada | myWordFile.docx |
| sucesso | Boolean | PDF4me status da operação - Boolean Sinalizador indicando o sucesso ou a falha da operação de extração de metadados. PDF4me retornos true para operações bem-sucedidas e false para quaisquer erros | true |
| nome_da_cultura | String | Código de cultura/localidade - Código cultural usado para formatação de data/hora (por exemplo, "en-US", "de-DE", "fr-FR") | en-US |
| metadados | Object | Objeto de metadados aninhado - Contém a estrutura de metadados do documento com objetos de metadados aninhados contendo todas as propriedades do documento, incluindo Autor, Título, Assunto, Palavras-chave, Comentários, Categoria, Empresa, Gerente, Data de Criação, Data da Última Modificação, Data da Última Impressão, Número da Revisão, Tempo Total de Edição, Páginas, Palavras, Caracteres e Parágrafos. | {"metadata": {"Author": "Ynoox Testtwo", "Company": "HP Inc.", "Words": 921}} |
| mensagem | String | Mensagem da operação - Mensagem descritiva indicando o resultado da operação de extração de metadados | Word metadata extracted successfully |
N8N Resposta à ação
O PDF4me Extrair metadados de um documento do Word API Retorna uma resposta que pode ser visualizada em vários formatos. Escolha a visualização que melhor se adapta às suas necessidades:
- JSON
- Table
- Schema
JSON Formato de resposta
O bruto JSON resposta do API:
[
{
"fileName": "myWordFile.docx",
"success": true,
"cultureName": "en-US",
"metadata": {
"document": null,
"fileName": null,
"success": true,
"errorMessage": null,
"metadata": {
"Author": "Ynoox Testtwo",
"Title": "",
"Subject": "",
"Keywords": "",
"Comments": "",
"Category": "",
"Company": "HP Inc.",
"Manager": "",
"Created": "5/16/2019 6:04:00 AM",
"LastModified": "8/7/2024 7:04:00 AM",
"LastPrinted": "5/16/2019 6:04:00 AM",
"RevisionNumber": 5,
"TotalEditingTime": 2,
"Pages": 3,
"Words": 921,
"Characters": 5256,
"Paragraphs": 12
}
},
"message": "Word metadata extracted successfully"
}
]
Visualização em tabela
Dados de resposta em formato de tabela estruturada:
| Parâmetro | Valor |
|---|---|
| fileName | myWordFile.docx |
| success | true |
| cultureName | en-US |
| metadata | Objeto aninhado contendo metadados do documento |
| message | Word metadata extracted successfully |
Estrutura do objeto de metadados:
| Parâmetro | Valor |
|---|---|
| documento | null |
| fileName | null |
| success | true |
| errorMessage | null |
| metadata | Objeto que contém as propriedades do documento |
Propriedades do documento (metadata.metadata):
| Propriedade | Valor |
|---|---|
| Author | Ynoox Testtwo |
| Title | "" |
| Subject | "" |
| Keywords | "" |
| Comments | "" |
| Category | "" |
| Company | HP Inc. |
| Manager | "" |
| Created | 5/16/2019 6:04:00 AM |
| LastModified | 8/7/2024 7:04:00 AM |
| LastPrinted | 5/16/2019 6:04:00 AM |
| RevisionNumber | 5 |
| TotalEditingTime | 2 |
| Pages | 3 |
| Words | 921 |
| Characters | 5256 |
| Paragraphs | 12 |
Visão do esquema
A estrutura de dados e os tipos de resposta:
1 item
fileName: T myWordFile.docx
success: ☑ true
cultureName: T en-US
metadata: {} Object
document: null
fileName: null
success: ☑ true
errorMessage: null
metadata: {} Object
Author: T Ynoox Testtwo
Title: T ""
Subject: T ""
Keywords: T ""
Comments: T ""
Category: T ""
Company: T HP Inc.
Manager: T ""
Created: T 5/16/2019 6:04:00 AM
LastModified: T 8/7/2024 7:04:00 AM
LastPrinted: T 5/16/2019 6:04:00 AM
RevisionNumber: # 5
TotalEditingTime: # 2
Pages: # 3
Words: # 921
Characters: # 5256
Paragraphs: # 12
message: T Word metadata extracted successfully
Indicadores de tipo:
T= String (Texto)#= Número☑= Boolean[]= Array{}= Objectnull= Valor nulo
Casos de uso
Automação de Documentos Empresariais
- Gestão de DocumentosExtrair metadados para organização e catalogação de documentos.
- Rastreamento de ConformidadeRastrear propriedades de documentos para fins de conformidade regulatória
- Análise de ConteúdoAnalisar estatísticas e propriedades do documento.
- Pesquisa de documentosUtilizar metadados para pesquisa e recuperação de documentos.
Processamento de documentos com inteligência artificial
- Suporte a múltiplos formatosProcessar documentos do Word nos formatos .docx e .doc
- Processamento MultilíngueSuporte para diferentes idiomas e regiões.
- Extração Inteligente de MetadadosExtração automática de todas as propriedades do documento.
Inteligência de Negócios e Análise
- Análise de DocumentosAnalisar propriedades e estatísticas do documento
- Monitoramento de ConformidadeGarantir que os documentos atendam aos requisitos de metadados.
- Métricas de desempenhoMonitorar a precisão e a eficiência do processamento.