Saltar al contenido principal

IA - Analizador de documentos en n8n

Lo que hace este nodo

PDF4me Analizador de documentos con IA extrae datos estructurados de cualquier documento ejecutando un archivo guardado AI Analizador de tu PDF4me cuenta contra el archivo. A diferencia de los analizadores fijos (AI-Invoice Parser, AI-Process Contract), usted elige el AI Identificador del analizador desde un menú desplegable de analizadores configurados en el PDF4me panel de control, por lo que el mismo nodo gestiona facturas, órdenes de compra, recibos, formularios personalizados, informes de laboratorio, plantillas internas, cualquier cosa que describa en un esquema. Utilice un Analizar gramaticalmente Analizador para un único esquema o un Clasificar Analizador para múltiples variantes de documentos en una sola llamada. Devuelve datos dinámicos. JSON indexado por su esquema más un _metadatos Bloque, sin archivo binario.

Entradas de blog relacionadas
Aún no hay ninguna entrada de blog sobre esta función; estará disponible próximamente.
Mientras tanto, echa un vistazo al blog de PDF4me para encontrar tutoriales y flujos de trabajo para todas las plataformas.
Visita el blog

Ejemplo de factura por pruebas

Utilice esta factura de proveedor de ejemplo para confirmar que el nodo funciona de extremo a extremo antes de dirigir su flujo de trabajo a datos reales. Asigne el valor como entrada binaria y seleccione default_invoice_extraction como el AI Identificador del analizador.

Autenticando su API Pedido

Cada PDF4me nodo en n8n requiere un válido Credencial para conectarse con. Crea o selecciona uno que contenga tu PDF4me API clave para que el flujo de trabajo pueda autenticarse AI solicitudes de extracción seguras. La misma credencial también alimenta la AI Identificador del analizador menú desplegable a través de GetAnalyzerId API.

Primero, configura tu analizador.

URL del panel de control que utilizarás en esta guía:
Crea primero tu Analyzer (obligatorio para todas las plataformas)
AI - Document Parser ejecuta un analizador guardado desde el panel de control para desarrolladores de PDF4me. Elige «Parse» para un esquema de documento único, o «Classify» para clasificar varias variantes (Cliente ABC, Cliente XYZ, factura genérica) en una sola llamada. El mismo ID de analizador funciona en Make, Zapier, Power Automate, n8n y la API REST.

Datos importantes que no debes perderte

Usted configura el Analizador en el panel de control, el nodo solo hace referencia a él.
Defina el esquema, los campos y las indicaciones una sola vez en el Lista de analizadores y Detalles del analizador páginas (Analizar para un esquema, clasificar para muchas variantes). El n8n El nodo carga sus analizadores en el AI Identificador del analizador Despliega el menú y ejecuta la opción que elijas. Editar el esquema posteriormente no requiere modificar el flujo de trabajo.
La salida es dinámica JSON, sin archivo binario
Las claves de nivel superior coinciden con los nombres de campo que definió en el Analizador (cadena, número, fecha o filas de tabla). _metadatos El objeto siempre se agrega con éxito, mensaje, marca de tiempo, nombre del archivo de origen, ID del analizador y operación. No hay Nombre del campo binario de salida.
La decisión entre analizar y clasificar la toma el analizador, no el nodo.
Mismo nodo, dos modos de analizador. A Analizar gramaticalmente El analizador devuelve los campos de su único esquema. Clasificar El analizador dirige el documento al esquema que mejor coincide y devuelve su nombre de clasificación. más los campos extraídos del esquema coincidente. Cambie el comportamiento cambiando el Id.
Nodo AI Document Parser n8n que muestra Credential Pdf4me, Resource Extract, Extract Operations AI Document Parser, Input Data Type Binary Data, Input Binary Field data, Document Name document.pdf, y menú desplegable AI Analyzer Id sin configurar (resaltado como obligatorio)

Panel de nodos completo: Extraer → AI Analizador de documentos con entrada de datos binarios. Elija un AI Identificador del analizador antes de correr.

Parámetros

URL del panel de control que utilizarás en esta guía:

Requerido en el n8n Interfaz de usuario: Credencial para conectarse, Tipo de datos de entrada, Nombre del documento, AI Los campos condicionales obligatorios (Campo binario de entrada, Contenido del documento Base64 o URL del documento) aparecen solo cuando se elige el tipo de datos de entrada correspondiente. No hay Nombre del campo binario de salida y no Opciones avanzadas / Perfiles personalizados en esta operación.

ParámetroRequeridoLo que haceEjemplo
Input Data TypeYesHow the document is supplied. Binary Data reads from a previous node (default, most common). Base64 String accepts an encoded document. URL downloads the document from a public link.Binary Data
Input Binary FieldConditionalName of the binary property on the incoming n8n item that holds the document. Required when Input Data Type is Binary Data. Defaults to data. Error reports which property was missing when the name is wrong.data
Base64 Document ContentConditionalBase64-encoded document. Required when Input Data Type is Base64 String. Data-URL style prefixes (text before the comma) are stripped automatically.JVBERi0xLjQK...
Document URLConditionalPublicly reachable HTTPS URL to the document. Required when Input Data Type is URL. Must be a valid full URL.https://example.com/document.pdf
Document NameYesFilename used by PDF4me for processing. Default document.pdf. With Binary Data, the uploaded file name is used for upload but your explicit Document Name value takes precedence in the API call when set. Use a real extension (.pdf, .png, .jpg, etc.) so PDF4me handles the file correctly.document.pdf
AI Analyzer IdYesThe saved Analyzer that controls extraction. Create Analyzers at https://dev.pdf4me.com/dashboard/#/ai-document-parser/ (+ Add), then edit schemas on https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>. Dropdown populated via GetAnalyzerId API. Sent as customisationNote. Pick Parse for one schema or Classify for many variants.aaaa133

Opciones de tipo de datos de entrada

Seleccione cómo se introduce el documento en el nodo. Los campos siguientes cambiarán según esta elección.

Menú desplegable Tipo de datos de entrada en el nodo n8n PDF4me AI Document Parser que muestra tres opciones: Datos binarios (resaltado con la descripción Usar el archivo de documento del nodo anterior), Cadena Base64 (con la descripción Proporcionar el contenido del documento como una cadena codificada en base64), URL (con la descripción Proporcionar la URL del archivo de documento).

Tipo de datos de entrada. Datos binarios (predeterminado), cadena Base64 o URL.

Datos binariosPredeterminado: archivo del nodo anterior
Lee el documento directamente desde un nodo anterior como Google Drive Download, HTTP Solicitud, lectura de archivo binario o un nodo de archivo adjunto de correo electrónico. Establecer Campo binario de entrada al nombre del campo binario (predeterminado) datosEl nombre del archivo subido se utilizará a menos que usted cambie el nombre del documento.
Cadena Base64Documento codificado en línea
Pegue o asigne una cadena base64 a Contenido del documento Base64Los prefijos de estilo Data-URL (texto antes de la coma) se eliminan automáticamente. Nombre del documento con la detección correcta del formato de las unidades de extensión.
URLDescargar desde un enlace público
Proporcionar un público HTTPS URL en URL del documento. PDF4me recupera el documento directamente. El nombre del archivo para el procesamiento se toma del URL ruta cuando sea posible, o desde el nombre del documento.

AI Menú desplegable de ID del analizador

El menú desplegable se rellena a partir de su PDF4me la cuenta a través de la Obtener ID del analizador API cuando abres el campo. Cada opción es un Analizador que guardaste en el PDF4me Panel de control. Seleccione aquel cuyo esquema coincida con el tipo de documento que está procesando.

El menú desplegable AI Analyzer Id se abre en el nodo n8n PDF4me AI Document Parser y muestra tres opciones de ejemplo de Analyzer: aaaa133, TestTenantProject, TestTenant

AI Menú desplegable de ID del analizador cargado desde su PDF4me cuenta.

Analizador de análisis sintáctico
Esquema de un solo documento. El nodo devuelve exactamente los campos definidos en ese esquema. Lo mejor es cuando cada documento que procesa comparte la misma familia de diseño. Consulte el Guía de configuración de Parse para reglas de esquema incluidas tipo de campo: "tabla" para filas anidadas y método de campo (extraer por defecto, generar para derivar/normalizar).
Analizador de clasificación
Muchos esquemas, uno por variante de documento. El AI Enruta el documento entrante al esquema que mejor coincida utilizando el indicador de clasificación de cada esquema, y luego devuelve el nombre de clasificación coincidente más sus campos. Consulte el Guía de configuración de clasificación.

¿Menú desplegable vacío? El nodo muestra "GetAnalyzerId no devolvió ninguna opción de analizador" cuando su cuenta no tiene analizadores o cuando la credencial no puede llegar a la API. Abrir el Lista de analizadores y agregue al menos un analizador en el Detalles del analizador página, luego verifique la API clave en tu n8n credencial.

Campos de salida

Una carrera exitosa devuelve uno n8n artículo con JSON solamente, sin archivo binario. Las claves de nivel superior coinciden con el esquema de su Analizador; un _metadata El objeto siempre se agrega al final.

CampoTipoLo que contiene
Top-level extracted fieldsDynamicOne key per field defined in your Analyzer schema (string, number, date, or nested table rows). Names match fieldName exactly.
_metadata.successBooleantrue on a successful parse.
_metadata.messageString"Document parsed successfully using AI Document Parser".
_metadata.processingTimestampStringISO timestamp of the parse.
_metadata.sourceFileNameStringDocument name used for processing.
_metadata.aiAnalyzerIdStringThe Analyzer Id you selected (sent as customisationNote to the API).
_metadata.operationString"aiDocumentParser".
rawContent (fallback only)StringIf the API returns plain text instead of JSON and parsing fails, the node wraps the response as { "rawContent": "<api response string>" } at the top level.

Configuración rápida

  1. Construye primero tu analizador. Abre el Lista de analizadores, haga clic + Agregar, escriba un ID de analizador claro, seleccione Analizar gramaticalmente o Clasificar, guarde la fila y luego agregue un esquema de documento en el Detalles del analizador página. Ver la Guía de configuración de Parse o Guía de configuración de clasificación para reglas de esquema completas, incluyendo fieldType: "table" para filas anidadas y fieldMethod (extraer o generar).
  2. En tu n8n flujo de trabajo, haga clic + y buscar PDF4me. Colocar Recurso a Extracto y Operaciones de extracción a Analizador de documentos con IA.
  3. En Credencial para conectarse con, seleccione su PDF4me credenciales o pegar una API llave.
  4. Colocar Tipo de datos de entrada. Los datos binarios (predeterminados) leen desde un nodo anterior y son los más comunes.
  5. Rellene el campo de entrada correspondiente (Campo binario de entrada, Contenido del documento Base64, o URL del documento).
  6. Nombre del documento. Anular el valor predeterminado document.pdf Utilizar el nombre de archivo real con la extensión correcta.
  7. Elige un AI Identificador del analizador del menú desplegable (cargado desde su cuenta).
  8. Ejecuta el nodo. El elemento de salida contiene los campos analizados en el nivel superior más _metadata. Enrutar a Set, Código, Google Sheets, Airtable, una base de datos, un correo electrónico o cualquier nodo descendente.

Configuraciones típicas

Ejemplos de flujo de trabajoCommon n8n workflow patterns using AI Document Parser.
Adjuntar archivo de correo electrónico a Google Sheets
  1. El disparador de correo electrónico (IMAP) se activa con un nuevo mensaje con PDF adjunto.
  2. AI El analizador de documentos se ejecuta con el tipo de datos de entrada Datos binarios, el nombre del documento establecido como el nombre del archivo adjunto, AI ID del analizador configurado en su analizador_de_facturas Analizador.
  3. Hojas de cálculo de Google Añadir Escribe invoiceNumber, vendorName, totalAmount, dueDate en el rastreador de AP.
Bandeja de entrada multivendedor con Classify
  1. La carpeta vigilada recibe contenido mixto PDFs del Cliente ABC, el Cliente XYZ y una cola larga.
  2. AI El analizador de documentos está configurado con un ID de analizador de clasificación (un esquema por proveedor).
  3. Un nodo Switch se ramifica según el nombre de clasificación coincidente devuelto en la respuesta, enviando cada resultado a la tabla descendente correspondiente.
Documento alojado por URL
  1. El webhook recibe un enlace a un documento desde su portal.
  2. AI El analizador de documentos se ejecuta con el tipo de datos de entrada. URL y su ID de analizador de formularios personalizados.
  3. Producción JSON se asigna a una escritura de Dataverse / Airtable / Postgres para crear un nuevo registro.
Escanee, recorte automático y luego analice.
  1. La salida del escáner se guarda en una carpeta con bordes anchos.
  2. Documento recortado automáticamente con IA (Recurso AI) recorta los bordes.
  3. AI El analizador de documentos se ejecuta sobre el archivo binario recortado con el ID de analizador correspondiente.
  4. Analizado JSON fluye río abajo como de costumbre.
Validar y luego enriquecer
  1. AI El analizador de documentos devuelve los campos estructurados.
  2. Un nodo de código valida los campos obligatorios y aplica las reglas de negocio.
  3. Si es válido, un HTTP La solicitud se enriquece con los datos del proveedor procedentes de su CRM; de lo contrario, se envía una alerta a Slack para su revisión manual.

Consejos prácticos

Set up the Analyzer in PDF4me first
The node does not define extraction rules. It runs whatever your selected Analyzer specifies. Build it in the dashboard before configuring the node.
Use Document Name with the real extension
PDF4me uses the extension for format detection. Even on Binary Data, an explicit Document Name with the correct extension is safest.
No Output Binary Field Name and no Advanced Options
Unlike AI Auto Crop Document, this operation has neither. The output is JSON only; there is nothing to write back as a binary file.
Plain-text fallback wraps as rawContent
If the API returns plain text instead of JSON and parsing fails, the node wraps the response as { "rawContent": "<string>" } so the workflow does not break.
Combine with AI Auto Crop Document for scans
Scans with wide borders parse better after cropping. Chain AI Auto Crop Document (Resource AI) before this node.
Use AI-Invoice Parser / AI-Process Contract for built-in schemas
When you only need standard invoice or contract fields, the dedicated nodes are simpler. AI Document Parser shines when you have a custom schema.

Solución de problemas

"AI Se requiere el ID del analizador.

Seleccione un analizador en el menú desplegable antes de ejecutarlo. El campo no puede quedar vacío.

"No se encontraron datos binarios en la propiedad '…'"

Alinear Campo binario de entrada con el nodo anterior (a menudo datos). El error indica qué propiedad faltaba.

"El contenido del documento es obligatorio"

Archivo base64 vacío o inexistente. Proporcione el contenido en el campo Tipo de datos de entrada correspondiente.

"Inválido URL formato"

Controlar URL del documento es un completo y válido URL (esquema + host + ruta).

"GetAnalyzerId no devolvió ninguna opción de analizador"

No hay analizadores en la cuenta o hay un problema con las credenciales. Cree un analizador en la PDF4me panel de control o verificar el API clave en el n8n credencial.

Hoja de trucos

CampoValor
ResourceExtract
OperationAI Document Parser
Input Data TypeBinary Data
Input Binary Fielddata
Document Nameform.pdf (with the real extension)
AI Analyzer Id(pick from the dropdown loaded from your account)
CredentialsPDF4me API credential

Preguntas frecuentes

Where does the AI Analyzer Id list come from?+
The dropdown is populated from your PDF4me account via the GetAnalyzerId API. Each option is an Analyzer you created at https://dev.pdf4me.com/dashboard/#/ai-document-parser/ with schemas on https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>. The node sends the selected value as customisationNote to the AiDocumentParser API.
What does "GetAnalyzerId returned no analyzer options" mean?+
The account has no Analyzers configured, or the credentials cannot reach the GetAnalyzerId endpoint. Open https://dev.pdf4me.com/dashboard/#/ai-document-parser/ and create at least one Analyzer (Parse or Classify) on the Analyzer detail page, or verify the API key in your n8n credential.
How is this different from AI-Invoice Parser, AI-Process Contract, AI-Process Bank Cheque?+
Those nodes use fixed schemas tuned to those document types. AI Document Parser is schema-driven: it runs whatever Analyzer you select, so the same node handles invoices, purchase orders, receipts, custom forms, lab reports, anything you describe in a schema. Pick AI Document Parser whenever you need a custom layout or document type.
What shape does the output have?+
Top-level keys match the field names in your Analyzer schema (for example customerName, invoiceNumber, totalAmount, lineItems). Nested objects and table arrays follow the same shape you defined. A _metadata object is always appended with success, message, processingTimestamp, sourceFileName, aiAnalyzerId, and operation. No binary file is returned.
Does this work on scanned PDFs?+
Yes. The AI engine handles OCR internally, so scanned PDFs and image formats work the same as native PDFs. If borders are large, chain AI Auto Crop Document (Resource AI) before this node for cleaner extraction.
Can I change the Analyzer schema without rebuilding the workflow?+
Yes. The workflow only references the Analyzer Id. Edit the schema in the PDF4me dashboard and the next run picks up the new shape automatically. Output keys follow your latest schema, so any downstream Set / Code / Sheets nodes that assume specific keys may need updating after a breaking schema change.
Can I switch between Parse and Classify Analyzers without rewiring the node?+
Yes. Both Analyzer types are listed in the AI Analyzer Id dropdown. Pick a Classify Analyzer when you want one node to handle several document variants; pick a Parse Analyzer for a single fixed schema. The output shape adapts to whichever you choose.
What happens when the API returns plain text instead of JSON?+
The node tries to parse it; if parsing fails, the response is wrapped as { "rawContent": "<api response string>" } at the top level so the workflow does not break. Useful for inspecting unexpected responses during development.

Acciones relacionadas

La misma tarea en otras plataformas

Obtén ayuda