IA - Analizador de documentos en n8n
Lo que hace este nodo
PDF4me Analizador de documentos con IA extrae datos estructurados de cualquier documento ejecutando un archivo guardado AI Analizador de tu PDF4me cuenta contra el archivo. A diferencia de los analizadores fijos (AI-Invoice Parser, AI-Process Contract), usted elige el AI Identificador del analizador desde un menú desplegable de analizadores configurados en el PDF4me panel de control, por lo que el mismo nodo gestiona facturas, órdenes de compra, recibos, formularios personalizados, informes de laboratorio, plantillas internas, cualquier cosa que describa en un esquema. Utilice un Analizar gramaticalmente Analizador para un único esquema o un Clasificar Analizador para múltiples variantes de documentos en una sola llamada. Devuelve datos dinámicos. JSON indexado por su esquema más un _metadatos Bloque, sin archivo binario.
Ejemplo de factura por pruebas
Utilice esta factura de proveedor de ejemplo para confirmar que el nodo funciona de extremo a extremo antes de dirigir su flujo de trabajo a datos reales. Asigne el valor como entrada binaria y seleccione default_invoice_extraction como el AI Identificador del analizador.
Autenticando su API Pedido
Cada PDF4me nodo en n8n requiere un válido Credencial para conectarse con. Crea o selecciona uno que contenga tu PDF4me API clave para que el flujo de trabajo pueda autenticarse AI solicitudes de extracción seguras. La misma credencial también alimenta la AI Identificador del analizador menú desplegable a través de GetAnalyzerId API.
Primero, configura tu analizador.
- Lista de analizadores (Pasos 1–2):
https://dev.pdf4me.com/dashboard/#/ai-document-parser/ - Detalles del analizador (pasos 3–5):
https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>
Datos importantes que no debes perderte
_metadatos El objeto siempre se agrega con éxito, mensaje, marca de tiempo, nombre del archivo de origen, ID del analizador y operación. No hay Nombre del campo binario de salida.
Panel de nodos completo: Extraer → AI Analizador de documentos con entrada de datos binarios. Elija un AI Identificador del analizador antes de correr.
Parámetros
- Lista de analizadores (Pasos 1–2):
https://dev.pdf4me.com/dashboard/#/ai-document-parser/ - Detalles del analizador (pasos 3–5):
https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>
Requerido en el n8n Interfaz de usuario: Credencial para conectarse, Tipo de datos de entrada, Nombre del documento, AI Los campos condicionales obligatorios (Campo binario de entrada, Contenido del documento Base64 o URL del documento) aparecen solo cuando se elige el tipo de datos de entrada correspondiente. No hay Nombre del campo binario de salida y no Opciones avanzadas / Perfiles personalizados en esta operación.
| Parámetro | Requerido | Lo que hace | Ejemplo |
|---|---|---|---|
| Input Data Type | Yes | How the document is supplied. Binary Data reads from a previous node (default, most common). Base64 String accepts an encoded document. URL downloads the document from a public link. | Binary Data |
| Input Binary Field | Conditional | Name of the binary property on the incoming n8n item that holds the document. Required when Input Data Type is Binary Data. Defaults to data. Error reports which property was missing when the name is wrong. | data |
| Base64 Document Content | Conditional | Base64-encoded document. Required when Input Data Type is Base64 String. Data-URL style prefixes (text before the comma) are stripped automatically. | JVBERi0xLjQK... |
| Document URL | Conditional | Publicly reachable HTTPS URL to the document. Required when Input Data Type is URL. Must be a valid full URL. | https://example.com/document.pdf |
| Document Name | Yes | Filename used by PDF4me for processing. Default document.pdf. With Binary Data, the uploaded file name is used for upload but your explicit Document Name value takes precedence in the API call when set. Use a real extension (.pdf, .png, .jpg, etc.) so PDF4me handles the file correctly. | document.pdf |
| AI Analyzer Id | Yes | The saved Analyzer that controls extraction. Create Analyzers at https://dev.pdf4me.com/dashboard/#/ai-document-parser/ (+ Add), then edit schemas on https://dev.pdf4me.com/ai-document-parser/?id=<analyzer-guid>. Dropdown populated via GetAnalyzerId API. Sent as customisationNote. Pick Parse for one schema or Classify for many variants. | aaaa133 |
Opciones de tipo de datos de entrada
Seleccione cómo se introduce el documento en el nodo. Los campos siguientes cambiarán según esta elección.

Tipo de datos de entrada. Datos binarios (predeterminado), cadena Base64 o URL.
Datos binariosPredeterminado: archivo del nodo anteriorCampo binario de entrada al nombre del campo binario (predeterminado) datosEl nombre del archivo subido se utilizará a menos que usted cambie el nombre del documento.Cadena Base64Documento codificado en líneaContenido del documento Base64Los prefijos de estilo Data-URL (texto antes de la coma) se eliminan automáticamente. Nombre del documento con la detección correcta del formato de las unidades de extensión.URLDescargar desde un enlace públicoURL del documento. PDF4me recupera el documento directamente. El nombre del archivo para el procesamiento se toma del URL ruta cuando sea posible, o desde el nombre del documento.AI Menú desplegable de ID del analizador
El menú desplegable se rellena a partir de su PDF4me la cuenta a través de la Obtener ID del analizador API cuando abres el campo. Cada opción es un Analizador que guardaste en el PDF4me Panel de control. Seleccione aquel cuyo esquema coincida con el tipo de documento que está procesando.

AI Menú desplegable de ID del analizador cargado desde su PDF4me cuenta.
tipo de campo: "tabla" para filas anidadas y método de campo (extraer por defecto, generar para derivar/normalizar).¿Menú desplegable vacío? El nodo muestra "GetAnalyzerId no devolvió ninguna opción de analizador" cuando su cuenta no tiene analizadores o cuando la credencial no puede llegar a la API. Abrir el Lista de analizadores y agregue al menos un analizador en el Detalles del analizador página, luego verifique la API clave en tu n8n credencial.
Campos de salida
Una carrera exitosa devuelve uno n8n artículo con JSON solamente, sin archivo binario. Las claves de nivel superior coinciden con el esquema de su Analizador; un _metadata El objeto siempre se agrega al final.
| Campo | Tipo | Lo que contiene |
|---|---|---|
Top-level extracted fields | Dynamic | One key per field defined in your Analyzer schema (string, number, date, or nested table rows). Names match fieldName exactly. |
_metadata.success | Boolean | true on a successful parse. |
_metadata.message | String | "Document parsed successfully using AI Document Parser". |
_metadata.processingTimestamp | String | ISO timestamp of the parse. |
_metadata.sourceFileName | String | Document name used for processing. |
_metadata.aiAnalyzerId | String | The Analyzer Id you selected (sent as customisationNote to the API). |
_metadata.operation | String | "aiDocumentParser". |
rawContent (fallback only) | String | If the API returns plain text instead of JSON and parsing fails, the node wraps the response as { "rawContent": "<api response string>" } at the top level. |
Configuración rápida
- Construye primero tu analizador. Abre el Lista de analizadores, haga clic + Agregar, escriba un ID de analizador claro, seleccione Analizar gramaticalmente o Clasificar, guarde la fila y luego agregue un esquema de documento en el Detalles del analizador página. Ver la Guía de configuración de Parse o Guía de configuración de clasificación para reglas de esquema completas, incluyendo
fieldType: "table"para filas anidadas yfieldMethod(extraer o generar). - En tu n8n flujo de trabajo, haga clic + y buscar PDF4me. Colocar Recurso a Extracto y Operaciones de extracción a Analizador de documentos con IA.
- En Credencial para conectarse con, seleccione su PDF4me credenciales o pegar una API llave.
- Colocar Tipo de datos de entrada. Los datos binarios (predeterminados) leen desde un nodo anterior y son los más comunes.
- Rellene el campo de entrada correspondiente (Campo binario de entrada, Contenido del documento Base64, o URL del documento).
- Nombre del documento. Anular el valor predeterminado
document.pdfUtilizar el nombre de archivo real con la extensión correcta. - Elige un AI Identificador del analizador del menú desplegable (cargado desde su cuenta).
- Ejecuta el nodo. El elemento de salida contiene los campos analizados en el nivel superior más
_metadata. Enrutar a Set, Código, Google Sheets, Airtable, una base de datos, un correo electrónico o cualquier nodo descendente.
Configuraciones típicas
Ejemplos de flujo de trabajoCommon n8n workflow patterns using AI Document Parser.
- El disparador de correo electrónico (IMAP) se activa con un nuevo mensaje con PDF adjunto.
- AI El analizador de documentos se ejecuta con el tipo de datos de entrada Datos binarios, el nombre del documento establecido como el nombre del archivo adjunto, AI ID del analizador configurado en su
analizador_de_facturasAnalizador. - Hojas de cálculo de Google Añadir Escribe invoiceNumber, vendorName, totalAmount, dueDate en el rastreador de AP.
- La carpeta vigilada recibe contenido mixto PDFs del Cliente ABC, el Cliente XYZ y una cola larga.
- AI El analizador de documentos está configurado con un ID de analizador de clasificación (un esquema por proveedor).
- Un nodo Switch se ramifica según el nombre de clasificación coincidente devuelto en la respuesta, enviando cada resultado a la tabla descendente correspondiente.
- El webhook recibe un enlace a un documento desde su portal.
- AI El analizador de documentos se ejecuta con el tipo de datos de entrada. URL y su ID de analizador de formularios personalizados.
- Producción JSON se asigna a una escritura de Dataverse / Airtable / Postgres para crear un nuevo registro.
- La salida del escáner se guarda en una carpeta con bordes anchos.
- Documento recortado automáticamente con IA (Recurso AI) recorta los bordes.
- AI El analizador de documentos se ejecuta sobre el archivo binario recortado con el ID de analizador correspondiente.
- Analizado JSON fluye río abajo como de costumbre.
- AI El analizador de documentos devuelve los campos estructurados.
- Un nodo de código valida los campos obligatorios y aplica las reglas de negocio.
- Si es válido, un HTTP La solicitud se enriquece con los datos del proveedor procedentes de su CRM; de lo contrario, se envía una alerta a Slack para su revisión manual.
Consejos prácticos
Solución de problemas
Seleccione un analizador en el menú desplegable antes de ejecutarlo. El campo no puede quedar vacío.
Alinear Campo binario de entrada con el nodo anterior (a menudo datos). El error indica qué propiedad faltaba.
Archivo base64 vacío o inexistente. Proporcione el contenido en el campo Tipo de datos de entrada correspondiente.
Controlar URL del documento es un completo y válido URL (esquema + host + ruta).
No hay analizadores en la cuenta o hay un problema con las credenciales. Cree un analizador en la PDF4me panel de control o verificar el API clave en el n8n credencial.
Hoja de trucos
| Campo | Valor |
|---|---|
| Resource | Extract |
| Operation | AI Document Parser |
| Input Data Type | Binary Data |
| Input Binary Field | data |
| Document Name | form.pdf (with the real extension) |
| AI Analyzer Id | (pick from the dropdown loaded from your account) |
| Credentials | PDF4me API credential |
Preguntas frecuentes
Acciones relacionadas
La misma tarea en otras plataformas
/v2/FlowV2/AiDocumentParser para código backend personalizado o pruebas con Postman.