Saltar al contenido principal

Analizador de documentos de IA mediante Classify

Qué abarca esta guía

Analizador de documentos con IA. Clasificar permite que un analizador maneje varias variantes de documentos en una sola llamada. Usted define un Identificador del analizador, luego añade uno Diagrama por variante (Cliente ABC, Cliente XYZ, factura genérica, orden de compra genérica). Cada esquema contiene un Nombre de la clasificación, a Indicación de clasificación en lenguaje natural y un Esquema del documento describiendo los campos a extraer. En tiempo de ejecución, la IA compara los datos entrantes. PDF contra cada solicitud de clasificación de esquema, elige la que mejor se ajusta y devuelve tanto el nombre de clasificación coincidente como los campos extraídos. El mismo ID de analizador funciona desde el REST API y todas las plataformas de automatización compatibles.

Entradas de blog relacionadas(4)
Extracción y cambio de nombre inteligente de cualquier PDF mediante IA en Make: un flujo de trabajo de Dropbox de 4 módulos con PDF4me AI - Analizador de documentos
Escenario de creación de cuatro módulos: descargar un PDF de un proveedor desde Dropbox, ejecutar AI - Document Parser con default_invoice_extraction, analizar JSON para obtener el nombre del proveedor y volver a cargarlo con vendorName.pdf como nombre de archivo. Capturas de pantalla reales, valores de campo exactos, sin entrada manual de datos.
Leer la publicación
Cambiar el nombre de las facturas de proveedores mediante IA en Zapier: un flujo de trabajo de 5 pasos con Dropbox y PDF4me.
Zap de cinco pasos: Dropbox Nuevo archivo en carpeta → Dropbox Buscar archivo → PDF4me AI - Analizador de documentos → Código de Zapier Ejecutar JavaScript → Dropbox Subir archivo. Extrae el nombre del cliente con IA y lo usa como nombre de archivo de salida. Capturas de pantalla reales, valores de campo exactos, sin código más allá de un JSON.parse de 2 líneas.
Leer la publicación
Cambiar el nombre de todas las facturas de proveedores por el nombre del proveedor en Zapier: un flujo de trabajo de 5 pasos con Dropbox y PDF4me AI.
Zapier, un proceso de cinco pasos para equipos de cuentas por pagar. Dropbox supervisa la carpeta de facturas recibidas, PDF4me AI (el analizador de documentos) extrae el nombre del proveedor de cada PDF, Code by Zapier convierte la salida del analizador en tokens mapeables y Dropbox vuelve a subir el archivo con el nombre del proveedor como nombre de archivo. Se incluyen capturas de pantalla reales, valores de campo exactos y el mismo archivo sample-vendor-invoice.pdf utilizado en este tutorial, que se puede descargar.
Leer la publicación

Autenticando su configuración

Los analizadores de clasificación se crean en el PDF4me Panel de desarrollador. Inicie sesión con su cuenta y luego cree o copie un API clave para el analizador de IA API llamadas que hacen referencia al analizador que usted crea aquí.

URL del panel de control que utilizarás en esta guía:

Datos importantes que no debes perderte

Un analizador, muchos esquemas (uno por variante)
Classify está diseñado para el mundo real, donde las facturas del Cliente ABC son diferentes a las del Cliente XYZ. Añada tantos esquemas como variantes tenga. Cada esquema es un paquete independiente que incluye el nombre de la clasificación, la solicitud y el esquema del documento.
La solicitud de clasificación es el cerebro de enrutamiento
Redacta la solicitud en un lenguaje sencillo. Menciona elementos clave como el nombre de la empresa en la parte superior, el correo electrónico de contacto, detalles de diseño y palabras exclusivas de esta versión. Cuanto más clara sea la solicitud, más fácil será la comunicación.
Classify devuelve TANTO la etiqueta como los datos.
A diferencia de un clasificador puro, la respuesta incluye el nombre de clasificación coincidente. y todos los campos del esquema de documento de ese esquema. Una llamada le da la decisión de enrutamiento y la extracción. JSON juntos.

Paso 1: Abra AI Document Parser en el panel de control

  1. Iniciar sesión en dev.pdf4me.com.
  2. Desde la barra lateral del panel de control, haga clic en Analizador de documentos con IA.
  3. La página de lista muestra todos los analizadores existentes con tres columnas: Identificador del analizador, Tipo de analizador (Analizar o clasificar), y Comportamiento.
  4. Haz clic en el azul + Agregar botón para iniciar un nuevo analizador.
Vista de lista del panel de control de PDF4me AI Document Parser con el elemento de la barra lateral AI Document Parser resaltado en rojo, un botón azul Agregar en la parte superior del panel principal y una tabla vacía con los encabezados de columna Analyzer Id, Analyzer Type y Actions.

Vista de lista del analizador de documentos con IA. Haga clic en + Agregar para iniciar un nuevo analizador.

Paso 2: Crear un analizador de clasificación

Aparece una nueva fila con tres controles:

  1. Entrada de ID del analizadorEscriba cualquier identificador claro que recuerde, por ejemplo client_invoices, Vendor Documents, o incoming-ordersNo hay restricciones de formato de nombres. snake_case, camelCase, kebab-case, palabras simples con espacios, todo funciona igual. El ejemplo a continuación utiliza client_invoices.
  2. Menú desplegable Tipo de analizador. elegir Clasificar (esta guía) o Analizar gramaticalmente (ver el Guía de análisis).
  3. Guardar / Cancelar botones. Guardar crea el Analizador; Cancelar descarta la fila.
PDF4me AI Document Parser Agregar fila abierta con el campo ID del analizador rellenado con client_invoices, menú desplegable Tipo de analizador que muestra Clasificar resaltado encima de Analizar, y un valor de Clasificar seleccionado en la fila, con botones Guardar y Cancelar a la derecha

Agregar fila: ingrese el ID del analizador (aquí) facturas de clientes), elegir Clasificar, luego Guardar.

Paso 3: Abra el Analizador y agregue el primer Esquema.

Haz clic en la nueva fila para abrir la página de detalles. El patrón de URL es:

https://dev.pdf4me.com/ai-document-parser/?id=<your-analyzer-guid>

El panel de control genera un GUID por cada analizador la primera vez que lo abres. Guarda esta URL en tus marcadores para volver directamente al mismo analizador de clasificación la próxima vez.

La página de detalles muestra:

  • Clasificar información (izquierda). muestra el ID del analizador que ingresó en el paso 2 (aquí). client_invoicesEste panel es de solo lectura.
  • Esquemas (derecha). vacío por defecto. Cada esquema es una variante de documento. Haga clic en el + Botón en la esquina superior derecha para agregar el primer esquema.
  • Guardar cambios (arriba a la izquierda). Conserva cada edición que realices en esta página.
  • Atrás. regresa al Lista de analizadores.
Página de detalles de PDF4me AI Document Parser para Classify Analyzer. El banner azul principal dice AI Document Parser con el subtítulo Extrae automáticamente datos de facturas usando IA con una salida rápida, precisa y estructurada. Debajo hay un botón Atrás y un botón azul Guardar cambios. El panel Información de clasificación a la izquierda muestra el ID del analizador client_invoices. La sección Esquemas a la derecha está vacía, con un botón azul de signo más en el extremo derecho para agregar un nuevo esquema.

Página de detalles. Clasificar información A la izquierda se encuentra el ID del analizador. Haga clic en el botón azul "+" para agregar un esquema.

Paso 4: Complete el nombre de clasificación, la solicitud y el esquema del documento.

Cada esquema es una variante de documento que el analizador debe procesar. Cada esquema tiene tres entradas obligatorias y una fila de autocompletado habitual en la parte inferior.

Campos del esquema (obligatorios)

CampoObjetivoEjemplo
Classification NameThe label returned by the API when this Schema matches. Use a short, business-friendly name.Client ABC
Classification PromptNatural-language description of how to recognise this variant. Mention company name, email, layout cues, distinguishing phrases. This is what the AI uses to route.The invoice has the company name ABC at the top, followed by the contact email [email protected].
Document SchemaJSON object with a description and a fields array. Each field has fieldName, fieldType, and fieldDescription, plus an optional fieldMethod such as generate for derived values.{ "description": "Extract invoice detail for ABC invoices", "fields": [ ... ] }

Esquema de ejemplo: Cliente ABC

PDF4me AI Document Parser Classify Schema editor muestra el primer esquema titulado Cliente ABC. El panel Classify Info a la izquierda contiene Analyzer Id client_invoices. La tarjeta Schema tiene un icono de papelera rojo para eliminar, campo Classification Name con valor Cliente ABC, campo Classification Prompt con texto El nombre de la factura en la parte superior contendrá el nombre de la empresa ABC y después de eso estará el correo electrónico en la parte superior para las facturas del cliente en abc.com, y un editor JSON de esquema de documento que muestra una descripción Extraer detalle de factura para facturas ABC y una matriz de campos que comienza con invoiceNumber cadena Número de factura número de recibo y invoiceDate fecha de generación. Debajo del editor están los botones de autocompletado rápido Factura y Orden de compra.

Primer esquema. El nombre de clasificación, la indicación de clasificación y el esquema del documento describen conjuntamente una variante del documento.

Client ABC. Document Schema
{
"description": "Extract invoice detail for ABC invoices",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldMethod": "generate",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4-digit year not found then consider 2-digit year at the end of extracted date."
}
]
}

La solicitud de clasificación para el cliente ABC es la pista en lenguaje natural que guía a la IA hacia este esquema:

"La factura tiene el nombre de la empresa ABC en la parte superior, seguido del correo electrónico de contacto. [email protected]"

Paso 5: Añada más esquemas y guarde los cambios.

Haz clic en el azul + Vuelva a pulsar el botón para añadir un esquema para la siguiente variante. Cada nuevo esquema tiene su propio nombre de clasificación, solicitud de clasificación y esquema de documento. Los campos pueden ser totalmente diferentes entre esquemas. El cliente ABC puede no tener una columna de referencia de cliente, mientras que el cliente XYZ sí.

Segundo esquema de ejemplo: Cliente XYZ

PDF4me AI Document Parser Clasifica la segunda tarjeta de esquema titulada Cliente XYZ. Nombre de clasificación Cliente XYZ, Mensaje de clasificación El documento es una factura con el nombre de la empresa XYZ en la parte superior, luego el correo electrónico support@xyz.com seguido de la dirección, y un editor JSON de esquema de documento que muestra la descripción Extraer datos de factura de la factura de la empresa XYZ con una matriz de campos que comienza con invoiceNumber e invoiceDate. Debajo del editor hay botones de autocompletado rápido de Factura y Orden de compra.

Segundo esquema para el mismo analizador. Ambos esquemas ahora se encuentran en facturas de clientes.

Client XYZ. Document Schema
{
"description": "Extract Invoice data from company XYZ's Invoice",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldMethod": "generate",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4-digit year not found then consider 2-digit year at the end of extracted date."
}
]
}

La lista de esquemas se contrae después de guardar.

Una vez introducidos ambos esquemas, la lista muestra cada uno como una tarjeta desplegable con el nombre de la clasificación a la izquierda y una flecha para expandirla a la derecha. Haga clic en una tarjeta para editarla más tarde.

Página de detalles del analizador de documentos PDF4me AI para un analizador de clasificación que muestra ambos esquemas en la vista de lista contraída. El panel de información de clasificación de la izquierda muestra el ID del analizador client_invoices. La sección Esquemas de la derecha muestra Cliente ABC y Cliente XYZ como dos tarjetas de acordeón contraídas con flechas de expansión en forma de chevrón. Un botón azul con el signo más se encuentra en la esquina superior derecha para agregar más esquemas.

Ambos esquemas se han guardado. Haz clic en cualquier tarjeta para expandirla y editarla; usa el signo + para añadir más variantes.

Haga clic Guardar cambios en la parte superior izquierda para guardar todos los esquemas que hayas añadido. El analizador ya está activo y listo para recibir. PDFs.

Opciones a nivel de campo dentro del esquema del documento

Atributo¿Requerido?Lo que hace
fieldNameRequiredThe name of the field and how it will appear in the response JSON.
fieldTypeRequiredThe type of data to extract. One of string, number, date, or table.
fieldDescriptionRequiredNatural-language description of what needs to be extracted and where to find it. Include alternate labels and example formats so the AI matches correctly.
fieldMethodOptional (default extract)How the AI fills the value. extract takes the value verbatim from the document. generate tells the AI to derive or normalise it (useful for dates, computed totals, or cleaned-up IDs). Omit for default extract behaviour.
fieldsRequired when fieldType is tableNested array describing the columns of the table. Each entry takes the same attributes as a top-level field (fieldName, fieldType, fieldDescription, fieldMethod). Cannot itself be table.

Esquema con un campo de tabla (filas anidadas)

Usar tipo de campo: "tabla" cuando un esquema necesita extraer filas repetidas como los elementos de línea de factura. Cada campo de tabla lleva su propio anidado campos Matriz que describe las columnas.

{
"description": "Invoice data extractor",
"fields": [
{
"fieldName": "invoiceNumber",
"fieldType": "string",
"fieldDescription": "Invoice number / bill number / receipt number"
},
{
"fieldName": "invoiceDate",
"fieldType": "date",
"fieldDescription": "Look for labels: 'Invoice Date', 'Bill Date', 'Date', 'Dated', 'Issue Date', 'Doc Date'. If 4 digit year not found then consider 2 digit year at the end of extracted date.",
"fieldMethod": "generate"
},
{
"fieldName": "lineItems",
"fieldType": "table",
"fieldDescription": "All product / service rows from the invoice table. Be careful, sometimes a row can be part of the next item like when description goes over one line, but it's of a single item.",
"fields": [
{
"fieldName": "itemNumber",
"fieldType": "string",
"fieldDescription": "Product number, product id number or product code"
},
{
"fieldName": "hsnCode",
"fieldType": "string",
"fieldDescription": "HSN / SAC code (4 to 8 digit)"
}
]
}
]
}

Botones de autocompletado (úsalos como punto de partida)

El editor de esquemas ofrece Factura y Orden de compra Botones preestablecidos en la parte inferior de la tarjeta Esquema del documento. Úsalos como punto de partida Solo con hacer clic en uno para generar un esquema típico para esa familia de documentos; luego, ajuste los nombres, tipos, métodos y descripciones de los campos para que coincidan con la variante específica que está configurando. Los ajustes predefinidos son solo una estructura básica, no la configuración final.

Utilice el Analizador de clasificación en API o llamadas de automatización

Una vez guardado, el mismo ID de analizador se ejecuta en cualquier lugar por referencia. No es necesario recrear los esquemas en cada plataforma.

CampoFuenteObjetivo
AnalyzerIdLa cadena que escribiste en el paso 2 (client_invoices)Identificador estable para el analizador Classify.
docNameFuente PDF Nombre del archivoSe utiliza para el seguimiento y los mensajes de error.
docContentFuente PDF codificado como Base64El documento que se va a clasificar y del que se va a extraer información.
asyncfalse para síncrono, true para encuestasControla la entrega de respuestas.

Ejemplo REST Cuerpo de la solicitud:

{
"docName": "incoming_invoice.pdf",
"docContent": "BASE64_ENCODED_PDF_CONTENT",
"AnalyzerId": "client_invoices",
"async": false
}

La respuesta incluye el nombre de clasificación coincidente más los campos definidos en el esquema de documento de ese esquema. Un documento reconocido como Cliente ABC devuelve los campos del Cliente ABC; un documento reconocido como Cliente XYZ devuelve los campos del Cliente XYZ. Una sola llamada, ambas decisiones.

Flujos de trabajo comunes

Patrones típicos del analizador de clasificaciónHow a Classify Analyzer with multiple Schemas runs in production.
Bandeja de entrada del punto de acceso multicliente
  1. Las facturas de los proveedores, del Cliente ABC, del Cliente XYZ y de algunos otros, llegan a una misma bandeja de entrada.
  2. Make, Zapier, Power Automate, o n8n llama al analizador de IA con Identificador del analizador: facturas de clientes.
  3. La respuesta incluye el nombre de clasificación (Cliente ABC, Cliente XYZ, etc.) y los campos extraídos.
  4. Un paso de conmutación dirige cada resultado al correspondiente ERP Registro del cliente mediante el nombre de clasificación; los campos extraídos se incorporan directamente al registro de la factura.
Incorporación de proveedores sin necesidad de reconstrucciones
  1. Un nuevo proveedor envía por primera vez una factura con un formato diferente.
  2. Las operaciones abren el existente facturas de clientes Analizador en el panel de control y haga clic +.
  3. Se agrega un nuevo esquema con un nombre de clasificación (el nombre del proveedor), una indicación de clasificación que describe el diseño y un esquema de documento para los campos relevantes.
  4. El próximo entrante PDF Se enruta automáticamente al nuevo esquema. No se requiere recableado de automatización.
Clasificación de documentos mixtos
  1. One Analyzer cubre facturas, órdenes de compra y notas de crédito.
  2. La indicación de clasificación de cada esquema describe los marcadores distintivos ("contiene Cobrar a y un total a pagar" frente a "contiene un número de pedido y una dirección de envío").
  3. El esquema de documento por esquema extrae los campos relevantes para ese tipo de documento.
  4. Las ramas de enrutamiento descendentes se basan en el nombre de clasificación; cada rama escribe en el sistema correspondiente.

Mejores prácticas de esquema para Classify

  • Un esquema por variante de documento estable. Dos proveedores con diseños muy diferentes deberían tener dos esquemas distintos, no uno con reglas superpuestas.
  • La indicación de clasificación es su regla de enrutamiento. Redáctela en un lenguaje sencillo e incluya indicadores concretos (nombre de la empresa, correo electrónico, frases distintivas, pistas de diseño).
  • Mantén el nombre de clasificación corto, fácil de entender para el negocio y estable. Es la base sobre la que se ramifican tus rutas posteriores.
  • Utilice los botones de autocompletar de Factura y Pedido de Compra como puntos de partida y, a continuación, refine las descripciones de los campos para cada variante.
  • Agregar fieldMethod: "generate" a fechas, totales calculados o campos donde la IA debería normalizar el valor en lugar de copiarlo textualmente.
  • Pruebe cada esquema con una muestra real antes de su puesta en marcha: una factura obvia del Cliente ABC siempre debe dirigirse al esquema del Cliente ABC, no al del Cliente XYZ.
  • Haga clic Guardar cambios Después de cada ronda de edición, los esquemas no guardados se pierden al navegar.

Acciones relacionadas

Analizador de documentos de IA que utiliza Parse
Mismo panel de control, un único esquema por analizador. Úselo cuando todos los documentos que procese compartan una misma familia de diseño.
IA - Analizador de documentos en Make
Utilice su ID de analizador de clasificación guardado de un Make escenario. Combínelo con cualquier módulo de almacenamiento y fuente de datos para distribuir el enrutamiento y la extracción en flujos de trabajo visuales.
IA - Analizador de documentos en Power Automate
Ejecute el mismo Analizador de clasificación desde un Power Automate flujo. Se conecta naturalmente a SharePoint, Excel, Dataverse, y Outlook.
IA - Analizador de documentos en n8n
Autogestionado o en la nube n8n flujos de trabajo. El menú desplegable ID del analizador de IA carga los analizadores guardados directamente desde su cuenta.
IA - Analizador de documentos en Zapier
Activa la extracción de IA desde cualquiera de los más de 6000 elementos. SaaS aplicaciones y webhooks. Escriba su ID de analizador de clasificación guardado en el campo Nombre del analizador de IA.

Preguntas frecuentes

How is Classify different from Parse in AI Document Parser?+
Parse holds a single Document Schema and returns its extracted fields. Classify holds multiple Schemas, one per document variant, each with its own Classification Prompt and Document Schema. At runtime the AI picks the best-matching Schema and returns its fields plus the Classification Name. Use Classify when one Analyzer must handle several layouts.
What is the Classification Prompt?+
A natural-language description of the markers that identify this document variant. Mention the company name printed at the top, the contact email, layout cues, anything distinctive. The AI compares every Schema Classification Prompt against the incoming PDF to pick the best match.
Can each Schema have different fields?+
Yes. Each Schema has its own Document Schema, so Client ABC can extract invoiceNumber and invoiceDate while Client XYZ extracts invoiceNumber, customerRef, and PONumber. The response contains exactly the fields defined in the matched Schema.
What does fieldMethod: generate do?+
Inside a Document Schema, fieldMethod controls how the AI fills the value. generate tells the AI to derive or normalize the value rather than copy a substring verbatim. Useful for dates (normalize multiple formats), totals (compute or normalize), and identifiers that may need cleanup. Omit fieldMethod for straight extraction.
How many Schemas can I add to one Analyzer?+
No hard cap published. In practice, 5 to 20 well-described Schemas per Analyzer perform best. If you need dozens, group similar variants under broader Classification Names and let the Document Schema handle the small differences.
Does the Analyzer Id change after Save Changes?+
No. The Analyzer Id is the string you typed in the Add row in Step 2 (for example client_invoices). It stays stable across edits and is the value every API call and automation module uses.
Do I need to upload a sample PDF when setting up the Analyzer?+
No. The AI Analyzer does not need a sample for setup. You describe each variant in natural language via the Classification Prompt; the AI engine applies the prompts to whatever document you send at runtime.
What happens if the incoming PDF does not match any Schema confidently?+
The AI still returns its best guess. To handle ambiguous cases, add a catch-all Schema with a generic Classification Prompt and a minimal Document Schema, or route low-confidence responses to a manual review queue in your automation.

Obtén ayuda