PDF a JSON

Extraer JSON de un PDF

Extrae datos estructurados de cualquier PDF como JSON limpio: define tus campos y deja que la IA los rellene.

Extraer JSON de un PDF en línea

En lugar de volcar todo el documento como texto, PDF Vision te pregunta qué campos importan (invoiceNumber, invoiceDate, totalAmount, partyA) y de qué tipo es cada uno: string, number, boolean, date, array u object. Después, la IA lee el PDF y devuelve exactamente esa forma en JSON, lista para pegar en el cuerpo de una petición, en una fila de base de datos o en un paso de automatización. Los ajustes predefinidos para facturas, contactos y contratos te dan un esquema de partida. La extracción se ejecuta en nuestros servidores con un servicio de IA de pago, así que esta herramienta requiere un plan Gold: una cuenta gratuita se rechaza en este punto de acceso.

Cómo funciona

  1. Define tu esquema

    Añade una fila por campo, ponle un nombre en camelCase y asígnale un tipo, o carga el ajuste predefinido de factura, contacto o contrato.

  2. Sube el PDF

    Selecciona el documento que quieres leer; la extracción se ejecuta en nuestros servidores con tu plan Gold y tarda más con archivos densos o de varias páginas.

  3. Copia o descarga el JSON

    Revisa el resultado en la vista de árbol y cópialo al portapapeles o guárdalo como archivo .json.

Por qué usarlo

Tú controlas el esquema

Los nombres y tipos de los campos los decides tú, así que la respuesta encaja directamente en una interfaz de TypeScript o en una columna de base de datos existentes sin escribir una capa de conversión intermedia.

Datos tipados, no todo en texto

Declarar un valor como number, boolean o date hace que los totales lleguen como números y las fechas en un formato comparable, en lugar de cadenas que tu código tiene que analizar y validar.

Cada ejecución se guarda

Las extracciones anteriores quedan en un panel de historial: vuelve a abrir una para revisar su JSON en la vista de árbol o descargar de nuevo el archivo, sin volver a subir el PDF.

Preguntas frecuentes

¿Cómo elijo qué campos extraer?
Los enumeras tú, fila a fila: un nombre de campo y un tipo entre string, number, boolean, date, array u object. Los nombres deben ser identificadores válidos, así que escribe invoiceTotal y no «invoice total».
¿Hay un punto de partida para documentos habituales?
Sí, tres ajustes predefinidos rellenan el esquema por ti: factura (número, fecha, proveedor, total, moneda), contacto (nombre completo, correo electrónico, teléfono, empresa) y contrato (título, ambas partes, fechas de inicio y fin). Puedes editar cualquier fila después.
¿Funciona con PDF escaneados?
No de forma fiable. La extracción lee el texto que ya contiene el PDF, así que un escaneo puro devuelve campos pobres o vacíos. Pásale primero OCR PDF para añadir una capa de texto y vuelve después a extraer.
¿Qué pasa si un campo no está en el documento?
La extracción con IA solo puede leer lo que aparece en la página, así que un campo que el documento nunca menciona no se puede rellenar. Trata el resultado como datos que hay que validar, sobre todo las cifras que determinan pagos o asientos contables.
¿Necesito una cuenta?
Sí, y de pago: PDF a JSON requiere un plan Gold. Una cuenta gratuita se rechaza en esta herramienta, así que registrarse no basta para tener acceso. Además, la extracción se hace en el servidor, lo que significa que el documento se sube para procesarlo en lugar de analizarse dentro de tu navegador.
¿Qué puedo hacer con el JSON después?
Cópialo desde la vista de árbol o descarga el archivo, y luego envíalo por POST a una API, insértalo como fila en una base de datos o pásalo a una importación de hoja de cálculo, a un sistema contable o a un flujo de automatización.