PDF para JSON

Extrair JSON de um PDF

Tire dados estruturados de qualquer PDF em JSON limpo — defina os seus campos e deixe a IA preenchê-los.

Extrair JSON de um PDF online

Em vez de despejar o documento inteiro como texto, o PDF Vision pergunta quais campos importam — invoiceNumber, invoiceDate, totalAmount, partyA — e qual é o tipo de cada um: string, number, boolean, date, array ou object. A IA então lê o PDF e devolve exatamente esse formato em JSON, pronto para colar no corpo de uma requisição, em uma linha de banco de dados ou em uma etapa de automação. Modelos prontos para faturas, contatos e contratos dão um esquema inicial. A extração roda nos nossos servidores com um serviço de IA pago, por isso esta ferramenta exige um plano Gold — uma conta gratuita é recusada neste endpoint.

Como funciona

  1. Defina o seu esquema

    Adicione uma linha por campo, dê um nome em camelCase e defina o tipo, ou carregue o modelo de fatura, contato ou contrato.

  2. Envie o PDF

    Selecione o documento a ser lido; a extração roda nos nossos servidores com o seu plano Gold e leva mais tempo em arquivos densos ou com muitas páginas.

  3. Copie ou baixe o JSON

    Confira o resultado na visualização em árvore e depois copie para a área de transferência ou salve como arquivo .json.

Por que usar

Você controla o esquema

Os nomes e tipos dos campos são seus, então a resposta entra direto em uma interface TypeScript ou em uma coluna de banco de dados que já existe, sem escrever uma camada de mapeamento no meio.

Tipado, e não tudo como string

Declarar um valor como number, boolean ou date faz os totais voltarem como números e as datas em um formato comparável, em vez de strings que o seu código precisa interpretar e validar.

Cada execução fica salva

As extrações anteriores ficam em um painel de histórico: reabra uma para ver o JSON na visualização em árvore ou baixar o arquivo de novo, sem reenviar o PDF.

Perguntas frequentes

Como escolho quais campos extrair?
Você mesmo os lista, uma linha por vez: um nome de campo e um tipo entre string, number, boolean, date, array ou object. Os nomes precisam ser identificadores válidos, então escreva invoiceTotal em vez de “invoice total”.
Há um ponto de partida para documentos comuns?
Sim, três modelos preenchem o esquema para você: fatura (número, data, fornecedor, total, moeda), contato (nome completo, e-mail, telefone, empresa) e contrato (título, as duas partes, datas de início e fim). Edite qualquer linha depois.
Funciona com PDF escaneado?
Não de forma confiável. A extração lê o texto que o PDF já contém, então um escaneamento puro devolve campos vazios ou quase vazios. Rode o OCR PDF antes para adicionar uma camada de texto, depois volte e extraia.
E se um campo não estiver no documento?
A extração por IA só consegue ler o que aparece na página, então um campo que o documento nunca menciona não pode ser preenchido. Trate o resultado como dados a validar, principalmente valores que geram pagamentos ou lançamentos contábeis.
Preciso de uma conta?
Sim, e paga: o PDF para JSON exige um plano Gold. Uma conta gratuita é recusada nesta ferramenta, então só se cadastrar não dá acesso. A extração também roda no servidor, o que significa que o documento é enviado para processamento, e não analisado dentro do seu navegador.
O que posso fazer com o JSON depois?
Copie da visualização em árvore ou baixe o arquivo e depois envie por POST para uma API, insira como linha de banco de dados ou use em uma importação de planilha, em um sistema contábil ou em um fluxo de automação.