ForHosting KIT · Ler texto de imagem (OCR)

Classificação de documentos

Essa ferramenta recebe um documento digitalizado e responde o que ele é: nota fiscal, boleto, contrato, extrato bancário, documento de identidade, comprovante. Com isso, uma pasta bagunçada de arquivos “digitalizado_004.pdf” vira um acervo organizado por tipo — sem ninguém abrir os arquivos um a um.

● Estávelpor documentoUS$ 0,010
Use pelo WebAPIE-mailApp em breveTelegram em breve

Rode nos nossos servidores com a sua conta. As ferramentas grátis rodam no seu navegador; esta aqui é descontada do seu saldo do KIT pelo preço acima.

Todo escritório tem uma pasta chamada “Escaneados”

Ela cresce todo mês: o cliente manda tudo junto pelo WhatsApp, o scanner nomeia os arquivos por número, e no fim do trimestre ninguém sabe qual PDF é a nota fiscal e qual é o boleto pago. A classificação automática ataca exatamente essa pilha: cada documento é analisado pelo conteúdo e pela aparência — não pelo nome do arquivo — e recebe uma etiqueta de tipo que permite roteá-lo para a pasta, o sistema ou a pessoa certa.

Tipos que aparecem no dia a dia brasileiro

O universo documental do Brasil é peculiar: DANFE, boleto com linha digitável, comprovante de transferência, contrato social, declaração de imposto de renda, conta de luz servindo de comprovante de residência. A classificação trabalha sobre o conteúdo real do documento — cabeçalhos, campos, estrutura visual — e por isso distingue, por exemplo, uma nota fiscal de serviço de um recibo simples, ou um extrato bancário de uma fatura de cartão.

Da etiqueta à automação

Sozinha, a etiqueta já organiza; combinada com outras etapas, ela vira o primeiro estágio de uma esteira: classificar, depois extrair os dados com a ferramenta adequada ao tipo, depois lançar no sistema. Via API, cada documento classificado custa US$ 0,0575 mais US$ 0,010 de chamada — arquivos de até 25 MB e 10 páginas. Uma caixa com 500 documentos do mês é triada por cerca de US$ 33,75, sem plano nem franquia.

Onde a máquina ainda pede ajuda

Documentos muito atípicos — formulários internos exclusivos da sua empresa, papéis manuscritos, digitalizações ilegíveis — podem receber uma classificação genérica. A prática que funciona: deixe a ferramenta resolver o grosso (os tipos comuns são a imensa maioria) e direcione o resíduo para conferência humana. É a diferença entre abrir 500 arquivos um a um e revisar apenas os 15 que realmente pedem um par de olhos humanos.

Escritório contábil no fechamento do mês

Os clientes do escritório mandam tudo misturado: notas fiscais, boletos pagos, extratos, comprovantes de Pix. A classificação separa a papelada por tipo antes do lançamento, e cada auxiliar recebe só a fila que lhe cabe.

Departamento pessoal na admissão

O candidato envia um ZIP com RG, CPF, comprovante de residência e carteira de trabalho digitalizados. O sistema de RH classifica cada arquivo e detecta na hora que faltou o comprovante de residência — antes de o processo travar na véspera da contratação.

Advocacia organizando acervo digitalizado

Um escritório de Porto Alegre digitalizou o arquivo morto: milhares de PDFs sem nome útil. Classificando tudo — contratos, procurações, petições, comprovantes — o acervo ganhou ordem e a busca por tipo passou a funcionar.

Fintech triando documentos de cadastro

No onboarding de clientes, os envios chegam pelo celular e nem sempre são o que o formulário pediu. A classificação confere se o arquivo enviado no campo “comprovante de renda” é mesmo um holerite ou extrato — e devolve o cadastro na hora quando não é.

Quais tipos de documento a ferramenta sabe distinguir?

Os grandes tipos do cotidiano: notas fiscais, boletos, recibos e comprovantes, contratos, extratos e faturas, documentos de identidade, formulários, currículos, correspondência. Documentos fora desses padrões recebem a classificação mais próxima ou uma marcação genérica.

Posso usar as minhas próprias categorias?

O retorno traz o tipo identificado, e o seu sistema decide o mapeamento: muitas empresas traduzem as etiquetas para as pastas ou os status internos que já usam. A triagem fina por regra de negócio fica do seu lado.

E se um PDF só tiver vários documentos misturados?

O ideal é um documento por arquivo — a classificação avalia o conteúdo como um todo, e um PDF com boleto, nota e contrato juntos tende a receber a etiqueta do que domina. Separe antes, e o resultado fica confiável.

Qual o custo para triar o movimento de um mês?

US$ 0,010 por chamada mais US$ 0,0575 por documento. Um volume de 1.000 arquivos mensais custa cerca de US$ 67,50 — pago por uso, sem contrato de fidelidade.

Vocês leem o conteúdo dos meus documentos? Como fica a privacidade?

A análise do conteúdo é justamente o que permite classificar — o documento é processado para essa finalidade e ponto. Nenhum arquivo vira base pública. Para dados de terceiros, aplique o princípio da LGPD que você já segue: enviar o mínimo necessário.

Funciona com foto tirada pelo celular, ou só com scanner?

Funciona com os dois. Foto legível, sem corte nas bordas do documento, classifica tão bem quanto digitalização de scanner.

Isso também extrai os dados do documento?

Não — essa etapa diz o que o documento é. A extração dos campos (valores, datas, CNPJ) é feita pelas ferramentas específicas de cada tipo, que você aciona depois, já sabendo qual usar.

Tudo nesta página está disponível via API. Esta seção é para equipes que querem integrar a ferramenta aos próprios sistemas; quem não precisa disso pode simplesmente usar a ferramenta acima.

POSThttps://api.kit.forhosting.com/ocr/document-classify

Autenticação por token Bearer. Um único POST coloca a tarefa na fila; o resultado chega por webhook ou link assinado.

curl -X POST https://api.kit.forhosting.com/ocr/document-classify \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"input":"…"}'
{
  "input": "…"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "ocr.document_classify",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

A API é assíncrona: cada chamada devolve um task_id na hora. Se preferir polling, consulte o status a até 1 requisição por segundo.

por chamadaUS$ 0,010
por documentoUS$ 0,0575

Preço publicado, sem tokens nem créditos escondidos. Tarefa que falha não é cobrada.

max_mb25
max_pages10
HTTPCódigoO que significa
401unauthorizedToken ausente ou inválido. Confira o header Authorization.
402insufficient_balanceSaldo insuficiente para esta tarefa. Faça uma recarga e tente de novo.
404unknown_typeEsse tipo de tarefa não existe. Confira o campo type no catálogo.
429rate_limitedMuitas requisições em pouco tempo. Espere um instante e tente de novo.
422task_failedA tarefa falhou do nosso lado. Você não paga nada por ela.

Ver a documentação completa do KIT →