PDF escaneado não deixa copiar texto?
Um PDF escaneado é só uma fotografia das páginas: não dá para buscar nem copiar nada. Este serviço aplica OCR e insere uma camada de texto invisível sobre a imagem, mantendo o visual original intacto. O documento passa a responder ao Ctrl+F, vira indexável e fica pronto para arquivamento digital de verdade.
Rode online
Rode nos nossos servidores com a sua conta. As ferramentas grátis rodam no seu navegador; esta aqui é descontada do seu saldo do KIT pelo preço acima.
A camada invisível: o escaneado continua igual, mas agora tem texto
O truque é elegante: o OCR reconhece cada palavra da imagem e grava esse texto em uma camada transparente, posicionada exatamente sobre a palavra impressa. Quem abre o arquivo vê o mesmo escaneado de sempre — carimbos, assinaturas, manchas de café incluídos. Mas agora dá para selecionar um trecho, copiar uma cláusula e buscar um nome. É o padrão usado por sistemas de gestão documental no mundo inteiro, e o que separa um arquivo morto de um acervo consultável.
Escaneou pelo celular? Serve também
O reconhecimento funciona bem com escaneamento de mesa e com foto de celular razoável — página inteira no quadro, luz decente, sem dedo na frente. Quanto melhor a origem, melhor o texto reconhecido: um contrato escaneado a 300 dpi sai quase perfeito; uma foto torta de comprovante amassado sai utilizável, mas com tropeços. O visual nunca é alterado; o que varia é a qualidade da camada de busca por trás.
Para que gente usa isso no dia a dia
Escritórios que digitalizaram anos de contratos assinados e agora precisam achar “aquela cláusula de rescisão” sem folhear tudo. Contabilidades que recebem caixas de documentos antigos de clientes novos. Departamentos que precisam entregar acervo pesquisável para auditoria. Em todos os casos, o ganho é o mesmo: o documento continua com validade visual de escaneado, mas se comporta como texto.
Preço publicado e fase de implantação
O serviço funciona via API, pagando por uso: US$ 0,042 por chamada mais US$ 0,0025 por página processada — um dossiê de 100 páginas sai por US$ 0,292. O limite por arquivo é de 25 MB e 200 páginas. Atenção à fase atual: esta capacidade está em implantação e ainda não aceita execuções. O preço e os limites já estão publicados para você planejar a integração; assim que abrir, é ligar e usar.
Casos de uso
Acervo de contratos assinados do escritório
Um escritório de advocacia de Belo Horizonte digitalizou dez anos de contratos em papel. Com a camada de OCR aplicada em lote, a equipe passou a localizar qualquer cliente ou cláusula pelo buscador do próprio sistema — sem abrir arquivo por arquivo.
Notas antigas para fechar a contabilidade
A contabilidade que atende a Padaria Pão Dourado Ltda. recebeu uma caixa de notas e recibos escaneados de 2022. Processados com OCR, os PDFs viraram documentos pesquisáveis: achar a nota do fornecedor de farinha virou questão de digitar o nome.
Auditoria pede acervo consultável
A Distribuidora Horizonte Verde S.A. precisou entregar à auditoria os comprovantes de frete de dois anos. Em vez de uma pasta de imagens soltas, entregou PDFs com camada de texto — os auditores buscaram por CNPJ e data sem pedir mais nada.
Trabalhos e provas digitalizados na escola
Uma escola de Curitiba escaneia provas aplicadas em papel para guardar por cinco anos. Com o texto reconhecido, a secretaria encontra a prova de qualquer aluno pelo nome, direto na pasta da rede.
Perguntas frequentes
O documento fica com aparência diferente depois do OCR?
Não. A camada de texto é invisível e fica por trás da imagem original. Carimbos, assinaturas e o próprio aspecto do escaneado permanecem exatamente como estavam.
O OCR entende português, com acento e cedilha?
Sim — atenção, coração e serviço saem com ã, ç e acentos no lugar. O reconhecimento cobre o português do Brasil e os idiomas latinos mais comuns.
Foto de celular funciona ou precisa de scanner?
Funciona, desde que a página esteja inteira no quadro e legível. Scanner a 300 dpi dá o melhor resultado; foto razoável dá resultado utilizável.
Quanto custa processar um arquivo de 100 páginas?
US$ 0,042 pela chamada + 100 × US$ 0,0025 = US$ 0,292. O preço é por uso, em dólar americano, sem mensalidade.
O conteúdo dos meus documentos fica retido?
Só pelo tempo necessário para você baixar o resultado; depois é descartado e não serve para nenhum outro fim. Prática alinhada à LGPD.
Posso usar agora mesmo?
Ainda não: esta capacidade está em implantação e não aceita execuções por enquanto. O preço já está publicado e vale quando o serviço abrir — sem pegadinha depois.
Para desenvolvedores — acesso via API
Tudo nesta página está disponível via API. Esta seção é para equipes que querem integrar a ferramenta aos próprios sistemas; quem não precisa disso pode simplesmente usar a ferramenta acima.
Endpoint
Autenticação por token Bearer. Um único POST coloca a tarefa na fila; o resultado chega por webhook ou link assinado.
Chame do seu código
curl -X POST https://api.kit.forhosting.com/pdf/ocr-layer \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"pdf":"https://ejemplo.com/documento.pdf"}'const res = await fetch("https://api.kit.forhosting.com/pdf/ocr-layer", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"pdf": "https://ejemplo.com/documento.pdf"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/pdf/ocr-layer",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"pdf": "https://ejemplo.com/documento.pdf"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/pdf/ocr-layer", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"pdf":"https://ejemplo.com/documento.pdf"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"pdf":"https://ejemplo.com/documento.pdf"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/pdf/ocr-layer", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Exemplo de requisição
{
"pdf": "https://ejemplo.com/documento.pdf"
}Exemplo de resposta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "pdf.ocr_layer",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}A API é assíncrona: cada chamada devolve um task_id na hora. Se preferir polling, consulte o status a até 1 requisição por segundo.
Preço
Preço publicado, sem tokens nem créditos escondidos. Tarefa que falha não é cobrada.
Limites
max_mb | 25 |
max_pages | 200 |
Erros
| HTTP | Código | O que significa |
|---|---|---|
401 | unauthorized | Token ausente ou inválido. Confira o header Authorization. |
402 | insufficient_balance | Saldo insuficiente para esta tarefa. Faça uma recarga e tente de novo. |
404 | unknown_type | Esse tipo de tarefa não existe. Confira o campo type no catálogo. |
429 | rate_limited | Muitas requisições em pouco tempo. Espere um instante e tente de novo. |
413 | input_too_large | A entrada passou do tamanho máximo desta tarefa. Confira os limites publicados. |