Leer un PDF escaneado
La API OCR PDF abre un PDF escaneado — de esos que en realidad son una pila de imágenes de páginas disfrazadas de PDF — y devuelve el texto que está impreso visualmente en cada página. Existe porque un contrato escaneado o un informe archivado parece buscable, pero no lo es, hasta que algo realmente lee lo que hay en la página.
Ejecútela online
Ejecute esto en nuestros servidores con su cuenta. Las herramientas gratuitas corren en su navegador; esta cobra de su saldo del KIT según el precio de arriba.
Un PDF que solo parece texto
No todo PDF contiene texto real y seleccionable. Muchos se producen escaneando papel, y lo que resulta es, en la práctica, una fotografía de cada página guardada dentro de un contenedor PDF — ábralo e intente seleccionar una frase, y nada se resalta, porque no hay capa de texto debajo, solo píxeles ordenados para parecer letras. La api ocr pdf está construida exactamente para este tipo de documento: mira más allá de la imagen y lee lo que realmente está impreso.
Reconocimiento página por página
Envía el PDF y el servicio lo recorre página por página, reconociendo los caracteres impresos en cada una y armando la salida como texto plano ligado a su página de origen, así un informe escaneado de 40 páginas produce la misma estructura que esperaría una persona que lo hubiera leído de principio a fin. Esto importa para documentos como contratos antiguos, formularios gubernamentales o informes archivados que se digitalizaron como imágenes mucho antes de que alguien pensara en hacerlos buscables.
Cómo corre el flujo asíncrono
Llamar a POST /ocr/pdf devuelve un task_id de inmediato, y el reconocimiento avanza en nuestra red global sin ocupar una conexión mientras se procesa un documento largo de varias páginas. Cuando termina, la entrega ocurre por webhook firmado — adecuado para un flujo documental que maneja muchos archivos — o por un enlace firmado válido 24 horas, para una consulta puntual donde una persona solo necesita el texto de un archivo.
Su lugar en archivos y flujos documentales
Esta es la capa que convierte un archivo digital estático en algo que un motor de búsqueda, una herramienta legal o un sistema de expedientes realmente puede consultar: un despacho legal que hace buscable un expediente escaneado, un departamento de registros que procesa un rezago de formularios digitalizados, un equipo de investigación que extrae texto de informes archivados hace años. Como cada PDF es una solicitud asíncrona individual, procesar todo un archivo es cuestión de repetir la llamada, no de rediseñar un flujo de trabajo.
Costo y manejo de fallos
El precio es de $0.010 por solicitud más $0.0575 por página, una tarifa publicada que escala con la extensión del documento en lugar de un cargo fijo u oculto. Si el reconocimiento falla en un documento, se reintenta tres veces antes de devolver un error claro, y nunca se cobra una tarea fallida — el costo sigue las páginas realmente leídas, no los intentos. Usar el endpoint requiere saldo prepago; no hay plan gratuito ni prueba, lo que mantiene el rendimiento confiable, y las solicitudes sin saldo devuelven 402. Los PDF de origen y el texto extraído se eliminan tras el periodo de retención y nunca se usan para entrenamiento.
Qué puede hacer con ella
Hacer buscable un archivo legal
Un despacho de abogados procesa un rezago de expedientes escaneados con la API para que los abogados finalmente puedan buscar un término en décadas de registros en papel.
Digitalizar formularios gubernamentales o históricos
Un departamento de registros procesa una pila de formularios digitalizados y recibe texto plano listo para cargar en una base de datos, en lugar de dejarlos como escaneos no buscables.
Investigación sobre informes archivados
Un equipo de investigación extrae texto de informes escaneados anteriores a la publicación digital, habilitando la búsqueda de texto completo en un archivo que antes solo eran imágenes.
Flujos de revisión de contratos
Un sistema de gestión de contratos aplica OCR a los acuerdos escaneados que llegan antes de enrutarlos, así la herramienta de revisión busca cláusulas en lugar de leer imágenes de página.
Preguntas frecuentes
¿Cómo aplico OCR a un PDF escaneado con una API?
Envía el PDF a POST /ocr/pdf y recibe un task_id de inmediato. La api ocr pdf lee cada página de forma asíncrona y entrega el texto por webhook firmado o por un enlace firmado válido 24 horas.
¿La API de OCR PDF es gratis?
No hay capa gratuita: las capas gratis se abusan y ralentizan a todos. El acceso funciona con un saldo prepago de ForHosting KIT: se recarga desde $10.00 (no caduca) y cada solicitud se cobra a su precio publicado, así que una llamada sin saldo devuelve HTTP 402. Sin suscripción, sin tokens ni créditos inventados, y una tarea fallida no se cobra.
¿Funciona con documentos escaneados de varias páginas?
Sí, procesa el PDF página por página y devuelve el texto ligado a cada página, lo que la hace apta para contratos largos escaneados, informes o archivos completos.
¿Cuál es la diferencia con un PDF que ya tiene texto?
Un PDF con una capa de texto real no necesita OCR en absoluto; este endpoint es específicamente para PDF escaneados donde las páginas son imágenes y nada es seleccionable hasta que se reconoce.
¿Puedo procesar un gran rezago de PDF escaneados de una vez?
Sí. Cada PDF es una solicitud asíncrona independiente con su propio task_id, así que procesar todo un archivo es cuestión de repetir la llamada en cada archivo.
¿Qué pasa si el OCR falla en una página o documento?
El sistema reintenta tres veces antes de devolver un error claro, y una tarea fallida nunca se cobra, así que el costo sigue las páginas realmente entregadas, no los intentos fallidos.
¿Cómo se determina el número de páginas para el cobro?
Se basa en la cantidad de páginas del PDF enviado, ya que la tarifa de $0.0575 por página aplica a cada página que el servicio realmente lee.
¿Por cuánto tiempo puedo obtener el texto extraído?
El enlace firmado permanece válido 24 horas, o recibe el texto de inmediato por webhook firmado; tras la ventana de retención todo se elimina y nunca se usa para entrenamiento.
Para desarrolladores — acceso por API
Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.
Endpoint de API
¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, y pronto desde nuestra app, el email y Telegram.
Llámela desde su stack
curl -X POST https://api.kit.forhosting.com/ocr/pdf \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"input":"…"}'const res = await fetch("https://api.kit.forhosting.com/ocr/pdf", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"input": "…"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/ocr/pdf",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"input": "…"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/ocr/pdf", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"input":"…"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"input":"…"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/ocr/pdf", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Ejemplo de solicitud
{
"input": "…"
}Ejemplo de respuesta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "ocr.pdf",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.
Precio
Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.
Límites
max_mb | 25 |
max_pages | 10 |
Errores
| HTTP | Código | Significado |
|---|---|---|
401 | unauthorized | API key ausente o inválida. |
402 | insufficient_balance | El saldo no cubre el precio de la tarea. |
404 | unknown_type | El tipo de tarea no existe. |
429 | rate_limited | Demasiadas peticiones. Use el webhook en vez de sondear. |
413 | input_too_large | El archivo supera el límite de tamaño. |
422 | task_failed | La tarea falló tras 3 reintentos. No se cobra. |