ForHosting KIT · Documentos y PDF

Convertir PDF a HTML

Este endpoint lee el diseño de un PDF y lo reconstruye como HTML real: etiquetas para encabezados y párrafos, elementos posicionados como en la página original, no una captura de pantalla disfrazada de documento. Está pensado para el momento en que un PDF necesita vivir dentro de una página web en lugar de detrás de un enlace de descarga.

● BetaPor solicitud + por página$0.052
Úselo desde WebAPIEmailApp prontoTelegram pronto

Ejecute esto en nuestros servidores con su cuenta. Las herramientas gratuitas corren en su navegador; esta cobra de su saldo del KIT según el precio de arriba.

Por qué un PDF y una página web no son lo mismo

Un PDF está construido para verse idéntico en cualquier lugar, en cualquier pantalla o impresora, lo que lo convierte en un mal ciudadano de la web: no se reacomoda en un teléfono, es invisible para la mayoría de las búsquedas dentro de la página, y un lector de pantalla batalla con contenido que en realidad son solo glifos posicionados. El HTML resuelve las tres cosas al describir contenido y estructura en lugar de tinta fija. Este endpoint existe para los equipos que tienen documentos atrapados en PDF pero necesitan que se comporten como contenido web real: indexable, adaptable y estilizable con CSS.

Cómo se verá una solicitud

Enviará el PDF con un POST a /pdf/to-html y recibirá un task_id de inmediato, ya que reconstruir marcado a partir de un formato de maquetación fija exige análisis real. Cuando la conversión termine, el HTML se entregará en su webhook o quedará disponible en un enlace firmado válido por 24 horas — el mismo patrón asíncrono que usa cada endpoint de esta API, así que se integra en una canalización que quizás ya tenga corriendo para otras conversiones.

Dos formatos creados para propósitos opuestos

El HTML y el PDF nacieron de problemas distintos: el HTML para que el contenido se adapte al dispositivo que lo renderiza, el PDF para garantizar que una página se vea igual sin importar qué la abra. Ambos han prosperado porque ninguno de esos dos propósitos desapareció, pero eso también significa que moverse de uno a otro es trabajo de traducción genuino, no un simple cambio de extensión. Reconstruir encabezados, flujo de párrafos y estructura a partir de un formato que nunca fue diseñado para exponerlos es exactamente el problema que este endpoint resuelve.

Dónde encajará en su infraestructura

Espere la misma forma amigable con la automatización que el resto de la API: un task_id al enviar, un webhook al terminar y reintentos automáticos — hasta tres — antes de devolver un error claro para un documento que de verdad no puede convertirse. Eso significa que una migración masiva de archivos PDF hacia un CMS basado en HTML o un sitio de documentación podrá correr sin supervisión, convirtiendo cientos de archivos y reaccionando a cada uno conforme termina, sin consultar una cola manualmente.

Estado, precio y manejo de datos

Este endpoint está en despliegue y aún no acepta trabajos, pero el precio ya está definido y publicado: $0.052 por solicitud más $0.003 por página. Una vez activo, el acceso requerirá saldo prepago como cualquier otro endpoint; una solicitud sin saldo devolverá un 402 por diseño, manteniendo el servicio rápido y libre de abuso para todos los que lo usan. Como en el resto de la API, los PDFs de origen y el HTML generado se conservarán solo durante la ventana de retención, luego se eliminarán y nunca se usarán para entrenar nada.

Publicar archivos PDF en la web

Convierta un rezago de reportes o manuales en PDF en páginas HTML que los buscadores puedan indexar y a las que se pueda enlazar directamente, en vez de dejarlos detrás de un botón de descarga que nadie usa.

Lectura adaptable en cualquier dispositivo

Convierta PDFs de maquetación fija en HTML que se reacomoda correctamente en la pantalla de un teléfono, para que el lector no tenga que hacer zoom en un documento pensado para una hoja impresa.

Mejoras de accesibilidad

Reconstruya el contenido de un PDF como HTML semántico para que los lectores de pantalla y otras herramientas de asistencia puedan navegar encabezados y texto correctamente, algo que un PDF plano rara vez soporta bien.

Alimentar un CMS con contenido antiguo

Mueva una biblioteca de viejos folletos o fichas técnicas en PDF hacia un sistema de gestión de contenido como bloques HTML editables, listos para estilizarse con el CSS ya existente del sitio.

¿Está disponible ahora la API PDF a HTML?

Está en despliegue y todavía no acepta trabajos, pero el endpoint, el precio y el comportamiento ya están definidos y seguirán el mismo patrón asíncrono del resto de la API.

¿Cómo convertiré un PDF a HTML con la API?

Hará un POST del PDF a /pdf/to-html y recibirá un task_id de inmediato; el HTML convertido llegará a su webhook o a un enlace firmado cuando termine el procesamiento.

¿Habrá plan gratuito o prueba gratis?

No hay capa gratuita: las capas gratis se abusan y ralentizan a todos. El acceso funciona con un saldo prepago de ForHosting KIT: se recarga desde $10.00 (no caduca) y cada solicitud se cobra a su precio publicado, así que una llamada sin saldo devuelve HTTP 402. Sin suscripción, sin tokens ni créditos inventados, y una tarea fallida no se cobra.

¿Cuánto costará convertir un PDF a HTML?

El precio publicado es $0.052 por solicitud más $0.003 por página, así que un documento de diez páginas costará cerca de $0.082.

¿Conservará encabezados, párrafos y estructura?

Sí: el objetivo es HTML real que refleje la estructura del documento, no una imagen ni una reproducción posicionada píxel por píxel de la página.

¿En qué se diferencia de PDF a Markdown?

El resultado en HTML está pensado para estilizarse e incrustarse directamente en una página web con CSS, mientras que el Markdown está pensado para edición en texto plano, control de versiones y herramientas de documentación.

¿Se podrá convertir en lote?

Sí: cada PDF correrá como una tarea independiente con su propio task_id, así que los lotes de archivos podrán procesarse en paralelo y rastrearse mediante sus webhooks individuales.

¿Qué pasa con mis archivos, y habrá política de reintentos?

Las tareas fallidas se reintentarán automáticamente hasta tres veces antes de devolver un error claro, sin cobro por los fallos. Los PDFs de origen y el HTML generado se eliminarán tras la ventana de retención y nunca se usarán para entrenar nada.

Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.

POSThttps://api.kit.forhosting.com/pdf/to-html

¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, y pronto desde nuestra app, el email y Telegram.

curl -X POST https://api.kit.forhosting.com/pdf/to-html \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"pdf":"https://ejemplo.com/documento.pdf"}'
{
  "pdf": "https://ejemplo.com/documento.pdf"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "pdf.to_html",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.

Por solicitud$0.052
Por página$0.003

Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.

max_mb25
max_pages200
HTTPCódigoSignificado
401unauthorizedAPI key ausente o inválida.
402insufficient_balanceEl saldo no cubre el precio de la tarea.
404unknown_typeEl tipo de tarea no existe.
429rate_limitedDemasiadas peticiones. Use el webhook en vez de sondear.
413input_too_largeEl archivo supera el límite de tamaño.

Ver la documentación completa del KIT →