Convertir un PDF en HTML
Cette capacité convertira un PDF en page HTML : le contenu du document — texte, titres, mise en page — repris dans un format directement affichable dans un navigateur, sans lecteur PDF. Utile pour intégrer un document à un site ou le rendre lisible sur tous les écrans. Elle est aujourd’hui en cours de déploiement.
Exécuter en ligne
Exécutez cette tâche sur nos serveurs, avec votre compte. Les outils gratuits tournent dans votre navigateur ; celui-ci est facturé sur votre solde KIT au prix affiché ci-dessus.
Du PDF figé à la page vivante
Le PDF est fait pour l’impression : sa mise en page ne s’adapte pas à l’écran, et le lire sur mobile impose des zooms pénibles. Le HTML, lui, coule dans la page et s’ajuste à la largeur disponible. Convertir un PDF en HTML, c’est libérer son contenu de la feuille A4 pour le rendre consultable partout, indexable par les moteurs de recherche et intégrable à un site sans obliger le visiteur à télécharger quoi que ce soit.
Ce que la conversion reprend
Le moteur reconstruit le texte, la hiérarchie des titres et l’essentiel de la mise en forme dans une structure HTML propre. Une mise en page très graphique — colonnes savantes, encarts, superpositions — se traduit toujours imparfaitement d’un format d’impression vers un format fluide : c’est une réalité de toute conversion PDF vers HTML, pas une limite propre à cet outil. Le résultat vise la lisibilité et la réutilisation, non la copie pixel par pixel de la page d’origine.
Bientôt disponible, à quel prix
Cette capacité est en phase de déploiement : elle n’accepte pas encore d’exécutions, ni depuis cette page ni via l’API. Nous préférons vous le dire clairement plutôt que d’afficher un bouton qui ne répondrait pas. Le tarif prévu est de $0.052 par requête, plus $0.003 par page, en dollars US, à l’usage et sans abonnement. Dès l’ouverture, la conversion s’utilisera ici comme via l’API (alias /pdf/to-html).
Cas d’usage
Publier un rapport sur un site
Studio Lumen SAS voudra reprendre un rapport PDF en page web, consultable sans téléchargement et référencée par les moteurs de recherche. La version HTML remplacera le lien vers un fichier lourd par une lecture directe.
Rendre un document lisible sur mobile
Julien Lefèvre consulte des notes PDF sur son téléphone et peine à zoomer sans cesse. Une version HTML, qui s’ajuste à l’écran, lui offrira une lecture confortable en déplacement.
Intégrer une notice à une aide en ligne
Atelier Garnier SARL souhaitera insérer ses notices dans son centre d’aide plutôt que d’y déposer des PDF. Le HTML permettra de coller le contenu directement dans les pages du site.
Questions fréquentes
Puis-je déjà utiliser cette conversion ?
Pas encore. La capacité est en cours de déploiement et n’accepte aucune exécution pour le moment. Nous l’annonçons dès qu’elle ouvre, plutôt que de laisser croire à une disponibilité immédiate.
La page HTML sera-t-elle une copie exacte du PDF ?
Non, et ce n’est pas son but. Elle reprendra le texte et la structure dans un format fluide, adapté à l’écran. Une mise en page d’impression très graphique se traduit toujours de façon approchée vers le web.
Quelle différence avec une conversion en Markdown ?
Le Markdown vise l’édition et le versionnage d’un contenu ; le HTML vise l’affichage direct dans un navigateur et l’intégration à un site. Le choix dépend de ce que vous ferez ensuite du document.
Quel sera le tarif ?
$0.052 par requête, plus $0.003 par page, en dollars US, à l’usage et sans abonnement. Le règlement se fera par PayPal, sans compte à créer, avec facture sur demande.
Un PDF scanné pourra-t-il être converti ?
Le contenu récupérable dépendra de la présence d’une couche de texte. Un simple scan devra d’abord passer par une reconnaissance de caractères pour donner un HTML porteur de vrai texte.
Mes fichiers seront-ils conservés ?
Non. Comme pour les autres capacités, le document sera chiffré en transit, traité pour le seul besoin de la conversion, puis effacé une fois le résultat renvoyé.
Pour les développeurs — accès API
Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.
Endpoint
Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.
Appeler depuis votre stack
curl -X POST https://api.kit.forhosting.com/pdf/to-html \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"pdf":"https://ejemplo.com/documento.pdf"}'const res = await fetch("https://api.kit.forhosting.com/pdf/to-html", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"pdf": "https://ejemplo.com/documento.pdf"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/pdf/to-html",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"pdf": "https://ejemplo.com/documento.pdf"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/pdf/to-html", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"pdf":"https://ejemplo.com/documento.pdf"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"pdf":"https://ejemplo.com/documento.pdf"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/pdf/to-html", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Exemple de requête
{
"pdf": "https://ejemplo.com/documento.pdf"
}Exemple de réponse
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "pdf.to_html",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.
Tarifs
Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.
Limites
max_mb | 25 |
max_pages | 200 |
Erreurs
| HTTP | Code | Signification |
|---|---|---|
401 | unauthorized | Clé API absente ou invalide : vérifiez l’en-tête Authorization. |
402 | insufficient_balance | Solde insuffisant : rechargez votre compte pour lancer cette tâche. |
404 | unknown_type | Type de tâche inconnu : vérifiez le champ type de votre requête. |
429 | rate_limited | Trop de requêtes : ralentissez la cadence, puis réessayez. |
413 | input_too_large | Entrée trop volumineuse : consultez la limite de taille de cette capacité. |