ForHosting KIT · Documents et PDF

Extraire les liens d'un PDF

L'extracteur de liens PDF lit la liste d'annotations page par page d'un PDF — exactement ce qu'une bibliothèque de lecture comme pdf.js renvoie depuis getAnnotations — et retourne chaque hyperlien trouvé, avec son numéro de page et son URL cible.

● BetaGratuit · dans votre navigateur
Utilisez-le depuis WebAPIE-mailTelegramApp bientôt

Tout se passe dans votre navigateur : gratuit, sans envoi de vos données.

C'est l'étape qui manquait entre « j'ai les annotations » et « je sais où pointe ce document » : un passage déterministe, sans rendu, sans OCR et sans conjecture. Les liens purement internes et les annotations qui ne sont pas des liens sont écartés, de sorte que vous récupérez une liste propre et ordonnée des références externes que fait le document, prête pour un audit, une liste de départ pour un crawler ou un contrôle de conformité.

Comment l’utiliser

Saisissez vos données dans le formulaire ci-dessus. L’outil les vérifie avant le calcul et affiche le résultat sur la même page.

Vérifiez vos données

Suivez les libellés et les unités de chaque champ. Si une valeur manque ou sort de la plage autorisée, la page indique quoi corriger.

Relancez le calcul ou automatisez-le

Utilisez l’outil web pour les vérifications ponctuelles et l’API pour intégrer la même capacité à un flux automatisé.

Obtenez une réponse maintenant

Saisissez un jeu de valeurs et consultez le résultat sans créer de feuille de calcul ni de script.

Comparez des scénarios

Modifiez une valeur à la fois et relancez le calcul pour voir ce qui influence le résultat.

Automatisez les tâches répétées

Utilisez l’API lorsque le même calcul doit s’exécuter dans votre produit ou votre flux.

Comment utiliser cette capacité ?

Remplissez les champs ci-dessus et lancez-la sur cette page. Le formulaire signale les données à corriger.

Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.

POSThttps://api.kit.forhosting.com/pdf/extract-links

Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.

curl -X POST https://api.kit.forhosting.com/pdf/extract-links \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"annotations":[{"page":1,"subtype":"Link","uri":"https://example.com/docs"},{"page":1,"subtype":"Text","uri":null},{"page":3,"subtype":"Link","uri":"https://example.com/contact"}]}'
{
  "annotations": [
    {
      "page": 1,
      "subtype": "Link",
      "uri": "https://example.com/docs"
    },
    {
      "page": 1,
      "subtype": "Text",
      "uri": null
    },
    {
      "page": 3,
      "subtype": "Link",
      "uri": "https://example.com/contact"
    }
  ]
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "pdf.extract_links",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.

par requête$0.002

Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.

max_mb1
max_annotations50000
HTTPCodeSignification
401unauthorizedClé API absente ou invalide : vérifiez l’en-tête Authorization.
402insufficient_balanceSolde insuffisant : rechargez votre compte pour lancer cette tâche.
404unknown_typeType de tâche inconnu : vérifiez le champ type de votre requête.
429rate_limitedTrop de requêtes : ralentissez la cadence, puis réessayez.

Consulter la documentation complète du KIT →