ForHosting KIT · Veille et lecture de sites web

Extraire tous les liens d’une page

Cet outil relève tous les liens présents sur une page web et vous en renvoie la liste : l’adresse de destination et, quand il existe, le texte du lien. Nos serveurs lisent la page et rassemblent les liens internes comme externes, sans que vous ayez à parcourir le code.

● Stablepar requête + par URL$0.002
Utilisez-le depuis WebAPIE-mailApp bientôtTelegram bientôt

Exécutez cette tâche sur nos serveurs, avec votre compte. Les outils gratuits tournent dans votre navigateur ; celui-ci est facturé sur votre solde KIT au prix affiché ci-dessus.

Tous les liens, réunis

Une page contient souvent bien plus de liens qu’il n’y paraît : ceux du menu, du contenu, du pied de page, sans compter ceux qui ne sautent pas aux yeux. L’outil les rassemble tous en une liste unique, chacun avec son adresse et le texte cliquable qui l’accompagne. Vous obtenez ainsi une vue complète des chemins qui partent de cette page, là où une lecture à l’œil laisserait forcément passer une partie des liens.

À quoi sert la liste

Recenser les liens d’une page ouvre plusieurs usages : vérifier avant publication que rien ne pointe vers une mauvaise adresse, cartographier la manière dont un site s’articule, ou collecter des références citées dans un article. Pour un travail d’audit ou de documentation, disposer de la liste brute, triable et exportable, vaut mieux que de cliquer sur chaque lien un à un pour en noter la destination sur un coin de table.

Internes et externes : faire le tri

Les liens ne se valent pas tous : certains restent sur le même site, d’autres mènent ailleurs. La liste permet de distinguer les deux — utile pour repérer d’un coup vers quels sites extérieurs une page renvoie, ou pour ne garder que les chemins internes lors d’un audit. Ce tri, fastidieux à faire à la main, devient immédiat une fois les adresses rassemblées dans un tableau que vous filtrez à votre guise.

Un traitement léger et rapide

Relever des liens ne demande pas d’ouvrir un navigateur complet : l’outil lit la page et en extrait les adresses, ce qui rend l’opération à la fois rapide et bon marché. C’est l’une des tâches les moins coûteuses du service. En contrepartie, il liste les liens tels qu’ils figurent dans la page ; il ne vérifie pas s’ils fonctionnent — une vérification que réalise, elle, la détection des liens morts.

Contrôle avant publication

Avant de mettre en ligne une page, Sophie Nguyen liste ses liens pour s’assurer qu’aucun ne pointe vers une adresse erronée ou obsolète.

Cartographie d’un site

Studio Lumen SAS relève les liens de plusieurs pages pour comprendre comment un site s’articule avant d’en proposer une refonte.

Collecte de références

Pour un dossier, Nadia Benali récupère l’ensemble des liens cités dans un long article, avec leur texte, afin d’en vérifier les sources.

Repérage des liens sortants

Julien Lefèvre isole les seuls liens externes d’une page pour voir vers quels sites tiers elle renvoie ses visiteurs.

Quels liens sont récupérés ?

Tous ceux présents sur la page : menu, contenu, pied de page, internes comme externes. Chacun est renvoyé avec son adresse de destination et, s’il existe, son texte cliquable.

Le texte des liens est-il inclus ?

Oui, quand il est présent : le texte cliquable accompagne chaque adresse, ce qui aide à comprendre où mène le lien sans avoir à l’ouvrir.

Les liens sont-ils vérifiés ?

Non. L’outil liste les liens tels qu’ils figurent dans la page, sans tester s’ils fonctionnent. Pour repérer les liens morts, c’est la détection des liens cassés qu’il faut utiliser.

Combien coûte l’extraction des liens ?

Le tarif est réduit, à $0.002 par requête en dollars US, sans coût par unité. C’est l’une des opérations les moins chères du service, car elle reste légère.

L’adresse saisie est-elle conservée ?

Non. La page est lue le temps d’en relever les liens, dont la liste vous est renvoyée, puis l’URL et le résultat sont écartés de nos serveurs.

Faut-il un compte ?

Non, aucune inscription. Le service se règle à l’usage ; une facture s’obtient auprès de [email protected].

Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.

POSThttps://api.kit.forhosting.com/web/links

Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.

curl -X POST https://api.kit.forhosting.com/web/links \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"url":"https://ejemplo.com"}'
{
  "url": "https://ejemplo.com"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "web.links",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.

par requête$0.002

Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.

timeout_sec30
max_crawl_pages25
HTTPCodeSignification
401unauthorizedClé API absente ou invalide : vérifiez l’en-tête Authorization.
402insufficient_balanceSolde insuffisant : rechargez votre compte pour lancer cette tâche.
404unknown_typeType de tâche inconnu : vérifiez le champ type de votre requête.
429rate_limitedTrop de requêtes : ralentissez la cadence, puis réessayez.

Consulter la documentation complète du KIT →