Extraire tous les liens d’une page
Cet outil relève tous les liens présents sur une page web et vous en renvoie la liste : l’adresse de destination et, quand il existe, le texte du lien. Nos serveurs lisent la page et rassemblent les liens internes comme externes, sans que vous ayez à parcourir le code.
Exécuter en ligne
Exécutez cette tâche sur nos serveurs, avec votre compte. Les outils gratuits tournent dans votre navigateur ; celui-ci est facturé sur votre solde KIT au prix affiché ci-dessus.
Tous les liens, réunis
Une page contient souvent bien plus de liens qu’il n’y paraît : ceux du menu, du contenu, du pied de page, sans compter ceux qui ne sautent pas aux yeux. L’outil les rassemble tous en une liste unique, chacun avec son adresse et le texte cliquable qui l’accompagne. Vous obtenez ainsi une vue complète des chemins qui partent de cette page, là où une lecture à l’œil laisserait forcément passer une partie des liens.
À quoi sert la liste
Recenser les liens d’une page ouvre plusieurs usages : vérifier avant publication que rien ne pointe vers une mauvaise adresse, cartographier la manière dont un site s’articule, ou collecter des références citées dans un article. Pour un travail d’audit ou de documentation, disposer de la liste brute, triable et exportable, vaut mieux que de cliquer sur chaque lien un à un pour en noter la destination sur un coin de table.
Internes et externes : faire le tri
Les liens ne se valent pas tous : certains restent sur le même site, d’autres mènent ailleurs. La liste permet de distinguer les deux — utile pour repérer d’un coup vers quels sites extérieurs une page renvoie, ou pour ne garder que les chemins internes lors d’un audit. Ce tri, fastidieux à faire à la main, devient immédiat une fois les adresses rassemblées dans un tableau que vous filtrez à votre guise.
Un traitement léger et rapide
Relever des liens ne demande pas d’ouvrir un navigateur complet : l’outil lit la page et en extrait les adresses, ce qui rend l’opération à la fois rapide et bon marché. C’est l’une des tâches les moins coûteuses du service. En contrepartie, il liste les liens tels qu’ils figurent dans la page ; il ne vérifie pas s’ils fonctionnent — une vérification que réalise, elle, la détection des liens morts.
Cas d’usage
Contrôle avant publication
Avant de mettre en ligne une page, Sophie Nguyen liste ses liens pour s’assurer qu’aucun ne pointe vers une adresse erronée ou obsolète.
Cartographie d’un site
Studio Lumen SAS relève les liens de plusieurs pages pour comprendre comment un site s’articule avant d’en proposer une refonte.
Collecte de références
Pour un dossier, Nadia Benali récupère l’ensemble des liens cités dans un long article, avec leur texte, afin d’en vérifier les sources.
Repérage des liens sortants
Julien Lefèvre isole les seuls liens externes d’une page pour voir vers quels sites tiers elle renvoie ses visiteurs.
Questions fréquentes
Quels liens sont récupérés ?
Tous ceux présents sur la page : menu, contenu, pied de page, internes comme externes. Chacun est renvoyé avec son adresse de destination et, s’il existe, son texte cliquable.
Le texte des liens est-il inclus ?
Oui, quand il est présent : le texte cliquable accompagne chaque adresse, ce qui aide à comprendre où mène le lien sans avoir à l’ouvrir.
Les liens sont-ils vérifiés ?
Non. L’outil liste les liens tels qu’ils figurent dans la page, sans tester s’ils fonctionnent. Pour repérer les liens morts, c’est la détection des liens cassés qu’il faut utiliser.
Combien coûte l’extraction des liens ?
Le tarif est réduit, à $0.002 par requête en dollars US, sans coût par unité. C’est l’une des opérations les moins chères du service, car elle reste légère.
L’adresse saisie est-elle conservée ?
Non. La page est lue le temps d’en relever les liens, dont la liste vous est renvoyée, puis l’URL et le résultat sont écartés de nos serveurs.
Faut-il un compte ?
Non, aucune inscription. Le service se règle à l’usage ; une facture s’obtient auprès de [email protected].
Pour les développeurs — accès API
Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.
Endpoint
Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.
Appeler depuis votre stack
curl -X POST https://api.kit.forhosting.com/web/links \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"url":"https://ejemplo.com"}'const res = await fetch("https://api.kit.forhosting.com/web/links", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"url": "https://ejemplo.com"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/web/links",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"url": "https://ejemplo.com"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/web/links", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"url":"https://ejemplo.com"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"url":"https://ejemplo.com"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/web/links", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Exemple de requête
{
"url": "https://ejemplo.com"
}Exemple de réponse
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "web.links",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.
Tarifs
Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.
Limites
timeout_sec | 30 |
max_crawl_pages | 25 |
Erreurs
| HTTP | Code | Signification |
|---|---|---|
401 | unauthorized | Clé API absente ou invalide : vérifiez l’en-tête Authorization. |
402 | insufficient_balance | Solde insuffisant : rechargez votre compte pour lancer cette tâche. |
404 | unknown_type | Type de tâche inconnu : vérifiez le champ type de votre requête. |
429 | rate_limited | Trop de requêtes : ralentissez la cadence, puis réessayez. |