Alle Links einer Webseite auslesen
Diese Funktion ruft eine Internetadresse auf und liefert alle darin enthaltenen Links als Liste zurück, getrennt nach internen und externen Verweisen. Gedacht für eine schnelle Übersicht, etwa zur Prüfung, wohin eine Seite tatsächlich verlinkt, ohne den Quelltext von Hand zu durchsuchen.
Online ausführen
Führen Sie dies mit Ihrem Konto auf unseren Servern aus. Kostenlose Tools laufen in Ihrem Browser; dieses wird zum oben genannten Preis von Ihrem KIT-Guthaben abgebucht.
Was in der Liste steht
Jeder gefundene Link erscheint mit seiner Zieladresse und, sofern vorhanden, seinem Ankertext – dem sichtbaren Wort oder Satz, auf den geklickt wird. Interne Links, die auf dieselbe Website zeigen, werden von externen Links zu anderen Domains unterschieden, sodass sich beide Gruppen getrennt auswerten lassen, ohne die Liste erst selbst nach Zieladresse sortieren zu müssen. Doppelte Links, die mehrfach auf derselben Seite vorkommen, erscheinen dabei einmal pro Fundstelle, nicht zusammengefasst.
Wofür sich das eignet
Vor einer rechtlichen Prüfung lässt sich so schnell feststellen, ob eine Seite auf problematische externe Angebote verlinkt, ohne den kompletten Quelltext manuell durchzugehen. Auch für die Kontrolle der eigenen Navigation eignet sich die Liste, etwa um zu prüfen, ob alle wichtigen Unterseiten tatsächlich von der Startseite aus verlinkt sind und keine Seite ohne internen Zugang verwaist im System liegt, was Besucher und Suchmaschinen gleichermaßen erschweren würde, sie überhaupt zu finden.
Grenzen
Erfasst werden Links, die im geladenen HTML tatsächlich vorhanden sind; Verweise, die erst durch eine Nutzerinteraktion wie einen Klick sichtbar werden, etwa in einem eingeklappten Menü, werden nicht automatisch mit erfasst. Diese Funktion nutzt ein leichtes Verfahren ohne vollständigen Browser, was sie schnell und günstig macht, aber bei sehr JavaScript-lastigen Seiten an Grenzen stößt, bei denen Links erst nachträglich per Skript in die Seite eingefügt werden.
Preis pro Anfrage
$0.002 pro Anfrage, ohne zusätzliche Kosten pro gefundenem Link – damit eine der günstigsten Funktionen dieser Kategorie, da kein vollständiger Browser für die Verarbeitung nötig ist. Ob eine Seite fünf oder fünfhundert Links enthält, ändert am Preis der einzelnen Anfrage nichts. Ein Abonnement ist dafür nicht erforderlich, Sie zahlen ausschließlich für die tatsächlich ausgeführte Anfrage, unabhängig davon, wie umfangreich die Navigation der geprüften Seite ausfällt.
Anwendungsfälle
Externe Verweise vor einer rechtlichen Prüfung sichten
Sabine Schneider prüft, welche externen Seiten von einer Partnerseite aus verlinkt sind, bevor ein gemeinsamer Auftritt freigegeben wird.
Eigene Navigation auf Vollständigkeit prüfen
Schneider IT-Systeme GmbH & Co. KG prüft, ob alle Unterseiten der eigenen Website tatsächlich von der Startseite aus erreichbar sind.
Quellenliste eines Fachartikels zusammenstellen
Ein Redaktionsteam liest die externen Links eines fremden Fachartikels aus, um die verwendeten Quellen für die eigene Recherche nachzuvollziehen.
Häufige Fragen
Werden interne und externe Links getrennt ausgegeben?
Ja, jeder Link ist als intern oder extern gekennzeichnet, je nachdem, ob er auf dieselbe Website oder eine andere Domain zeigt.
Erfasst die Funktion auch Links, die erst nach einem Klick erscheinen?
Nein, erfasst wird das geladene HTML; Verweise, die erst durch eine Interaktion sichtbar werden, bleiben unberücksichtigt.
Wird auch der Linktext mit ausgegeben?
Ja, sofern vorhanden, erscheint zu jedem Link der sichtbare Ankertext.
Warum ist diese Funktion günstiger als ein Screenshot?
Weil kein vollständiger Browser nötig ist, um Links aus dem HTML zu lesen; das senkt Aufwand und Preis gegenüber Funktionen, die eine Seite vollständig rendern.
Was kostet das Auslesen aller Links?
$0.002 pro Anfrage, unabhängig davon, wie viele Links gefunden werden.
Ist für diese Funktion ein Konto erforderlich?
Nein, auch hier gilt: kein Konto, Zahlung direkt pro Anfrage.
Für Entwickler — API-Zugang
Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.
Endpunkt
Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.
Aufruf aus Ihrem Stack
curl -X POST https://api.kit.forhosting.com/web/links \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"url":"https://ejemplo.com"}'const res = await fetch("https://api.kit.forhosting.com/web/links", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"url": "https://ejemplo.com"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/web/links",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"url": "https://ejemplo.com"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/web/links", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"url":"https://ejemplo.com"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"url":"https://ejemplo.com"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/web/links", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Beispiel-Anfrage
{
"url": "https://ejemplo.com"
}Beispiel-Antwort
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "web.links",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.
Preis
Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.
Limits
timeout_sec | 30 |
max_crawl_pages | 25 |
Fehler
| HTTP | Code | Bedeutung |
|---|---|---|
401 | unauthorized | Der API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer). |
402 | insufficient_balance | Ihr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht. |
404 | unknown_type | Unbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog. |
429 | rate_limited | Zu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt. |