Stellenanzeige auslesen
Ein Werkzeug, das eine einzelne Stellenanzeige von einer Webseite ausliest – Titel, Standort, Gehaltsangabe, Anstellungsart und die wichtigsten Anforderungen – und als strukturierte Daten liefert. Gedacht für alle, die Stellenanzeigen aus mehreren Quellen zu einer eigenen Übersicht zusammenführen, ohne jede Angabe einzeln von Hand zu übertragen.
Online ausführen
Führen Sie dies mit Ihrem Konto auf unseren Servern aus. Kostenlose Tools laufen in Ihrem Browser; dieses wird zum oben genannten Preis von Ihrem KIT-Guthaben abgebucht.
Was ausgelesen wird
Aus einer Stellenanzeige werden Jobtitel, Unternehmen, Standort, Anstellungsart, Gehaltsangabe, soweit veröffentlicht, sowie die wichtigsten Anforderungen erkannt und als einzelne Felder zurückgegeben. Fehlt eine Angabe, etwa das Gehalt, weil viele deutsche Stellenanzeigen es nicht nennen, wird das Feld leer gelassen statt geraten. So bleibt für jede Anzeige nachvollziehbar, welche Angabe tatsächlich veröffentlicht wurde und welche schlicht fehlt und ungenannt bleibt, ohne nachträglich ergänzt zu werden.
Wofür sich das eignet
Wer Stellenanzeigen aus mehreren Quellen für eine eigene Übersicht, ein Jobportal oder eine interne Auswertung zusammenführen möchte, kann sich damit das manuelle Abtippen jeder einzelnen Anzeige sparen. Auch für die Marktbeobachtung, etwa welche Gehälter für eine bestimmte Position in einer Region üblich sind, eignet sich die strukturierte Erfassung, da sich die Felder anschließend direkt vergleichen lassen, statt jede Anzeige einzeln lesen zu müssen.
Grenzen der Erkennung
Nicht jede Stellenanzeige nennt ein Gehalt oder einen genauen Standort, und diese Lücken lassen sich aus dem Text nicht zuverlässig ergänzen, ohne etwas zu erfinden. Anzeigen als eingebettetes PDF-Dokument statt als Text auf der Seite werden nicht erkannt; dafür eignet sich eine eigene Texterkennung, die auf gescannte oder eingebettete Dokumente spezialisiert ist. Bei klar formatierten HTML-Anzeigen ist das Ergebnis dagegen zuverlässig.
Kanäle und Preis
Auf dieser Seite genügt die Eingabe der URL der Stellenanzeige, das Ergebnis erscheint im Browser. Über die API lässt sich die Extraktion für viele Anzeigen gleichzeitig automatisieren, etwa für ein eigenes Jobportal. Der Preis liegt bei $0.046 pro Anfrage, zuzüglich $0.0145 je 1.000 Token der Analyse, unabhängig von der Zahl der gefundenen Felder. Ein Konto ist für keinen der beiden Wege nötig.
Anwendungsfälle
Zusammenführung mehrerer Jobportale
Eine Personalabteilung führt Stellenanzeigen von drei verschiedenen Jobportalen in einer einzigen internen Übersicht zusammen, um Doppelungen zu vermeiden.
Marktbeobachtung für Gehälter
Vor einer Gehaltsverhandlung sammelt Lukas Fischer veröffentlichte Gehaltsangaben vergleichbarer Stellenanzeigen in seiner Region, um eine realistische Vorstellung zu bekommen.
Import in ein eigenes Bewerbermanagement
Ein Unternehmen überträgt bestehende Stellenanzeigen von der eigenen Karriereseite automatisch in ein neues Bewerbermanagement-System, statt sie manuell neu anzulegen.
Wettbewerbsbeobachtung im Recruiting
Eine Personalabteilung prüft regelmäßig, welche neuen Positionen ein Wettbewerber ausschreibt, um die eigene Recruiting-Strategie danach auszurichten.
Häufige Fragen
Was passiert, wenn kein Gehalt angegeben ist?
Das entsprechende Feld bleibt leer. Viele deutsche Stellenanzeigen nennen kein Gehalt, und das Werkzeug ergänzt keine geschätzten Werte.
Funktioniert das auch bei Stellenanzeigen als PDF-Dokument?
Nein, erkannt wird nur Text im HTML der Seite. Eine Anzeige als eingebettetes PDF-Dokument benötigt eine separate Texterkennung.
Was kostet eine Extraktion?
$0.046 pro Anfrage, zuzüglich $0.0145 je 1.000 Token der Analyse.
Was bedeutet Beta bei dieser Funktion?
Dass die Erkennung bei ungewöhnlich aufgebauten Stellenanzeigen noch nicht immer vollständig ist. Bei klar strukturierten Anzeigen ist das Ergebnis in der Regel zuverlässig.
Werden die Daten der geprüften Seite gespeichert?
Die Seite wird zur Extraktion geladen und danach nicht dauerhaft gespeichert.
Brauche ich ein Konto?
Nein, es gibt derzeit keine Konten. Sie zahlen jede Anfrage einzeln, direkt über PayPal.
Für Entwickler — API-Zugang
Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.
Endpunkt
Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.
Aufruf aus Ihrem Stack
curl -X POST https://api.kit.forhosting.com/web/job-extract \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"url":"https://ejemplo.com"}'const res = await fetch("https://api.kit.forhosting.com/web/job-extract", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"url": "https://ejemplo.com"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/web/job-extract",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"url": "https://ejemplo.com"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/web/job-extract", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"url":"https://ejemplo.com"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"url":"https://ejemplo.com"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/web/job-extract", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Beispiel-Anfrage
{
"url": "https://ejemplo.com"
}Beispiel-Antwort
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "web.job_extract",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.
Preis
Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.
Limits
timeout_sec | 30 |
max_crawl_pages | 25 |
Fehler
| HTTP | Code | Bedeutung |
|---|---|---|
401 | unauthorized | Der API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer). |
402 | insufficient_balance | Ihr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht. |
404 | unknown_type | Unbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog. |
429 | rate_limited | Zu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt. |
422 | task_failed | Die Aufgabe ist fehlgeschlagen und wird nicht berechnet. |