ForHosting KIT · Websites auslesen & überwachen

Stellenanzeige auslesen

Ein Werkzeug, das eine einzelne Stellenanzeige von einer Webseite ausliest – Titel, Standort, Gehaltsangabe, Anstellungsart und die wichtigsten Anforderungen – und als strukturierte Daten liefert. Gedacht für alle, die Stellenanzeigen aus mehreren Quellen zu einer eigenen Übersicht zusammenführen, ohne jede Angabe einzeln von Hand zu übertragen.

● Betapro Anfrage + pro URL$0.046
Nutzen Sie es über WebAPIE-MailApp baldTelegram bald

Führen Sie dies mit Ihrem Konto auf unseren Servern aus. Kostenlose Tools laufen in Ihrem Browser; dieses wird zum oben genannten Preis von Ihrem KIT-Guthaben abgebucht.

Was ausgelesen wird

Aus einer Stellenanzeige werden Jobtitel, Unternehmen, Standort, Anstellungsart, Gehaltsangabe, soweit veröffentlicht, sowie die wichtigsten Anforderungen erkannt und als einzelne Felder zurückgegeben. Fehlt eine Angabe, etwa das Gehalt, weil viele deutsche Stellenanzeigen es nicht nennen, wird das Feld leer gelassen statt geraten. So bleibt für jede Anzeige nachvollziehbar, welche Angabe tatsächlich veröffentlicht wurde und welche schlicht fehlt und ungenannt bleibt, ohne nachträglich ergänzt zu werden.

Wofür sich das eignet

Wer Stellenanzeigen aus mehreren Quellen für eine eigene Übersicht, ein Jobportal oder eine interne Auswertung zusammenführen möchte, kann sich damit das manuelle Abtippen jeder einzelnen Anzeige sparen. Auch für die Marktbeobachtung, etwa welche Gehälter für eine bestimmte Position in einer Region üblich sind, eignet sich die strukturierte Erfassung, da sich die Felder anschließend direkt vergleichen lassen, statt jede Anzeige einzeln lesen zu müssen.

Grenzen der Erkennung

Nicht jede Stellenanzeige nennt ein Gehalt oder einen genauen Standort, und diese Lücken lassen sich aus dem Text nicht zuverlässig ergänzen, ohne etwas zu erfinden. Anzeigen als eingebettetes PDF-Dokument statt als Text auf der Seite werden nicht erkannt; dafür eignet sich eine eigene Texterkennung, die auf gescannte oder eingebettete Dokumente spezialisiert ist. Bei klar formatierten HTML-Anzeigen ist das Ergebnis dagegen zuverlässig.

Kanäle und Preis

Auf dieser Seite genügt die Eingabe der URL der Stellenanzeige, das Ergebnis erscheint im Browser. Über die API lässt sich die Extraktion für viele Anzeigen gleichzeitig automatisieren, etwa für ein eigenes Jobportal. Der Preis liegt bei $0.046 pro Anfrage, zuzüglich $0.0145 je 1.000 Token der Analyse, unabhängig von der Zahl der gefundenen Felder. Ein Konto ist für keinen der beiden Wege nötig.

Zusammenführung mehrerer Jobportale

Eine Personalabteilung führt Stellenanzeigen von drei verschiedenen Jobportalen in einer einzigen internen Übersicht zusammen, um Doppelungen zu vermeiden.

Marktbeobachtung für Gehälter

Vor einer Gehaltsverhandlung sammelt Lukas Fischer veröffentlichte Gehaltsangaben vergleichbarer Stellenanzeigen in seiner Region, um eine realistische Vorstellung zu bekommen.

Import in ein eigenes Bewerbermanagement

Ein Unternehmen überträgt bestehende Stellenanzeigen von der eigenen Karriereseite automatisch in ein neues Bewerbermanagement-System, statt sie manuell neu anzulegen.

Wettbewerbsbeobachtung im Recruiting

Eine Personalabteilung prüft regelmäßig, welche neuen Positionen ein Wettbewerber ausschreibt, um die eigene Recruiting-Strategie danach auszurichten.

Was passiert, wenn kein Gehalt angegeben ist?

Das entsprechende Feld bleibt leer. Viele deutsche Stellenanzeigen nennen kein Gehalt, und das Werkzeug ergänzt keine geschätzten Werte.

Funktioniert das auch bei Stellenanzeigen als PDF-Dokument?

Nein, erkannt wird nur Text im HTML der Seite. Eine Anzeige als eingebettetes PDF-Dokument benötigt eine separate Texterkennung.

Was kostet eine Extraktion?

$0.046 pro Anfrage, zuzüglich $0.0145 je 1.000 Token der Analyse.

Was bedeutet Beta bei dieser Funktion?

Dass die Erkennung bei ungewöhnlich aufgebauten Stellenanzeigen noch nicht immer vollständig ist. Bei klar strukturierten Anzeigen ist das Ergebnis in der Regel zuverlässig.

Werden die Daten der geprüften Seite gespeichert?

Die Seite wird zur Extraktion geladen und danach nicht dauerhaft gespeichert.

Brauche ich ein Konto?

Nein, es gibt derzeit keine Konten. Sie zahlen jede Anfrage einzeln, direkt über PayPal.

Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.

POSThttps://api.kit.forhosting.com/web/job-extract

Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.

curl -X POST https://api.kit.forhosting.com/web/job-extract \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"url":"https://ejemplo.com"}'
{
  "url": "https://ejemplo.com"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "web.job_extract",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.

pro Anfrage$0.046
pro URL$0.0145

Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.

timeout_sec30
max_crawl_pages25
HTTPCodeBedeutung
401unauthorizedDer API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer).
402insufficient_balanceIhr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht.
404unknown_typeUnbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog.
429rate_limitedZu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt.
422task_failedDie Aufgabe ist fehlgeschlagen und wird nicht berechnet.

Vollständige KIT-Dokumentation lesen →