Textähnlichkeit berechnen
Die Funktion vergleicht zwei Texte und liefert einen Ähnlichkeitswert zwischen 0 und 1, der beschreibt, wie inhaltlich nah sie beieinanderliegen – unabhängig davon, ob dieselben Wörter verwendet werden. Sie richtet sich an alle, die doppelte oder nahezu gleiche Inhalte automatisiert erkennen wollen.
Online ausführen
Führen Sie dies mit Ihrem Konto auf unseren Servern aus. Kostenlose Tools laufen in Ihrem Browser; dieses wird zum oben genannten Preis von Ihrem KIT-Guthaben abgebucht.
Was der Wert bedeutet
Ein Wert nahe 1 bedeutet, dass beide Texte inhaltlich fast dasselbe aussagen, auch wenn die Formulierung unterschiedlich ist. Ein Wert nahe 0 bedeutet inhaltliche Distanz, unabhängig davon, ob einzelne Wörter zufällig übereinstimmen. Anders als ein reiner Wortvergleich erkennt dieses Verfahren auch Umformulierungen und Synonyme als inhaltlich ähnlich, statt nur identische Zeichenfolgen zu zählen, was gerade bei frei formulierten Texten den Unterschied macht.
Wie das technisch funktioniert
Im Hintergrund wandelt das Verfahren jeden Text in einen numerischen Vektor um, der die Bedeutung erfasst, und misst den Abstand zwischen beiden Vektoren. Dieses Verfahren wird als Embedding bezeichnet und ist derselbe Mechanismus, der auch semantischer Suche zugrunde liegt, hier jedoch auf genau ein Textpaar angewendet, statt auf einen ganzen Index von Dokumenten, wie es bei der Suche über viele Dokumente hinweg der Fall wäre.
Typische Einsatzfelder
Unternehmen nutzen den Ähnlichkeitswert, um doppelte Einträge in einer FAQ-Sammlung zu finden, zwei Versionen einer Produktbeschreibung miteinander zu vergleichen oder zu prüfen, ob eine eingereichte Bewerbung inhaltlich zur Stellenausschreibung passt, bevor eine Vorauswahl der Bewerbungen beginnt. Auch beim Zusammenführen zweier Kundenlisten hilft der Wert, nahezu gleiche Einträge zu erkennen, die sich nur in Schreibweise oder Reihenfolge unterscheiden, aber inhaltlich denselben Sachverhalt beschreiben.
Wo Sie es nutzen
Die Hauptoberfläche ist diese Webseite: beide Texte einfügen, Ähnlichkeitswert erhalten, ohne Anmeldung. Dieselbe Funktion steht auch per API bereit, für alle, die viele Textpaare automatisiert prüfen, und bald zusätzlich über App und E-Mail. Es handelt sich nicht um „eine API“, sondern um ein Werkzeug für mehrere Kanäle, unabhängig davon, wie viele Textpaare Sie regelmäßig prüfen oder wie Ihr Katalog organisiert ist.
Anwendungsfälle
Doppelte FAQ-Einträge finden
Die Bäckerei Hoffmann e. K. prüft zwei ähnlich klingende Fragen in der eigenen FAQ-Sammlung auf inhaltliche Nähe, bevor eine der beiden Fragen entfernt wird.
Bewerbung gegen Stellenausschreibung
Anna Hoffmann vergleicht den Text einer eingereichten Bewerbung mit der ursprünglichen Stellenausschreibung, um vor dem Vorstellungsgespräch einen ersten Anhaltspunkt zur inhaltlichen Passung zu erhalten.
Zwei Produktbeschreibungen abgleichen
Lukas Fischer prüft, ob eine neu formulierte Produktbeschreibung inhaltlich noch mit der ursprünglichen Fassung übereinstimmt, nachdem ein Kollege den Text überarbeitet hat.
Häufige Fragen
Was genau bedeutet der Zahlenwert?
Ein Wert zwischen 0 und 1, wobei 1 für inhaltlich nahezu identisch steht und 0 für keinerlei inhaltliche Nähe. Werte dazwischen zeigen eine graduelle Ähnlichkeit.
Erkennt das Verfahren auch Umformulierungen als ähnlich?
Ja, das ist der zentrale Unterschied zu einem reinen Wortvergleich. Zwei Sätze mit völlig anderen Wörtern, aber gleicher Aussage, erhalten trotzdem einen hohen Ähnlichkeitswert.
Was passiert mit den eingefügten Texten?
Sie werden ausschließlich zur Berechnung des Werts verarbeitet und danach nicht dauerhaft gespeichert. Ein Konto ist dafür nicht erforderlich.
Was kostet die Berechnung genau?
$0.002 pro Anfrage zuzüglich $0.0015 pro verglichenem Textpaar. Der Vergleich von zehn Textpaaren kostet damit deutlich unter zwei US-Cent Verarbeitungskosten.
Kann ich mehrere Textpaare auf einmal prüfen?
Ja, mehrere Paare lassen sich nacheinander einreichen; jedes Paar wird einzeln abgerechnet und einzeln ausgewertet.
Brauche ich ein Konto?
Nein. Es gibt derzeit keine Konten – Sie zahlen pro Anfrage, direkt und ohne Registrierung.
Für Entwickler — API-Zugang
Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.
Endpunkt
Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.
Aufruf aus Ihrem Stack
curl -X POST https://api.kit.forhosting.com/text/semantic-similarity \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"input":"…"}'const res = await fetch("https://api.kit.forhosting.com/text/semantic-similarity", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"input": "…"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/text/semantic-similarity",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"input": "…"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/text/semantic-similarity", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"input":"…"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"input":"…"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/text/semantic-similarity", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Beispiel-Anfrage
{
"input": "…"
}Beispiel-Antwort
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "text.semantic_similarity",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.
Preis
Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.
Limits
max_tokens | 20000 |
Fehler
| HTTP | Code | Bedeutung |
|---|---|---|
401 | unauthorized | Der API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer). |
402 | insufficient_balance | Ihr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht. |
404 | unknown_type | Unbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog. |
429 | rate_limited | Zu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt. |