ForHosting KIT · Text & KI

Textähnlichkeit berechnen

Die Funktion vergleicht zwei Texte und liefert einen Ähnlichkeitswert zwischen 0 und 1, der beschreibt, wie inhaltlich nah sie beieinanderliegen – unabhängig davon, ob dieselben Wörter verwendet werden. Sie richtet sich an alle, die doppelte oder nahezu gleiche Inhalte automatisiert erkennen wollen.

● Stabilpro Anfrage + pro Paar$0.002
Nutzen Sie es über WebAPIE-MailApp baldTelegram bald

Führen Sie dies mit Ihrem Konto auf unseren Servern aus. Kostenlose Tools laufen in Ihrem Browser; dieses wird zum oben genannten Preis von Ihrem KIT-Guthaben abgebucht.

Was der Wert bedeutet

Ein Wert nahe 1 bedeutet, dass beide Texte inhaltlich fast dasselbe aussagen, auch wenn die Formulierung unterschiedlich ist. Ein Wert nahe 0 bedeutet inhaltliche Distanz, unabhängig davon, ob einzelne Wörter zufällig übereinstimmen. Anders als ein reiner Wortvergleich erkennt dieses Verfahren auch Umformulierungen und Synonyme als inhaltlich ähnlich, statt nur identische Zeichenfolgen zu zählen, was gerade bei frei formulierten Texten den Unterschied macht.

Wie das technisch funktioniert

Im Hintergrund wandelt das Verfahren jeden Text in einen numerischen Vektor um, der die Bedeutung erfasst, und misst den Abstand zwischen beiden Vektoren. Dieses Verfahren wird als Embedding bezeichnet und ist derselbe Mechanismus, der auch semantischer Suche zugrunde liegt, hier jedoch auf genau ein Textpaar angewendet, statt auf einen ganzen Index von Dokumenten, wie es bei der Suche über viele Dokumente hinweg der Fall wäre.

Typische Einsatzfelder

Unternehmen nutzen den Ähnlichkeitswert, um doppelte Einträge in einer FAQ-Sammlung zu finden, zwei Versionen einer Produktbeschreibung miteinander zu vergleichen oder zu prüfen, ob eine eingereichte Bewerbung inhaltlich zur Stellenausschreibung passt, bevor eine Vorauswahl der Bewerbungen beginnt. Auch beim Zusammenführen zweier Kundenlisten hilft der Wert, nahezu gleiche Einträge zu erkennen, die sich nur in Schreibweise oder Reihenfolge unterscheiden, aber inhaltlich denselben Sachverhalt beschreiben.

Wo Sie es nutzen

Die Hauptoberfläche ist diese Webseite: beide Texte einfügen, Ähnlichkeitswert erhalten, ohne Anmeldung. Dieselbe Funktion steht auch per API bereit, für alle, die viele Textpaare automatisiert prüfen, und bald zusätzlich über App und E-Mail. Es handelt sich nicht um „eine API“, sondern um ein Werkzeug für mehrere Kanäle, unabhängig davon, wie viele Textpaare Sie regelmäßig prüfen oder wie Ihr Katalog organisiert ist.

Doppelte FAQ-Einträge finden

Die Bäckerei Hoffmann e. K. prüft zwei ähnlich klingende Fragen in der eigenen FAQ-Sammlung auf inhaltliche Nähe, bevor eine der beiden Fragen entfernt wird.

Bewerbung gegen Stellenausschreibung

Anna Hoffmann vergleicht den Text einer eingereichten Bewerbung mit der ursprünglichen Stellenausschreibung, um vor dem Vorstellungsgespräch einen ersten Anhaltspunkt zur inhaltlichen Passung zu erhalten.

Zwei Produktbeschreibungen abgleichen

Lukas Fischer prüft, ob eine neu formulierte Produktbeschreibung inhaltlich noch mit der ursprünglichen Fassung übereinstimmt, nachdem ein Kollege den Text überarbeitet hat.

Was genau bedeutet der Zahlenwert?

Ein Wert zwischen 0 und 1, wobei 1 für inhaltlich nahezu identisch steht und 0 für keinerlei inhaltliche Nähe. Werte dazwischen zeigen eine graduelle Ähnlichkeit.

Erkennt das Verfahren auch Umformulierungen als ähnlich?

Ja, das ist der zentrale Unterschied zu einem reinen Wortvergleich. Zwei Sätze mit völlig anderen Wörtern, aber gleicher Aussage, erhalten trotzdem einen hohen Ähnlichkeitswert.

Was passiert mit den eingefügten Texten?

Sie werden ausschließlich zur Berechnung des Werts verarbeitet und danach nicht dauerhaft gespeichert. Ein Konto ist dafür nicht erforderlich.

Was kostet die Berechnung genau?

$0.002 pro Anfrage zuzüglich $0.0015 pro verglichenem Textpaar. Der Vergleich von zehn Textpaaren kostet damit deutlich unter zwei US-Cent Verarbeitungskosten.

Kann ich mehrere Textpaare auf einmal prüfen?

Ja, mehrere Paare lassen sich nacheinander einreichen; jedes Paar wird einzeln abgerechnet und einzeln ausgewertet.

Brauche ich ein Konto?

Nein. Es gibt derzeit keine Konten – Sie zahlen pro Anfrage, direkt und ohne Registrierung.

Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.

POSThttps://api.kit.forhosting.com/text/semantic-similarity

Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.

curl -X POST https://api.kit.forhosting.com/text/semantic-similarity \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"input":"…"}'
{
  "input": "…"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "text.semantic_similarity",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.

pro Anfrage$0.002
pro Paar$0.0015

Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.

max_tokens20000
HTTPCodeBedeutung
401unauthorizedDer API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer).
402insufficient_balanceIhr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht.
404unknown_typeUnbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog.
429rate_limitedZu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt.

Vollständige KIT-Dokumentation lesen →