ForHosting KIT · Semantische Suche

Daten automatisch gruppieren

KIT teilt eine Liste von Texten – etwa Kundenanfragen, Bewertungen oder Produktbeschreibungen – automatisch in Gruppen mit ähnlichem Inhalt ein, ohne dass die Kategorien vorher festgelegt werden müssen. Gedacht für alle, die in großen Datenmengen wiederkehrende Themen finden wollen, ohne jede Zeile einzeln zu lesen und von Hand einzuordnen.

● Stabilpro Anfrage + pro 1.000 Datensätze$0.002
Nutzen Sie es über WebAPIE-MailApp baldTelegram bald

Führen Sie dies mit Ihrem Konto auf unseren Servern aus. Kostenlose Tools laufen in Ihrem Browser; dieses wird zum oben genannten Preis von Ihrem KIT-Guthaben abgebucht.

Wie die Gruppierung funktioniert

KIT berechnet für jede Zeile ein Embedding und fasst Zeilen, deren Embeddings nahe beieinanderliegen, zu einer gemeinsamen Gruppe zusammen. Anders als bei einer klassischen Kategorisierung müssen die Gruppen vorher nicht benannt oder definiert werden – sie ergeben sich aus den Daten selbst. Das eignet sich besonders, wenn noch unklar ist, welche Themen in einer Liste überhaupt vorkommen. Erst die Auswertung der entstandenen Gruppen zeigt, welche Muster tatsächlich vorliegen.

Was Sie als Ergebnis erhalten

Das Ergebnis weist jeder Zeile eine Gruppennummer zu, zusammen mit den Zeilen, die derselben Gruppe zugeordnet wurden. Für jede Gruppe lässt sich anschließend ein passender Name vergeben, etwa anhand eines typischen Beispiels aus der Gruppe oder mithilfe einer eigenen Zusammenfassung der enthaltenen Zeilen. So wird aus einer unsortierten Liste eine übersichtliche Struktur mit klar benannten Themen. Diese Struktur lässt sich anschließend deutlich schneller auswerten als die ursprüngliche Rohliste.

Typische Einsatzfälle

Häufig genutzt wird die Gruppierung, um Tausende offene Kundenanfragen nach Thema zu ordnen, um Produktbewertungen nach häufig genannten Punkten zu bündeln, oder um eine unübersichtliche Liste von Support-Tickets in handhabbare Kategorien zu überführen. Auch bei der ersten Sichtung einer neuen, noch unbekannten Datenquelle hilft die Gruppierung, sich einen schnellen Überblick über die enthaltenen Themen zu verschaffen. Das spart vor allem bei wiederkehrenden Auswertungen erheblichen manuellen Aufwand.

Preis nach Zeilenzahl

$0.002 pro Anfrage plus $0.0015 je 1.000 Zeilen. Eine Liste mit 10.000 Zeilen kostet damit rund $0.017 – deutlich weniger als eine manuelle Sichtung. Der Preis skaliert linear mit der Zeilenzahl, sodass sich auch für sehr große Listen vorab genau berechnen lässt, was die Gruppierung insgesamt kosten wird, bevor die Verarbeitung überhaupt startet. Unerwartete Zusatzkosten entstehen bei dieser Funktion damit praktisch nicht.

Kundenanfragen nach Thema ordnen

Ein Softwareunternehmen gruppiert 8.000 offene Supportanfragen automatisch nach Thema, um zu erkennen, welche Probleme am häufigsten auftreten.

Produktbewertungen bündeln

Ein Online-Shop gruppiert Tausende Kundenbewertungen automatisch, um wiederkehrende Kritikpunkte an einem Produkt zu erkennen.

Ideen aus einer Umfrage sortieren

Ein Unternehmen gruppiert die freien Textantworten einer Mitarbeiterumfrage automatisch nach Thema, statt jede Antwort einzeln zu lesen.

Was kostet die Gruppierung von 10.000 Zeilen?

$0.002 pro Anfrage plus $0.0015 je 1.000 Zeilen, bei 10.000 Zeilen also rund $0.017.

Muss ich die Anzahl der Gruppen vorher festlegen?

Nein, die Anzahl lässt sich optional vorgeben; ohne Vorgabe ermittelt KIT eine sinnvolle Anzahl anhand der Daten.

Benennt KIT die Gruppen automatisch?

Nein, das Ergebnis liefert Gruppennummern und die zugehörigen Zeilen; eine Benennung der Gruppen ist eine eigene Funktion (Textzusammenfassung).

Wie groß darf die Liste sein?

Bis zu 10.000 Zeilen pro Anfrage; für größere Listen empfiehlt sich eine Aufteilung.

Was passiert mit den gesendeten Daten?

Sie werden nur zur Berechnung der Gruppierung verwendet und nicht dauerhaft gespeichert.

Brauche ich ein Konto?

Nein. Es gibt derzeit keine Konten – Sie zahlen pro Nutzung.

Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.

POSThttps://api.kit.forhosting.com/search/cluster

Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.

curl -X POST https://api.kit.forhosting.com/search/cluster \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"text":"…"}'
{
  "text": "…"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "search.cluster",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.

pro Anfrage$0.002
pro 1.000 Datensätze$0.0015

Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.

max_chunks10000
max_tokens20000
HTTPCodeBedeutung
401unauthorizedDer API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer).
402insufficient_balanceIhr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht.
404unknown_typeUnbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog.
429rate_limitedZu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt.

Vollständige KIT-Dokumentation lesen →