Daten automatisch gruppieren
KIT teilt eine Liste von Texten – etwa Kundenanfragen, Bewertungen oder Produktbeschreibungen – automatisch in Gruppen mit ähnlichem Inhalt ein, ohne dass die Kategorien vorher festgelegt werden müssen. Gedacht für alle, die in großen Datenmengen wiederkehrende Themen finden wollen, ohne jede Zeile einzeln zu lesen und von Hand einzuordnen.
Online ausführen
Führen Sie dies mit Ihrem Konto auf unseren Servern aus. Kostenlose Tools laufen in Ihrem Browser; dieses wird zum oben genannten Preis von Ihrem KIT-Guthaben abgebucht.
Wie die Gruppierung funktioniert
KIT berechnet für jede Zeile ein Embedding und fasst Zeilen, deren Embeddings nahe beieinanderliegen, zu einer gemeinsamen Gruppe zusammen. Anders als bei einer klassischen Kategorisierung müssen die Gruppen vorher nicht benannt oder definiert werden – sie ergeben sich aus den Daten selbst. Das eignet sich besonders, wenn noch unklar ist, welche Themen in einer Liste überhaupt vorkommen. Erst die Auswertung der entstandenen Gruppen zeigt, welche Muster tatsächlich vorliegen.
Was Sie als Ergebnis erhalten
Das Ergebnis weist jeder Zeile eine Gruppennummer zu, zusammen mit den Zeilen, die derselben Gruppe zugeordnet wurden. Für jede Gruppe lässt sich anschließend ein passender Name vergeben, etwa anhand eines typischen Beispiels aus der Gruppe oder mithilfe einer eigenen Zusammenfassung der enthaltenen Zeilen. So wird aus einer unsortierten Liste eine übersichtliche Struktur mit klar benannten Themen. Diese Struktur lässt sich anschließend deutlich schneller auswerten als die ursprüngliche Rohliste.
Typische Einsatzfälle
Häufig genutzt wird die Gruppierung, um Tausende offene Kundenanfragen nach Thema zu ordnen, um Produktbewertungen nach häufig genannten Punkten zu bündeln, oder um eine unübersichtliche Liste von Support-Tickets in handhabbare Kategorien zu überführen. Auch bei der ersten Sichtung einer neuen, noch unbekannten Datenquelle hilft die Gruppierung, sich einen schnellen Überblick über die enthaltenen Themen zu verschaffen. Das spart vor allem bei wiederkehrenden Auswertungen erheblichen manuellen Aufwand.
Preis nach Zeilenzahl
$0.002 pro Anfrage plus $0.0015 je 1.000 Zeilen. Eine Liste mit 10.000 Zeilen kostet damit rund $0.017 – deutlich weniger als eine manuelle Sichtung. Der Preis skaliert linear mit der Zeilenzahl, sodass sich auch für sehr große Listen vorab genau berechnen lässt, was die Gruppierung insgesamt kosten wird, bevor die Verarbeitung überhaupt startet. Unerwartete Zusatzkosten entstehen bei dieser Funktion damit praktisch nicht.
Anwendungsfälle
Kundenanfragen nach Thema ordnen
Ein Softwareunternehmen gruppiert 8.000 offene Supportanfragen automatisch nach Thema, um zu erkennen, welche Probleme am häufigsten auftreten.
Produktbewertungen bündeln
Ein Online-Shop gruppiert Tausende Kundenbewertungen automatisch, um wiederkehrende Kritikpunkte an einem Produkt zu erkennen.
Ideen aus einer Umfrage sortieren
Ein Unternehmen gruppiert die freien Textantworten einer Mitarbeiterumfrage automatisch nach Thema, statt jede Antwort einzeln zu lesen.
Häufige Fragen
Was kostet die Gruppierung von 10.000 Zeilen?
$0.002 pro Anfrage plus $0.0015 je 1.000 Zeilen, bei 10.000 Zeilen also rund $0.017.
Muss ich die Anzahl der Gruppen vorher festlegen?
Nein, die Anzahl lässt sich optional vorgeben; ohne Vorgabe ermittelt KIT eine sinnvolle Anzahl anhand der Daten.
Benennt KIT die Gruppen automatisch?
Nein, das Ergebnis liefert Gruppennummern und die zugehörigen Zeilen; eine Benennung der Gruppen ist eine eigene Funktion (Textzusammenfassung).
Wie groß darf die Liste sein?
Bis zu 10.000 Zeilen pro Anfrage; für größere Listen empfiehlt sich eine Aufteilung.
Was passiert mit den gesendeten Daten?
Sie werden nur zur Berechnung der Gruppierung verwendet und nicht dauerhaft gespeichert.
Brauche ich ein Konto?
Nein. Es gibt derzeit keine Konten – Sie zahlen pro Nutzung.
Für Entwickler — API-Zugang
Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.
Endpunkt
Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.
Aufruf aus Ihrem Stack
curl -X POST https://api.kit.forhosting.com/search/cluster \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"text":"…"}'const res = await fetch("https://api.kit.forhosting.com/search/cluster", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"text": "…"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/search/cluster",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"text": "…"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/search/cluster", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"text":"…"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"text":"…"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/search/cluster", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Beispiel-Anfrage
{
"text": "…"
}Beispiel-Antwort
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "search.cluster",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.
Preis
Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.
Limits
max_chunks | 10000 |
max_tokens | 20000 |
Fehler
| HTTP | Code | Bedeutung |
|---|---|---|
401 | unauthorized | Der API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer). |
402 | insufficient_balance | Ihr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht. |
404 | unknown_type | Unbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog. |
429 | rate_limited | Zu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt. |