Eigene Texte durchsuchbar machen
KIT zerlegt eigene Texte in Abschnitte, wandelt sie in Embeddings um und legt sie in einem durchsuchbaren Index ab. Gedacht für alle, die eine eigene Sammlung an Notizen, Artikeln oder Dokumentationen aufbauen wollen, über die sich anschließend inhaltlich statt nur nach Stichwort suchen lässt.
Online ausführen
Führen Sie dies mit Ihrem Konto auf unseren Servern aus. Kostenlose Tools laufen in Ihrem Browser; dieses wird zum oben genannten Preis von Ihrem KIT-Guthaben abgebucht.
Was Indexieren bedeutet
Ein einzelner langer Text lässt sich schlecht durchsuchen; deshalb zerlegt KIT ihn zunächst in kleinere Abschnitte, sogenannte Chunks, und berechnet für jeden Abschnitt ein eigenes Embedding. Diese Sammlung aus Abschnitten und den dazugehörigen Vektoren bildet den Index, über den später gesucht wird. Je feiner die Zerlegung, desto präziser lässt sich später ein einzelner passender Abschnitt statt eines ganzen Dokuments finden.
Wie Sie einen Index aufbauen
Sie senden den Text per API oder fügen ihn auf dieser Seite ein; KIT übernimmt die Zerlegung in Abschnitte automatisch, mit einer sinnvollen Standardlänge pro Chunk. Der fertige Index steht anschließend für die Funktion zur semantischen Suche bereit und lässt sich jederzeit um weitere Texte ergänzen, ohne die bereits vorhandenen Abschnitte neu berechnen zu müssen, was den laufenden Ausbau einer Wissensbasis deutlich vereinfacht.
Preis nach Textmenge
$0.002 pro Anfrage plus $0.0015 je 1.000 Chunks. Ein Text, der in 200 Abschnitte zerlegt wird, kostet damit rund $0.0023 – deutlich weniger als eine manuell aufgebaute Stichwortliste. Der Preis richtet sich allein nach der Zahl der entstandenen Abschnitte, nicht nach der ursprünglichen Textlänge in Zeichen, weshalb sich auch sehr umfangreiche Dokumentensammlungen kalkulierbar indexieren lassen. Auch bei sehr unterschiedlich langen Texten bleibt die Abrechnung dadurch nachvollziehbar.
Grenzen des Index
Ein Index fasst bis zu 10.000 Chunks; für größere Sammlungen empfiehlt sich eine Aufteilung in mehrere Indizes nach Thema oder Abteilung. Der Index selbst beantwortet keine Fragen – dafür ist die Funktion zur Fragenbeantwortung über eigene Dokumente gedacht, die auf demselben Index aufbaut. Ein Index ohne Inhalte liefert entsprechend auch keine sinnvollen Suchergebnisse. Erst mit ausreichend Inhalt entfaltet die spätere Suche ihren vollen Nutzen.
Anwendungsfälle
Interne Wissensdatenbank
Ein Handwerksbetrieb aus Stuttgart indexiert seine internen Arbeitsanweisungen, damit Mitarbeitende sie später über eine Suchleiste statt über einen Ordnerbaum finden.
Notizsammlung eines Beraters
Ein selbstständiger Berater indexiert Jahre an Gesprächsnotizen, um sie später inhaltlich zu durchsuchen, statt jede Datei einzeln zu öffnen.
FAQ-Sammlung für den Support
Ein Softwareunternehmen indexiert seine gesammelten Support-Antworten als Grundlage für eine spätere semantische Suche im Kundenservice.
Häufige Fragen
Was kostet das Indexieren von 5.000 Textabschnitten?
$0.002 pro Anfrage plus $0.0015 je 1.000 Chunks, bei 5.000 Chunks also rund $0.0095.
Wie groß darf ein Index werden?
Bis zu 10.000 Chunks pro Index; für größere Sammlungen empfiehlt sich eine Aufteilung nach Thema.
Zerlegt KIT den Text automatisch in Abschnitte?
Ja, die Zerlegung in Chunks erfolgt automatisch mit einer sinnvollen Standardlänge; eine eigene Aufteilung lässt sich per API vorgeben.
Was passiert mit meinen Texten?
Sie werden im Index gespeichert, damit die semantische Suche darauf zugreifen kann, und nicht an Dritte weitergegeben.
Brauche ich ein Konto?
Nein. Es gibt derzeit keine Konten – Sie zahlen pro Nutzung.
Kann ich Texte später aus dem Index entfernen?
Ja, einzelne Abschnitte lassen sich per API gezielt löschen oder aktualisieren.
Für Entwickler — API-Zugang
Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.
Endpunkt
Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.
Aufruf aus Ihrem Stack
curl -X POST https://api.kit.forhosting.com/search/index-text \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"text":"…"}'const res = await fetch("https://api.kit.forhosting.com/search/index-text", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"text": "…"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/search/index-text",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"text": "…"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/search/index-text", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"text":"…"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"text":"…"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/search/index-text", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Beispiel-Anfrage
{
"text": "…"
}Beispiel-Antwort
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "search.index_text",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.
Preis
Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.
Limits
max_chunks | 10000 |
max_tokens | 20000 |
Fehler
| HTTP | Code | Bedeutung |
|---|---|---|
401 | unauthorized | Der API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer). |
402 | insufficient_balance | Ihr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht. |
404 | unknown_type | Unbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog. |
429 | rate_limited | Zu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt. |