ForHosting KIT · Semantische Suche

Eigene Texte durchsuchbar machen

KIT zerlegt eigene Texte in Abschnitte, wandelt sie in Embeddings um und legt sie in einem durchsuchbaren Index ab. Gedacht für alle, die eine eigene Sammlung an Notizen, Artikeln oder Dokumentationen aufbauen wollen, über die sich anschließend inhaltlich statt nur nach Stichwort suchen lässt.

● Stabilpro Anfrage + pro 1.000 Chunks$0.002
Nutzen Sie es über WebAPIE-MailApp baldTelegram bald

Führen Sie dies mit Ihrem Konto auf unseren Servern aus. Kostenlose Tools laufen in Ihrem Browser; dieses wird zum oben genannten Preis von Ihrem KIT-Guthaben abgebucht.

Was Indexieren bedeutet

Ein einzelner langer Text lässt sich schlecht durchsuchen; deshalb zerlegt KIT ihn zunächst in kleinere Abschnitte, sogenannte Chunks, und berechnet für jeden Abschnitt ein eigenes Embedding. Diese Sammlung aus Abschnitten und den dazugehörigen Vektoren bildet den Index, über den später gesucht wird. Je feiner die Zerlegung, desto präziser lässt sich später ein einzelner passender Abschnitt statt eines ganzen Dokuments finden.

Wie Sie einen Index aufbauen

Sie senden den Text per API oder fügen ihn auf dieser Seite ein; KIT übernimmt die Zerlegung in Abschnitte automatisch, mit einer sinnvollen Standardlänge pro Chunk. Der fertige Index steht anschließend für die Funktion zur semantischen Suche bereit und lässt sich jederzeit um weitere Texte ergänzen, ohne die bereits vorhandenen Abschnitte neu berechnen zu müssen, was den laufenden Ausbau einer Wissensbasis deutlich vereinfacht.

Preis nach Textmenge

$0.002 pro Anfrage plus $0.0015 je 1.000 Chunks. Ein Text, der in 200 Abschnitte zerlegt wird, kostet damit rund $0.0023 – deutlich weniger als eine manuell aufgebaute Stichwortliste. Der Preis richtet sich allein nach der Zahl der entstandenen Abschnitte, nicht nach der ursprünglichen Textlänge in Zeichen, weshalb sich auch sehr umfangreiche Dokumentensammlungen kalkulierbar indexieren lassen. Auch bei sehr unterschiedlich langen Texten bleibt die Abrechnung dadurch nachvollziehbar.

Grenzen des Index

Ein Index fasst bis zu 10.000 Chunks; für größere Sammlungen empfiehlt sich eine Aufteilung in mehrere Indizes nach Thema oder Abteilung. Der Index selbst beantwortet keine Fragen – dafür ist die Funktion zur Fragenbeantwortung über eigene Dokumente gedacht, die auf demselben Index aufbaut. Ein Index ohne Inhalte liefert entsprechend auch keine sinnvollen Suchergebnisse. Erst mit ausreichend Inhalt entfaltet die spätere Suche ihren vollen Nutzen.

Interne Wissensdatenbank

Ein Handwerksbetrieb aus Stuttgart indexiert seine internen Arbeitsanweisungen, damit Mitarbeitende sie später über eine Suchleiste statt über einen Ordnerbaum finden.

Notizsammlung eines Beraters

Ein selbstständiger Berater indexiert Jahre an Gesprächsnotizen, um sie später inhaltlich zu durchsuchen, statt jede Datei einzeln zu öffnen.

FAQ-Sammlung für den Support

Ein Softwareunternehmen indexiert seine gesammelten Support-Antworten als Grundlage für eine spätere semantische Suche im Kundenservice.

Was kostet das Indexieren von 5.000 Textabschnitten?

$0.002 pro Anfrage plus $0.0015 je 1.000 Chunks, bei 5.000 Chunks also rund $0.0095.

Wie groß darf ein Index werden?

Bis zu 10.000 Chunks pro Index; für größere Sammlungen empfiehlt sich eine Aufteilung nach Thema.

Zerlegt KIT den Text automatisch in Abschnitte?

Ja, die Zerlegung in Chunks erfolgt automatisch mit einer sinnvollen Standardlänge; eine eigene Aufteilung lässt sich per API vorgeben.

Was passiert mit meinen Texten?

Sie werden im Index gespeichert, damit die semantische Suche darauf zugreifen kann, und nicht an Dritte weitergegeben.

Brauche ich ein Konto?

Nein. Es gibt derzeit keine Konten – Sie zahlen pro Nutzung.

Kann ich Texte später aus dem Index entfernen?

Ja, einzelne Abschnitte lassen sich per API gezielt löschen oder aktualisieren.

Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.

POSThttps://api.kit.forhosting.com/search/index-text

Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.

curl -X POST https://api.kit.forhosting.com/search/index-text \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"text":"…"}'
{
  "text": "…"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "search.index_text",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.

pro Anfrage$0.002
pro 1.000 Chunks$0.0015

Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.

max_chunks10000
max_tokens20000
HTTPCodeBedeutung
401unauthorizedDer API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer).
402insufficient_balanceIhr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht.
404unknown_typeUnbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog.
429rate_limitedZu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt.

Vollständige KIT-Dokumentation lesen →