ForHosting KIT · Semantische Suche

Viele Texte auf einmal umwandeln

KIT wandelt eine ganze Liste von Texten in einem einzigen Durchgang in Embeddings um, statt jeden Text einzeln als eigene Anfrage zu verarbeiten. Gedacht für alle, die eine größere Menge an Produktbeschreibungen, Support-Artikeln oder Dokumentabschnitten auf einmal für die semantische Suche vorbereiten wollen, ohne dabei Hunderte einzelne Anfragen verwalten zu müssen.

● Stabilpro Anfrage + pro 1.000 Tokens$0.002
Nutzen Sie es über WebAPIE-MailApp baldTelegram bald

Führen Sie dies mit Ihrem Konto auf unseren Servern aus. Kostenlose Tools laufen in Ihrem Browser; dieses wird zum oben genannten Preis von Ihrem KIT-Guthaben abgebucht.

Warum ein Batch statt Einzelanfragen

Wer Hunderte oder Tausende Texte in Embeddings umwandeln will, spart sich mit einer Stapelverarbeitung die Verwaltung vieler Einzelanfragen: Sie senden eine Liste von Texten und erhalten eine Liste von Vektoren zurück, in genau derselben Reihenfolge. Das vereinfacht vor allem den erstmaligen Aufbau einer Wissensbasis, bei dem sonst Hunderte einzelne Anfragen nacheinander gestellt und ausgewertet werden müssten. Vor allem bei einem ersten großen Import macht das einen spürbaren Unterschied.

Ablauf einer Stapelverarbeitung

Sie laden die Textliste per API hoch oder fügen sie auf dieser Seite ein; die Aufgabe läuft asynchron und liefert sofort eine Vorgangsnummer zurück. Sobald alle Texte verarbeitet sind, steht das vollständige Ergebnis zum Abruf bereit oder wird per Webhook zugestellt. Bei einer sehr langen Liste kann die Verarbeitung mehrere Minuten dauern, da jeder einzelne Text ein eigenes Embedding erhält.

Preis und Grenzen

Der Preis richtet sich nach der Gesamtmenge an Token über alle Texte hinweg: $0.002 pro Anfrage plus $0.0015 je 1.000 Token, unabhängig davon, ob es sich um zehn oder tausend einzelne Texte handelt. Pro Anfrage verarbeitet KIT bis zu 20.000 Token insgesamt; wer mehr Text auf einmal verarbeiten möchte, teilt die Liste auf mehrere Anfragen auf. So bleiben die Kosten in jedem Fall genau vorhersehbar.

Wann sich der Batch lohnt

Bei wenigen Texten reicht die einfache Umwandlung völlig aus; sobald aber ein Produktkatalog, ein Archiv oder eine FAQ-Sammlung auf einmal vorbereitet werden soll, spart die Stapelverarbeitung deutlich Zeit und Verwaltungsaufwand gegenüber vielen einzelnen Anfragen. Gerade beim erstmaligen Aufbau einer Wissensbasis mit mehreren hundert Dokumenten macht dieser Unterschied den Prozess erst praktikabel, statt tagelang einzelne Anfragen von Hand abzuarbeiten. Der Unterschied wird mit wachsender Textmenge immer deutlicher spürbar.

Produktkatalog auf einmal vorbereiten

Weber Metallbau GmbH lässt den gesamten Produktkatalog in einem Durchgang in Embeddings umwandeln, um ihn anschließend durchsuchbar zu machen.

Support-Artikel für eine Wissensbasis

Ein Softwareunternehmen aus München wandelt alle Hilfeartikel gesammelt in Embeddings um, statt jeden Artikel einzeln zu senden.

Archiv digitalisierter Protokolle

Eine Kanzlei verarbeitet ein Archiv aus mehreren hundert Besprechungsprotokollen in einem Batch, um es später nach Themen durchsuchbar zu machen.

Was kostet die Umwandlung von 200 Texten?

Der Preis richtet sich nach der Gesamtzahl der Token, nicht nach der Anzahl der Texte: $0.002 pro Anfrage plus $0.0015 je 1.000 Token über alle Texte zusammen.

Wie viele Texte passen in eine Anfrage?

Begrenzend ist die Tokenzahl, nicht die Textanzahl: bis zu 20.000 Token pro Anfrage, verteilt auf beliebig viele einzelne Texte.

Was passiert, wenn ein einzelner Text in der Liste fehlerhaft ist?

Das Ergebnis weist den fehlerhaften Text aus, ohne die Verarbeitung der übrigen Liste abzubrechen.

Werden meine Texte gespeichert?

Nein, sie dienen ausschließlich der Berechnung der Embeddings für diese eine Anfrage.

Brauche ich ein Konto?

Nein. Es gibt derzeit keine Konten – Sie zahlen pro Nutzung.

Kommt danach automatisch die semantische Suche dazu?

Nein, die Batch-Umwandlung liefert nur die Vektoren; die semantische Suche darüber ist eine eigene Funktion, die auf diesen Embeddings aufbaut.

Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.

POSThttps://api.kit.forhosting.com/search/embed-batch

Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.

curl -X POST https://api.kit.forhosting.com/search/embed-batch \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"text":"…"}'
{
  "text": "…"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "search.embed_batch",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.

pro Anfrage$0.002
pro 1.000 Tokens$0.0015

Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.

max_chunks10000
max_tokens20000
HTTPCodeBedeutung
401unauthorizedDer API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer).
402insufficient_balanceIhr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht.
404unknown_typeUnbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog.
429rate_limitedZu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt.

Vollständige KIT-Dokumentation lesen →