Viele Texte auf einmal umwandeln
KIT wandelt eine ganze Liste von Texten in einem einzigen Durchgang in Embeddings um, statt jeden Text einzeln als eigene Anfrage zu verarbeiten. Gedacht für alle, die eine größere Menge an Produktbeschreibungen, Support-Artikeln oder Dokumentabschnitten auf einmal für die semantische Suche vorbereiten wollen, ohne dabei Hunderte einzelne Anfragen verwalten zu müssen.
Online ausführen
Führen Sie dies mit Ihrem Konto auf unseren Servern aus. Kostenlose Tools laufen in Ihrem Browser; dieses wird zum oben genannten Preis von Ihrem KIT-Guthaben abgebucht.
Warum ein Batch statt Einzelanfragen
Wer Hunderte oder Tausende Texte in Embeddings umwandeln will, spart sich mit einer Stapelverarbeitung die Verwaltung vieler Einzelanfragen: Sie senden eine Liste von Texten und erhalten eine Liste von Vektoren zurück, in genau derselben Reihenfolge. Das vereinfacht vor allem den erstmaligen Aufbau einer Wissensbasis, bei dem sonst Hunderte einzelne Anfragen nacheinander gestellt und ausgewertet werden müssten. Vor allem bei einem ersten großen Import macht das einen spürbaren Unterschied.
Ablauf einer Stapelverarbeitung
Sie laden die Textliste per API hoch oder fügen sie auf dieser Seite ein; die Aufgabe läuft asynchron und liefert sofort eine Vorgangsnummer zurück. Sobald alle Texte verarbeitet sind, steht das vollständige Ergebnis zum Abruf bereit oder wird per Webhook zugestellt. Bei einer sehr langen Liste kann die Verarbeitung mehrere Minuten dauern, da jeder einzelne Text ein eigenes Embedding erhält.
Preis und Grenzen
Der Preis richtet sich nach der Gesamtmenge an Token über alle Texte hinweg: $0.002 pro Anfrage plus $0.0015 je 1.000 Token, unabhängig davon, ob es sich um zehn oder tausend einzelne Texte handelt. Pro Anfrage verarbeitet KIT bis zu 20.000 Token insgesamt; wer mehr Text auf einmal verarbeiten möchte, teilt die Liste auf mehrere Anfragen auf. So bleiben die Kosten in jedem Fall genau vorhersehbar.
Wann sich der Batch lohnt
Bei wenigen Texten reicht die einfache Umwandlung völlig aus; sobald aber ein Produktkatalog, ein Archiv oder eine FAQ-Sammlung auf einmal vorbereitet werden soll, spart die Stapelverarbeitung deutlich Zeit und Verwaltungsaufwand gegenüber vielen einzelnen Anfragen. Gerade beim erstmaligen Aufbau einer Wissensbasis mit mehreren hundert Dokumenten macht dieser Unterschied den Prozess erst praktikabel, statt tagelang einzelne Anfragen von Hand abzuarbeiten. Der Unterschied wird mit wachsender Textmenge immer deutlicher spürbar.
Anwendungsfälle
Produktkatalog auf einmal vorbereiten
Weber Metallbau GmbH lässt den gesamten Produktkatalog in einem Durchgang in Embeddings umwandeln, um ihn anschließend durchsuchbar zu machen.
Support-Artikel für eine Wissensbasis
Ein Softwareunternehmen aus München wandelt alle Hilfeartikel gesammelt in Embeddings um, statt jeden Artikel einzeln zu senden.
Archiv digitalisierter Protokolle
Eine Kanzlei verarbeitet ein Archiv aus mehreren hundert Besprechungsprotokollen in einem Batch, um es später nach Themen durchsuchbar zu machen.
Häufige Fragen
Was kostet die Umwandlung von 200 Texten?
Der Preis richtet sich nach der Gesamtzahl der Token, nicht nach der Anzahl der Texte: $0.002 pro Anfrage plus $0.0015 je 1.000 Token über alle Texte zusammen.
Wie viele Texte passen in eine Anfrage?
Begrenzend ist die Tokenzahl, nicht die Textanzahl: bis zu 20.000 Token pro Anfrage, verteilt auf beliebig viele einzelne Texte.
Was passiert, wenn ein einzelner Text in der Liste fehlerhaft ist?
Das Ergebnis weist den fehlerhaften Text aus, ohne die Verarbeitung der übrigen Liste abzubrechen.
Werden meine Texte gespeichert?
Nein, sie dienen ausschließlich der Berechnung der Embeddings für diese eine Anfrage.
Brauche ich ein Konto?
Nein. Es gibt derzeit keine Konten – Sie zahlen pro Nutzung.
Kommt danach automatisch die semantische Suche dazu?
Nein, die Batch-Umwandlung liefert nur die Vektoren; die semantische Suche darüber ist eine eigene Funktion, die auf diesen Embeddings aufbaut.
Für Entwickler — API-Zugang
Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.
Endpunkt
Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.
Aufruf aus Ihrem Stack
curl -X POST https://api.kit.forhosting.com/search/embed-batch \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"text":"…"}'const res = await fetch("https://api.kit.forhosting.com/search/embed-batch", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"text": "…"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/search/embed-batch",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"text": "…"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/search/embed-batch", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"text":"…"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"text":"…"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/search/embed-batch", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Beispiel-Anfrage
{
"text": "…"
}Beispiel-Antwort
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "search.embed_batch",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.
Preis
Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.
Limits
max_chunks | 10000 |
max_tokens | 20000 |
Fehler
| HTTP | Code | Bedeutung |
|---|---|---|
401 | unauthorized | Der API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer). |
402 | insufficient_balance | Ihr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht. |
404 | unknown_type | Unbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog. |
429 | rate_limited | Zu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt. |