Indexer vos textes
Indexer, c’est préparer vos textes pour qu’on puisse les interroger. KIT les découpe en fragments, calcule le vecteur de chacun et les range dans un index prêt à la recherche. Une fois l’index construit, une question exprimée en langage courant retrouve les passages qui répondent au sens, sans dépendre des mots exacts.
Exécuter en ligne
Exécutez cette tâche sur nos serveurs, avec votre compte. Les outils gratuits tournent dans votre navigateur ; celui-ci est facturé sur votre solde KIT au prix affiché ci-dessus.
Ce que veut dire « indexer »
Vectoriser un texte donne un vecteur ; l’indexer va plus loin : KIT conserve ces vecteurs dans une structure conçue pour retrouver, en une fraction de seconde, les plus proches d’une question. C’est la différence entre calculer une empreinte et bâtir la bibliothèque qui la classe. Sans index, chaque recherche recalculerait tout ; avec lui, vos contenus restent prêts à être interrogés autant de fois que vous le souhaitez.
Le découpage en fragments, un choix qui compte
Un texte long est coupé en fragments — quelques phrases chacun — car un vecteur unique résume mal dix pages. La taille des fragments influence la finesse des réponses : trop gros, ils noient l’information ; trop petits, ils perdent le contexte. KIT applique un découpage raisonnable par défaut, adapté à des documents d’aide, des articles ou des procédures internes.
Où se passe le traitement
L’index vit sur nos serveurs : vos textes y sont envoyés, découpés et vectorisés, puis conservés le temps que vous vous en servez. Ce n’est pas un traitement dans le navigateur, et nous préférons le dire franchement. Vos contenus ne nourrissent aucun modèle et restent les vôtres. Vous pouvez faire supprimer un index à tout moment en écrivant à [email protected], et rien de ce que vous indexez n’est partagé avec un tiers.
Le prix, lié au volume indexé
Comptez $0.002 par requête d’indexation et $0.0015 pour 1 000 fragments rangés. Indexer la base d’aide d’une PME — quelques centaines de fragments — coûte donc une poignée de centimes de dollar. Interroger l’index ensuite se facture séparément, à la requête, ce qui vous permet d’étaler la dépense. Aucun abonnement n’est requis : vous payez la construction une fois, puis seulement les recherches que vous lancez réellement.
Cas d’usage
Manuel interne consultable
Menuiserie Rousseau & Fils indexe son manuel de sécurité et ses fiches de poste. Un apprenti demande « que faire si la scie chauffe » et tombe sur le bon paragraphe, sans feuilleter un classeur de cent pages.
Assistance aux clients
Une TPE indexe ses articles d’aide pour offrir une recherche qui comprend les questions mal formulées. « Je n’arrive pas à me connecter » mène à la procédure de réinitialisation, même si l’article ne dit jamais « connexion ».
Mémoire d’une association
Une association indexe ses comptes rendus d’assemblée. Retrouver « la décision sur la cotisation de 2024 » devient immédiat, alors que la recherche par mot-clé imposait de connaître le vocabulaire exact du procès-verbal.
Questions fréquentes
Quelle différence entre vectoriser et indexer ?
Vectoriser produit le vecteur d’un texte, sans le garder. Indexer conserve ces vecteurs dans une structure interrogeable : vous posez ensuite autant de questions que vous voulez sans tout recalculer à chaque fois.
Faut-il découper mes documents moi-même ?
Non. KIT segmente vos textes en fragments cohérents avant de les vectoriser. Vous pouvez fournir des documents entiers ; le découpage est fait pour vous, avec des réglages raisonnables par défaut.
Mon index est-il conforme au RGPD ?
Nous ne vendons pas de certification que nous n’avons pas. Concrètement : vos textes sont traités pour construire et servir votre index, jamais pour entraîner un modèle, et un index se supprime sur demande. Décrivez vos besoins à [email protected] pour cadrer les détails.
Combien de fragments un index peut-il contenir ?
Jusqu’à 10 000 fragments par opération d’indexation ; vous pouvez enchaîner plusieurs opérations pour bâtir un index plus vaste. C’est amplement suffisant pour la documentation d’une PME.
Combien coûte la construction de l’index ?
$0.002 par requête et $0.0015 pour 1 000 fragments, en dollars US. Interroger l’index se paie ensuite à part, par recherche. Tout est affiché avant de lancer.
Puis-je mettre à jour un index existant ?
Oui : vous ajoutez de nouveaux textes au fil de l’eau plutôt que de tout reconstruire. Pratique pour une base d’aide qui grandit chaque mois.
Pour les développeurs — accès API
Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.
Endpoint
Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.
Appeler depuis votre stack
curl -X POST https://api.kit.forhosting.com/search/index-text \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"text":"…"}'const res = await fetch("https://api.kit.forhosting.com/search/index-text", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"text": "…"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/search/index-text",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"text": "…"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/search/index-text", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"text":"…"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"text":"…"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/search/index-text", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Exemple de requête
{
"text": "…"
}Exemple de réponse
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "search.index_text",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.
Tarifs
Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.
Limites
max_chunks | 10000 |
max_tokens | 20000 |
Erreurs
| HTTP | Code | Signification |
|---|---|---|
401 | unauthorized | Clé API absente ou invalide : vérifiez l’en-tête Authorization. |
402 | insufficient_balance | Solde insuffisant : rechargez votre compte pour lancer cette tâche. |
404 | unknown_type | Type de tâche inconnu : vérifiez le champ type de votre requête. |
429 | rate_limited | Trop de requêtes : ralentissez la cadence, puis réessayez. |