ForHosting KIT · Recherche sémantique

Embeddings par lots

Le traitement par lots vectorise une longue liste de textes en une seule demande, au lieu de les envoyer un par un. Vous obtenez pour chaque entrée son embedding, dans le même ordre. C’est la façon pratique d’indexer un catalogue entier, une base d’articles ou un historique de tickets sans écrire de boucle interminable.

● Stablepar requête + par 1 000 tokens$0.002
Utilisez-le depuis WebAPIE-mailApp bientôtTelegram bientôt

Exécutez cette tâche sur nos serveurs, avec votre compte. Les outils gratuits tournent dans votre navigateur ; celui-ci est facturé sur votre solde KIT au prix affiché ci-dessus.

Pourquoi grouper plutôt qu’envoyer à l’unité

Traiter mille fiches une par une, c’est mille allers-retours, mille occasions de perdre le fil si l’une échoue. Le mode par lots regroupe tout en une requête ordonnée : vous fournissez votre liste, KIT renvoie les vecteurs alignés sur vos entrées. Rien à recoller à la main. Pour un catalogue de Menuiserie Rousseau & Fils ou un export de tickets, c’est la différence entre une manipulation d’une minute et un après-midi de bricolage.

Le bon format d’entrée

Chaque élément de la liste doit être un texte autonome et lisible : une fiche produit, un paragraphe d’aide, un avis client. Évitez d’y coller un document brut de dizaines de pages ; découpez-le d’abord en fragments cohérents, car un vecteur résume mal un texte trop long. Une demande accepte jusqu’à 10 000 fragments et 20 000 tokens au total, de quoi couvrir un catalogue de PME en une passe.

Facturation proportionnelle

Vous ne payez pas au nombre de textes mais au volume traité : $0.002 par requête, plus $0.0015 pour 1 000 tokens. Un lot de cinq cents fiches courtes revient à quelques centimes de dollar. Le montant se calcule sur ce que vous envoyez réellement, sans forfait ni ligne fixe mensuelle. Et comme un lot compte pour une seule requête, grouper vos textes réduit aussi le nombre d’appels facturés : c’est plus économique qu’un envoi à l’unité.

Indexer un catalogue complet

Une boutique de mobilier envoie ses 1 200 descriptions produit en un lot. Chaque fiche ressort avec son vecteur, prête à alimenter une recherche par le sens ou un moteur de recommandations sur le site.

Réveiller un historique de support

Studio Lumen SAS vectorise trois ans de tickets d’un coup pour retrouver, plus tard, les demandes déjà résolues qui ressemblent à une nouvelle. L’archive dormante redevient consultable par le sens.

Préparer une analyse d’avis

Une association vectorise les réponses à son questionnaire annuel afin de regrouper ensuite les commentaires par thème. Le lot unique évite de traiter chaque réponse séparément.

Quelle différence avec la vectorisation d’un seul texte ?

Le résultat est identique pour chaque texte ; seul le confort change. Le mode par lots accepte une liste entière en une requête et renvoie les vecteurs dans l’ordre reçu, ce qui vous épargne des centaines d’appels séparés.

Que se passe-t-il si un élément de ma liste pose problème ?

Le lot signale l’entrée en cause au lieu de tout abandonner en silence. Vous voyez laquelle corriger et pouvez la renvoyer seule, sans relancer l’ensemble.

Combien de textes puis-je envoyer en une fois ?

Jusqu’à 10 000 fragments et 20 000 tokens par requête. Au-delà, découpez en plusieurs lots : rien n’empêche d’en enchaîner autant que nécessaire pour couvrir une très grande base.

Mes fichiers sont-ils lisibles par quelqu’un d’autre ?

Vos textes transitent chiffrés jusqu’à nos serveurs et n’y servent qu’à produire vos vecteurs. Ils ne sont ni publiés, ni partagés, ni réemployés pour entraîner un modèle. Une suppression peut être demandée à [email protected].

Quel est le prix pour un gros catalogue ?

Il dépend du volume, pas du nombre d’articles : $0.002 par requête et $0.0015 pour 1 000 tokens. Un catalogue de PME tient souvent en quelques centimes de dollar. Le total s’affiche avant lancement.

Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.

POSThttps://api.kit.forhosting.com/search/embed-batch

Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.

curl -X POST https://api.kit.forhosting.com/search/embed-batch \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"text":"…"}'
{
  "text": "…"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "search.embed_batch",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.

par requête$0.002
par 1 000 tokens$0.0015

Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.

max_chunks10000
max_tokens20000
HTTPCodeSignification
401unauthorizedClé API absente ou invalide : vérifiez l’en-tête Authorization.
402insufficient_balanceSolde insuffisant : rechargez votre compte pour lancer cette tâche.
404unknown_typeType de tâche inconnu : vérifiez le champ type de votre requête.
429rate_limitedTrop de requêtes : ralentissez la cadence, puis réessayez.

Consulter la documentation complète du KIT →