ForHosting KIT · Recherche sémantique

Regroupement de textes

Le clustering range une liste de textes en groupes cohérents, découverts tout seuls. KIT vectorise chaque ligne, puis rassemble celles qui parlent de la même chose. Vous obtenez des familles de sens — les motifs récurrents dans des avis, des réponses à un questionnaire ou des tickets — sans avoir défini de catégories à l’avance.

● Stablepar requête + par 1 000 lignes de données$0.002
Utilisez-le depuis WebAPIE-mailApp bientôtTelegram bientôt

Exécutez cette tâche sur nos serveurs, avec votre compte. Les outils gratuits tournent dans votre navigateur ; celui-ci est facturé sur votre solde KIT au prix affiché ci-dessus.

Des groupes qui émergent des données

À la différence d’un classement où vous imposez les rubriques, le clustering laisse les thèmes apparaître d’eux-mêmes. KIT mesure la proximité de sens entre toutes les lignes et forme des groupes : ici les remarques sur les délais, là celles sur le prix, ailleurs sur l’accueil. Vous découvrez des sujets que vous n’auriez pas pensé à chercher, au lieu de forcer vos textes dans des cases décidées d’avance.

Ce que vous obtenez en sortie

Chaque ligne est rattachée à un groupe, et chaque groupe rassemble des textes de sens voisin. Vous pouvez en tirer un aperçu rapide : combien de retours par thème, quels sujets dominent. C’est une lecture d’ensemble d’un gros volume de verbatims, utile avant d’entrer dans le détail. Le nombre et la finesse des groupes dépendent de la diversité réelle de vos textes.

Un tarif au volume de lignes

Le clustering se facture $0.002 par requête et $0.0015 par tranche de 1 000 lignes traitées, en dollars US. Regrouper les huit cents réponses d’un questionnaire annuel revient donc à quelques centimes de dollar. C’est un traitement d’un bloc, à l’usage, sans abonnement, et le montant s’affiche avant de lancer l’analyse. Vous pouvez relancer un regroupement autant de fois que nécessaire pour affiner votre lecture, en ne payant que le volume réellement traité.

Dépouiller un questionnaire

Une association regroupe les 800 réponses libres de son enquête annuelle. En quelques secondes, les grands thèmes ressortent — horaires, tarifs, communication — au lieu d’une lecture ligne à ligne épuisante.

Comprendre les tickets du support

Studio Lumen SAS passe un trimestre de demandes au clustering et découvre que trois motifs concentrent la moitié des tickets. La priorité de la prochaine fiche d’aide devient évidente.

Analyser des avis clients

Atelier Garnier SARL regroupe les avis laissés sur ses meubles. Les familles « livraison », « montage » et « finition » apparaissent seules, ce qui oriente les améliorations sans trier les commentaires manuellement.

Dois-je définir les thèmes à l’avance ?

Non. C’est toute la différence avec un classement : les groupes se forment à partir du sens des textes, sans catégories imposées. Vous découvrez les thèmes réels de vos données au lieu de les présumer.

Combien de textes puis-je regrouper d’un coup ?

Le traitement se compte aux 1 000 lignes et accepte de gros volumes. Pour un questionnaire ou un lot de tickets de PME, tout passe en une seule analyse ; au-delà, on découpe en plusieurs passes.

Comment est fixé le nombre de groupes ?

Il dépend de la diversité de vos textes : des données très variées donnent plus de groupes, des données homogènes en donnent peu. Le regroupement reflète ce que contiennent réellement vos lignes.

Quel est le prix ?

$0.002 par requête et $0.0015 pour 1 000 lignes, en dollars US, sans abonnement. Huit cents réponses coûtent quelques centimes. Le total est affiché avant l’analyse.

Mes verbatims sont-ils conservés ?

Les textes servent au calcul des groupes le temps de l’analyse, puis ne sont pas réutilisés ni versés dans l’entraînement d’un modèle. Si vos réponses contiennent des données personnelles, pensez à les anonymiser en amont.

Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.

POSThttps://api.kit.forhosting.com/search/cluster

Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.

curl -X POST https://api.kit.forhosting.com/search/cluster \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"text":"…"}'
{
  "text": "…"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "search.cluster",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.

par requête$0.002
par 1 000 lignes de données$0.0015

Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.

max_chunks10000
max_tokens20000
HTTPCodeSignification
401unauthorizedClé API absente ou invalide : vérifiez l’en-tête Authorization.
402insufficient_balanceSolde insuffisant : rechargez votre compte pour lancer cette tâche.
404unknown_typeType de tâche inconnu : vérifiez le champ type de votre requête.
429rate_limitedTrop de requêtes : ralentissez la cadence, puis réessayez.

Consulter la documentation complète du KIT →