ForHosting KIT · Texte et IA

Similarité sémantique

Cette capacité mesure à quel point deux textes se ressemblent par le sens, et non par les mots. Elle renvoie un score de proximité qui repère les redites, les doublons déguisés ou les réponses équivalentes formulées différemment. Utile pour dédoublonner une liste, rapprocher des questions similaires ou vérifier que deux passages disent la même chose.

● Stablepar requête + par paire$0.002
Utilisez-le depuis WebAPIE-mailApp bientôtTelegram bientôt

Exécutez cette tâche sur nos serveurs, avec votre compte. Les outils gratuits tournent dans votre navigateur ; celui-ci est facturé sur votre solde KIT au prix affiché ci-dessus.

La proximité de sens, pas les mots communs

« Comment réduire un PDF trop lourd ? » et « alléger un fichier PDF pour l’envoyer » ne partagent presque aucun mot, mais expriment le même besoin. La capacité s’appuie sur des représentations vectorielles du sens (embeddings) pour donner à cette paire un score de similarité élevé, là où une comparaison mot à mot les jugerait éloignées. Vous obtenez une valeur chiffrée, exploitable pour trier, regrouper ou filtrer automatiquement selon un seuil que vous fixez.

Un score, à vous d’en faire un seuil

Le résultat est un nombre : plus il est haut, plus les deux textes sont proches par le sens. L’outil ne décide pas à votre place si deux éléments sont « le même » ; il vous donne la mesure, et vous fixez le seuil selon votre usage — strict pour dédoublonner des factures, plus souple pour rapprocher des questions de clients. Cette approche vectorielle est différente d’une lecture par un modèle de langage : elle est rapide, régulière et pensée pour le volume.

Sur cette page et en série

Vous collez deux textes sur cette page et le score s’affiche. Pour comparer des milliers de paires — dédoublonner un fichier clients, apparier des tickets à une base de réponses — la capacité s’appelle en API, avec d’autres canaux à venir. Le tarif est de $0.002 par requête, plus $0.0015 par paire de textes comparée, en dollars US. C’est un prix pensé pour le volume, connu d’avance et sans abonnement.

Dédoublonner une liste de demandes

Studio Lumen SAS reçoit des demandes clients reformulées de mille façons. En comparant les paires, l’équipe regroupe celles qui disent la même chose et traite chaque sujet une seule fois.

Rapprocher une question d’une réponse type

Menuiserie Rousseau & Fils dispose d’une liste de réponses préparées. À chaque nouvelle question, le score indique la réponse type la plus proche par le sens, même si les mots diffèrent.

Vérifier qu’un paragraphe n’est pas un doublon

Nadia Benali contrôle qu’une nouvelle section de documentation ne répète pas une page existante. Un score élevé la met sur la piste d’un contenu redondant à fusionner.

En quoi est-ce différent d’une comparaison mot à mot ?

Un diff classique regarde les caractères ; ici, on mesure la proximité de sens. Deux phrases sans mots communs peuvent obtenir un score élevé si elles expriment la même idée.

Que représente le score renvoyé ?

Une valeur de proximité : plus elle est haute, plus les textes sont proches par le sens. À vous de fixer le seuil à partir duquel vous les considérez équivalents.

Peut-on comparer des textes de langues différentes ?

Oui, dans une certaine mesure : les représentations de sens rapprochent des formulations proches même à travers deux langues, ce qui aide à repérer des équivalences.

Combien coûte une comparaison ?

$0.002 par requête, plus $0.0015 par paire de textes comparée, en dollars US. Le tarif, pensé pour le volume, est affiché avant l’envoi, sans abonnement.

Mes textes sont-ils conservés ?

Non. Ils transitent chiffrés, servent uniquement à calculer le score, puis ne sont rattachés à aucun compte ni réutilisés.

Faut-il créer un compte ?

Il n'y a pas d'offre gratuite — les paliers gratuits sont détournés et ralentissent tout le monde. L'accès fonctionne avec un solde prépayé ForHosting KIT : rechargez à partir de $10.00 (il n'expire jamais) et chaque requête est facturée à son prix publié, donc un appel sans solde renvoie HTTP 402. Pas d'abonnement, pas de jetons, pas de crédits inventés, et une tâche en échec n'est jamais facturée.

Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.

POSThttps://api.kit.forhosting.com/text/semantic-similarity

Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.

curl -X POST https://api.kit.forhosting.com/text/semantic-similarity \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"input":"…"}'
{
  "input": "…"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "text.semantic_similarity",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.

par requête$0.002
par paire$0.0015

Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.

max_tokens20000
HTTPCodeSignification
401unauthorizedClé API absente ou invalide : vérifiez l’en-tête Authorization.
402insufficient_balanceSolde insuffisant : rechargez votre compte pour lancer cette tâche.
404unknown_typeType de tâche inconnu : vérifiez le champ type de votre requête.
429rate_limitedTrop de requêtes : ralentissez la cadence, puis réessayez.

Consulter la documentation complète du KIT →