Similarité sémantique
Cette capacité mesure à quel point deux textes se ressemblent par le sens, et non par les mots. Elle renvoie un score de proximité qui repère les redites, les doublons déguisés ou les réponses équivalentes formulées différemment. Utile pour dédoublonner une liste, rapprocher des questions similaires ou vérifier que deux passages disent la même chose.
Exécuter en ligne
Exécutez cette tâche sur nos serveurs, avec votre compte. Les outils gratuits tournent dans votre navigateur ; celui-ci est facturé sur votre solde KIT au prix affiché ci-dessus.
La proximité de sens, pas les mots communs
« Comment réduire un PDF trop lourd ? » et « alléger un fichier PDF pour l’envoyer » ne partagent presque aucun mot, mais expriment le même besoin. La capacité s’appuie sur des représentations vectorielles du sens (embeddings) pour donner à cette paire un score de similarité élevé, là où une comparaison mot à mot les jugerait éloignées. Vous obtenez une valeur chiffrée, exploitable pour trier, regrouper ou filtrer automatiquement selon un seuil que vous fixez.
Un score, à vous d’en faire un seuil
Le résultat est un nombre : plus il est haut, plus les deux textes sont proches par le sens. L’outil ne décide pas à votre place si deux éléments sont « le même » ; il vous donne la mesure, et vous fixez le seuil selon votre usage — strict pour dédoublonner des factures, plus souple pour rapprocher des questions de clients. Cette approche vectorielle est différente d’une lecture par un modèle de langage : elle est rapide, régulière et pensée pour le volume.
Sur cette page et en série
Vous collez deux textes sur cette page et le score s’affiche. Pour comparer des milliers de paires — dédoublonner un fichier clients, apparier des tickets à une base de réponses — la capacité s’appelle en API, avec d’autres canaux à venir. Le tarif est de $0.002 par requête, plus $0.0015 par paire de textes comparée, en dollars US. C’est un prix pensé pour le volume, connu d’avance et sans abonnement.
Cas d’usage
Dédoublonner une liste de demandes
Studio Lumen SAS reçoit des demandes clients reformulées de mille façons. En comparant les paires, l’équipe regroupe celles qui disent la même chose et traite chaque sujet une seule fois.
Rapprocher une question d’une réponse type
Menuiserie Rousseau & Fils dispose d’une liste de réponses préparées. À chaque nouvelle question, le score indique la réponse type la plus proche par le sens, même si les mots diffèrent.
Vérifier qu’un paragraphe n’est pas un doublon
Nadia Benali contrôle qu’une nouvelle section de documentation ne répète pas une page existante. Un score élevé la met sur la piste d’un contenu redondant à fusionner.
Questions fréquentes
En quoi est-ce différent d’une comparaison mot à mot ?
Un diff classique regarde les caractères ; ici, on mesure la proximité de sens. Deux phrases sans mots communs peuvent obtenir un score élevé si elles expriment la même idée.
Que représente le score renvoyé ?
Une valeur de proximité : plus elle est haute, plus les textes sont proches par le sens. À vous de fixer le seuil à partir duquel vous les considérez équivalents.
Peut-on comparer des textes de langues différentes ?
Oui, dans une certaine mesure : les représentations de sens rapprochent des formulations proches même à travers deux langues, ce qui aide à repérer des équivalences.
Combien coûte une comparaison ?
$0.002 par requête, plus $0.0015 par paire de textes comparée, en dollars US. Le tarif, pensé pour le volume, est affiché avant l’envoi, sans abonnement.
Mes textes sont-ils conservés ?
Non. Ils transitent chiffrés, servent uniquement à calculer le score, puis ne sont rattachés à aucun compte ni réutilisés.
Faut-il créer un compte ?
Il n'y a pas d'offre gratuite — les paliers gratuits sont détournés et ralentissent tout le monde. L'accès fonctionne avec un solde prépayé ForHosting KIT : rechargez à partir de $10.00 (il n'expire jamais) et chaque requête est facturée à son prix publié, donc un appel sans solde renvoie HTTP 402. Pas d'abonnement, pas de jetons, pas de crédits inventés, et une tâche en échec n'est jamais facturée.
Pour les développeurs — accès API
Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.
Endpoint
Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.
Appeler depuis votre stack
curl -X POST https://api.kit.forhosting.com/text/semantic-similarity \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"input":"…"}'const res = await fetch("https://api.kit.forhosting.com/text/semantic-similarity", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"input": "…"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/text/semantic-similarity",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"input": "…"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/text/semantic-similarity", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"input":"…"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"input":"…"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/text/semantic-similarity", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Exemple de requête
{
"input": "…"
}Exemple de réponse
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "text.semantic_similarity",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.
Tarifs
Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.
Limites
max_tokens | 20000 |
Erreurs
| HTTP | Code | Signification |
|---|---|---|
401 | unauthorized | Clé API absente ou invalide : vérifiez l’en-tête Authorization. |
402 | insufficient_balance | Solde insuffisant : rechargez votre compte pour lancer cette tâche. |
404 | unknown_type | Type de tâche inconnu : vérifiez le champ type de votre requête. |
429 | rate_limited | Trop de requêtes : ralentissez la cadence, puis réessayez. |