Détection de la langue d'un texte
La détection de langue identifie automatiquement dans quelle langue un texte est écrit, à partir de quelques phrases seulement. Elle renvoie la langue principale — français, anglais, espagnol, arabe et bien d’autres — sous une forme lisible par un humain comme par un programme. Utile pour trier, router ou traduire ensuite un message reçu.
Exécuter en ligne
Exécutez cette tâche sur nos serveurs, avec votre compte. Les outils gratuits tournent dans votre navigateur ; celui-ci est facturé sur votre solde KIT au prix affiché ci-dessus.
Reconnaître une langue à partir de quelques mots
Il suffit de quelques phrases pour que l’outil identifie la langue dominante d’un texte. Il ne se contente pas des langues les plus répandues : il distingue aussi des langues proches qu’un œil non averti confond, comme l’espagnol et le portugais, ou le danois et le norvégien. Le texte lui-même n’a pas besoin d’être correct ni bien ponctué ; la détection fonctionne sur du langage courant, y compris des messages écrits à la va-vite.
Textes courts, mélanges et cas limites
Plus le texte est long, plus la détection est sûre. Sur trois mots, l’ambiguïté existe : « information » s’écrit pareil en français et en anglais. L’outil signale alors la langue la plus probable. Quand un texte mêle deux langues — un e-mail en français avec un paragraphe cité en anglais —, il renvoie la langue principale, celle qui domine. Pour des messages franchement bilingues, c’est le contexte majoritaire qui tranche.
Un résultat exploitable par une machine
La langue détectée est renvoyée sous une forme standard, facile à réutiliser dans un traitement automatique : router un message vers la bonne boîte, choisir la langue d’une réponse, déclencher une traduction. Depuis cette page, vous lisez le résultat à l’écran ; par API, votre système le récupère directement pour enchaîner l’étape suivante. Les canaux e-mail et messagerie compléteront bientôt ces deux voies.
Là où la détection sert vraiment
Un service qui reçoit des messages du monde entier gagne à savoir, avant même de les lire, dans quelle langue ils arrivent. La détection permet de les distribuer aux bonnes personnes, de mesurer la part de chaque langue dans un flux d’avis, ou de n’envoyer à la traduction que ce qui n’est pas déjà en français. C’est une brique simple qui débloque tout un tri en amont.
Cas d’usage
Router les messages d’un support multilingue
Le Studio Lumen SAS reçoit des demandes de clients étrangers. Avant de les répartir, l’équipe fait passer chaque message par la détection de langue : les demandes en anglais partent vers la personne qui répond en anglais, les autres sont mises de côté pour traduction. Le tri se fait en amont, sans ouvrir chaque message.
Trier une pile de candidatures
Une petite entreprise reçoit des CV et lettres dans plusieurs langues pour un poste ouvert à l’international. La détection identifie la langue de chaque document pour les regrouper, et repérer d’un coup ceux rédigés en français, à traiter en priorité.
Ne traduire que ce qui doit l’être
Sur un flux d’avis clients, une partie est déjà en français. Détecter la langue de chaque avis évite d’envoyer inutilement à la traduction ceux qui n’en ont pas besoin — et de payer pour rien.
Questions fréquentes
Combien de texte faut-il pour une détection fiable ?
Quelques phrases suffisent en général. Sur un ou deux mots, l’ambiguïté augmente et l’outil renvoie la langue la plus probable. Plus le texte est long, plus le résultat est sûr.
Que se passe-t-il si le texte mélange deux langues ?
L’outil renvoie la langue principale, celle qui domine dans le texte. Pour un message franchement bilingue, c’est la part majoritaire qui l’emporte ; la détection n’est pas conçue pour découper le texte langue par langue.
Reconnaît-il les langues proches, comme l’espagnol et le portugais ?
Oui, il distingue ces langues souvent confondues, ainsi que d’autres paires voisines. Sur un texte très court, une confusion reste possible ; elle se réduit dès que le texte s’allonge.
Le texte doit-il être correctement écrit ?
Non. La détection fonctionne sur du langage courant, y compris des messages rédigés vite, mal ponctués ou familiers. Elle ne juge pas la qualité du texte, seulement sa langue.
Combien coûte une détection ?
$0.003 par requête, puis $0.0135 par tranche de 1 000 mots. Comme quelques phrases suffisent, le coût par message reste très faible. Le prix s’affiche avant l’envoi, sans abonnement.
Mes messages sont-ils conservés ?
Non. Chaque texte est traité pour renvoyer la langue, puis n’est pas conservé sur nos serveurs. Il n’est réutilisé pour aucun autre traitement.
Pour les développeurs — accès API
Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.
Endpoint
Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.
Appeler depuis votre stack
curl -X POST https://api.kit.forhosting.com/text/detect-language \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"text":"…"}'const res = await fetch("https://api.kit.forhosting.com/text/detect-language", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"text": "…"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/text/detect-language",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"text": "…"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/text/detect-language", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"text":"…"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"text":"…"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/text/detect-language", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Exemple de requête
{
"text": "…"
}Exemple de réponse
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "text.detect_language",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.
Tarifs
Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.
Limites
max_tokens | 20000 |
Erreurs
| HTTP | Code | Signification |
|---|---|---|
401 | unauthorized | Clé API absente ou invalide : vérifiez l’en-tête Authorization. |
402 | insufficient_balance | Solde insuffisant : rechargez votre compte pour lancer cette tâche. |
404 | unknown_type | Type de tâche inconnu : vérifiez le champ type de votre requête. |
429 | rate_limited | Trop de requêtes : ralentissez la cadence, puis réessayez. |
422 | task_failed | La tâche a échoué : elle ne vous est pas facturée. |