Extraction d'entités
L’extraction d’entités isole d’un texte les éléments nommés : personnes, entreprises, lieux, organisations, produits. À partir d’un article, d’un contrat ou d’un compte rendu, elle sort une liste structurée de « qui » et « quoi », prête à réutiliser. Elle transforme un texte en continu en données exploitables, sans que vous ayez à surligner à la main.
Exécuter en ligne
Exécutez cette tâche sur nos serveurs, avec votre compte. Les outils gratuits tournent dans votre navigateur ; celui-ci est facturé sur votre solde KIT au prix affiché ci-dessus.
Personnes, organisations, lieux : ce qui est extrait
L’outil parcourt le texte et repère les entités nommées : les personnes citées, les entreprises et institutions, les lieux, parfois les produits ou les montants selon le besoin. Il les classe par type, de sorte que vous obtenez d’un côté les noms de personnes, de l’autre les organisations, ailleurs les lieux. Là où une lecture rapide oublie forcément des mentions, l’extraction les capte toutes, y compris celles enfouies au milieu d’un long paragraphe.
Une liste structurée, prête à réutiliser
Le résultat n’est pas un simple surlignage : c’est une liste organisée, réutilisable telle quelle. On peut la reverser dans un tableau, alimenter une fiche, remplir un champ de base de données. Un compte rendu de réunion devient ainsi la liste nette des participants et des sociétés évoquées ; un contrat, la liste des parties et des lieux. Le texte brut se change en information rangée, exploitable par une personne comme par un programme.
Le sens plutôt que la liste de mots
Extraire des entités ne revient pas à relever les mots qui commencent par une majuscule. L’outil comprend le contexte : il distingue « Orange » l’entreprise du fruit, sait que « Camille Moreau » est une personne et « Atelier Garnier SARL » une société. Il rattache aussi les variantes d’un même nom — « la société », « Garnier », « l’Atelier » — à une seule entité quand le texte le permet. Cette compréhension évite les listes truffées de faux positifs.
Du texte unique au traitement en série
Depuis cette page, vous collez un document et lisez les entités extraites, classées par type. Par API, vous traitez de nombreux textes d’affilée : dépouiller une revue de presse, structurer un lot de comptes rendus, indexer une base documentaire. Les canaux e-mail et messagerie compléteront ces voies. Le moteur d’extraction est identique quel que soit le canal ; le texte est traité sur nos serveurs, puis n’y est pas conservé.
Cas d’usage
Dépouiller un contrat
Face à un contrat de plusieurs pages, Julien Lefèvre veut la liste des parties, des sociétés et des lieux mentionnés. L’extraction d’entités les sort d’un coup, ce qui lui évite de relire tout le document au surligneur pour reconstituer qui est engagé et où.
Analyser une revue de presse
Le Studio Lumen SAS suit ce qui se dit d’un client dans la presse. En extrayant les entités de chaque article, l’agence obtient la liste des personnes, entreprises et lieux cités, et repère d’un coup d’œil qui revient le plus souvent, sans lire chaque texte en entier.
Structurer des comptes rendus de réunion
Une équipe accumule des comptes rendus rédigés au fil de l’eau. L’extraction en tire, pour chacun, la liste des participants et des organisations évoquées, de quoi alimenter un suivi propre sans ressaisir les noms à la main.
Questions fréquentes
Quels types d’entités sont extraits ?
Principalement les personnes, les entreprises et organisations, et les lieux. Selon le besoin, l’outil peut aussi remonter des produits ou d’autres catégories nommées. Chaque entité est classée par type dans le résultat.
Distingue-t-il les homonymes selon le contexte ?
Oui. Il s’appuie sur le sens, pas sur la majuscule : il sait reconnaître une entreprise d’un mot courant identique, et rattacher les variantes d’un même nom à une seule entité quand le texte le permet.
Le résultat est-il réutilisable dans un tableau ?
Oui. L’extraction renvoie une liste structurée, classée par type, que vous pouvez reverser dans un tableau, une fiche ou une base. C’est une donnée rangée, pas un simple surlignage à recopier.
Faut-il extraire aussi les dates ici ?
L’extraction d’entités se concentre sur les noms — personnes, organisations, lieux. Pour lister spécifiquement les échéances et dates d’un texte, un outil dédié à l’extraction de dates est plus précis, et les deux se combinent bien.
Combien coûte une extraction ?
$0.003 par requête, puis $0.0135 par tranche de 1 000 mots. Le coût dépend de la longueur du texte, s’affiche avant l’envoi et ne suppose aucun abonnement.
Mes textes sont-ils conservés ?
Non. Chaque texte est traité sur nos serveurs pour produire la liste des entités, puis n’est pas conservé et n’est réutilisé pour aucun autre usage.
Pour les développeurs — accès API
Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.
Endpoint
Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.
Appeler depuis votre stack
curl -X POST https://api.kit.forhosting.com/text/extract-entities \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"text":"…"}'const res = await fetch("https://api.kit.forhosting.com/text/extract-entities", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"text": "…"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/text/extract-entities",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"text": "…"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/text/extract-entities", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"text":"…"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"text":"…"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/text/extract-entities", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Exemple de requête
{
"text": "…"
}Exemple de réponse
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "text.extract_entities",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.
Tarifs
Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.
Limites
max_tokens | 20000 |
Erreurs
| HTTP | Code | Signification |
|---|---|---|
401 | unauthorized | Clé API absente ou invalide : vérifiez l’en-tête Authorization. |
402 | insufficient_balance | Solde insuffisant : rechargez votre compte pour lancer cette tâche. |
404 | unknown_type | Type de tâche inconnu : vérifiez le champ type de votre requête. |
429 | rate_limited | Trop de requêtes : ralentissez la cadence, puis réessayez. |
422 | task_failed | La tâche a échoué : elle ne vous est pas facturée. |