ForHosting KIT · Texte et IA

Anonymisation de texte

L’anonymisation transforme un texte pour qu’on ne puisse plus y reconnaître les personnes concernées. Plutôt que de simples marques, elle peut remplacer les données réelles par des valeurs fictives mais cohérentes : un vrai nom devient un faux nom crédible. Le texte reste naturel à lire, mais ne permet plus d’identifier qui que ce soit.

● Stablepar requête + par 1 000 mots$0.003
Utilisez-le depuis WebAPIE-mailApp bientôtTelegram bientôt

Exécutez cette tâche sur nos serveurs, avec votre compte. Les outils gratuits tournent dans votre navigateur ; celui-ci est facturé sur votre solde KIT au prix affiché ci-dessus.

Rendre un texte non ré-identifiable

Anonymiser va plus loin que masquer une donnée çà et là. L’objectif est qu’en lisant le résultat, personne ne puisse remonter aux individus d’origine, même en recoupant les indices. L’outil traite non seulement les identifiants évidents — nom, e-mail, téléphone — mais aussi les détails qui, mis bout à bout, désignent une personne : une fonction rare dans une petite structure, une combinaison de lieu et de date. Le texte garde son sens ; il perd sa capacité à trahir une identité.

Des remplacements cohérents, pas du charabia

Une bonne anonymisation ne pose pas des trous partout. Quand un même nom revient dix fois, il est remplacé partout par le même substitut, pour que le texte reste compréhensible et suivi. Les valeurs de remplacement sont plausibles : un prénom devient un autre prénom, une ville une autre ville. Le lecteur suit toujours l’histoire — qui a dit quoi, qui a fait quoi — sans jamais pouvoir mettre un vrai nom derrière les personnages.

Anonymiser, caviarder ou détecter : bien choisir

Trois besoins voisins, trois outils. La détection repère et liste les données personnelles sans rien changer. Le caviardage les remplace par des étiquettes visibles, [NOM] ou [IBAN], quand il faut prouver qu’une donnée a été retirée. L’anonymisation, elle, vise un texte fluide et non ré-identifiable, idéal pour partager largement. On part toujours du même repérage ; c’est la finalité — auditer, masquer visiblement ou diffuser naturellement — qui dicte l’outil.

Exploiter des textes sans exposer les personnes

Beaucoup de textes utiles contiennent des données qu’on ne peut pas diffuser telles quelles : retours d’enquête, comptes rendus, échanges clients. L’anonymisation permet de les réutiliser — pour une formation, un exemple public, un jeu de test — sans exposer personne. Depuis cette page, vous anonymisez un texte et lisez le résultat ; par API, vous traitez un lot avant réutilisation. Le traitement s’exécute sur nos serveurs, où le texte n’est pas conservé après l’opération.

Partager des verbatims d’enquête

Une association a mené une enquête et veut citer des témoignages dans son rapport public. L’anonymisation remplace les noms et détails identifiants par des équivalents fictifs cohérents : les témoignages restent vivants et lisibles, mais aucun participant ne peut être reconnu par un lecteur.

Constituer un jeu de test réaliste

Une équipe a besoin de données ressemblant à de vrais échanges pour tester un outil, sans manipuler de vraies informations personnelles. En anonymisant des messages réels, elle obtient un jeu crédible — noms plausibles, structure intacte — qui se comporte comme l’original sans risque de fuite.

Illustrer une formation avec de vrais cas

Pour une formation interne, Sophie Nguyen veut s’appuyer sur des dossiers réels plutôt que sur des exemples artificiels. L’anonymisation lui donne des cas authentiques dans leur déroulé, où clients et collègues portent des noms d’emprunt cohérents, utilisables devant un public sans trahir personne.

Quelle différence entre anonymiser et caviarder ?

Le caviardage remplace chaque donnée par une étiquette visible comme [NOM], ce qui montre qu’une information a été retirée. L’anonymisation vise un texte fluide et non ré-identifiable, souvent avec des valeurs fictives cohérentes. On choisit selon qu’on veut prouver le masquage ou diffuser un texte naturel.

Le texte reste-t-il compréhensible ?

Oui, c’est tout l’intérêt. Un même nom est remplacé partout par le même substitut, et les valeurs choisies sont plausibles. Le lecteur suit l’histoire — qui fait quoi — sans pouvoir identifier les vraies personnes.

L’anonymisation traite-t-elle les détails indirects ?

Elle s’attache aussi aux éléments qui identifient par recoupement : une fonction rare, une combinaison de lieu et de date. L’enjeu n’est pas seulement de retirer les noms, mais d’empêcher de remonter à une personne par déduction.

Le résultat est-il garanti irréversible ?

L’anonymisation réduit fortement le risque de ré-identification, mais aucun outil ne peut garantir l’impossible en toutes circonstances. Sur des textes très sensibles, gardez une relecture humaine avant diffusion large.

Combien coûte une anonymisation ?

$0.003 par requête, puis $0.0135 par tranche de 1 000 mots. Le coût dépend de la longueur du texte, s’affiche avant l’envoi et ne suppose aucun abonnement.

Mon texte est-il conservé après traitement ?

Non. L’analyse s’exécute sur nos serveurs le temps de produire la version anonymisée, puis le texte n’est pas conservé et n’est réutilisé pour aucun autre usage.

Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.

POSThttps://api.kit.forhosting.com/text/anonymize

Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.

curl -X POST https://api.kit.forhosting.com/text/anonymize \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"text":"…"}'
{
  "text": "…"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "text.anonymize",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.

par requête$0.003
par 1 000 mots$0.0135

Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.

max_tokens20000
HTTPCodeSignification
401unauthorizedClé API absente ou invalide : vérifiez l’en-tête Authorization.
402insufficient_balanceSolde insuffisant : rechargez votre compte pour lancer cette tâche.
404unknown_typeType de tâche inconnu : vérifiez le champ type de votre requête.
429rate_limitedTrop de requêtes : ralentissez la cadence, puis réessayez.
422task_failedLa tâche a échoué : elle ne vous est pas facturée.

Consulter la documentation complète du KIT →