ForHosting KIT · Outils pour développeurs

Classez les champs en PII directes, indirectes ou non-PII

Le classificateur de champs PII examine les noms d’un schéma de données et attribue à chacun une catégorie probable : PII directes, PII indirectes ou non-PII.

● BetaGratuit · dans votre navigateur
Utilisez-le depuis WebAPIE-mailTelegramApp bientôt

Il reconnaît des indices courants tels que l’adresse e-mail, le passeport, la date de naissance, le code postal, l’identifiant d’appareil et les indicateurs métier ordinaires. Le résultat fournit une brève justification pour chaque décision ainsi que les totaux par catégorie. Il convient donc à un premier inventaire de confidentialité, à l’examen d’un schéma ou à un contrôle reproductible dans un pipeline de données. Puisqu’il analyse les noms et non les valeurs stockées, il est rapide et déterministe, mais ses conclusions doivent être confrontées au sens et au contenu du jeu réel.

Commencez l’inventaire de confidentialité par le schéma

Une liste de champs est souvent la carte la plus rapidement accessible d’un jeu de données. Envoyez les noms canoniques tels qu’ils figurent dans une base, une définition d’événement, l’en-tête d’une feuille de calcul ou un contrat d’API. Avant de comparer chaque nom à un ensemble d’indices sélectionnés, le classificateur normalise les conventions usuelles : snake case, kebab case, espaces et camel case. Les noms évoquant une adresse e-mail, un numéro de téléphone, un nom complet, un identifiant officiel, un compte bancaire, une carte de paiement, une adresse précise, une adresse IP ou un identifiant biométrique sont signalés comme PII directes probables. Ces champs peuvent généralement désigner une personne sans beaucoup d’attributs complémentaires. La réponse conserve l’orthographe originale, indique la catégorie et explique l’indice à l’origine de la décision. Vous pouvez ainsi la rapprocher facilement d’un export de schéma ou l’intégrer à une feuille de revue. N’envoyez que les noms de champs, jamais d’enregistrements exemples ni de valeurs personnelles. Une liste vide est refusée, car elle ne permet aucun inventaire utile, et chaque élément doit être une chaîne non vide.

Interprétez les PII indirectes selon leur contexte

Les PII indirectes n’identifient pas toujours une personne à elles seules, mais elles peuvent réduire une population ou relier une activité à une personne stable lorsqu’elles sont combinées à d’autres champs. Le classificateur range parmi les PII indirectes probables les noms associés à la date de naissance, l’âge, le genre, une localisation générale, une zone postale, un identifiant d’appareil ou de cookie, un nom de compte, des données professionnelles et des attributs comparables. Cette catégorie invite volontairement à un examen contextuel ; elle ne constitue pas une conclusion juridique. Un code postal dans un tableau statistique national n’a pas le même profil de risque que le même champ placé à côté d’une date de naissance et d’un identifiant de salarié. De même, un identifiant client peut être pseudonyme dans un système et devenir directement attribuable grâce à une table de correspondance ailleurs. Examinez les résultats indirects avec les contrôles d’accès, les clés de jointure, la durée de conservation, la taille de la population et les sources externes disponibles. Les règles déterministes rendent comparables les analyses de versions successives, mais elles ignorent les significations non documentées et ne peuvent établir si certaines combinaisons isolent une personne.

Considérez le résultat comme un signal, jamais comme une preuve

Les noms ne correspondant à aucun indice reconnu sont classés non-PII. Cela signifie uniquement que leur libellé ne révèle aucun signal habituel de confidentialité. Un champ vague comme valeur, charge utile, note, réponse ou données peut encore contenir des informations personnelles. À l’inverse, un champ nommé customer_email peut renfermer un jeton de test plutôt qu’une véritable adresse. Complétez la classification par un profilage des données, une revue documentaire et l’avis des responsables du système. Dans vos automatisations, conservez le résultat avec la version du schéma, soumettez les nouveaux champs directs ou indirects à validation et comparez les totaux lors du contrôle des changements. Cette sortie constitue un contrôle léger avant de partager des extraits, de créer des événements analytiques ou d’approuver une intégration. Elle ne remplace ni une analyse d’impact, ni un conseil juridique, ni une politique propre à une juridiction. L’algorithme n’utilise aucun réseau, modèle, hasard ou horaire actuel : une entrée identique produit donc une sortie identique. Une requête API coûte $0.002, et les justifications facilitent l’audit des décisions fondées sur les règles.

Examinez une migration de base de données

Contrôlez les noms de colonnes avant de déplacer les tables vers un entrepôt et transmettez les champs PII probables au responsable de la confidentialité.

Vérifiez les schémas d’événements analytiques

Repérez les nouveaux champs d’e-mail, d’appareil, de localisation ou d’identifiant utilisateur pendant la revue du contrat d’événements.

Constituez un inventaire de données

Ajoutez au catalogue des étiquettes PII préliminaires et des justifications cohérentes avant une inspection approfondie du contenu.

Les valeurs des champs sont-elles examinées ?

Non. Seuls les noms sont classés ; poursuivez par une inspection du contenu si vous recherchez une confiance supérieure.

Que sont les PII directes ?

Il s’agit ici d’un champ représentant couramment un attribut capable d’identifier ou de contacter directement une personne, comme une adresse e-mail ou un numéro de passeport.

Que sont les PII indirectes ?

C’est un attribut susceptible d’identifier, d’isoler ou de relier une personne lorsqu’il est combiné à d’autres données, comme une date de naissance, un code postal ou un identifiant d’appareil.

Un résultat non-PII peut-il tout de même contenir des données personnelles ?

Oui. Un nom générique ou trompeur peut masquer des valeurs personnelles ; non-PII signifie qu’aucun indice courant n’a été détecté, et non que le contenu est sûr.

Le résultat constitue-t-il une décision juridique ?

Non. Les définitions varient selon la juridiction et le contexte ; servez-vous-en comme premier tri, puis appliquez la politique et les conseils juridiques de votre organisation.

Combien coûte une requête API ?

Chaque requête API coûte $0.002. Les mêmes règles déterministes permettent de vérifier les schémas de manière reproductible.

Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.

POSThttps://api.kit.forhosting.com/security/pii-field-classify

Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.

curl -X POST https://api.kit.forhosting.com/security/pii-field-classify \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"field_names":["customer_email","billing_postcode","order_total"]}'
{
  "field_names": [
    "customer_email",
    "billing_postcode",
    "order_total"
  ]
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "security.pii_field_classify",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.

par requête$0.002

Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.

max_items1000
HTTPCodeSignification
401unauthorizedClé API absente ou invalide : vérifiez l’en-tête Authorization.
402insufficient_balanceSolde insuffisant : rechargez votre compte pour lancer cette tâche.
404unknown_typeType de tâche inconnu : vérifiez le champ type de votre requête.
429rate_limitedTrop de requêtes : ralentissez la cadence, puis réessayez.

Consulter la documentation complète du KIT →