Comparatif
Quatre détecteurs. Les mêmes documents.
Comparez la détection sur un corpus commun, puis regardez où vos documents sont traités. Deux critères distincts pour choisir votre outil.
| Détecteur | Rappel strict | Fuites évitées | Faux positifs |
|---|---|---|---|
| Anoni (modèles + règles) | 94,8 % | 99,0 % | 73 |
| openai/privacy-filter (brut) | 67,8 % | 91,9 % | 217 |
| Microsoft Presidio (fr) | 58,6 % | 77,1 % | 356 |
| AInonymizer | 64,4 % | 67,9 % | 143 |
Rappel strict : donnée trouvée dans la bonne catégorie, avec un recouvrement ≥ 66 %. Fuites évitées : part des caractères sensibles couverts, toutes catégories confondues. Ces résultats décrivent ce corpus et ces configurations ; ils ne garantissent pas le résultat sur votre document. Voir la méthode →
Local vs cloud
Anoni traite tout sur votre poste. Un anonymiseur en ligne envoie le texte à un serveur distant.
Validé aussi sur des données indépendantes
Anoni est aussi mesuré sur un corpus indépendant, ai4privacy OpenPII : de la donnée personnelle française réelle, annotée à la main, sous licence libre (CC-BY). Sur 500 documents que nous n’avons pas écrits : 92,7 % de rappel strict et 97,1 % des caractères sensibles couverts.
Questions
Sur le banc synthétique de 210 documents juridiques français (run du 18 juin 2026, même règle de mesure), Anoni atteint 94,8 % de rappel strict contre 58,6 % pour Microsoft Presidio (français).