Tri d'emails privé par IA : quelles données restent locales
Le problème : tu veux un tri par IA, mais pas une boîte noire
Le tri sémantique des emails a besoin d’un modèle IA pour vraiment lire ton courrier — ce n’est pas optionnel, c’est comme ça que ça marche. Ce qui est optionnel, c’est de savoir ce que ça implique pour tes données. La plupart des concurrents dans ce domaine sont cloud uniquement, IA boîte noire — ils ne disent pas ce qui est envoyé où ni combien de temps c’est conservé, donc tu te retrouves à chaque fois avec la même question ouverte : que se passe-t-il réellement avec ton courrier une fois classé ? Si tu as évité les outils d’email IA spécifiquement parce que tu ne pouvais pas obtenir de réponse claire à « qu’est-ce qui quitte réellement ma machine », cette prudence est raisonnable — la solution est un outil qui y répond précisément, pas un outil auquel tu dois faire confiance aveuglément.
Pourquoi les filtres classiques ne résolvent pas ça (ils évitent juste la question)
Les règles Sieve et les filtres côté fournisseur sont privés par défaut parce qu’ils sont bêtes — faire correspondre une adresse d’expéditeur ou un mot-clé d’objet se passe localement et n’a jamais besoin de comprendre le sens. Cette confidentialité est un effet secondaire du fait que le filtre est incapable de faire du tri sémantique, pas un choix de conception. Dès que tu veux un filtre qui comprend « ceci est un argumentaire de vente » par opposition à « ceci est un·e collègue », quelque chose doit évaluer le sens, et ce quelque chose est un LLM. La vraie question n’est pas de savoir s’il faut impliquer un LLM — c’est exactement ce que tu lui envoies et ce qui arrive à ces données ensuite.
Ce qui se passe réellement avec tes données
Voici la réponse précise, pas un résumé vague de politique de confidentialité. Pour la classification, AI Email Filter envoie l’objet, l’expéditeur et un court aperçu du corps au LLM — pas l’email complet. Le stockage à long terme ne conserve que des données d’en-tête : objet, expéditeur, date et catégorie choisie, pour que l’onglet Historique puisse montrer ce qui s’est passé et te laisser l’annuler. Le corps complet de l’email n’est jamais conservé nulle part.
Quelques-uns des vrais prompts de catégorie montrent à quel point la classification a peu besoin de contexte en pratique :
- « Des personnes que je connais personnellement ou à qui j’ai déjà écrit » — une décision prise à partir de l’expéditeur et d’un contact antérieur, pas d’une lecture approfondie du contenu du message.
- « Démarchage à froid, spam LinkedIn, ou quelqu’un qui essaie de me vendre quelque chose » — identifiable à partir de l’objet et d’un aperçu, sans avoir besoin du texte complet du corps.
Si même ce court aperçu envoyé à une API tierce est plus que ce que tu souhaites, votre propre LLM te permet de pointer la classification vers une instance Ollama locale à la place. Avec un modèle local, aucun contenu d’email ne quitte du tout ta propre infrastructure — la classification se fait sur du matériel que tu contrôles, pas sur les serveurs d’un fournisseur.
D’où vient la piste d’audit
La raison pour laquelle quoi que ce soit est stocké à long terme est l’historique et l’annulation en un clic — chaque déplacement, marquage, transfert ou suppression est journalisé pour que tu puisses voir ce que l’IA a fait et l’annuler. Ce journal n’a besoin que des données d’en-tête (ce qui s’est passé, quand, sur quel message) pour fonctionner ; il n’a pas besoin du corps de l’email, ce qui explique exactement pourquoi le corps n’est pas conservé. Rien de ce que fait AI Email Filter n’est définitif ou silencieux — chaque action est visible et réversible depuis ce journal.
FAQ
Quelles données exactes sont envoyées au LLM lors de la classification d’un email ?
L’objet, l’expéditeur et un court aperçu du corps — pas le contenu complet de l’email. C’est le minimum nécessaire pour que les prompts de catégorie évaluent de quoi parle un email.
Le corps complet de l’email est-il stocké quelque part après la classification ?
Non. Le stockage à long terme se limite aux données d’en-tête — objet, expéditeur, date et catégorie assignée — conservées pour que l’onglet Historique puisse afficher et annuler les actions passées. Le corps complet n’est jamais conservé.
Puis-je éviter complètement d’envoyer quoi que ce soit à une API IA tierce ?
Oui, avec votre propre LLM pointé vers une instance Ollama locale. Dans cette configuration, la classification tourne sur ton propre matériel et aucun contenu d’email ne quitte ton infrastructure.
Essaie-le avec une visibilité totale sur ce qui est envoyé
AI Email Filter inclut 200 classifications gratuites, sans carte de crédit, pour que tu puisses voir exactement quelles données circulent avant de décider si tu lui fais confiance avec ta vraie boîte. Voir les tarifs pour les plans au-delà du plan gratuit.
Prêt à mettre ta boîte mail en pilote automatique ?
Commencer gratuitement