// Sovereign LLM Filter & Anonymizer

Privacy by default,
not by effort.

SELFA est un proxy local qui s'interpose entre vous et les LLMs. Vos données sensibles sont anonymisées avant l'envoi, et réintégrées à la réception. Le modèle ne voit jamais rien.

Tes données sont ta propriété par défaut. La divulgation est un acte conscient et volontaire.

selfa — pipeline d'anonymisation
1. Requête
2. Anonymisation
3. LLM (tokens)
4. Réintégration
providers : claude · gpt · glm · gemini · mistral · ollama logs : fernet / pbkdf2-sha256 (600k) score : VERT · ORANGE · ROUGE

01 // le problème

Chaque prompt est une divulgation.

Quand votre équipe colle du code, une requête SQL ou un dossier client dans ChatGPT, Claude ou Gemini, ces données quittent votre infrastructure. Elles transitent par des serveurs tiers, alimentent des logs, et échappent à votre contrôle. La protection aujourd'hui repose sur la discipline individuelle — donc sur rien.

$ cat prompt_du_dev.txt

« Optimise cette requête sur db-prod-02.clients_europe avec la clé sk_live_51H7… »

→ Topologie serveur, schéma BDD et secret de production exposés en une phrase.

$ cat prompt_du_rh.txt

« Rédige un courrier pour Marie Dupont, marie.dupont@… concernant son dossier n° 2026-0847 »

→ Données personnelles nominatives envoyées à un processeur tiers sans base contractuelle.

$ cat prompt_du_cto.txt

« Explique ce bug dans notre algorithme de pricing dynamique (méthode brevetée) »

→ Votre avantage compétitif, dicté mot pour mot à un service que vous ne contrôlez pas.

La logique dominante est inversée. Aujourd'hui, protéger ses données face aux LLMs est un effort — opt-in, manuel, faillible. SELFA inverse la charge : la protection devient le défaut, la divulgation devient un choix.

02 // la solution

Un proxy local. Quatre étapes. Zéro fuite.

SELFA tourne sur votre machine ou votre serveur. Il intercepte chaque requête, substitue les données sensibles par des tokens neutres, interroge le LLM de votre choix, puis réintègre les vraies valeurs dans la réponse. Pour vous, rien ne change. Pour le LLM, rien n'est visible.

01

Vous envoyez normalement

Même interface, mêmes habitudes. Aucune friction, aucune formation, aucune discipline requise.

02

SELFA anonymise

Substitution bidirectionnelle par tokens neutres : [SERVER_1], [PERSON_2], [TABLE_3]

03

Le LLM traite les tokens

Claude, GPT, GLM, Gemini, Mistral ou Ollama local ne reçoivent que des tokens dénués de sens.

04

Réintégration transparente

Les vraies valeurs reviennent dans la réponse. Vous pouvez inspecter la version brute avant réintégration.

✗ ce que le LLM recevrait sans SELFA

Connecte-toi à 10.0.0.2 et liste les tables de clients_prod pour luc.yago@yglobal.com

✓ ce que le LLM reçoit avec SELFA

Connecte-toi à [IP_1] et liste les tables de [DB_1] pour [EMAIL_1]

03 // fonctionnalités

Trois périmètres de protection, un seul pipeline.

🖧

IP technique

Adresses serveurs, noms de tables, clés API, topologie d'infrastructure.

⚙️

Propriété intellectuelle

Algorithmes métier, méthodes propriétaires, logique business.

👤

Données personnelles

Noms, emails, données élèves/clients, informations de paiement.

⇄ bidirectionnel

Anonymisation à l'envoi, réintégration à la réception. Le cycle est complet, jamais à sens unique.

◉ transparent

Vous voyez la réponse brute du LLM avant réintégration — détection d'anomalies immédiate.

⛉ chiffré

Logs Fernet / PBKDF2-SHA256 (600 000 itérations). La session_map n'est jamais persistée en clair.

⬡ multi-providers

Claude, GPT, GLM, Gemini, Mistral, Ollama local — interchangeables sans changer votre workflow.

▣ agent souverain

Planification, exécution locale, cache chiffré, mémoire sémantique — tout reste chez vous.

⌗ connecteurs sandboxés

Supabase, GitHub, custom — confinés par whitelist AST et garde réseau.

◈ système de score

VERT auto ORANGE humain ROUGE bloqué

Chaque réintégration est scorée : automatique, soumise à validation humaine, ou bloquée.

✈ gateway telegram

Bot Selfaw, même pipeline. Sur Telegram — un tiers — aucune réintégration : tokens neutres uniquement.

⌂ self-hosted

Tourne sur votre serveur. Vos données ne quittent jamais votre infrastructure. Point.

04 // sécurité éprouvée

Pas une promesse. Une architecture validée.

Un outil de protection doit être plus dur à attaquer que ce qu'il protège. SELFA a été soumis à un audit offensif complet avant toute annonce publique.

178+

tests unitaires, e2e et sécurité

12

tests d'attaque passés — subprocess, socket, eval, injection, exfiltration réseau

18

fichiers core scellés par manifest SHA-256 + HMAC

9

failles identifiées en audit et corrigées — injection ANSI, zéro-largeur NFKC, fuite de casse…

📜

Protection intellectuelle — e-Soleau INPI

Dépôt e-Soleau n° DSO2026025467, déposé le 12/07/2026. L'architecture et les méthodes de SELFA sont horodatées et protégées.

05 // positionnement

Les autres filtrent du texte.
SELFA protège votre souveraineté.

Agrégateurs, pipelines LLM, filtres regex : aucun ne fait le cycle complet anonymisation → traitement → réintégration.

SELFA Mammouth TIAMAT VoidLLM
Anonymisation technique ✅ Bidirectionnelle temps réel ❌ Agrégateur sans anonymisation ⚠️ Regex statique ❌ Pipeline sans anonymisation
Réintégration ✅ Automatique + score ❌ Aucune
Multi-providers ✅ Claude, GPT, GLM, Ollama… ⚠️ Limité ⚠️
Self-hosted ✅ Votre serveur ❌ SaaS ⚠️ ⚠️
Détection PI sémantique ✅ Validation humaine
Logs chiffrés ✅ Fernet / PBKDF2
Open source ✅ Open core Partiel Partiel

06 // modèle

Open core. Self-hosted. Cloud optionnel.

Le cœur de SELFA est open source : l'anonymisation, la réintégration, le scoring et les logs chiffrés appartiennent à tout le monde. Les briques entreprise, elles, financent le développement.

core

Open source

  • → Anonymisation bidirectionnelle
  • → Réintégration + scoring
  • → Logs chiffrés Fernet
  • → Multi-providers

premium

Entreprise

  • → Connecteurs avancés
  • → Gateway multi-canaux
  • → Dashboard entreprise
  • → Support dédié

futur

Cloud managé

  • → Instance SELFA hébergée
  • → Clé en main
  • → Vous gardez vos clés

sur mesure

Consulting

  • → Intégration sur mesure
  • → Accompagnement équipes
  • → Audit de vos flux LLM

Tarifs communiqués aux inscrits de la waitlist en priorité. Aucun prix public à ce stade.

07 // pourquoi maintenant

Le double verrou réglementaire est en place.

SELFA n'est pas un outil de conformité. C'est un outil de souveraineté — qui, par construction, facilite naturellement la conformité.

AI ACT — RÈGLEMENT UE 2024/1689

Article 50 en vigueur depuis le 2 août 2026

Obligations de transparence sur les systèmes d'IA. Savoir quelles données alimentent quels modèles n'est plus optionnel — c'est le socle de toute gouvernance IA crédible.

RGPD

Minimisation, pseudonymisation, privacy by design

Ne pas envoyer la donnée est la minimisation ultime. SELFA applique le privacy by design littéralement : la protection est le chemin par défaut.

CJUE — EDPS v. SRB (C-413/23 P, sept. 2025)

Pseudonymisation contextuelle

La jurisprudence reconnaît qu'une donnée pseudonymisée peut ne plus être personnelle pour son destinataire. C'est exactement le mécanisme SELFA : pour le LLM, vos tokens ne sont rien.

CONVERGENCE

AI Act + RGPD : un seul réflexe

Les deux cadres convergent vers la même exigence : contrôler ce qui sort. SELFA adresse nativement ce double verrou — non comme une case à cocher, mais comme une propriété de l'architecture.

// accès anticipé

Vos données ne quitteront plus jamais votre infrastructure.

Rejoignez la waitlist pour être informé de l'ouverture de l'accès anticipé, de la publication du core open source et de la documentation.

Pas de spam. Un email quand c'est prêt. Désinscription en un clic.