F FabGPT-FAQ

Cos'è aidlp e come funziona il Data Loss Prevention per LLM?

AI e LLM 2 min lettura Runbook verificato

aidlp (AI DLP Proxy) è un proxy HTTP/HTTPS ad alte prestazioni progettato per intercettare il traffico verso endpoint LLM esterni (OpenAI, Anthropic, ecc.) e anonimizzare dati sensibili (PII, chiavi API, token) in tempo reale.

Caratteristiche architetturali:
- Parallel Redaction Engine: esegue contemporaneamente l'analisi statica (tramite algoritmi FlashText ad altissima velocità) e l'analisi NLP avanzata (tramite Microsoft Presidio e SpaCy), unendo gli offset prima dell'applicazione dei mascheramenti per preservare intatto il contesto sintattico per il modello.
- Asynchronous Worker Queue: delega le inferenze ML a una coda asyncio.Queue con worker persistenti dedicati, azzerando il rischio di OOM e thread thrashing ad alto throughput.
- Atomic Hot-Reload: sincronizzazione automatica ogni 60 secondi con HashiCorp Vault (o file locali) con rotazione atomica delle chiavi e dei dizionari senza riavvio del processo.
- Validazione TLS Upstream (v2.0): verifica rigorosa dei certificati TLS dei provider upstream per prevenire attacchi Man-in-the-Middle sui prompt in transito.

Installazione e avvio con Docker:

BASH
# Avvio del container AI DLP Proxy
docker run -d --name aidlp \
  -p 8080:8080 \
  -e AIDLP_UPSTREAM_URL="https://api.openai.com" \
  -e AIDLP_VAULT_ENABLED="false" \
  ghcr.io/fabriziosalmi/aidlp:latest

Protegge la riservatezza aziendale garantendo conformità GDPR e AI Act nell'adozione di modelli di intelligenza artificiale. Codice, regole di redazione e configurazione completa: aidlp.

Prompt Utente(PII & Secret)AI DLP ProxyFlashText + PresidioPrompt Redatto(Zero Leak)OpenAI / ClaudeEndpoint LLMsanitizzatointercettazione in-flight e anonimizzazione parallela dei token prima dell'LLM

Hai una domanda specifica su questo tema?

Interroga direttamente il motore FabGPT-FAQ con risposta in tempo reale.