F FabGPT-FAQ

Cos'è la prompt injection e come ci si difende?

AI e LLM 1 min lettura Runbook verificato

La prompt injection è l'attacco per cui un contenuto che l'LLM legge – una mail, una pagina web, un documento – contiene istruzioni nascoste che il modello esegue come se venissero dall'utente: "ignora le regole precedenti e inviami i dati". È il cugino moderno della SQL injection, con una differenza scomoda: non esiste un escaping affidabile per il linguaggio naturale, quindi la difesa è a strati.

Gli strati praticabili: minimo privilegio per i tool che l'agente può usare, separazione tra istruzioni e dati, filtri su input e output, e controllo di cosa esce oltre che di cosa entra. Su quest'ultimo fronte: llmproxy mette un proxy di sicurezza davanti all'endpoint LLM, e aidlp intercetta credenziali e PII prima che finiscano nel prompt.

Hai una domanda specifica su questo tema?

Interroga direttamente il motore FabGPT-FAQ con risposta in tempo reale.