L'esigenza è comune: dare alle persone la comodità di ChatGPT senza che contratti, codice e dati dei clienti finiscano su server terzi (il caso Samsung). Due strade, non alternative:
- modello locale + interfaccia: Ollama come motore, Open WebUI come frontend multiutente – i dati non lasciano la tua infrastruttura, zero costo per token, hardware dimensionato al modello. Ideale per i dati davvero sensibili
- endpoint gestito con garanzie: dove serve un modello di frontiera, un piano business/API con DPA, no-training e residenza UE (GDPR normale), messo dietro un punto di controllo unico con guardrail e DLP – è il ruolo di llmproxy e aidlp: un solo endpoint da governare, PII e segreti intercettati prima che partano
Qualunque strada, serve anche una AI policy chiara: il canale ufficiale dev'essere più comodo della scorciatoia, o la shadow AI vince. E per le domande prevedibili e ripetute (onboarding, FAQ interne), la risposta più economica e affidabile non è un LLM affatto: è una knowledge base pre-scritta – esattamente ciò che stai leggendo.