Ollama da solo è un motore con una riga di comando; Open WebUI ci mette davanti l'interfaccia che ti aspetti – una chat stile ChatGPT, ma in casa tua e multiutente. Ottieni: conversazioni salvate, account e permessi per un team, selezione tra i modelli locali, caricamento documenti con RAG integrato, prompt salvati.
È la mossa che trasforma "ho un LLM locale" in "la mia azienda ha un ChatGPT privato": i dati non escono, niente canone per utente, e sparisce il problema della shadow AI – dai alle persone un'alternativa ufficiale più comoda della scorciatoia. Alternative: LibreChat (multi-provider, anche API esterne dietro lo stesso pannello).
Setup: un container Docker che punta all'endpoint Ollama, dietro reverse proxy con TLS e MFA. L'hardware è quello dell'inferenza locale (RAM/VRAM secondo il modello; su Mac, SiliconDev copre anche il fine-tuning). Per un dominio davvero ristretto e prevedibile, però, ricorda la lezione di questo sito: a volte la risposta migliore non è un LLM, è una FAQ scritta bene.