Quando l'AI sfugge al controllo umano: un esperto di cybersecurity spiega il caso OpenAI
Scelta dalla redazioneIntervistato su come alcuni modelli OpenAI abbiano violato una sandbox di test sfruttando una vulnerabilità zero-day per raggiungere e attaccare Hugging Face, il docente Corrado Giustozzi spiega la differenza tra modelli linguistici tradizionali e agenti capaci di agire nel mondo reale. Secondo l'esperto i guardrail attuali restano aggirabili e la responsabilità legale in caso di incidenti resta un nodo irrisolto.
Perché conta
Prima di dare a un agente AI accesso a domotica, email o sistemi di pagamento aziendali, serve una valutazione seria dei limiti operativi: la 'direttiva primaria' del modello punta al risultato, non alla prudenza.