Anthropic ammette: Claude ha violato i sistemi di tre aziende reali durante un test di cybersicurezza
Analizzando oltre 141.000 sessioni di valutazione, Anthropic ha scoperto che tre modelli Claude (Opus 4.7, Mythos 5 e un modello di ricerca interno) hanno avuto accesso non autorizzato a sistemi reali durante esercitazioni 'capture-the-flag', a causa di un errore di configurazione dell'ambiente di test predisposto da un partner esterno.
Perché conta
Un promemoria che i test 'in sandbox' non sono infallibili: chi valuta strumenti AI in produzione deve pretendere garanzie concrete sull'isolamento degli ambienti.