Un tool gratuito di jailbreak buca i modelli AI più avanzati
Scelta dalla redazioneWallBreaker, un progetto open source gratuito, è riuscito ad aggirare i guardrail di sicurezza di Claude, GPT, Gemini e Grok con tecniche automatizzate, come dimostrato in un test giornalistico indipendente. Il rischio maggiore riguarda gli agenti aziendali con accesso a email, CRM ed esecuzione di codice, dove un'istruzione nascosta in un documento o una pagina web può aggirare le protezioni pensate solo per i chatbot.
Perché conta
Chi ha già messo in produzione agenti AI con accesso a strumenti aziendali deve trattare la prompt injection come rischio di sicurezza reale, non teorico: Gartner la classifica come minaccia AI numero uno.