Mistral rilascia Shieldstral, il classificatore che decide cosa possono dire le altre AI

Scelta dalla redazione
Notizie della settimana: 10 – 4 agosto 2026

Mistral ha pubblicato Shieldstral, un modello da 3 miliardi di parametri con pesi aperti che non genera testo ma valuta se un contenuto viola una regola di sicurezza definita al momento in linguaggio naturale, invece che fissata nei pesi come nei concorrenti Llama Guard e ShieldGemma. Il modello dichiara le migliori prestazioni su 13 benchmark, anche in italiano.

Perché conta

Un moderatore di contenuti riconfigurabile senza riaddestramento facilita la messa in sicurezza di chatbot e assistenti aziendali su misura, senza i costi di un nuovo modello dedicato.