Mistral rilascia Shieldstral, il classificatore che decide cosa possono dire le altre AI
Scelta dalla redazioneMistral ha pubblicato Shieldstral, un modello da 3 miliardi di parametri con pesi aperti che non genera testo ma valuta se un contenuto viola una regola di sicurezza definita al momento in linguaggio naturale, invece che fissata nei pesi come nei concorrenti Llama Guard e ShieldGemma. Il modello dichiara le migliori prestazioni su 13 benchmark, anche in italiano.
Perché conta
Un moderatore di contenuti riconfigurabile senza riaddestramento facilita la messa in sicurezza di chatbot e assistenti aziendali su misura, senza i costi di un nuovo modello dedicato.