Fonte: dday.it

11 notizie da questa fonte · Visita il sito

Il gruppo di sicurezza Hacktron ha sfruttato tra il 23 e il 25 luglio 2026 una falla nel forum OpenAI basato su Discourse, exploit costruiti con l'aiuto di Claude Opus, per ottenere accesso agli account ChatGPT e Codex di un dipendente e arrivare fino al monorepo con il codice sorgente dei prodotti OpenAI, senza consultare file riservati. OpenAI ha confermato il problema, revocato le sessioni coinvolte e pagato ai ricercatori un premio di 6.500 dollari; Discourse e Debian hanno rilasciato le relative correzioni.

Anthropic ha pubblicato a settembre 2026 il rapporto "Detecting and countering misuse of AI", che documenta casi di uso improprio di Claude tra dicembre 2025 e agosto 2026: un ricercatore ha tentato di progettare mutazioni di un virus aviario H5 a potenziale pandemico, una cellula yemenita ha scritto codice di guida per missili balistici e droni, un gruppo russo ha sviluppato uno sciame di droni kamikaze autonomi e un consulente in Mali ha costruito un sistema di sorveglianza capace di monitorare 25 milioni di SIM. In tutti i casi Anthropic ha bloccato gli account coinvolti e integrato le scoperte nei propri sistemi di sicurezza.

Anthropic unifica l'estensione Claude per Chrome con Cowork: il pannello laterale del browser diventa una sessione sincronizzata con l'account, naviga pagine, compila campi e clicca pulsanti con le credenziali dell'utente. Il rischio principale resta il prompt injection, mitigato da un doppio livello di verifica prima delle azioni con conseguenze reali.

Mistral ha pubblicato Shieldstral, un modello da 3 miliardi di parametri con pesi aperti che non genera testo ma valuta se un contenuto viola una regola di sicurezza definita al momento in linguaggio naturale, invece che fissata nei pesi come nei concorrenti Llama Guard e ShieldGemma. Il modello dichiara le migliori prestazioni su 13 benchmark, anche in italiano.

Anthropic ha bloccato all'ultimo momento una modifica che avrebbe separato i limiti di utilizzo per l'uso interattivo e quello programmatico (script, automazioni, strumenti di terze parti), introducendo un credito mensile dedicato del valore di 20-200 dollari a seconda del piano. La misura era stata annunciata a maggio per far fronte all'uso intensivo degli agenti AI che consuma in pochi minuti la stessa quantità di token di ore di conversazione umana. La comunità degli sviluppatori aveva criticato il rischio di costi imprevisti, come documentato dal caso virale dell'utente con 200 dollari di addebiti inattesi.

Satya Nadella ha pubblicato un testo in cui sostiene che i modelli AI generalisti tenderanno a somigliarsi e diventare intercambiabili, mentre la vera proprietà intellettuale aziendale sarà il 'learning loop': il ciclo in cui un agente lavora su dati e procedure interne, i risultati vengono confrontati con esiti reali e gli errori diventano segnali di miglioramento. L'analisi arriva però dall'AD di Microsoft, che vende tutta l'infrastruttura su cui dovrebbe poggiare questo sistema cognitivo, da Azure a Copilot. Contestualmente, Microsoft ha presentato sette nuovi modelli della famiglia MAI, tra cui MAI-Thinking-1 con 1000 miliardi di parametri.

Al Google I/O 2026, Google ha presentato Gemini Spark, un agente AI personale integrato nell'app Gemini che divide i task complessi in passaggi e li esegue in background usando email, calendario e documenti Google. Gira su macchine virtuali cloud dedicate e continua a lavorare anche quando il dispositivo è spento. Nella demo ha organizzato una festa di quartiere: ha raccolto RSVP, creato un tracker in Google Sheets, generato promemoria e una presentazione automatica.

Hai delle domande?
Dei suggerimenti?

Vuoi contribuire con l'aggiornamento delle informazioni?

Compila la forum, ti risponderemo in live

Ricevi il TG AI ogni lunedì

La rassegna settimanale sull’intelligenza artificiale, curata e in italiano. Niente spam, solo notizie che contano.