Il gruppo di sicurezza Hacktron ha sfruttato tra il 23 e il 25 luglio 2026 una falla nel forum OpenAI basato su Discourse, exploit costruiti con l'aiuto di Claude Opus, per ottenere accesso agli account ChatGPT e Codex di un dipendente e arrivare fino al monorepo con il codice sorgente dei prodotti OpenAI, senza consultare file riservati. OpenAI ha confermato il problema, revocato le sessioni coinvolte e pagato ai ricercatori un premio di 6.500 dollari; Discourse e Debian hanno rilasciato le relative correzioni.
Fonte: dday.it
11 notizie da questa fonte · Visita il sito
Anthropic ha pubblicato a settembre 2026 il rapporto "Detecting and countering misuse of AI", che documenta casi di uso improprio di Claude tra dicembre 2025 e agosto 2026: un ricercatore ha tentato di progettare mutazioni di un virus aviario H5 a potenziale pandemico, una cellula yemenita ha scritto codice di guida per missili balistici e droni, un gruppo russo ha sviluppato uno sciame di droni kamikaze autonomi e un consulente in Mali ha costruito un sistema di sorveglianza capace di monitorare 25 milioni di SIM. In tutti i casi Anthropic ha bloccato gli account coinvolti e integrato le scoperte nei propri sistemi di sicurezza.
OpenAI ha diffuso i primi risultati del chip ASIC Jalapeño, sviluppato con Broadcom: nei test sulla piattaforma InferenceX supererebbe le GPU Nvidia GB200 e GB300 sia in latenza sia in efficienza energetica, con consumi misurati di 550 watt contro i 1.200-1.400 watt dei chip Nvidia. La distribuzione in piccoli volumi è prevista entro fine 2026.
Anthropic unifica l'estensione Claude per Chrome con Cowork: il pannello laterale del browser diventa una sessione sincronizzata con l'account, naviga pagine, compila campi e clicca pulsanti con le credenziali dell'utente. Il rischio principale resta il prompt injection, mitigato da un doppio livello di verifica prima delle azioni con conseguenze reali.
Mistral ha pubblicato Shieldstral, un modello da 3 miliardi di parametri con pesi aperti che non genera testo ma valuta se un contenuto viola una regola di sicurezza definita al momento in linguaggio naturale, invece che fissata nei pesi come nei concorrenti Llama Guard e ShieldGemma. Il modello dichiara le migliori prestazioni su 13 benchmark, anche in italiano.
OpenAI sostituisce la modalità vocale avanzata con GPT-Live, un modello full duplex che ascolta e parla simultaneamente senza attendere il turno dell'interlocutore, e può fare da interprete in tempo reale tra due lingue diverse. Al debutto mancano video e condivisione schermo, e l'italiano presenta ancora accenti non madrelingua.
Anthropic lancia Reflect, una dashboard che riassume come si è usato Claude nell'ultimo mese o negli ultimi 3-12 mesi, evidenziando temi ricorrenti e orari d'uso, con domande per riflettere se il tempo delegato all'AI sia speso bene. È in beta per utenti Free, Pro e Max con memoria attiva.
Anthropic ha bloccato all'ultimo momento una modifica che avrebbe separato i limiti di utilizzo per l'uso interattivo e quello programmatico (script, automazioni, strumenti di terze parti), introducendo un credito mensile dedicato del valore di 20-200 dollari a seconda del piano. La misura era stata annunciata a maggio per far fronte all'uso intensivo degli agenti AI che consuma in pochi minuti la stessa quantità di token di ore di conversazione umana. La comunità degli sviluppatori aveva criticato il rischio di costi imprevisti, come documentato dal caso virale dell'utente con 200 dollari di addebiti inattesi.
Satya Nadella ha pubblicato un testo in cui sostiene che i modelli AI generalisti tenderanno a somigliarsi e diventare intercambiabili, mentre la vera proprietà intellettuale aziendale sarà il 'learning loop': il ciclo in cui un agente lavora su dati e procedure interne, i risultati vengono confrontati con esiti reali e gli errori diventano segnali di miglioramento. L'analisi arriva però dall'AD di Microsoft, che vende tutta l'infrastruttura su cui dovrebbe poggiare questo sistema cognitivo, da Azure a Copilot. Contestualmente, Microsoft ha presentato sette nuovi modelli della famiglia MAI, tra cui MAI-Thinking-1 con 1000 miliardi di parametri.
Al Google I/O 2026, Google ha presentato Gemini Spark, un agente AI personale integrato nell'app Gemini che divide i task complessi in passaggi e li esegue in background usando email, calendario e documenti Google. Gira su macchine virtuali cloud dedicate e continua a lavorare anche quando il dispositivo è spento. Nella demo ha organizzato una festa di quartiere: ha raccolto RSVP, creato un tracker in Google Sheets, generato promemoria e una presentazione automatica.
Andrej Karpathy ha realizzato un visualizzatore del mercato del lavoro USA che mostra 342 professioni su 143 milioni di posti. L'analisi LLM assegna punteggi di esposizione all'AI (0-10): un valore alto non significa sparizione, ma trasformazione profonda. Docenti, insegnanti, psicologi, ingegneri e artisti sono tra i più esposti.