SpaceXAI ha aperto in early beta Grok Bot, un agente che opera su un computer cloud dedicato, si autentica nelle app autorizzate dall'utente e porta avanti incarichi anche quando il dispositivo locale è offline, tornando dall'utente solo per le approvazioni necessarie.
Fonte: Tom's Hardware
16 notizie da questa fonte · Visita il sito
Uno studio su oltre 3.200 aziende Usa collega i licenziamenti motivati con l'AI a un crollo della fiducia dei dipendenti superstiti, che annulla i guadagni di produttività promessi. Il sentiment interno misurato su Glassdoor anticipa i risultati economici meglio dell'ottimismo dichiarato dai vertici aziendali.
Secondo indiscrezioni riprese da Reuters, Microsoft potrebbe presentare già a settembre Maia 300, il successore del chip Maia 200 dedicato all'infrastruttura AI di Azure, puntando a migliorare il rapporto prestazioni-costi e a ridurre parzialmente la dipendenza da NVIDIA.
Il taglio dell'80% sul prezzo di GPT-5.6 Luna riduce le ragioni economiche per investire in modelli open-weight gestiti internamente, rafforzando il lock-in verso i fornitori proprietari. Il confronto con l'apertura dei pesi di Alibaba mostra due strategie opposte: prezzo basso senza controllo, oppure controllo senza azzerare i costi operativi.
WallBreaker, un progetto open source gratuito, è riuscito ad aggirare i guardrail di sicurezza di Claude, GPT, Gemini e Grok con tecniche automatizzate, come dimostrato in un test giornalistico indipendente. Il rischio maggiore riguarda gli agenti aziendali con accesso a email, CRM ed esecuzione di codice, dove un'istruzione nascosta in un documento o una pagina web può aggirare le protezioni pensate solo per i chatbot.
Il lancio di Presence, la piattaforma OpenAI per agenti AI in vendite e assistenza clienti, ha fatto perdere fino al 12,7% ai titoli di HubSpot, Atlassian, Workday, Salesforce e Okta in due giorni, nonostante il prodotto sia ancora ad accesso limitato e nessun cliente abbia spostato budget. Un copione già visto a ottobre 2025, giudicato 'esagerato' dagli analisti di TD Cowen.
Il 2 agosto 2026 entra in applicazione generale il Regolamento europeo sull'AI, compresi gli obblighi di trasparenza sull'etichettatura dei contenuti sintetici. L'accordo del 7 maggio 2026 ha spostato al 2 dicembre 2027 gli obblighi sui sistemi ad alto rischio, con proroga fino al 2 agosto 2028 per i sistemi già regolati da normative di prodotto come i macchinari.
Una guida pratica propone sette prompt strutturati per produrre kit di brand, thumbnail ad alto CTR, caroselli social e mockup UI usando ChatGPT e il nuovo motore gpt-image-2, che genera testo leggibile dentro le immagini. Il collo di bottiglia si sposta dalla qualità dell'immagine alla qualità del prompt.
Meituan, colosso cinese del food delivery, rilascia LongCat-2.0: 1,6 trilioni di parametri, licenza MIT, finestra di contesto da un milione di token, addestrato su oltre 50mila acceleratori cinesi senza alcun hardware Nvidia. Il caso mostra come la barriera d'ingresso nell'AI di frontiera si stia abbassando anche per aziende non native del settore tech.
Una guida pratica spiega come trasformare prompt isolati in micro-workflow riutilizzabili, fatti di contesto fisso, formato di output e controllo di qualità, sfruttando Claude Projects, ChatGPT Projects e Gemini Skills. Gli esempi coprono smistamento email, content planning e altre attività ricorrenti dei piccoli team.
Un'analisi su ottanta milioni di aziende mostra che, mentre le assunzioni complessive calano, gli ingegneri software rappresentano una quota crescente dei nuovi ingressi (dal 46% al 55% nelle big tech). I tagli colpiscono soprattutto i ruoli periferici, non il nucleo tecnico.
Subquadratic, startup di Miami, ha presentato SubQ, modello con sparse attention dinamica che promette un contesto da 12 milioni di token e costi di inferenza fino a 56 volte inferiori a FlashAttention. Gli esperti indipendenti chiedono però verifiche su scala produttiva.
Un'analisi di Tom's Hardware AI Operator propone una matrice di scelta per le aziende che devono decidere quale modello AI usare per compito specifico, sfatando il mito del 'modello migliore in assoluto'. Chi compra una sola licenza enterprise e la impone a tutto il team commette un errore prevedibile: paga il modello di fascia alta anche per riassumere una mail, oppure usa il modello economico dove servirebbe un ragionamento lungo. La scelta corretta è una per compito, e questo cambia il modo in cui si imposta il budget AI aziendale.
ByteDance rilascia DeerFlow 2.0, un framework open source che rappresenta un salto concettuale: gli agenti non suggeriscono azioni ma le eseguono direttamente in ambienti Docker isolati. Architettura a due livelli con memory persistente tra sessioni, capace di gestire ricerca, sviluppo software e generazione di contenuti in autonomia. Simile a Claude Code ma con implementazione più vicina a OpenClaw.
Secondo il report PwC 'Agentic SDLC in practice' (gennaio 2026), i modelli LLM non si limitano alla generazione di codice ma entrano in analisi requisiti, design, testing, code review, documentazione e deployment. Il 38,7% dei commenti AI nelle code review portano a ulteriori correzioni. L'impatto è doppio: velocità aumenta, ma dipendenza da supervisione umana diventa critica.
Il codice sorgente di Claude Code (v2.1.88) finisce su npm per errore: 512.000 righe di TypeScript con source map da 57 MB. Rivela architettura completa con plugin system, feature flag, memoria persistente, orchestrazione multi-agente. Nasconde anche una feature gelata: buddy virtuali (Tamagotchi ASCII) con statistiche, personalità generata dall'AI. Anthropic ha rimosso velocemente il file dal registry ma il codice già circolava.