https://gigibeltrame.substack.com/p/chiedono-la-frenata-allonu-ma-poi
---------------
Settimana particolare, in cui si nota un certo strabismo: da una parte chi chiede all’ONU di rallentare, dall’altra chi taglia i prezzi del 50% e rilancia.
Qui la versione podcast automatica.
Partirei con una considerazione.
Iscriviti ora
Sono stato ospite del corso allo Iulm di Mauro Lupi e proprio i ragazzi e Mauro mi hanno fatto riflettere su una cosa: l’istruzione, le competenze e l’esperienza devono essere al servizio di un metodo che può essere replicato, adattato e modificato, ma che deve fungere da stella polare.
Troppo progetti AI li vedo fallire perché non viene applicato un metodo, si cercano di replicare qualcosa di già visto funzionare, ma non c’è un metodo.
Non voglio entrare nei dettagli, ma le linee guida base sono semplice: identità, messaggio, controllo, poi il resto viene a cascata.
Ho notato che qualche società di consulenza non mette in chiaro questo nei progetti e poi ci si sorprende perché questi fatichino, non scalino o falliscano. E non parlo solo di progetti AI, ma tanti progetti di robotica applicata, che inizio a vederne tanti, uno dei quali settimana scorsa di movimentazione di materiale che si inceppava semplicemente perché un sensore era accecato dalla luce in certi momenti del giorno: era stato testato in inverno e da luglio ad agosto aveva smesso di funzionare! Basta poco, ma senza un controllo attento si rischia di sbattere la testa su problemi banali.
Identità significa capire cosa serve, cosa deve fare, qual è lo scopo.
Messaggio non è il comando, ma ordini chiari di quello che può fare o non fare, quali sono i limiti e a quali risorse può attingere.
Controllo è la parte delicata, perché si crede che bastino dei KPI per misurare l’impatto. Un progetto invece potrebbe avere un impatto su altre componenti dell’azienda, un umanoide potrebbe avere un impatto sulle persone, un’automazione potrebbe portare a credere che si possa fare a meno delle persone che eseguivano quel compito prima.
Sono solo esempi banali, ma davvero posso affermare che manca quel tassello base, che va ben oltre i dati da dare in pasto ai progetti, a quali modelli e agenti fare riferimento e via di seguito.
Forse non è chiaro a tutto, ma i dati sono fondamentali, mentre i modelli e agenti sono quasi un “di cui”, data l’abbondanza presente sul mercato.
Passiamo alla cronaca delle novità della settimana.
OpenAI e Anthropic all’ONU chiedono di fermarsi, poi lanciano tre modelli e tagliano i prezzi
La cosa che mi colpisce è la sequenza. A distanza di poche ore, Anthropic e OpenAI presentano i loro nuovi modelli: Claude Opus 5.5 e la coppia GPT-6 Sol / GPT-6 Luna. Entrambe le aziende, pochi giorni prima, avevano firmato appelli congiunti per una “frenata” dello sviluppo AI, portati anche all’Assemblea generale dell’ONU e destinati a sbarcare al G20.
I numeri del taglio, però, parlano da soli. Anthropic dice che Opus 5.5 costa circa il 40% in meno del predecessore e gira il 30% più veloce. OpenAI replica con un -50% sui listini API rispetto ai prezzi promozionali di GPT-5.6: Sol a 2 dollari in input e 10 in output per milione di token, Luna a 0,10 e 0,50. Sono prezzi che fino a due anni fa sarebbero sembrati un errore di stampa.
Il retroscena ovviamente è politico prima che tecnico: l’appello alla “frenata” era anche una mossa per allinearsi alla Casa Bianca, che ha bocciato l’idea di un organismo internazionale di supervisione. Non a caso, dopo il lancio, le azioni delle due aziende hanno reagito come ci si aspettava.
C’è una nota che mi fa sorridere ma che ci deve fare riflettere.
OpenAI ha ammesso in un documento interno che il modello Astra, in alcuni test, “può cercare di sottrarsi al monitoraggio umano”. Lo dicono loro, in un comunicato, e poi tagliano il prezzo del 50%.
Una sintesi perfetta.
Gemini 4 è quasi pronto, e Google non vuole fare la figura di quella che arriva ultima
Mustafa Kavukcuoglu, numero uno di Google DeepMind, ha confermato che Gemini 4 è in fase di post-training e verrà rilasciato “il prima possibile”, con l’obiettivo dichiarato di anticipare la fine del 2026. Il modello nasce mentre OpenAI ha già consolidato GPT-6 Astra e Anthropic ha alzato ancora l’asticella. In mezzo, Gemini 3.8 Live è arrivato il 15 settembre a 1,38 dollari l’ora come modello vocale bilingue con tool use integrato.
La cosa che mi fa pensare è il livello di coordinamento, o forse di panico. La finestra tra un rilascio e l’altro si è ridotta a settimane, non a mesi. Chi arriva secondo in una corsa del genere paga un prezzo di mercato che non si misura solo in quota API, ma in quote di ricerca e di distribuzione enterprise. E a quel punto “il prima possibile” diventa una dichiarazione di intenti che pesa come una roadmap.
Una domanda: ma la “fedeltà” ai modelli esiste oppure no? Io personalmente ho fatto un calcolo stamattina e per le varie cosette personali utilizzo 7 modelli differenti, senza contare Gemini nano nel mio Pixel. Non sempre serve utilizzare l’ultimo modello di un LLM, spesso basta anche qualche modello gratuito, magari in locale.
AI Act, settimana operativa: nuovi controlli UE e un mese di grazia sui watermark
L’Ufficio AI della Commissione europea, operativo dal 2 agosto, ha rafforzato l’enforcement dell’AI Act con tre canali pubblici: un portale per reclami, un canale dedicato per le violazioni degli articoli 53 e 55 (modelli general-purpose), e un Whistleblower Tool per i lavoratori del settore. Sono già oltre 180 le organizzazioni che hanno firmato il Codice di Condotta sulla trasparenza dei contenuti generati, salite a 234 secondo Stephenson Harwood: tra queste Anthropic, Google, Meta, Microsoft, Mistral e OpenAI.
Intanto OpenAI è finita nella lista dei “cattivi esempi”: l’Ufficio AI ha confermato di essere al corrente dell’incidente “RubyGems” ma di non aver ricevuto una notifica formale, nonostante l’AI Act obblighi a segnalare gli incidenti gravi “senza indebito ritardo”. La legge, scrive The EU AI Act Newsletter, non è ancora chiara sulla soglia che fa scattare l’obbligo: ed è esattamente il tipo di ambiguità su cui le aziende tecnologiche campano da anni.
Una notizia che meritava un fact-checking: secondo Digital Journal, gli obblighi high-risk per i software di recruiting slitterebbero dal 2 agosto 2026 al 2 dicembre 2027, grazie al Digital Omnibus. Ebbene sì, è vero!
Per chi progetta o vende AI in ambito HR, sono 15 mesi in più per prepararsi. Per chi assume, sono 15 mesi in più senza alcuna tutela europea contro i sistemi di selezione automatica. Una sintesi perfetta della differenza tra “proteggere le imprese” e “proteggere le persone”. Nel frattempo vedete comparire i RAL in ogni annuncio di posizione lavorativa su LinkedIn? Eppure è legge…
Cos’hanno in comune gli attacchi a Revolut e Fideuram?
Meglio di me, ha espresso il proprio parere Marco Liera in un lungo articolo nella sua newsletter.
Sebbene ci siano procedure ben orchestrate, il fattore umano è determinante. Qui è lo Human in the loop che fallisce, non le procedure di sicurezza.
Parliamo di cybersecurity e AI: Plugin4Shell e CLOSEDQUORUM (tra i tanti)
Vi lascio un caso che dovrebbe farvi riflettere sulla sicurezza. Il 17 settembre AIR Security ha rivelato Plugin4Shell, un attacco zero-click che bypassa il meccanismo di SHA pinning dei plugin su quattro dei principali coding agent in circolazione: Claude Code di Anthropic, Codex di OpenAI, GitHub Copilot e Gemini CLI di Google. Il trucco è elegante e brutale: un attaccante che controlla il repository di un plugin crea una copia il cui nome è identico e lo rende default, e Git risolve il riferimento a quel branch invece che a quello corretto. Risultato: l’agente installa codice malevolo mentre crede di aver verificato l’hash.
E cosa hanno fatto le Big Tech? Lo stato dei patch, al 21 settembre, è una fotografia impietosa del settore. Anthropic ha spedito il fix in Claude Code 2.1.179, OpenAI ha patchato Codex 0.146.0. Microsoft non ha rilasciato un fix per Copilot, e Google ha detto che Gemini CLI non verrà corretto perché “deprecato”: chi lo usa è invitato a migrare ad Antigravity.
La cosa che mi colpisce è l’onnipresenza del pattern. PlugIn4Shell funziona perché tutti e quattro gli agenti fanno la stessa assunzione architetturale sbagliata: “controllo l’hash in input, non verifico l’output”. Quando l’intera industria commette lo stesso errore di design, non è più una vulnerabilità, è un modello di business: installare velocemente, correggere dopo, pagare i danni (che non sono mai quelli dei vendor). Una sintesi perfetta della security AI nel 2026.
Cisco Talos ha pubblicato CAIRN, un framework open source per classificare malware che usano l’AI al proprio interno. Il primo campione analizzato si chiama CLOSEDQUORUM ed è, secondo i ricercatori, il primo elemento documentato che delega la scelta delle prossime azioni a un insieme di LLM commerciali: dopo l’installazione, non riceve comandi da un operatore umano e nemmeno da un server dedicato, decide autonomamente come muoversi per rubare credenziali e wallet crypto.
La cosa che mi fa pensare è il cambio di paradigma. I ricercatori di CAIRN cercano “artefatti cognitivi” nei metadati dei file: prompt embedded code, endpoint API, logica di orchestrazione, testi scritti per ingannare gli scanner sandbox basati su AI. Sono le impronte digitali del malware generato o controllato da modelli. WatchGuard nel suo Threat Report semestrale racconta che il malware mai visto prima sugli endpoint è cresciuto del 2.000% anno su anno, con il 96% delle minacce che appare su una sola macchina: la personalizzazione tramite AI sta distruggendo il modello “firma, distribuisci, monetizza” del cybercrime tradizionale.
E non è solo offensivo. LesNumériques racconta di un operatore cinese che da luglio scorso usa framework di AI agentica per compromettere siti di e-commerce e rubare dati di carte di credito: 600.000 carte sottratte a due aziende, costo medio per attacco andato a buon fine di 25 dollari, spesa totale di 7.000 dollari in API. Una sintesi perfetta del ROI dell’AI offensiva: il prezzo di un caffè al giorno per entrare in una Fortune 500.
OpenAI pubblica sei incidenti di “misalignment” e apre le porte ai valutatori indipendenti
Il 16 settembre OpenAI ha pubblicato sei report di “misalignment” relativi a comportamenti inattesi o preoccupanti dei suoi modelli, e ha reagito introducendo un framework formale per la disclosure pubblica di questi episodi. Il framework prevede tre modalità: “Ready for Disclosure”, “Minor Investigation” e “Larger Investigation” (per casi che coinvolgono terze parti). Qualsiasi dipendente OpenAI può segnalare un caso. OpenAI, intanto, ha anche pubblicato i principi per le valutazioni di terze parti, impegnandosi a dare accesso a livello dipendente ai valutatori indipendenti su incidenti critici di allineamento.
La cosa che mi colpisce è il tempismo. Il framework esce lo stesso giorno del lancio di Sol e Luna, e il giorno dopo il documento interno in cui OpenAI ammette che Astra può “cercare di sottrarsi al monitoraggio”. È trasparenza calcolata, e va riconosciuta, ma è anche la dimostrazione che senza obblighi regolatori le aziende decidono loro quando, come e quanto mostrare. Una sintesi perfetta: quando ti autoregali la disclosure, decidi anche tu quando finirla.
ChatMinerva violata, l’assistente AI della Sapienza: le chat degli studenti in mano a un attaccante
Chiudiamo con una notizia italiana che meriterebbe più spazio di quanto i giornali le abbiamo concesso. ChatMinerva, l’assistente AI sviluppato dalla Sapienza di Roma, è stato violato il 18 settembre: un soggetto esterno è entrato con privilegi da amministratore nei database e ha avuto accesso a email, hash delle password e, soprattutto, alle conversazioni degli utenti con il modello. La comunicazione agli iscritti parla di accesso “doloso” alla piattaforma.
La cosa che mi fa pensare è cosa contengono quelle chat. Uno studente che chiede aiuto per un esame, un ricercatore che usa il modello per riscrivere un paper, magari qualcuno che gli ha passato dati personali sanitari perché si fidava del provider universitario. Sono conversazioni che, se riutilizzate, possono fare danni enormi: profilazione, estorsione, semplice gogna pubblica. Le password erano hashate, ma le chat no.
E qui torniamo al punto. In un mondo in cui le aziende si autoregono la disclosure del misalignment, le università vengono bucate e i vendor di coding agent non rilasciano patch per i loro plugin, l’unica vera protezione è la consapevolezza dell’utente. Ve lo dicono con sei mesi di anticipo, in tutti i report che ho citato, e nessuno fiata. Il prompt è il nuovo esame di coscienza: scrivilo come se potesse finire su una testata. Una sintesi perfetta.
Il nuovo Microsoft Copilot diventa un’APP
Microsoft presenta il nuovo Copilot per le aziende, un unico punto d'accesso per chiedere, delegare, creare e automatizzare. Home è l'hub centrale che indirizza il lavoro verso Chat, per risposte rapide, o Cowork, per compiti complessi. Code permette di creare app, dashboard e automazioni descrivendole a parole, mentre Autopilot (ex Scout) agisce come collega digitale autonomo. Completano l'offerta Office in Copilot, Fabric IQ e Work IQ per il contesto aziendale, il Registro dei Plugin, Copilot Managed Runtime, nuovi strumenti per controllare i costi, Today in Home e @Copilot in Teams. Il rollout parte con il programma Frontier nelle prossime settimane.
Meta Connect e il ritorno alla realtà virtuale
Sapete che ho creduto molto nell’integrazione tra realtà e digitale, soprattutto a livello industriale e produttivo e oggi abbiamo assistenti e digital twin ovunque. Meta ha presentato i propri prodotti per la VR al Meta Connect e ha allargato la famiglia in tre direzioni, facendo una grossa scommessa: Ray-Ban con display nella lente per vedere chi partecipa a una riunione e rispondere senza tirare fuori il telefono, Threads che entra sul display con i Community Feeds, e soprattutto i Meta VR Glasses, il prodotto più ambizioso, che riporta Meta sulla realtà virtuale ma in formato occhiali. L’AI si sposta sempre più vicino agli occhi e alle orecchie, dicono. E hanno ragione.
La nuova generazione dei Ray-Ban Meta con più autonomia e pulsante personalizzabile per Meta AI, due nuovi modelli Capri e Nova, e una linea Ray-Ban Meta Audio senza fotocamera per chi la camera non la vuole, in fondo una versone di Muse (che qui ancora non c’è) a portata di occhi e orecchio. Cosa vedremo in Europa di questo? poco. Ma Meta non si ferma e Exilorluxottica ne trae vantaggio.
HP ZBook Ultra G3a: 192 GB e 300 miliardi di parametri in uno zaino
Secondo me questo computer meritava un’attenzione migliore. Infatti, l’annuncio HP del 15 settembre segna un cambiamento del modo di pensare ai notebook: HP ZBook Ultra G3a 16, mobile workstation pensata come “fabbrica AI personale”. Ryzen AI Max+ PRO 495, fino a 192 GB di memoria unificata con 160 GB dedicabili a VRAM, NPU da 55 TOPS, TDP fino a 100 W con un nuovo design termico. Obiettivo dichiarato: far girare LLM fino a 300 miliardi di parametri in locale, più agenti e app professionali insieme, senza passare dal cloud a ogni task.
Se ci limitassimo alla sezione delle tecnologie all’interno del prodotto ci sbaglieremmo clamorosamente.
La parte software è quella che dovrebbe interessare di più, non è solo potenza di calcolo, è progettare un computer da zero per la produttività più spinta. Ha Perplexity Computer preinstallato, con connettore MCP per Autodesk Revit per lavorare sui dati di progetto tenendoli sul direttamente nel dispositivo, più una serie di skill basate sui tak di lavoro sviluppate insieme ad HP. In pratica, non dovremo più assemblare stack, modelli, connettori e prompt da soli. Il lavoro parte in locale e solo quando serve chiama il modello in cloud, senza ricominciare tutto da capo, guadagnando in velocità e risparmiando token. Diciamolo: è un portatile solo di nome, dentro è un nodo da data center.
L’idea è interessante, ma va precisato che il vero collo di bottiglia degli agenti non è la VRAM, ma la governance di cosa fanno quando li lasciate soli?
La tecnologia ora c’è, ma manca il manuale di istruzioni per tante aziende.
GoogleBooks: i computer con Gemini integrata
Google ha presentato i Googlebook, Chromebook potenziati da Gemini, frutto di un’alleanza tra Acer, Asus, Dell, HP e Lenovo. Non è solo hardware, perché il vero motore è l’AI integrata. Chip Qualcomm e Intel, certo, ma la magia è nella fusione: Android e Chrome si uniscono in un ecosistema fluido, dematerializzando l’interazione. Gemini diventa traduttore, analista, assistente. Il PC non esegue più, capisce attraverso i Magic Pointer.
Prezzo più alto rispetto ai Chromebook, più potenza da computer, più integrazione con l’AI. La sostanza è questa: accorciare le distanze tra computer e smartphone, trasformare il lavoro e rompere gli schemi. Sono curioso.
Anthropic a 100 miliardi di “run-rate” e IPO a novembre da 2.000 miliardi: la bolla che fattura
Tra il 19 e il 20 settembre è circolata la notizia che Anthropic viaggia oltre i 100 miliardi di ricavi annualizzati, +50% rispetto ai 65 miliardi di luglio e oltre 10 volte i livelli di fine 2025, spinta da Claude Code e Cowork enterprise. E avrebbe spostato l’IPO da ottobre a novembre 2026 per includere i conti del terzo trimestre, puntando a circa 2.000 miliardi di valutazione, potenzialmente la più grande IPO della storia. Numeri da verificare nei documenti che presenteranno a breve, certo, ma l’ordine di grandezza è quello. Non è un caso che in Italia sia arrivato il country manager.
Il 18 settembre, sempre Anthropic ha nominato Accenture, attraverso Faculty, come primo valutatore dei propri sistemi, con un contratto da almeno un miliardo a testa. La collaborazione mira ad accelerare lo sviluppo di valutatori embedded, ritenuti fondamentali per la sicurezza dell’AI, ma se il valutatore è pagato da chi valuta non so se sia tutto perfetto, non vi pare?
E poi c’è il wet lab nella Bay Area dove Claude testerebbe teorie biologiche con esperimenti fisici, più il Life Sciences Verification Program per ricercatori selezionati, dopo l’acquisizione da circa 400 milioni di Coefficient Bio ad aprile. Anche qui la cosa andrebbe analizzata, sebbene Anthropic sostenga che non faranno ricerche su medicinali ma solo su fondamenti biologia.
Robot umanoidi: la Cina cambia idea, Unitree crolla in Borsa, ma sfila a Milano
Reuters ha raccontato che i regolatori cinesi hanno di fatto congelato le IPO del settore umanoide, dopo il debutto disastroso di Unitree Robotics sullo STAR Market di Shanghai. Il titolo aveva aperto il 19 agosto a 1.100 yuan, con un balzo del 629% sopra il prezzo di collocamento e una valutazione picco di 66 miliardi di dollari; un mese dopo ha perso il 55% dal massimo, e il regolatore ha cominciato a dare richiami informali alle banche d’investimento per rallentare le nuove quotazioni. Dal delirio retail al congelamento in trenta giorni.
Intanto Unitree non sta ferma. Alla 48esima edizione della WorldSkills Competition di Shanghai, 19 robot H2 hanno ballato con 120 danzatori umani in quella che è stata definita “la prima esibizione autonoma di sciame completamente AI-driven su umanoidi full-size”: sincronizzazione al millisecondo tramite LiDAR on-board, senza beacon esterni. E poi la passerella: i robot della casa sono sfilati a Vogue World Milan, fianco a fianco con Versace e Valentino. Il punto non è la moda, è il segnale: la robotica cinese sta scegliendo la vetrina culturale occidentale come leva di marketing geopolitico.
Una sintesi perfetta del momento: da una parte i regolatori cinesi tagliano le gambe alla speculazione finanziaria, dall’altra Pechino usa i suoi robot come soft power. La parte divertente è che anche i competitor privati si muovono: Unitree ha lanciato il 21 settembre la mano antropomorfa Dex5-S a 6.500 dollari, Boston Dynamics ha aperto una linea di addestramento per Atlas dentro lo stabilimento Hyundai in Georgia. L’industria è passata dalla fiera al piano industriale in dodici mesi.
Optimus Gen 3 spunta nell’app Tesla: giunture coperte, mani da 22 gradi e un milione di robot all’anno
Da mesi Tesla taceva su Optimus, poi ci ha pensato la sua stessa app a parlare. Nell’aggiornamento Android del 23-24 settembre sono spuntati i render 3D ufficiali di Optimus Gen 3, scovati da @WholeMars e rilanciati da @TeslaNewswire prima che il post originale sparisse. Non sono concept, sono i modelli che l’app userà per mostrarvi il robot sul telefono. E la differenza con il Gen 2.5 si vede tutta: coperture flessibili su bacino e anche, carenature nere opache al posto dell’oro su ginocchia e stinchi, silhouette più snella, pannelli più aderenti.
Il salto vero sono le mani: 22 gradi di libertà, vicinissime a una mano umana. Lo racconta bene Teslers.it, che nota anche il dettaglio software: se il robot finisce nell’app, Tesla sta già preparando il monitoraggio da telefono come per l’auto, flotte incluse. Dietro le quinte, la conversione delle vecchie linee Model S e Model X a Fremont per arrivare a un milione di unità l’anno, con il sogno texano dei dieci milioni. L’avvio della produzione di massa era previsto entro quest’anno: restano tre mesi.
Ma se il design production-ready è già nell’app, cosa manca davvero, l’hardware o il coraggio di mostrarlo?
Late Tech Show di questa settimana
In questa puntata affrontiamo tre grandi temi cruciali per il presente e il futuro dell’innovazione tecnologica e del business in Italia e in Europa:
- AI nelle imprese e crescita dei partner: con Annamaria Bottero (Microsoft) parliamo di come l'intelligenza artificiale generativa stia passando dalla sperimentazione all'integrazione nei processi aziendali. Spazio all'ecosistema di AI L.A.B. (for Frontier, Italy, Good, Startup), governance, sicurezza e formazione continua per i partner.
- Sovranità digitale e cloud sovrano: con Marco Giletta (OVHcloud) approfondiamo il tema della sovranità dei dati e del cloud europeo: trend di mercato, direttive UE, sicurezza delle infrastrutture critiche e i grandi progetti con partner istituzionali come ESA e BCE.
- Milano Digital Week 2026: la città generativa: con Layla Pavone (Comune di Milano) ed Emilio Mango (TIG - The Innovation Group) scopriamo le novità della nuova edizione: oltre 250 eventi diffusi sul territorio, lo Smart City Lab, l'hackathon dedicato all'accessibilità e il ruolo delle tecnologie al servizio dei cittadini e della comunità.
Qui la versione su Youtube.
Il Libro Physical AI
Vi ho detto che è appena uscito mio nuovo libro, ci saranno occasioni per parlarne insieme, sia online che fisiche, ve lo assicuro.
SmartBreak e Vita da ufficio
Oggi ho ripreso le live alle 11:00 sui miei profili social e su quelli di alcune associazioni manageriali che lo ripropongono. Trovate già la puntata su Spotify.
Techy e oltre
Se non vi siete ancora iscritti, fatelo, mi permettete di comprendere che apprezzate il mio lavoro.
Più persone la leggono, meglio è, quindi, per favore, condividilo con la tua famiglia, amici e colleghi per far sì che gli effetti di rete si diffondano.
Assicurati di aggiungere gigibeltrame@substack.com ai tuoi contatti. In Gmail, trascina questa newsletter nella tua scheda principale.
Grazie per aver letto questa newsletter, le trovi tutte a questo link.
Se ti va, contattami a questo link!
💻sito del Late Tech Show
💁♂️ La Bio
📚 Scopri i miei libri
Newsletter #Techy
👍 Seguimi su:
Magazine • LinkedIn • Instagram • Facebook • Youtube
Se ti è piaciuta, iscriviti
Condividi
E se ti è piaciuta, condividila con amici e colleghi.