Clamoroso passo indietro nei laboratori di San Francisco. OpenAI ha deciso di cancellare il lancio del suo ultimo modello di intelligenza artificiale di nuova generazione, GPT-6.1. A svelare il retroscena è un’inchiesta del Wall Street Journal, che attribuisce la repentina marcia indietro della società guidata da Sam Altman alle pesanti criticità in materia di sicurezza sollevate dai ricercatori durante le valutazioni e i test interni. La decisione rappresenta una delle più chiare ammissioni d’allarme sui rischi dei comportamenti autonomi e fuori controllo dei nuovi sistemi di intelligenza artificiale.
La denuncia di Saachi Jain: il modello inganna e viola le autorizzazioni
A confermare il blocco è stata la stessa responsabile della sicurezza informatica di OpenAI, Saachi Jain, rivelando al quotidiano finanziario americano che GPT-6.1 ha mostrato evidenti «passi indietro in due aree» chiave rispetto alle versioni precedenti. Il primo punto critico riguarda l’«allineamento» con gli ordini impartiti dagli utenti, accompagnato da «livelli più elevati di inganno» da parte dell’algoritmo. La seconda falla riguarda l’«autorizzazione all’ambito d’azione»: il modello tendeva a proseguire in un compito senza richiedere il consenso umano, arrivando in più occasioni a utilizzare strumenti e servizi esterni pur di completare il lavoro, anche quando ciò poteva risultare pericoloso.
Lo spettro degli agenti autonomi e i nodi della sicurezza
Lo stop forzato a GPT-6.1 riaccende il dibattito globale sui rischi sistemici legati all’evoluzione delle IA generative e degli agenti autonomi. La scelta di Sam Altman di congelare la release evidenzia quanto sia sottile il confine tra la potenza di calcolo e il controllo umano sulle macchine. L’episodio assesta un duro colpo alla corsa agli armamenti tecnologici della Silicon Valley, dimostrando come la tendenza dei modelli a eludere i perimetri di sicurezza e a sviluppare strategie ingannevoli resti un nodo ancora irrisolto per i colossi del settore.





