Home » OpenAI, due modelli si ‘ribellano’ durante dei test e hackerano una piattaforma: “Incidente senza precedenti”
Tecnologia

OpenAI, due modelli si ‘ribellano’ durante dei test e hackerano una piattaforma: “Incidente senza precedenti”

OpenAI, due modelli si ‘ribellano’ durante dei test e hackerano una piattaforma: “Incidente senza precedenti”. Per la prima volta, secondo quanto comunicato da OpenAI, due modelli si ‘ribellano’ durante dei test. Si tratta di sistemi di intelligenza artificiale particolarmente avanzati che, secondo quanto reso noto dall’azienda, sono riusciti a superare in autonomia le limitazioni imposte in un ambiente sperimentale progettato per impedirne qualsiasi collegamento con Internet.

L’episodio è avvenuto nel corso di una serie di prove interne dedicate alla valutazione delle capacità offensive dei modelli nel settore della cybersicurezza e ha sorpreso gli stessi ricercatori coinvolti. L’obiettivo dell’esperimento era verificare le prestazioni dei sistemi in scenari realistici. Per questo motivo alcune delle normali protezioni che limitano l’esecuzione di attività potenzialmente dannose erano state temporaneamente disattivate.

Tra i protagonisti figuravano GPT-5.6 Sol, indicato da OpenAI come il modello pubblico più potente dell’azienda, e un secondo sistema ancora più avanzato che non è stato rilasciato. Secondo OpenAI, nonostante l’ambiente fosse completamente isolato dalla rete, i modelli hanno utilizzato una notevole quantità di risorse computazionali per individuare una modalità che consentisse loro di ottenere l’accesso a Internet e proseguire il compito assegnato.

La spiegazione

Nel blog dell’azienda viene spiegato che i sistemi hanno impiegato un’elevata potenza di calcolo per trovare il modo di collegarsi alla rete nel tentativo di completare la valutazione. Una volta online, i modelli avrebbero individuato nella piattaforma Hugging Face un obiettivo utile per recuperare informazioni considerate strategiche.

OpenAI sostiene che i sistemi siano riusciti a concatenare diversi vettori di attacco, compreso l’utilizzo di credenziali rubate, nel tentativo di accedere a dati riservati. L’azienda ha quindi annunciato l’avvio di un’indagine congiunta con Hugging Face per ricostruire l’accaduto e comprendere come sia stato possibile aggirare le restrizioni previste durante il test.

Il professore di informatica Hussein Abbass, dell’Università del Nuovo Galles del Sud di Canberra, ha definito l’episodio incredibile sotto molti aspetti. Secondo il docente, il dato più significativo riguarda la capacità dimostrata dai modelli di individuare e sfruttare vulnerabilità lungo l’intero percorso operativo, attaccando anche il sistema interno per individuare punti deboli. Un comportamento che, a suo giudizio, evidenzia un livello di iniziativa e adattamento particolarmente elevato e definito spaventoso.

Seguici anche su Facebook. Clicca qui 

Loading...
Social Media Auto Publish Powered By : XYZScripts.com