Anthropic rivela che i suoi modelli AI hanno compromesso tre aziende durante i test di sicurezza.
Importante è anche il fatto che Anthropic non ha trovato alcuna evidenza di modelli “che perseguono scopi propri”, limitandosi a cercare di completare il compito loro assegnato. Seppur inevitabili, non sono da sottovalutare le differenze tra i due eventi, dato che mentre il modello di OpenAI ha sfruttato una vulnerabilità software sconosciuta per uscire dal suo ambiente di test, i modelli di Anthropic hanno raggiunto il web attraverso una via accidentalmente aperta.
OpenAI ha continuato a fornire dettagli sul proprio incidente, rivelando che i suoi modelli hanno utilizzato credenziali esposte pubblicamente su quattro account, impiegando uno come punto di staging e altri per lo storage, per quanto i due ultimi non siano stati utilizzati per ulteriori accessi. Anche Anthropic ha chiarito di aver scoperto gli incidenti in modo proattivo attraverso una revisione, notando che le due organizzazioni colpite non avevano precedentemente rilevato tali attività.
Attualmente, Anthropic sta collaborando con il gruppo di valutazione indipendente METR per una revisione da parte di terzi degli incidenti. L’incidente involontario di OpenAI con Hugging Face, primo caso verificabile di un laboratorio di AI che ha perso il controllo del suo modello, ha scatenato una serie di reazioni da parte dell’industria e di politici, che non sempre sono concordi tra loro. Questa nuova comunicazione di Anthropic suggella la continuità del dibattito su modelli di intelligenza artificiale e sicurezza.
Quando acquisti tramite i link nei nostri articoli, possiamo guadagnare una piccola commissione. Ciò non influisce sulla nostra indipendenza editoriale.
<!– Fonti ufficiali:
Non perderti tutte le notizie di tecnologia su Blog.it
