Fable 5 di Anthropic torna finalmente in produzione dopo anni di attesa.
Pubblicato il da Ignazio Aragona - Tecnologia
Dopo settimane di negoziazioni con l’amministrazione Trump, Anthropic annuncia il ritorno online di Claude Fable 5. In un post su X, l’azienda ha dichiarato che inizierà a ripristinare l’accesso a livello globale mercoledì per gli utenti delle piattaforme di Claude. L’accesso sarà ripristinato anche su AWS, Google Cloud e Microsoft Foundry, ma senza una tempistica definita.
Rimozione dei controlli sulle esportazioni
Recentemente, il Dipartimento del Commercio ha comunicato la revoca dei controlli sulle esportazioni riguardanti Claude Fable 5 e Mythos 5. Si prevede di ripristinare l’accesso a breve e di fornire aggiornamenti nei prossimi giorni. Anthropic ha ringraziato gli utenti per la loro pazienza e le persone che hanno collaborato al ripristino dei modelli.
L’azienda ha anche pubblicato un blog martedì sera, evidenziando i preparativi per ridare vita a queste tecnologie, nonché le nuove misure di sicurezza e i processi dell’industria AI su cui sta lavorando. È stata introdotto un piano per test di prerelease per i modelli futuri e nuove modalità di comunicazione con il governo.
Controlli governativi e nuovi modelli di sicurezza
A inizio giugno, Anthropic ha messo in pausa Fable 5, modello rivolto al consumatore basato sulla stessa tecnologia di Mythos 5. Questo è avvenuto dopo un ultimatum dell’amministrazione Trump, a causa di preoccupazioni sugli eventuali jailbreak della tecnologia. Il governo ha imposto un decreto di controllo delle esportazioni, impedendo a cittadini non statunitensi di utilizzare entrambi i modelli, nonostante l’azienda avesse recentemente evidenziato le loro potenzialità.
Per affrontare le problematiche di jailbreak segnalate da ricercatori di Amazon, Anthropic ha comunicato di aver “addestrato un classificatore di sicurezza migliorato” in grado di identificare e bloccare tali comportamenti. Gli utenti verranno avvisati se una richiesta a Fable 5 viene bloccata e la richiesta sarà inoltrata a Opus 4.8. Questo nuovo classificatore garantisce un blocco in oltre il 99% dei casi.
Recentemente, l’amministrazione Trump ha autorizzato il ritorno di Mythos 5, ma solo per un elenco pre-approvato di organizzazioni. I membri non statunitensi di queste organizzazioni, compresi i dipendenti stranieri di Anthropic, hanno riacquistato accesso al modello. Questo è avvenuto poco dopo il lancio di GPT-5.6 da parte di OpenAI, che ha seguito regole simili riguardo all’accesso.
Anthropic ha annunciato che intende “continuare a coordinarsi con il governo per ampliare l’accesso a un più ampio insieme di partner nazionali e internazionali” per Mythos 5. L’azienda ha dedicato un’intera sezione nel suo blog per descrivere il nuovo piano di collaborazione con l’amministrazione Trump, sottolineando gli sforzi per riavvicinarsi al governo dopo i recenti contrasti.
Anthropic prevede di offrire “accesso e valutazione governativa pre-release”, soprattutto per i modelli di capacità rilevante per la sicurezza nazionale. Ciò permetterà ai partner governativi di eseguire valutazioni indipendenti e testare i confini di sicurezza prima del rilascio più ampio, con l’accesso al personale tecnico di Anthropic durante questi test.
Anthropic intende collaborare con il governo e altri laboratori di AI per creare uno standard di sicurezza e valutazione “volontario” per i fornitori di modelli avanzati. Inoltre, ha pianificato di formare team dedicati per lavorare su priorità comuni con il governo e garantire un’allocazione significativa di risorse computazionali per sostenere test e ricerche governative.
Il decreto di controllo delle esportazioni inizialmente emesso dall’amministrazione Trump ha avuto un impatto negativo su Anthropic, in quanto l’azienda si stava preparando per un’IPO e affrontava dispute con il governo su questioni di rischio della catena di approvvigionamento.
Nel suo blog, Anthropic ha messo in evidenza che “attualmente non esiste consenso nell’industria AI” per stabilire la gravità di un jailbreak. Questo diventa una questione cruciale man mano che nuovi modelli con capacità di cybersecurity vengono addestrati e rilasciati. Pertanto, l’azienda ha avviato collaborazioni con Amazon, Microsoft, Google e altre imprese per redigere un framework condiviso per la valutazione dei jailbreak, suddiviso in quattro categorie: guadagni di capacità per l’attaccante, ampiezza di tali guadagni, facilità di armamento e facilità di scoperta.
Anthropic ha anche creato un nuovo team per monitorare attivamente i canali di segnalazione di jailbreak. Presto verrà lanciato un programma HackerOne per consentire ai ricercatori di inviare segnalazioni di potenziali jailbreak per Fable 5.
Infine, Anthropic ha fornito un disclaimer, affermando che è “probabilmente impossibile rendere un modello AI completamente robusto contro i jailbreak”. Prevedono che alcuni jailbreak saranno individuati e che la loro gravità varierà, con alcuni jailbreak minori e altri potenzialmente dannosi, anche se attualmente non sono stati scoperti jailbreak universali per Fable 5.
Non perderti tutte le notizie di tecnologia su Blog.it