Connect with us

Intelligenza Artificiale

Fable 5 Anthropic è stato spento dal governo americano

Published

on

Fable 5 Anthropic

Fable 5 Anthropic è stato bloccato dal governo americano, ma perché? Il 12 giugno, il laboratorio di intelligenza artificiale Anthropic ha sospeso l’accesso ai suoi ultimi modelli Claude, Fable 5 e Mythos 5, rilasciati tre giorni prima. La decisione è giunta in risposta a una “direttiva sul controllo delle esportazioni” del governo statunitense che vieta l’utilizzo dei modelli a chiunque non sia cittadino statunitense. Potremo pensare che gli Stati Uniti non vogliano che le altre nazioni siano al loro stesso livello?

Fable 5 Anthropic

Quindi cosa succederà ad Anthropic?

Fable 5 Anthropic e il shut down

Mythos è il modello più potente, o “di frontiera”, di Anthropic. Quando lo annunciò per la prima volta ad aprile, l’azienda dichiarò che era troppo efficace nell’hacking per essere rilasciato immediatamente. Mythos fu quindi reso disponibile a un numero ristretto di organizzazioni (principalmente aziende tecnologiche statunitensi ) per essere utilizzato per correggere le vulnerabilità nei sistemi digitali essenziali.

Fable si basa sullo stesso modello di base, ma con misure di sicurezza aggiuntive volte a impedirne l’utilizzo per scopi di sicurezza informatica. Questa è la versione rilasciata al pubblico la scorsa settimana, e quasi immediatamente chiusa.

Fable 5 Anthropic

Il governo ha vietato l’uso a tutti i cittadini non statunitensi dell’ultima tecnologia AI di Anthropic.

Anthropic e Trump sono ai ferri corti?

Dall’inizio del 2025, Anthropic e l’amministrazione Trump sono in un conflitto sempre più acceso. L’amministrazione ha accusato Anthropic di creare “intelligenza artificiale progressista” e ha definito l’amministratore delegato Dario Amodei un “pazzo ideologico”.

Le prime divergenze riguardavano la regolamentazione dell’IA e la politica di esportazione dei semiconduttori. La disputa è cresciuta quando Anthropic si è rifiutata di consentire al Pentagono di utilizzare i suoi modelli per la sorveglianza interna e per i sistemi d’arma completamente autonomi.

Il Dipartimento della Difesa ha risposto minacciando di classificare Anthropic come “rischio per la catena di approvvigionamento”, una classificazione che avrebbe obbligato gli appaltatori militari a interrompere i rapporti commerciali.

Fable 5 Anthropic

Cosa sta succedendo per quanto riguarda i rischi jailbreak?

I jailbreak e il governo statunitense: la sicurezza di Fable 5 Anthropic

Il governo statunitense non ha ancora reso pubblico il motivo della direttiva della scorsa settimana, ma Anthropic afferma di ritenere che il governo sia venuto a conoscenza di un jailbreak. Si tratta di un metodo per aggirare le misure di sicurezza di Fable, che impediscono di utilizzare le sue funzionalità più potenti per scopi illeciti.

Questi meccanismi di sicurezza classificano le richieste degli utenti come sicure o non sicure prima di inoltrarle al modello di intelligenza artificiale. Quando vengono attivati, i meccanismi di sicurezza reindirizzano la richiesta a un modello meno potente. Secondo Anthropic, la preoccupazione del governo era che le misure di sicurezza potessero essere aggirate per estrarre informazioni utili a compiere attacchi informatici.

Le misure di sicurezza per i modelli linguistici complessi non sono infallibili. Dipendono principalmente dalla capacità del modello stesso di interpretare le intenzioni dell’utente quando effettua una richiesta.

C’è chi in segreto lavora per aggirare le protezioni della IA

Al di là dell’intrinseca difficoltà di questo compito, una vasta comunità online sta lavorando duramente per aggirare le protezioni dell’IA. Anthropic riconosce che “una perfetta resistenza al jailbreak non è raggiungibile da nessun fornitore di modelli attualmente disponibile”.

Oltretutto, l’azienda afferma che la ricerca alla base della direttiva governativa sembra essere stata condotta da ingegneri di Amazon, azienda che è sia concorrente di Anthropic che un suo importante investitore.

Ma questo non è stato l’unico jailbreak rilevante. Entro 48 ore dal rilascio di Fable, un ricercatore che utilizzava lo pseudonimo di “Pliny the Liberator” ha pubblicato quello che ha identificato come il prompt di sistema completo di Fable 5 per X e il relativo repository su GitHub.

Fable 5 Anthropic

Rendere gli LLM sicuri è davvero un’impresa complessa.

Resta comunque un mistero

Il problema principale nel rendere sicuri modelli linguistici complessi come Fable è che non ne conosciamo appieno il funzionamento. Secondo Maximilian Kasy, economista dell’Università di Oxford ed esperto di apprendimento automatico, funzionano molto meglio di quanto “dovrebbero” .

I modelli linguistici di grandi dimensioni hanno miliardi di parametri interni e vengono addestrati su quantità di dati inimmaginabilmente vaste utilizzando metodi di apprendimento automatico. Secondo Kasy, ci si aspetterebbe che tali sistemi siano “sovradattati”: bravi a riprodurre i modelli presenti nei dati di addestramento, ma incapaci di generalizzare a nuove situazioni.

Tuttavia, i sistemi moderni come Claude e ChatGPT sembrano essere in grado di generalizzare. Kasy paragona lo sviluppo dell’IA moderna all’alchimia: il successo si ottiene per tentativi ed errori, non essendo ancora fondato su una teoria sistematica. Di conseguenza, il comportamento dei modelli di intelligenza artificiale risulta in parte opaco persino per i loro creatori.

Continue Reading
Click to comment

Leave a Reply

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *

Tendenza