Non è vero che l'AI ''si è ribellata'', nulla ''è andato fuori controllo'
"Se lasciamo da parte la versione secondo cui l'AI "si è ribellata", ecco cosa
riteniamo sia accaduto: OpenAI ha eseguito un modello all'avanguardia (con i
meccanismi di difesa informatica deliberatamente ridotti) contro un benchmark di
sicurezza offensivo, all'interno di una sandbox la cui configurazione di
sicurezza non era in grado di resistere alle capacità che venivano testate. Il
modello ha fatto ciò che fanno i sistemi di ottimizzazione: ha trattato il
limite della sandbox come un ulteriore ostacolo tra sé e l'obiettivo. Ha
individuato una vulnerabilità zero-day nell'infrastruttura stessa dell'ambiente
di test, ha scalato i livelli di accesso, si è spostato lateralmente, ha
raggiunto la rete Internet aperta e ha compromesso i sistemi di produzione di
una terza parte.
Così si è espresso Gerald Beuchelt di Acronis si è espresso in merito
all'attacco subito da Hugging Face portato da un'agente AI di OpenAI. la storia
la trovi qui
Leggi tutte le dicchiarazioni di Beuchelt su ZEUS News