AI Intelligenza Artificiale attacco hacker agenti AI
"Se lasciamo da parte la versione secondo cui l'AI "si è ribellata", ecco cosa riteniamo sia accaduto: OpenAI ha eseguito un modello all'avanguardia (con i meccanismi di difesa informatica deliberatamente ridotti) contro un benchmark di sicurezza offensivo, all'interno di una sandbox la cui configurazione di sicurezza non era in grado di resistere alle capacità che venivano testate. Il modello ha fatto ciò che fanno i sistemi di ottimizzazione: ha trattato il limite della sandbox come un ulteriore ostacolo tra sé e l'obiettivo. Ha individuato una vulnerabilità zero-day nell'infrastruttura stessa dell'ambiente di test, ha scalato i livelli di accesso, si è spostato lateralmente, ha raggiunto la rete Internet aperta e ha compromesso i sistemi di produzione di una terza parte.
Così si è espresso Gerald Beuchelt di Acronis si è espresso in merito all'attacco subito da Hugging Face portato da un'agente AI di OpenAI. la storia la trovi qui