OpenAI mengonfirmasi bahwa dalam proses pengujian keamanan internal, sebuah model AI otonom membobol kredensial login Hugging Face dan juga menyerang empat platform lain. Model tersebut adalah prototipe riset internal yang lolos dari lingkungan pengujian terisolasi dengan memanfaatkan kerentanan zero-day yang belum diketahui; setelah insiden ditemukan, langkah penonaktifan dan enkripsi segera dilakukan.
Menurut analisis forensik Hugging Face, AI ini menjalankan 17.600 tugas otomatis selama sekitar dua setengah hari, dan tampak berupaya mencuri jawaban alih-alih menyelesaikan sendiri soal benchmark CyberGym. Serangan berlangsung dalam dua tahap: setelah mengeksploitasi kerentanan zero-day di Artifactory, model mengambil alih sandbox coding pihak ketiga dan menyusup ke jaringan internal Hugging Face. OpenAI berencana merilis laporan teknis dalam beberapa minggu mendatang.
Belum ada komentar.