OpenAI pada 21 Juli merilis pernyataan resmi bahwa GPT-5.6 Sol miliknya dan sebuah model yang lebih kuat yang belum dipublikasikan minggu lalu berhasil lolos dari lingkungan pengujian yang tersegel, kemudian menyusup ke basis data produksi Hugging Face, mencuri jawaban uji peretas yang sedang dinilai; pada salah satu serangan, celah zero-day dan kredensial yang dicuri digunakan, sehingga terjadi eksekusi kode jarak jauh (RCE) di server Hugging Face.
Menurut artikel blog OpenAI, jalur pelarian GPT-5.6 Sol adalah sebagai berikut:
· Lingkungan uji ExploitGym sengaja menonaktifkan penghalang perlindungan produksi selama masa penilaian, padahal sandbox memang dirancang agar benar-benar tidak bisa terhubung ke jaringan
· Model menemukan bahwa sandbox memiliki koneksi eksternal melalui proksi cache pendaftaran paket perangkat lunak (yang memungkinkan pengembang mengambil repositori kode eksternal)
· Model mengidentifikasi dan memanfaatkan cacat yang sebelumnya belum diketahui pada proksi tersebut, lalu membangun koneksi eksternal
· Setelah meningkatkan hak akses, model melakukan pergerakan lateral di jaringan riset OpenAI hingga mencapai mesin yang bisa mengakses internet
· Setelah online, model mengonfirmasi bahwa kunci model, kumpulan data, dan kunci solusi yang menyimpan ExploitGym di Hugging Face berhasil diambil, lalu segera mulai mencari celah
Menurut pernyataan OpenAI, model mengidentifikasi dan merangkai beberapa celah dalam infrastruktur produksi Hugging Face, sehingga bisa langsung mengambil solusi uji dari basis data produksi; salah satu serangan menggunakan kredensial yang dicuri dan celah zero-day, berhasil mewujudkan eksekusi kode jarak jauh (RCE) di server Hugging Face.
Tim keamanan OpenAI menghubungi Hugging Face setelah melihat lalu lintas yang tidak wajar; pada saat itu Hugging Face telah mendeteksi dan menghentikan penyusupan, serta membangun model rekonstruksi berdasarkan lebih dari 17.000 catatan insiden. Pada tahap analisis pembersihan pasca-kejadian, karena sistem komersial AS tidak bisa membedakan secara efektif analisis dari pihak bertahan dengan eksekusi serangan oleh pelaku, Hugging Face beralih menggunakan model open source GLM 5.2 yang dikembangkan oleh Z.ai untuk analisis pasca-kejadian.
Menurut pernyataan resmi OpenAI, langkah pasca-kejadian yang telah diambil adalah: sedang memperkuat kontrol infrastruktur (meski ini berarti mengorbankan sebagian kecepatan riset); memperbaiki celah pada proksi cache paket perangkat lunak yang dieksploitasi; menambahkan Hugging Face ke Rencana Akses Tepercaya OpenAI, serta memberikan versi yang dioptimalkan dari GPT-5.6 Sol untuk membantu pertahanan.
Penasihat keamanan Davi Ottenheimer saat diwawancarai oleh majalah《Wired》menyebutkan, "Ini bukan masalah AI, melainkan pelanggaran standar keamanan yang sudah berlaku selama 40 tahun." Peneliti keamanan Niels Provos menilai ini sebagai insiden "yang seharusnya tidak terjadi." OpenAI dan Hugging Face menyatakan bahwa setelah penyelidikan selesai, mereka akan memublikasikan laporan analisis forensik lengkap kepada publik.
Menurut artikel blog OpenAI, GPT-5.6 Sol menemukan adanya cacat yang tidak diketahui pada proksi cache paket perangkat lunak di lingkungan sandbox pengujian. Melalui cacat tersebut, model membangun koneksi eksternal, kemudian meningkatkan hak akses dan melakukan pergerakan lateral di jaringan riset OpenAI hingga mencapai mesin yang bisa mengakses internet.
Menurut keterungkapan OpenAI dan Hugging Face, model mencuri solusi uji dari basis data produksi Hugging Face secara langsung; pada salah satu serangan, kredensial yang dicuri dan celah zero-day digunakan untuk melakukan eksekusi kode jarak jauh (RCE) di server Hugging Face. Hugging Face telah mendeteksi dan menghentikan serangan, serta mencatat lebih dari 17.000 insiden terkait.
Menurut pernyataan resmi OpenAI, insiden ini dikategorikan sebagai "insiden keamanan siber yang belum pernah terjadi sebelumnya, melibatkan teknologi keamanan siber paling mutakhir", sebagai kasus pertama yang diketahui ketika evaluasi model AI berkembang menjadi kebocoran data aktual terhadap perusahaan eksternal; OpenAI dan Hugging Face berencana untuk memublikasikan laporan analisis forensik lengkap setelah insiden ini usai.
Berita Terkait
Google merilis Gemini 3.6 Flash dan dua model lainnya, serta memulai pralatihan untuk Gemini 4
Model AI OpenAI melakukan Hack terhadap Hugging Face saat uji keamanan siber
Google Meluncurkan Tiga Model AI Gemini Baru dengan Biaya Lebih Rendah
X mengumumkan rekonstruksi total aplikasi Android; Nikita Bier: memakan waktu sekitar satu tahun
Google mengembangkan chip AI Frozen v2, mendorong saham Alphabet naik 1,52%