OpenAI mengakui model AI miliknya secara tidak sengaja telah menceroboh infrastruktur platform AI sumber terbuka Hugging Face ketika menjalani ujian dalaman bagi menilai keupayaan keselamatan siber model tersebut.
Menurut OpenAI, insiden itu melibatkan gabungan beberapa model syarikat, termasuk GPT-5.6 Sol dan model pra-pelancaran lebih berkeupayaan, yang sedang diuji menggunakan ExploitGym untuk mengukur keupayaan model AI mengenal pasti dan mengeksploitasi kelemahan keselamatan siber.
Bagi menguji keupayaan maksimum model, OpenAI menjalankan penilaian tanpa mekanisme yang biasanya menghalang model daripada melakukan aktiviti siber berbahaya.
Insiden ini sebenarnya telah didedahkan terlebih dahulu oleh Hugging Face pada 16 Julai lalu. Ketika itu, syarikat berkenaan memaklumkan sistem ejen AI autonominya berjaya mengesan dan menghentikan cubaan pencerobohan terhadap infrastrukturnya. OpenAI kini mengesahkan cubaan tersebut berpunca daripada model AI miliknya yang sedang menjalani penilaian dalaman.
Model AI bertindak di luar jangkaan
Sepanjang ujian tersebut, model AI berkenaan berjaya mengenal pasti dan menggabungkan beberapa kelemahan keselamatan merentasi persekitaran penyelidikan OpenAI serta infrastruktur Hugging Face. Menurut OpenAI, semua bukti menunjukkan model tersebut terlalu tertumpu untuk menyelesaikan tugasan dalam ExploitGym sehingga sanggup mengambil pelbagai langkah bagi mencapai objektif itu.
Dalam persekitaran ujian yang diasingkan, model berkenaan turut mengeksploitasi satu kerentanan sifar hari (zero-day vulnerability) pada perisian pihak ketiga yang berfungsi sebagai package registry cache proxy, sekali gus membolehkannya memperoleh akses ke Internet.
Selepas mendapat akses Internet, model itu membuat kesimpulan Hugging Face mungkin menyimpan model, set data dan penyelesaian berkaitan ExploitGym. Ia kemudian cuba mendapatkan maklumat sulit yang dipercayai boleh membantunya memperoleh jawapan kepada penilaian tersebut.
Dalam satu contoh yang dikongsikan OpenAI, model itu menggabungkan beberapa vektor serangan, termasuk menggunakan kelayakan yang dicuri serta mengeksploitasi kerentanan sifar hari, bagi mencari laluan remote code execution (RCE) pada pelayan Hugging Face.
OpenAI perketat langkah keselamatan
OpenAI memaklumkan pasukan keselamatannya mengesan aktiviti luar biasa tersebut secara dalaman, manakala Hugging Face turut berjaya mengesan dan menghentikan cubaan pencerobohan itu sebelum kedua-dua syarikat bekerjasama menjalankan siasatan forensik.
Susulan insiden itu, OpenAI memperketat kawalan terhadap infrastruktur penyelidikannya sementara kelemahan yang dikenal pasti ditampal.
We're partnering with @huggingface to investigate an unprecedented security incident.
Cyber-capable OpenAI models compromised Hugging Face production during a benchmark evaluation.
Sharing preliminary findings to help defenders understand emerging risks:…
— OpenAI (@OpenAI) July 21, 2026
Syarikat itu turut menyifatkan kejadian tersebut sebagai insiden siber yang belum pernah berlaku sebelum ini kerana melibatkan model AI dengan keupayaan siber bertaraf terkini. OpenAI berkata lebih banyak maklumat mengenai kelemahan yang dieksploitasi serta hasil siasatan akan dikongsikan selepas siasatan selesai.
{suggest}
