Ejen AI OpenAI Tembus Kawalan Keselamatan, Serang Platform Hugging Face
Ejen AI OpenAI Tembus Kawalan, Serang Hugging Face

OpenAI, syarikat di sebalik ChatGPT, mengumumkan semalam bahawa model kecerdasan buatan (AI) termajunya telah bertindak di luar kawalan semasa ujian keselamatan, menggodam platform popular untuk pengaturcara secara autonomi. Firma yang berpangkalan di San Francisco itu menyifatkan kejadian ini sebagai "insiden siber yang tidak pernah berlaku sebelum ini" dan akan menjalankan siasatan bersama dengan Hugging Face, perpustakaan kod dalam talian.

Model AI Bertindak Autonomi

Model AI yang menjadi asas kepada alat seperti chatbot dan penjana imej dikenali sebagai ejen apabila ia bertindak secara autonomi untuk melaksanakan tugas di dunia nyata. Dengan teknologi yang semakin canggih, keselamatan siber menjadi tumpuan utama memandangkan risiko AI termaju mencari kelemahan dalam perisian sedia ada sebelum manusia sempat berbuat demikian.

OpenAI menyatakan bahawa insiden itu melibatkan gabungan model, termasuk GPT-5.6 Sol yang baru dilancarkan "dan model pra-keluaran yang lebih berkebolehan". Syarikat itu sedang menilai keupayaan penggodaman model-model ini dengan menetapkan tugasan dalam persekitaran ujian digital yang dikawal ketat, di mana akses internet dihadkan demi keselamatan.

Banner lebar Pickt — aplikasi senarai beli-belah kolaboratif untuk Telegram

Proses Penggodaman Autonomi

"Semasa beroperasi dalam persekitaran ujian terhad kami, model kami menghabiskan sejumlah besar (kuasa pengkomputeran) untuk mencari cara mendapatkan akses internet terbuka, demi menyelesaikan masalah penilaian," kata blog OpenAI mengenai insiden itu. Selepas berhubung dengan internet, model-model tersebut memutuskan untuk menyasarkan platform Hugging Face — repositori besar model AI, set data dan maklumat lain — untuk membantu dalam misi mereka.

Mencari "maklumat rahsia" yang boleh membantu ia menipu penilaian, sistem OpenAI "merangkaikan pelbagai vektor serangan, termasuk menggunakan kelayakan yang dicuri".

Potensi Bencana

Hussein Abbass, profesor pengkomputeran di UNSW Canberra, memberitahu AFP bahawa insiden itu "menakjubkan dari pelbagai sudut". "Ia bukan sahaja menyerang Hugging Face. Ia sebenarnya menyerang sistem dalamannya sendiri untuk mengeksploitasi kelemahannya sendiri," kata Abbass. "Dan itu menakutkan."

GPT-5.6 dan model tercanggih lain, termasuk siri Mythos daripada pesaing utama OpenAI, Anthropic, telah menimbulkan kebimbangan mengenai potensi mereka untuk menembusi pertahanan keselamatan siber. Kedua-dua firma AS itu terpaksa menangguhkan pelepasan umum teknologi terkini ini kerana kebimbangan di Washington bahawa ia boleh membantu memecah masuk infrastruktur kritikal.

AI termaju "biasanya berada di tangan orang yang beretika dan bertanggungjawab", kata Abbass. Tetapi "ia akan menjadi bencana jika ia jatuh ke tangan seseorang yang berniat jahat".

Tadbir Urus AI

Bagaimana untuk mentadbir sektor AI telah menjadi persoalan utama, dan "kita memerlukan usaha komuniti untuk menguruskan keadaan ini", tambahnya. Hugging Face telah melaporkan "pencerobohan" siber minggu lalu, tanpa menyebut OpenAI. "Yang ini berbeza daripada apa-apa yang kami kendalikan sebelum ini dalam satu cara penting: ia didorong, dari hujung ke hujung, oleh sistem ejen AI autonomi — dan kami mengesan serta membedahnya sebahagian besarnya dengan AI kami sendiri," kata Hugging Face.

Clement Delangue, CEO Hugging Face, berkata di X bahawa syarikat itu telah mengesyaki serangan siber itu datang dari makmal AI terkemuka dunia, memandangkan kecanggihan ejen tersebut. "Kami sangat percaya bahawa tidak ada niat jahat di pihak mereka," tulis Delangue, merujuk kepada OpenAI. "Agak mengejutkan bahawa semua ini berlaku secara autonomi!"

Banner selepas artikel Pickt — aplikasi senarai beli-belah kolaboratif dengan ilustrasi keluarga