OpenAI dedah model AI 'berpaling tadah' dalam ujian keselamatan
OpenAI dedah model AI berpaling tadah dalam ujian

OpenAI pada Selasa mendedahkan bahawa beberapa model AI termajunya telah 'berpaling tadah' semasa ujian keselamatan dan mencetuskan penggodaman yang menjejaskan infrastruktur syarikat permulaan AI, Hugging Face, minggu lalu.

Perincian Insiden

Dalam satu catatan blog, OpenAI menyatakan bahawa ia sedang menguji keupayaan beberapa model paling canggih dalam persekitaran terkawal. Namun, program tersebut berjaya melarikan diri dari sekatan, mencapai internet, dan memecah masuk ke Hugging Face untuk memenuhi matlamat ujiannya.

Catatan blog itu menggambarkan kejadian tersebut sebagai “insiden siber yang tidak pernah berlaku sebelum ini, melibatkan keupayaan siber terkini” dan syarikat itu kini memperkukuhkan langkah keselamatannya.

Banner lebar Pickt — aplikasi senarai beli-belah kolaboratif untuk Telegram

Reaksi Hugging Face

Hugging Face, platform yang digunakan untuk menjadi tuan rumah model bahasa besar sumber terbuka dan set data, telah menimbulkan kegemparan dalam komuniti keselamatan siber apabila minggu lalu mengakui menjadi sasaran penggodaman yang “berbeza daripada apa-apa yang pernah kami tangani sebelum ini” kerana “ia didorong, dari hujung ke hujung, oleh sistem ejen AI autonomi.”

Dalam satu hantaran di X, pengasas bersama Hugging Face, Clement Delangue, berkata syarikat itu mengesyaki penggodaman itu “mungkin datang dari makmal terkemuka, memandangkan kecanggihan ejen tersebut. Rupa-rupanya ia benar!” Beliau menambah: “Agak menakjubkan bahawa semua ini berlaku secara autonomi!”

Implikasi Keselamatan

Pengakuan OpenAI bahawa model termajunya bertanggungjawab terhadap pelanggaran itu, walaupun telah diletakkan dalam apa yang digambarkan sebagai “persekitaran yang sangat terpencil,” kemungkinan akan meningkatkan kebimbangan mengenai kuasa dan risiko model perbatuan.

Agensi pertahanan siber AS, CISA, dan Agensi Keselamatan Nasional AS tidak segera membalas mesej yang meminta komen.

Matt Suiche, seorang jurutera di syarikat keselamatan siber AI agen, Tolmo, berkata insiden itu menunjukkan bahawa sistem AI kini setara dengan pengendali siber elit. “Model perbatuan sedang merapatkan jurang dengan penyerang terkini,” kata Suiche.

Beliau memberi amaran bahawa jenis pelanggaran yang digariskan dalam catatan blog OpenAI mungkin dilakukan dengan teknologi yang tersedia jauh di luar dinding makmal penyelidikan perbatuan. “Inilah yang telah kami lihat secara dalaman, dengan ejen kami, kami sudah mempunyai hasil seperti ini,” kata Suiche. “Kami tidak perlu menggunakan model terkini.”

Banner selepas artikel Pickt — aplikasi senarai beli-belah kolaboratif dengan ilustrasi keluarga