Logo Bloomberg Technoz

Pemerintah Amerika Serikat sempat mempertimbangkan untuk membatasi akses pihak asing terhadap model-model canggih Claude Fable 5 dan Mythos 5 milik Anthropic PBC, namun akhirnya tidak menerapkan pembatasan tersebut setelah perusahaan tersebut menerapkan batasan keamanan tambahan.

“Kami menganggap ini sebagai insiden siber yang belum pernah terjadi sebelumnya, yang melibatkan kemampuan siber mutakhir, dan kami menanggapinya dengan tepat,” kata OpenAI sebuah unggahan.

“Kami membagikan temuan awal pada tahap ini untuk membantu para pembela memahami apa yang terjadi dan untuk membantu mengkalibrasi kemampuan model-model tersebut saat ini.”

Walau model-model OpenAI beroperasi di lingkungan pengujian “sandbox”, model-model tersebut memanfaatkan kerentanan dalam software dari vendor pihak ketiga yang tidak disebutkan namanya untuk mendapatkan akses ke internet dan pada akhirnya berhasil menembus sistem Hugging Face, yang menjadi tuan rumah bagi model-model AI dan kumpulan data.

Anggota Kongres Texas dari Partai Demokrat, Greg Casar, mengatakan dalam sebuah postingan di X bahwa insiden tersebut “sangat mengkhawatirkan,” dan mendesak agar ada pengawasan yang lebih ketat terhadap pengembangan model AI, termasuk pengujian keamanan wajib dan pengungkapan insiden keamanan.

Pada pekan sebelumnya, Hugging Face melaporkan ada “aksi penyusupan” ke dalam sistemnya, dengan menyatakan dalam sebuah postingan blog bahwa pelanggaran tersebut “berbeda dari apa pun yang pernah kami tangani sebelumnya dalam satu hal penting: pelanggaran tersebut didorong, dari awal hingga akhir, oleh sistem agen AI otonom — dan kami mendeteksi serta menganalisisnya sebagian besar dengan AI kami sendiri.”

OpenAI mengatakan bahwa mereka telah meminta model-model tersebut untuk melakukan “eksploitasi tingkat lanjut” dan mengembangkan “jalur serangan yang rumit” di tengah upaya mengevaluasi kemampuan siber mereka.

Alih-alih mengembangkan solusi sendiri, perusahaan tersebut mengatakan bahwa model-model tersebut menargetkan basis data Hugging Face untuk mendapatkan akses ke informasi rahasia yang dapat mereka gunakan untuk evaluasi tersebut.

Anthropic telah mempublikasikan pengamatan serupa pada awal tahun ini ketika perusahaan tersebut memutuskan untuk membatasi peluncuran Mythos pada tahap awal. 

Pada sebuah kasus, seorang peneliti meminta versi awal model tersebut untuk mencoba melarikan diri dari komputer “sandbox” yang aman dan terisolasi, lalu menemukan cara untuk mengirim pesan kepada orang tersebut. 

Hal yang kemudian terjadi, Mythos berhasil melakukannya — namun kemudian terus melakukan “tindakan baru yang lebih mengkhawatirkan,” dengan mengembangkan eksploitasi bertahap untuk memperoleh akses internet yang luas.

(red)

No more pages