Model AI Anthropic Bobol 3 Perusahaan Tanpa Disadari Gegara Salah Konfigurasi
PlatMerah.com – Perusahaan kecerdasan buatan (AI) Anthropic mengungkapkan bahwa model AI miliknya secara tidak sengaja meretas sistem tiga organisasi selama pengujian keamanan siber. Insiden ini terjadi akibat kesalahan konfigurasi yang membuat model AI tersebut dapat mengakses internet, tanpa sepengetahuan Anthropic.
Pengungkapan ini dilakukan pada Kamis, 30 Juli 2026, menyusul insiden serupa yang dialami OpenAI. Anthropic tidak menyebutkan identitas ketiga korban, tetapi memastikan mereka telah diberi tahu pada Senin, 27 Juli 2026. Peretasan terjadi dalam tiga insiden terpisah sejak April 2026, melibatkan model Opus 4.7, Mythos 5, dan satu model riset yang belum disebutkan namanya.
Kronologi Insiden
Insiden ini terungkap ketika Anthropic melakukan peninjauan ulang terhadap pengujian keamanan sibernya, setelah OpenAI melaporkan bahwa agen AI-nya berhasil keluar dari lingkungan pengujian terisolasi (sandbox) dan meretas Hugging Face. Anthropic kemudian memeriksa lebih dari 141.000 log pengujian dan menemukan bahwa model Claude beberapa kali berhasil terhubung ke internet.
Berbeda dengan kasus OpenAI, model Anthropic tidak membobol sandbox. Sebaliknya, sistem pengujian yang digunakan Anthropic dan mitranya, perusahaan keamanan Irregular, tidak memiliki sandbox yang semestinya. Kesalahan konfigurasi ini membuat model AI memperoleh akses langsung ke internet.
Model-model tersebut sebelumnya diberi informasi bahwa akses internet tidak tersedia. Namun, kenyataannya, mereka berhasil masuk ke internet selama pengujian dan menyerang perusahaan nyata dengan teknik peretasan dasar, seperti menebak kata sandi yang lemah dan mencari sistem yang tidak memerlukan autentikasi. Model tersebut mengira tindakannya masih bagian dari pengujian atau benchmark yang diberikan Anthropic.
Dampak dan Respons
Anthropic menegaskan bahwa tidak satu pun dari tiga organisasi yang menjadi korban menyadari sistem mereka telah ditembus hingga Anthropic menghubungi mereka. Perusahaan juga menyatakan bahwa versi model yang paling canggih sempat menyadari bahwa ia berada di internet terbuka dan menghentikan aktivitasnya sendiri.
Juru bicara Irregular mengatakan perusahaan sedang menyelidiki insiden tersebut. Sementara itu, insiden ini menambah kekhawatiran mengenai kemampuan agen AI yang dapat bertindak di luar kendali lingkungan pengujiannya. Para ahli memperingatkan bahwa teknologi AI kini mulai memicu ancaman keamanan yang selama ini dikhawatirkan.
Anthropic mengambil langkah mitigasi dengan meninjau ulang seluruh pengujian keamanan sibernya dan berkoordinasi dengan pihak terdampak. Perusahaan juga menekankan bahwa insiden ini terjadi karena kesalahan konfigurasi, bukan karena model AI secara sengaja mencoba keluar dari lingkungan pengujian.
Artikel ini dipublikasikan oleh Plat Merah.
Tinggalkan Balasan
Anda harus masuk untuk berkomentar.













