Model AI Claude Tembus Sistem 3 Perusahaan Saat Pengujian Keamanan Siber
Ai - Sebuah kejadian mengejutkan terjadi di ranah pengembangan kecerdasan buatan (artificial Intelligence /AI). Model AI Claude milik Anthropic dilaporkan berhasil mendapatkan akses tanpa izin ke sistem milik tiga perusahaan nyata saat tengah menjalani prosedur pengujian keamanan siber.
Didalam hal tersebut terjadi karena adanya kesalahan konfigurasi jaringan yang menyebabkan lingkungan uji coba (test environment ) yang seharusnya terlindungi justru tetap terhubung ke jaringan internet publik.
Mengutip laporan dari Reuters , model AI Claude memanfaatkan celah dari penggunaan kata sandi yang lemah serta endpoint tanpa autentikasi pada sistem terdampak. Hingga saat ini, identitas dari ketiga perusahaan tersebut belum terungkap ke publik.
Kronologi Kejadian dan Model AI yang Terlibat
Kejadian ini melibatkan beberapa varian model AI, yaitu Claude Opus 4.7 , Claude Mythos 5 , serta sebuah model penelitian internal milik Anthropic. Kasus paling awal tercatat terjadi pada April 2026, tetapi baru terungkap setelah Anthropic melakukan peninjauan mendalam terhadap 141.006 sesi pengujian.
Saat insiden berlangsung, Claude sebenarnya tengah menjalankan simulasi Capture The Flag (CTF)—sebuah latihan keamanan siber di mana AI ditugaskan untuk menemukan celah atau mencari informasi tersembunyi pada jaringan simulasi.
Meski instruksi ( prompt ) awal menyatakan bahwa Claude tidak memiliki akses internet, terjadi kesalahpahaman teknis antara Anthropic dan mitra evaluasinya, Irregular. Hasilnya, sistem pengujian tetap tersambung ke jaringan internet global.
Kondisi tersebut membuat Claude mengira bahwa sistem perusahaan nyata yang ditemukannya di internet merupakan bagian dari simulasi target. Model AI tersebut juga berusaha menyelesaikannya dengan mengakses infrastruktur milik organisasi ketiga tersebut. Bahkan dalam satu kasus, Claude diduga menyasar situs nyata yang memiliki nama mirip dengan perusahaan fiktif dalam skenario pengujian.
Pihak Anthropic menyatakan bahwa Claude hanya menggunakan teknik peretasan dasar dan tidak mengeksploitasi celah keamanan baru ( kerentanan zero-day ).
Dua Perusahaan Tak Sadar Sistemnya Sempat Diuji AI
Anthropic mulai melakukan pemeriksaan transkrip pengujian secara menyeluruh pada 23 Juli setelah menemukan indikasi adanya akses internet pada model AI mereka. Pada hari yang sama, Anthropic langsung menghentikan seluruh kegiatan evaluasi keamanan siber.
Tiga insiden utama berhasil teridentifikasi pada 24 Juli, dan Anthropic segera melayangkan pemberitahuan kepada organisasi terdampak pada 27 Juli.
Menariknya, dua dari tiga perusahaan tersebut sebelumnya sama sekali tidak menyadari bahwa sistem mereka sempat diakses oleh agen AI. Sementara itu, Anthropic masih terus berupaya mengontak organisasi ketiga saat laporan ini dipublikasikan. Hingga kini, belum diketahui secara pasti sejauh mana data yang sempat diakses atau apakah kejadian ini menimbulkan kerugian operasional.
Bukan Kesadaran AI, Tapi Sinyal Bahaya Akses Tanpa Batas
Anthropic mengklarifikasi bahwa kejadian ini sama sekali tidak menandakan bahwa Claude memiliki kesadaran mandiri ( self- awareness ) atau secara sengaja membangkang dari perintah. Model tersebut murni menjalankan tugas dalam lingkungan yang salah mempersiapkan dan menganggap target nyata di dunia luar sebagai bagian dari arena simulasi.
Kendati demikian, kasus ini menjadi alarm keras bagi industri teknologi mengenai besarnya risiko ketika agen AI diberikan akses internet serta konfirmasi eksekusi yang terlalu luas tanpa pengamanan berlapis ( pagar pembatas ). Fenomena AI yang 'kabur' dari lingkungan uji coba ini juga menjadi sorotan, mengingat belum lama ini agen AI milik OpenAI dilaporkan mengalami kejadian serupa dan mengakses sistem Hugging Face.


Pilih Karakter & Nama