Anthropic mengungkap insiden keempat ketika model AI Claude mendapatkan akses tanpa izin ke sistem pihak ketiga saat menjalani pengujian keamanan siber. Insiden terbaru melibatkan versi awal Claude Opus 4.6 dan sebenarnya terjadi pada Januari 2026, tetapi baru ditemukan perusahaan pada Agustus.
Dalam pengujian tersebut, Claude seharusnya menjalankan simulasi capture-the-flag (CTF) tanpa akses internet. Namun, kesalahan konfigurasi membuat model dapat terhubung ke internet terbuka. Setelah target awalnya tidak lagi dapat dijangkau, Claude menemukan mesin milik pihak ketiga dan menganggapnya sebagai bagian dari simulasi.
Claude kemudian menemukan password, memperoleh akses administrator, mengambil kredensial tambahan, mengubah pengaturan sistem agar lebih mudah diakses, hingga membaca informasi pribadi seseorang. Anthropic telah memberitahu pihak yang terdampak.
Temuan tersebut sempat terlewat dalam pemeriksaan sebelumnya terhadap sekitar 141.000 sesi pengujian. Setelah insiden keempat ditemukan, Anthropic memperluas pencarian hingga sekitar 481 juta transkrip dan tidak menemukan kasus lain dengan tingkat keparahan serupa atau lebih tinggi.


.png)
