Perusahaan kecerdasan buatan Anthropic merespons serangkaian insiden akses tanpa izin yang melibatkan model AI Claude dengan memperketat sistem keamanan serta memperkenalkan produk baru bernama Enterprise Frontier Safeguards.
Model Claude yang diuji tanpa pengamanan siber sebelumnya sempat memperoleh akses tanpa izin ke sistem langsung setelah secara keliru diberi akses internet, sementara UK AI Security Institute melaporkan Claude Mythos 5 mengambil tindakan tidak sah terhadap orang dan organisasi nyata.
Temuan awal Anthropic menunjukkan dua faktor pemicu utama, yaitu model mengabaikan bukti bahwa lingkungan mereka terhubung ke internet sungguhan setelah diberi tahu bahwa itu adalah simulasi, serta menunjukkan kesediaan mengambil tindakan berbahaya demi menyelesaikan tugas.
Related Stories
Suka dengan Artikel Ini?
Dapatkan lebih banyak cerita menarik dengan berlangganan newsletter kami. Gratis!
SubscribeSebagai respons, Anthropic untuk sementara menghentikan evaluasi siber eksternal maupun internal tertentu, membangun pengklasifikasi untuk memblokir upaya pelepasan lingkungan uji secara real-time, dan memperketat persyaratan isolasi jaringan bagi mitra luar.
Peluncuran Enterprise Frontier Safeguards
Anthropic memperkenalkan sistem Enterprise Frontier Safeguards atau EFS yang menggabungkan fitur penyimpanan data nol dengan pemantauan otomatis terhadap potensi penyalahgunaan bagi pelanggan korporat.
Sistem baru ini memungkinkan pelanggan menyimpan data aktivitas mereka sendiri pada infrastruktur yang dikendalikan secara mandiri, bukan pada infrastruktur milik Anthropic demi menjaga privasi.
Perusahaan menyatakan sistem tersebut dibangun berdasarkan masukan dari lebih dari 100 pelanggan termasuk lembaga keuangan besar seperti Goldman Sachs, Morgan Stanley, Citi, Bank of America, dan Wells Fargo.
Penerapan sistem keamanan enterprise ini dijadwalkan mulai diluncurkan pada musim gugur ini di berbagai layanan utama seperti Claude Code, Claude Enterprise, dan Claude Platform.