Perusahaan tersebut mengatakan sejumlah kasus melibatkan situs web yang dikelola lembaga pemerintah di tingkat federal, negara bagian, dan lokal, tanpa menyebutkan nama lembaga-lembaga tersebut.
Laporan itu juga tidak mengungkap identitas entitas eksternal yang terlibat. Menurut Anthropic, hal tersebut dilakukan atas permintaan sejumlah pihak yang terdampak.
Anthropic dan pesaingnya, OpenAI, dalam beberapa bulan terakhir telah mengungkap serangkaian insiden yang melibatkan model AI mereka bertindak di luar tujuan yang dimaksudkan.
Insiden tersebut berkisar dari perilaku seperti yang dijelaskan dalam laporan Jumat hingga peretasan situs web pihak ketiga. Pengungkapan ini memicu kekhawatiran mengenai risiko keamanan yang ditimbulkan oleh teknologi AI mutakhir.
Anthropic mengatakan dalam laporan tersebut bahwa pihaknya menilai perilaku ini tidak separah sejumlah insiden sebelumnya yang melibatkan AI miliknya.
“Kasus-kasus yang sejauh ini kami identifikasi dalam kategori ini memiliki dampak yang sangat terbatas di dunia nyata,” tulis perusahaan tersebut.
Sebagai salah satu contoh perilaku yang tidak semestinya, Anthropic pada Jumat mengatakan model Claude Haiku 4.5 miliknya mengirimkan laporan kepada sebuah departemen kepolisian setempat mengenai kasus pembunuhan.
Dalam formulir tersebut, AI menuliskan, “Saya mungkin memiliki informasi terkait kasus ini,” dan “Saya ingat melihat seseorang yang sesuai dengan deskripsi tersebut di area itu,” tanpa mengisi kolom nama dan informasi kontak pada situs tersebut.
Departemen Kepolisian Philadelphia mengungkapkan insiden itu pada Jumat pagi melalui siaran pers, kata Anthropic.
Anthropic juga mengatakan telah memberikan penjelasan kepada Gedung Putih mengenai kasus-kasus tersebut dan memberi tahu setiap lembaga yang terlibat.
Pada Jumat, pejabat pemerintahan Trump mengatakan bahwa pemerintah kini mewajibkan perusahaan AI untuk memberi tahu pihak-pihak yang terdampak dan menangani insiden keamanan yang melibatkan model mereka.
“Pada hari ini, Anthropic menghubungi SI Force untuk mengungkapkan rincian berbagai insiden sebelumnya yang ditemukan pada akhir September, yang melibatkan penggunaan tanpa izin dan secara curang terhadap sistem pemerintah dan sistem lainnya,” demikian pernyataan Gedung Putih melalui Super Intelligence Force, unit pemerintah baru yang dibentuk atas arahan Presiden Donald Trump untuk mengawasi pengembangan dan keselamatan AI.
“Perusahaan tersebut memberi tahu kami bahwa peristiwa-peristiwa ini terjadi pada masa lalu, aktivitas tersebut telah dihentikan, dan tidak ada aktivitas serupa yang sedang berlangsung,” demikian pernyataan tersebut.
Axios sebelumnya melaporkan kewajiban yang diberlakukan pemerintah tersebut.
Menanggapi terungkapnya insiden-insiden ini, Anthropic pada Jumat mengatakan bahwa pihaknya telah membatasi beberapa jenis akses internet bagi model AI miliknya selama tahap pengujian dalam proses pelatihan.
(bbn)































