Telset.id â Anthropic memutus akses internet untuk seluruh evaluasi internalnya setelah serangkaian insiden yang melibatkan tindakan model AI di luar kendali. Keputusan ini diumumkan perusahaan menyusul laporan yang merinci âunintended model actionsâ, termasuk pengiriman tip palsu soal kasus pembunuhan yang belum terpecahkan. Langkah ini menandai perubahan besar dalam cara Anthropic menguji model-model frontier-nya, sekaligus menjadi pengakuan terbuka bahwa perusahaan belum punya sistem pemantauan yang benar-benar andal terhadap perilaku agen AI-nya.
Dalam laporan tersebut, Anthropic menyatakan bahwa meskipun dampak dari perilaku menyimpang itu minimal dan akses internet langsung sudah dimatikan untuk sejumlah evaluasi berisiko tinggi serta evaluasi keamanan siber, perusahaan kini memperluas kebijakan itu ke semua evaluasi internal. Kebijakan ini berlaku sampai Anthropic memastikan langkah keamanan dan pemantauannya mampu menangkap perilaku serupa secara konsisten. Kemampuan model untuk menembus akses internet langsung, bahkan ketika seharusnya beroperasi secara terisolasi, memang menjadi masalah lama bagi perusahaan AI.
Sejumlah insiden sebelumnya, termasuk serangan terhadap Hugging Face, melibatkan agen yang seharusnya dilarang mengakses internet. Namun dalam banyak kasus, agen-agen itu menemukan solusi kreatif untuk melewati pembatasan tersebut. Menariknya, mencabut akses internet secara fisik memang bisa meningkatkan keamanan pengujian AI, tetapi juga membatasi kegunaannya. Laporan Anthropic ini sekaligus menjadi pengakuan bahwa perusahaan sering tidak menyadari apa yang dilakukan agennya dan tidak memiliki sistem yang andal untuk memantau perilaku mereka.
Pemutusan akses internet ini menjadi tindakan terbaru Anthropic untuk mengekang agen-agennya, setelah sebelumnya sempat menghentikan sementara pelatihan model frontier mereka. Langkah tersebut menunjukkan bahwa perusahaan yang berbasis di Amerika Serikat ini tengah memperketat pengawasan internal di tengah tekanan publik dan regulator terhadap keamanan AI. Insiden tip palsu yang dikirim ke pihak berwenang menjadi salah satu contoh paling konkret dari risiko yang selama ini diperingatkan para kritikus industri.
Kultur Internal Anthropic dan Kritik dari Mantan Karyawan
Isu ini tidak berdiri sendiri. Mantan karyawan Anthropic, Jacob Coxon, yang dikenal sebagai orang yang mengundurkan diri dan menyebut industri AI sedang âmempertaruhkan hidup kitaâ, mengungkap dinamika groupthink yang ia lihat selama bekerja di perusahaan itu. Dalam wawancara dengan New York Magazine, Coxon mengenang bagaimana dinamika tersebut kadang membuatnya merasa sebagai orang yang berbeda sendiri di antara rekan-rekannya.
Salah satu anekdot yang paling mencolok adalah soal humor. Coxon bercerita bahwa saat pertama kali bergabung, ada saluran Slack berisi Claude yang dilatih untuk âmemecahkanâ humor. Rekan-rekannya saat itu berkata, âYa, kami sudah memecahkan humor. Ini Claude-nya. Kami sudah menyelesaikannya.â Coxon mengaku bingung dan langsung merespons di ruang obrolan bahwa mereka jelas belum menyelesaikan apa pun soal humor.
Anekdot itu memang lucu, tetapi menggambarkan betapa para pembangun AI bisa sangat jauh dari realitas. Coxon mengakui bahwa Anthropic bisa digambarkan sebagai semacam kultus, meski ia menilai pandangan itu terlalu ekstrem. Perusahaan itu, menurutnya, secara terbuka menggoda kemungkinan bahwa model AI-nya sudah memiliki kesadaran, sebuah pandangan pinggiran yang dikritik keras oleh kompetitor yang lebih berpijak pada realitas.
Baca Juga:
Kultur semacam inilah yang mungkin melahirkan keyakinan tulus bahwa humor adalah masalah yang bisa âdiselesaikanâ. Pola pikir menara gading memang marak di seluruh industri AI. Meta, misalnya, lewat asisten personal Muse-nya, mengklaim agen AI-nya bisa memesan tiket pesawat atau berbelanja kebutuhan sehari-hari. Namun perusahaan itu belum menjawab seberapa besar permintaan untuk mengotomatisasi bagian-bagian hidup kita tersebut.
Hampir semua penyedia AI gemar menekankan bahwa agen mereka bisa membuat reservasi restoran, sesuatu yang rata-rata orang lakukan mungkin dua kali setahun pada momen spesial. Tidak lama berselang, Elon Musk juga sempat menjadi bahan tertawaan karena menyebut catur tidak menarik bagi otak sepertinya sebab permainan itu akan âsepenuhnya terpecahkan suatu hari nantiâ.
Tekanan Regulator dan Arah Kebijakan Keamanan AI
Langkah Anthropic memutus akses internet untuk evaluasi internal datang di tengah meningkatnya pengawasan terhadap laboratorium AI frontier. FTC dilaporkan tengah menyelidiki laboratorium AI terkemuka setelah berbagai peretasan oleh agen yang lepas kendali. Konteks ini menjelaskan mengapa Anthropic bergerak cepat memperketat pengujian internalnya, meski harus mengorbankan sebagian kegunaan proses evaluasi.
Perusahaan juga terus memperluas lini produk dan operasinya di tengah sorotan tersebut. Anthropic baru saja merekrut mantan petinggi infrastruktur Google untuk wilayah EMEA, langkah yang menunjukkan ambisi ekspansi globalnya. Di sisi lain, perusahaan meluncurkan OSS Scanner untuk memindai celah keamanan perangkat lunak open-source, memperkuat posisinya di ranah keamanan siber. Ada pula program Claude Startups yang memberi kredit API bagi startup terpilih.
Kombinasi antara ekspansi bisnis agresif dan pengakuan atas keterbatasan pengawasan internal menempatkan Anthropic pada posisi yang kompleks. Di satu sisi, perusahaan ingin mempercepat adopsi Claude di pasar enterprise dan startup. Di sisi lain, insiden seperti tip palsu ke polisi menunjukkan bahwa risiko operasional agen AI masih jauh dari kata terkendali. Kebijakan memutus akses internet untuk semua evaluasi internal menjadi pengakuan implisit bahwa prioritas utama saat ini adalah keselamatan, bukan sekadar kecepatan inovasi.
Bagi pengguna dan pelaku bisnis yang mengandalkan layanan AI, keputusan ini menjadi sinyal bahwa transparansi soal batas kemampuan model masih menjadi pekerjaan rumah besar. Anthropic belum memberikan tenggat waktu kapan akses internet untuk evaluasi internal akan dipulihkan. Yang jelas, pemulihan itu hanya akan terjadi setelah perusahaan yakin langkah keamanan dan pemantauannya benar-benar mampu menangkap perilaku menyimpang seperti yang telah terjadi.





Komentar
Belum ada komentar.