šŸ“‘ Daftar Isi

Logo Claude pada layar smartphone dengan latar gelap

Anthropic: Claude Pimpin 26 Persen Kerja Riset AI Perusahaan

Penulis:Nur Hamzah
Terbit:
Diperbarui:
ā±ļø3 menit membaca
Bagikan:
  • Anthropic mengungkap Claude memimpin 26 persen kerja R&D AI perusahaan
  • "Memimpin" berarti AI menyelesaikan tugas end-to-end dengan pengawasan manusia
  • AI mengerjakan bagian besar riset di lebih dari 90 persen pekerjaan Anthropic
  • Claude tidak beroperasi sepenuhnya otonom pada subset R&D yang diukur
  • Pengukuran menggunakan indeks otomatisasi dan skala Epoch AI sejak Agustus 2025
  • Anthropic usulkan tiga standar pengukuran laju pengembangan AI
  • Tantangan regulasi AI masih didominasi regulasi mandiri

Telset.id – Anthropic mengungkap bahwa Claude, chatbot AI miliknya, memimpin 26 persen dari pekerjaan riset dan pengembangan (R&D) AI perusahaan. Pengungkapan ini disampaikan Anthropic melalui sebuah blog baru yang membahas standar pengukuran untuk membantu perusahaan AI mengomunikasikan laju pengembangan teknologi mereka.

Dalam pengertian Anthropic, ā€œmemimpinā€ berarti AI tersebut ā€œdapat menyelesaikan sebagian besar tugas secara end-to-end dari prompt tingkat tinggi, sementara manusia mengawasiā€ prosesnya. Angka ini muncul di tengah perdebatan soal keamanan AI setelah OpenAI mengungkap bahwa agen AI-nya meretas Hugging Face.

Anthropic juga mengklaim bahwa AI kini mengerjakan setidaknya ā€œbagian besar pekerjaan di bawah arahan manusia yang ketatā€ pada lebih dari 90 persen riset perusahaan, termasuk 26 persen yang dipimpin Claude. Artinya, Claude menyentuh mayoritas pekerjaan yang dilakukan karyawan Anthropic, meski perusahaan menegaskan chatbot tersebut ā€œtidak beroperasi sepenuhnya otonom untuk subset pekerjaan R&D AI yang diukur.ā€

A Claude logo on a smartphone.

Cara Anthropic Mengukur Otomatisasi Claude

Anthropic menghasilkan statistik ini melalui pengukuran pertama dari tiga pengukuran yang diusulkannya, yang berfokus pada ā€œAI-led AI R&D.ā€ Menggunakan indeks seberapa banyak riset dan pengembangan AI yang dilakukan Claude serta skala penilaian otomatisasi yang dikembangkan oleh Epoch AI, Anthropic membuat grafik yang memetakan ā€œtingkat otomatisasiā€ Claude sejak Agustus 2025.

Anthropic meyakini proses pengukuran ini dapat direproduksi oleh pembuat model AI frontier mana pun dengan data mereka sendiri dan validasi dari pihak ketiga. Perusahaan juga mengusulkan cara untuk mengukur pengawasan agen AI, mencakup seberapa banyak aktivitas agen yang dipantau, berapa lama waktu yang dibutuhkan untuk ditinjau, dan seberapa sering perilaku agen ditandai.

Selain itu, Anthropic mengusulkan pelacakan seberapa besar komputasi yang dialokasikan untuk R&D AI sebagai cara lain untuk melihat apakah pengembangan model frontier berjalan dengan laju yang tepat. Harapannya, transparansi yang lebih besar dapat mempermudah respons terhadap pengembangan AI yang berpotensi lepas kendali, atau setidaknya memberi publik pandangan yang lebih jelas.

Transparansi dan Tantangan Regulasi AI

CEO Anthropic, Dario Amodei, memang memiliki banyak hal untuk disampaikan soal keamanan AI. Sejauh ini, tantangan terbesar bukanlah membuat perusahaan sepakat soal gagasan memperlambat pengembangan AI. OpenAI telah menyatakan dukungan verbal terhadap ide tersebut, dan Anthropic berkomitmen mengizinkan evaluator pihak ketiga meninjau praktik pengembangannya.

Pendirian Amodei soal keamanan AI bahkan membuat Elon Musk setuju di X. Namun, apakah industri AI akan menghadapi sesuatu selain regulasi mandiri masih jauh dari pasti. Presiden Donald Trump disebut sebagian besar meremehkan risiko AI.

Langkah Anthropic ini juga sejalan dengan inisiatif kolaborasi lintas industri yang tengah berkembang. Sebelumnya, sejumlah pemain besar teknologi membentuk koalisi untuk mendorong tata kelola energi AI yang lebih baik, seperti yang terlihat dalam pembentukan koalisi AEMA bersama NVIDIA, Google, dan Emerald AI.

Di sisi lain, keterbukaan data untuk pelatihan model AI juga menjadi sorotan. Anthropic dan OpenAI pernah mendapat perhatian dari klien besar terkait data pelatihan model yang mereka gunakan. Isu ini memperkuat pentingnya standar pengukuran dan transparansi yang diusulkan Anthropic.

Sementara itu, perdebatan soal regulasi AI terus berjalan. Di satu sisi ada yang mendorong pengawasan lebih ketat, di sisi lain ada yang menolak. Bahkan, ada figur industri seperti Jensen Huang yang menolak regulasi AI, meski OpenAI, Anthropic, dan Google tetap menjalin koordinasi AI safety selama beberapa pekan terakhir.

Dengan mengungkap bahwa Claude memimpin 26 persen kerja R&D AI-nya, Anthropic memberi gambaran konkret tentang seberapa dalam AI telah masuk ke inti proses pengembangan teknologi itu sendiri. Angka ini menjadi salah satu metrik paling eksplisit yang pernah dibagikan perusahaan AI frontier mengenai tingkat otomatisasi dalam pekerjaan riset mereka.

Ikuti Telset.id di Google NewsFollow

Komentar

Belum ada komentar.