happy.com.tr

happy.com.tr

happy.com.tr

happy.com.tr

happy.com.tr

happy.com.tr

happy.com.tr

happy.com.tr

happy.com.tr

happy.com.tr

happy.com.tr

happy.com.tr

happy.com.tr

happy.com.tr

happy.com.tr

happy.com.tr

happy.com.tr

happy.com.tr

happy.com.tr

happy.com.tr

slot depo 10k slot depo 10k
Teknologi

Claude Menguasai 26% Tugas di Anthropic, Bukan Manusia Lagi

Jakarta – Dalam era kecerdasan buatan yang berkembang pesat, kehadiran Claude di Anthropic telah menunjukkan dampak yang signifikan. Dengan kemampuan untuk memimpin hingga 26% dari total pekerjaan penelitian dan pengembangan (R&D), Claude bukan sekadar alat, tetapi telah menjadi komponen integral dalam proses inovasi teknologi AI. Angka ini menandakan evolusi dari keterlibatan manusia dalam R&D, dan menimbulkan pertanyaan mengenai peran AI dalam pengembangan teknologi masa depan. Artikel ini akan menjelaskan lebih dalam tentang bagaimana Claude beroperasi di Anthropic, serta apa artinya bagi industri AI secara keseluruhan.

Peningkatan Keterlibatan Claude dalam R&D

Dalam laporan terbaru, Anthropic mengungkapkan bahwa Claude kini memegang peranan utama dalam pekerjaan R&D, dengan proporsi yang meningkat drastis. Pada awal tahun 2026, peran Claude masih berada di bawah 1%, tetapi angka ini melonjak menjadi 26% pada Agustus 2026. Ini menunjukkan tren signifikan dalam penggunaan AI dalam pengembangan teknologi generasi selanjutnya. Namun, penting untuk dicatat bahwa istilah ‘leads’ tidak berarti Claude bekerja sepenuhnya tanpa pengawasan manusia.

Dalam metodologi yang dikembangkan Anthropic, kategori ini mengindikasikan bahwa Claude dapat menyelesaikan sebagian besar tugas secara end-to-end berdasarkan instruksi tingkat tinggi, sementara pengawasan manusia tetap ada. Dengan demikian, meskipun angka 26% menunjukkan peran penting Claude, ia tidak sepenuhnya menggantikan fungsi manusia dalam proses R&D.

Peran AI dalam R&D di Anthropic

Selain porsi 26% pekerjaan yang dipimpin Claude, data menunjukkan bahwa lebih dari 90% dari total pekerjaan R&D yang diukur telah berada dalam kategori AI collaborates atau lebih tinggi. Dalam konteks ini, AI berkolaborasi dengan manusia untuk menyelesaikan bagian besar dari pekerjaan, meskipun masih memerlukan arahan dan supervisi dari individu. Proses pengukuran ini menggunakan skala yang dikenal sebagai Automation Level (AL), yang dikembangkan oleh Epoch AI.

  • AL0: Tidak ada keterlibatan AI.
  • AL1-2: AI terlibat dalam tugas-tugas dasar.
  • AL3: AI berkolaborasi di bawah arahan manusia.
  • AL4: AI memimpin sebagian besar pekerjaan dengan supervisi manusia.
  • AL5: AI beroperasi sepenuhnya tanpa keterlibatan manusia.

Skala ini memungkinkan Anthropic untuk membangun Anthropic R&D Automation Index, yang memberikan gambaran jelas tentang tingkat otomatisasi dalam berbagai kategori pekerjaan R&D. Melalui pendekatan ini, Anthropic dapat mengevaluasi seberapa besar peran AI dalam setiap tahap pengembangan.

Metodologi dalam Penilaian R&D

Untuk membangun indeks tersebut, Anthropic melakukan pengambilan sampel terhadap 20% staf dari setiap departemen yang terlibat dalam siklus R&D. Proses ini dilakukan setiap minggu pada bulan Juli 2026, menghasilkan sekitar 15.000 tugas R&D yang dikelompokkan oleh Claude ke dalam 542 kategori. Claude kemudian bertugas untuk meneliti tingkat otomatisasi pada setiap kategori, serta membandingkan hasil penilaiannya dengan penilaian dari karyawan yang bertanggung jawab atas bidang terkait.

Menariknya, Anthropic melaporkan bahwa terdapat kesesuaian penuh sebesar 59% antara penilaian Claude dan manusia, sedangkan untuk penilai manusia satu sama lain, kesesuaian penuh hanya mencapai 35%. Dalam 97% kasus, penilaian Claude dan manusia berada dalam rentang satu tingkat otomatisasi yang sama, menunjukkan bahwa Claude dapat diandalkan dalam memberikan evaluasi yang akurat.

Jumlah Agen AI yang Beroperasi

Selain peran Claude, penggunaan AI di Anthropic juga terlihat dari jumlah agen AI yang beroperasi dalam aktivitas penelitian dan rekayasa. Hingga Agustus 2026, terdapat sekitar 30.000 agen yang menjalankan tugas-tugas R&D di platform internal Anthropic. Semua agen ini berada di bawah pengawasan sistem yang dirancang untuk mendeteksi dan mengurangi risiko tindakan yang tidak diinginkan.

  • Pemantauan Online: Dilakukan sebelum agen mengambil tindakan.
  • Pemantauan Offline: Menganalisis aktivitas setelah tindakan dilakukan.
  • Keputusan yang Diblokir: Hanya 0,002% dari lebih dari satu miliar keputusan yang dibuat agen diblokir oleh sistem pemantauan online.
  • Transkrip yang Ditandai: Sekitar 100.000 transkrip ditandai setiap minggu untuk pemeriksaan lebih lanjut.
  • Pemeriksaan Manusia: Sekitar 50 kasus prioritas tinggi ditindaklanjuti oleh pemeriksa manusia setiap minggu.

Data ini menunjukkan adanya sistem yang sangat terstruktur dalam pengawasan aktivitas AI di Anthropic, memastikan bahwa semua tindakan yang diambil oleh agen AI tetap dalam batasan yang aman.

Pengukuran Perkembangan AI di Anthropic

Pengungkapan terkait penggunaan Claude di dalam perusahaan merupakan langkah penting bagi Anthropic untuk memudahkan pengukuran dan perbandingan perkembangan AI. Selain tingkat otomatisasi R&D, perusahaan juga mengusulkan dua ukuran tambahan, yaitu tingkat pengawasan terhadap agen AI dan alokasi komputasi untuk R&D. Dalam seminggu pengukuran, sekitar 6% dari total komputasi yang digunakan untuk R&D AI dialokasikan untuk pekerjaan terkait keselamatan AI. Jika hanya memperhitungkan komputasi yang digerakkan oleh AI, porsinya meningkat menjadi sekitar 12%.

Anthropic menekankan bahwa angka tersebut merupakan estimasi konservatif dan bukan ukuran langsung dari seluruh sumber daya yang digunakan untuk keselamatan AI. Metrik ini juga dirancang agar dapat digunakan oleh pengembang AI lainnya, menciptakan standar yang konsisten dalam industri.

Tantangan dalam Pembandingan Hasil

Anthropic mengidentifikasi dua tantangan utama dalam membandingkan hasil antar perusahaan. Pertama, kurangnya metodologi bersama yang dapat digunakan sebagai acuan. Kedua, penggunaan model AI yang berbeda untuk melakukan evaluasi yang bisa mengakibatkan bias. Untuk mengatasi masalah ini, Anthropic berencana melibatkan evaluator pihak ketiga yang akan mendapatkan akses ke proses, sistem, dan data internal tertentu. Hal ini penting untuk memungkinkan verifikasi independen terhadap pengukuran dan praktik keselamatan yang dilaporkan.

Impikasi bagi Masa Depan AI

Dengan meningkatnya peran AI seperti Claude dalam pengembangan teknologi, ada banyak hal yang perlu dipertimbangkan. Meskipun angka 26% menunjukkan kontribusi Claude yang signifikan, penting untuk memahami konteks di baliknya. Ini bukan hanya tentang seberapa banyak pekerjaan yang dapat diselesaikan oleh AI, tetapi juga tentang bagaimana AI berkolaborasi dengan manusia untuk mencapai hasil yang lebih baik.

Anthropic menegaskan bahwa Claude belum sepenuhnya otonom dalam kategori R&D yang diukur. Oleh karena itu, peran manusia dalam pengawasan dan pengambilan keputusan tetap krusial. Dalam konteks ini, kolaborasi antara manusia dan AI harus dilihat sebagai sinergi yang memperkuat kemampuan masing-masing, bukan sebagai pengganti.

Seiring dengan kemajuan teknologi yang terus berlanjut, penting untuk terus memantau perkembangan ini dan bagaimana mereka akan membentuk masa depan di berbagai sektor. Claude di Anthropic adalah contoh nyata dari potensi AI, dan bagaimana AI dapat diintegrasikan secara efektif dalam proses inovasi dan pengembangan teknologi.

➡️ Baca Juga: Pantai Parangtritis Ramai Pengunjung, Wisatawan Diingatkan Hati-hati saat Bermain Air

➡️ Baca Juga: Riekerink Jelaskan Perbedaan Gaya Bermain Dewa United dan Persib Bandung

Related Articles

Back to top button