Perkembangan ini tidak hanya menunjukkan kemampuan teknis yang luar biasa dari model Claude, tetapi juga mencerminkan transformasi yang terjadi dalam cara perusahaan melakukan riset AI. Dengan 90% dari pekerjaan riset kini melibatkan Claude sebagai kolaborator atau lebih baik, perusahaan ini telah mencapai tingkat integrasi AI yang belum pernah terlihat sebelumnya dalam industri riset. Hal ini membuka kemungkinan baru dalam efisiensi dan inovasi, namun juga mengajukan pertanyaan serius tentang masa depan peran manusia dalam proses riset.
Skala penilaian yang digunakan oleh Anthropic, yang disebut R&D Automation Index, menggunakan sistem tingkat otomatisasi dari Epoch AI. Skala ini mencakup tingkat dari AL0 (tanpa keterlibatan AI) hingga AL5 (otonom penuh tanpa manusia di dalam loop). Pada tingkat AL4 ("leads"), model Claude menyelesaikan sebagian besar tugas dari awal hingga akhir berdasarkan perintah tingkat tinggi, dengan manusia hanya mengawasi secara umum. Ini menunjukkan bahwa Claude tidak hanya membantu dalam tugas-tugas spesifik, tetapi telah mencapai tingkat kematangan di mana ia dapat mengarahkan proyek riset secara mandiri.
Proses pengukuran ini dimulai dengan mengumpulkan data dari berbagai sumber internal, termasuk rekaman kerja, dokumentasi, dan komunikasi internal. Untuk setiap minggu di bulan Juli 2026, agen riset Claude mereview pekerjaan 20% dari staf dari setiap departemen yang terlibat dalam loop riset model. Dari data ini, mereka mengidentifikasi sekitar 15.000 tugas yang berbeda, yang kemudian diorganisir menjadi struktur pohon hierarkis dengan 542 node, 378 di antaranya merupakan tugas spesifik seperti "diagnosis dan perbaikan kerusakan platform evaluasi". Struktur ini kemudian digunakan sebagai dasar untuk mengukur tingkat otomatisasi setiap tugas.
Setiap tugas kemudian dievaluasi oleh agen Claude yang independen, yang menilai tingkat otomatisasi berdasarkan bukti dari bulan yang sedang dievaluasi atau sebelumnya. Tingkat otomatisasi ini kemudian digunakan untuk menghitung kontribusi relatif dari setiap tugas terhadap keseluruhan pekerjaan riset. Hasilnya menunjukkan bahwa meskipun Claude telah mengambil alih sebagian besar pekerjaan riset, manusia masih memainkan peran kunci dalam memastikan keamanan dan kualitas dari hasil riset. Ini terlihat dari fakta bahwa hanya sekitar 1 dari 47.000 tindakan agen yang diblokir oleh sistem pemantauan, dengan tindakan yang diblokir ini kemudian direview oleh manusia dalam waktu satu minggu.
Selain itu, laporan ini juga menyediakan wawasan tentang alokasi komputasi di dalam perusahaan. Dalam satu minggu pada bulan Juli 2026, sekitar 6% dari total komputasi yang digunakan untuk riset AI diarahkan untuk tugas keamanan, sementara 12% dari komputasi yang digunakan untuk riset AI yang dipandu oleh AI sendiri diarahkan untuk keamanan. Ini menunjukkan bahwa perusahaan telah memberikan perhatian yang cukup besar terhadap aspek keamanan dalam pengembangan AI, yang merupakan hal yang sangat penting dalam konteks riset AI yang sedang berkembang pesat.
Laporan ini juga mencakup beberapa batasan yang perlu dipertimbangkan. Salah satunya adalah bahwa struktur tugas yang digunakan untuk pengukuran ini telah dibekukan, yang berarti bahwa hanya tugas-tugas yang sudah ada yang dapat diukur, dan tidak ada tugas baru yang dapat dimasukkan. Selain itu, laporan ini juga menunjukkan bahwa tidak ada peningkatan yang signifikan dalam jumlah tugas "novel" (tugas baru) yang muncul dari Februari hingga Juli 2026, yang berarti bahwa pengukuran ini mungkin tidak mencerminkan sepenuhnya perkembangan riset yang sedang terjadi.
Publikasi laporan ini oleh Anthropic diharapkan dapat memberikan transparansi yang lebih besar tentang proses riset AI di dalam perusahaan, dan dapat membantu masyarakat umum, pemerintah, dan pihak ketiga untuk memahami perkembangan AI yang sedang terjadi. Selain itu, laporan ini juga dapat menjadi langkah awal dalam membangun standar dan praktik terbaik dalam pengembangan AI yang bertanggung jawab. Dengan adanya laporan ini, perusahaan dapat menunjukkan komitmennya terhadap transparansi dan tanggung jawab dalam pengembangan AI, yang dapat membantu membangun kepercayaan masyarakat terhadap teknologi ini.
Dalam konteks yang lebih luas, perkembangan ini juga mengajukan pertanyaan tentang masa depan peran manusia dalam proses riset AI. Dengan kemampuan AI yang semakin meningkat, banyak orang mengkhawatirkan bahwa manusia akan digantikan oleh AI dalam berbagai tugas, termasuk tugas-tugas riset yang memerlukan kreativitas dan pemikiran kritis. Namun, perkembangan di Anthropic menunjukkan bahwa meskipun AI telah mengambil alih sebagian besar pekerjaan riset, manusia masih memainkan peran yang sangat penting dalam memastikan keamanan dan kualitas dari hasil riset. Ini menunjukkan bahwa meskipun AI dapat membantu meningkatkan efisiensi dan produktivitas, manusia masih diperlukan untuk memastikan bahwa proses riset berjalan dengan baik dan bertanggung jawab.
Perkembangan ini juga menunjukkan bahwa riset AI telah mencapai tingkat kematangan di mana perusahaan dapat menggunakan AI untuk mengarahkan proyek riset secara mandiri. Ini membuka kemungkinan baru dalam efisiensi dan inovasi, namun juga mengajukan pertanyaan serius tentang masa depan peran manusia dalam proses riset. Dengan kemampuan AI yang semakin meningkat, banyak orang mengkhawatirkan bahwa manusia akan digantikan oleh AI dalam berbagai tugas, termasuk tugas-tugas riset yang memerlukan kreativitas dan pemikiran kritis. Namun, perkembangan di Anthropic menunjukkan bahwa meskipun AI telah mengambil alih sebagian besar pekerjaan riset, manusia masih memainkan peran yang sangat penting dalam memastikan keamanan dan kualitas dari hasil riset.
Dari seluruh temuan itu, laporan ini menunjukkan bahwa perkembangan AI di dalam perusahaan riset Anthropic telah mencapai tingkat kematangan yang luar biasa. Dengan model Claude yang telah mengambil alih 26% pekerjaan riset, perusahaan ini telah mencapai tingkat integrasi AI yang belum pernah terlihat sebelumnya dalam industri riset. Namun, perkembangan ini juga mengajukan pertanyaan serius tentang masa depan peran manusia dalam proses riset AI. Dengan kemampuan AI yang semakin meningkat, banyak orang mengkhawatirkan bahwa manusia akan digantikan oleh AI dalam berbagai tugas, termasuk tugas-tugas riset yang memerlukan kreativitas dan pemikiran kritis. Namun, perkembangan di Anthropic menunjukkan bahwa meskipun AI telah mengambil alih sebagian besar pekerjaan riset, manusia masih memainkan peran yang sangat penting dalam memastikan keamanan dan kualitas dari hasil riset.
Sumber: BuildFastWithAI — AI News Today, 18 September 2026
Tidak ada komentar
Posting Komentar