Eksekutif Microsoft Sebut Pengambilan Data AI Pencurian Tenaga Kerja Terbesar

Eksekutif Microsoft Sebut Pengambilan Data AI Pencurian Tenaga Kerja Terbesar

Dokumen gugatan hak cipta mengungkap pernyataan direktur ilmu terapan Microsoft, Brent Hecht, yang menyebut praktik pengambilan karya orang untuk melatih model kecerdasan buatan sebagai pencurian tenaga kerja terbesar dalam sejarah manusia.

Dokumen dari gugatan hak cipta terhadap OpenAI dan Microsoft mengungkap bagaimana para eksekutif perusahaan teknologi berbicara secara terbuka tentang batas aturan, hukum, dan hak orang lain. Salah satu pernyataan yang menonjol datang dari direktur ilmu terapan Microsoft, Brent Hecht.

Dalam dokumen yang diajukan para penggugat, Hecht menggambarkan praktik pengambilan karya orang di seluruh dunia untuk melatih model besar sebagai pencurian tenaga kerja terbesar dalam sejarah manusia. Ia juga menyebut jutaan orang akan segera menganggap praktik itu sebagai pencurian yang belum pernah terjadi sebelumnya.

Pernyataan tersebut menjadi bagian dari berkas setebal 84 halaman yang diajukan penggugat pada 4 September. Dokumen itu memuat kutipan dari sejumlah eksekutif teknologi yang menurut penggugat memperlihatkan kesadaran bahwa praktik pengambilan data melampaui batas aturan yang berlaku.

Gugatan itu sendiri diajukan sejumlah organisasi media, termasuk Mother Jones, dengan argumen bahwa perusahaan membangun produk bernilai sangat tinggi melalui pengambilan karya yang mereka sebut mengejutkan dan belum pernah terjadi sebelumnya. Gugatan serupa juga diajukan The New York Times, The Intercept, dan sejumlah penerbit lain.

Menurut para penggugat, dokumen internal perusahaan menunjukkan bahwa persoalan hak cipta bukan hal yang tidak disadari. Sebaliknya, dokumen itu menggambarkan pertimbangan bisnis yang mendahulukan percepatan pengembangan produk dibanding kepatuhan terhadap hak pemilik karya.

Kasus ini menjadi bagian dari gelombang gugatan hak cipta yang menghadapi industri kecerdasan buatan di Amerika Serikat. Para penerbit dan pencipta karya berargumen bahwa model bahasa dibangun dengan menyalin karya berhak cipta tanpa izin, tanpa pembayaran, dan tanpa pemberitahuan kepada pemiliknya.

Perusahaan teknologi umumnya berargumen bahwa pelatihan model memakai karya yang tersedia publik termasuk penggunaan wajar. Mereka juga menyatakan model yang dihasilkan tidak menyimpan salinan utuh karya tertentu, melainkan mempelajari pola dari kumpulan data yang sangat besar.

Sengketa ini memiliki implikasi besar bagi masa depan industri media dan penerbitan. Jika pengadilan memutuskan bahwa pelatihan model tanpa izin melanggar hukum, perusahaan kecerdasan buatan berpotensi menghadapi kewajiban pembayaran besar serta keharusan mengubah cara memperoleh data pelatihan.

Sejumlah penerbit sudah memilih jalur perjanjian lisensi dengan perusahaan kecerdasan buatan. Langkah itu memungkinkan karya jurnalistik dipakai untuk pelatihan model dengan kompensasi tertentu, meskipun nilai kesepakatannya bervariasi antara satu penerbit dan penerbit lain.

Penggugat juga meminta hakim mengizinkan mereka mengakses dokumen asli yang menjadi sumber kutipan tersebut. Saat ini hanya kalangan pengacara yang diizinkan melihat dokumen asli itu, sehingga publik belum dapat memeriksa konteks lengkap pernyataan para eksekutif.

Perkembangan perkara ini akan menjadi rujukan penting bagi cara industri kecerdasan buatan memperoleh bahan pelatihan di masa mendatang. Putusan pengadilan diperkirakan memengaruhi tidak hanya perusahaan besar, tetapi juga ribuan pencipta konten yang karyanya telah masuk ke dalam kumpulan data pelatihan.

Gugatan terhadap perusahaan kecerdasan buatan menyentuh pertanyaan mendasar soal nilai karya yang dipakai tanpa izin. Penggugat berargumen bahwa kumpulan data pelatihan mencakup jutaan artikel, buku, dan gambar yang diambil dari internet tanpa perjanjian lisensi dengan pemilik hak cipta.

Sejumlah pengadilan di Amerika Serikat telah menerima gugatan serupa dari kalangan penulis, seniman, dan penerbit. Perkara-perkara itu berjalan paralel dan putusannya berpotensi saling memengaruhi, terutama dalam menafsirkan sejauh mana doktrin penggunaan wajar berlaku bagi pelatihan model kecerdasan buatan.

Kalangan industri menyatakan bahwa pelatihan model membutuhkan data dalam jumlah sangat besar dan tidak mungkin memperoleh izin satu per satu. Mereka mengusulkan mekanisme lisensi kolektif sebagai jalan tengah, meskipun bentuk dan besaran kompensasi bagi pemilik karya masih menjadi perdebatan panjang.

Dokumen gugatan juga memuat sejumlah percakapan internal yang menurut penggugat memperlihatkan bahwa perusahaan menyadari risiko hukum dari praktik pengumpulan data. Penggugat menilai kesadaran itu penting untuk membuktikan bahwa tindakan tersebut dilakukan dengan pengetahuan penuh, bukan kelalaian.

Sengketa ini juga memicu diskusi di kalangan pembuat kebijakan tentang perlunya aturan yang lebih jelas bagi pengumpulan data untuk pelatihan model kecerdasan buatan. Sejumlah usulan mencakup kewajiban keterbukaan soal sumber data dan mekanisme kompensasi bagi pemilik karya yang digunakan.

Sumber: Mother Jones, TechCrunch, CNBC, September 2026.

Tidak ada komentar

Posting Komentar