Artificial Intelligence

OpenAI Dituduh Gunakan Riset Matematika Rahasia untuk Melatih Model AI

Bagikan: X Facebook WhatsApp Telegram LinkedIn
OpenAI Dituduh Gunakan Riset Matematika Rahasia untuk Melatih Model AI

Ringkasan

  • Matematikawan Andreas Thom menuding OpenAI menggunakan riset rahasia miliknya untuk melatih model AI tanpa izin, memicu kekhawatiran soal etika dan transparansi data.

Ketegangan antara komunitas matematikawan global dan OpenAI memuncak setelah munculnya tuduhan serius mengenai transparansi data pelatihan model AI. Andreas Thom, seorang matematikawan terkemuka, secara terbuka menuding OpenAI bersikap tidak jujur terkait asal-usul data yang digunakan dalam pencapaian matematis perusahaan tersebut. Ia mencurigai bahwa interaksi pribadinya dengan chatbot ChatGPT, yang melibatkan teknik riset khusus, telah diserap oleh sistem OpenAI untuk mempercepat pengembangan model mereka tanpa izin atau pengakuan yang layak.

Kecurigaan Thom dipicu oleh pengumuman OpenAI mengenai hasil riset terkait 'non-sofic groups'—struktur matematika kompleks yang menjadi bidang keahlian Thom bersama rekannya, Gábor Kun. OpenAI sempat merilis hasil tersebut dengan klaim besar, namun gagal mencantumkan kontribusi fundamental dari riset Thom dan Kun. Setelah mendapat kritik tajam dari komunitas matematika, perusahaan tersebut secara diam-diam merevisi dokumentasi mereka untuk mengakui peran riset terdahulu.

Permasalahan ini bukan yang pertama kalinya. Sebelumnya, profesor matematika dari New York University, Tristan Buckmaster, juga melayangkan pertanyaan serupa terkait penggunaan platform Codex oleh OpenAI. Buckmaster menduga model AI tersebut mempelajari teknik penyelesaian masalah dari riset yang ia lakukan secara pribadi. Pola yang sama terlihat pada kasus penyelesaian masalah Navier-Stokes oleh OpenAI, di mana perusahaan tersebut mengklaim tidak mengakses data pengguna secara langsung, namun tidak mampu menepis kemungkinan bahwa data tersebut memengaruhi model secara tidak langsung melalui proses de-identifikasi.

Bagi dunia akademis, perbedaan antara akses langsung ke data pribadi dan penggunaan data dalam kumpulan pelatihan (training data) adalah garis batas yang kabur namun krusial. Thom menegaskan bahwa proses de-identifikasi mungkin menghapus nama penulis, tetapi tidak menghilangkan esensi konten intelektual dan ide matematis di dalamnya. Ia menilai sikap OpenAI yang enggan membuka transparansi dataset sebagai tindakan yang tidak etis, terutama jika perusahaan tersebut menggunakan riset orang lain untuk berkompetisi dengan peneliti itu sendiri.

Situasi ini menciptakan preseden berbahaya bagi masa depan kolaborasi sains dan teknologi. Banyak matematikawan kini merasa khawatir bahwa setiap kabar tentang terobosan baru yang mereka diskusikan secara daring dapat memicu perlombaan riset dengan perusahaan teknologi besar yang memiliki sumber daya komputasi jauh lebih masif. Hal ini berpotensi mendorong dunia akademis menjadi lebih tertutup dan enggan membagikan temuan awal demi menjaga orisinalitas riset mereka.

Di Indonesia, fenomena ini menjadi pengingat penting bagi para peneliti dan pengembang teknologi lokal yang mulai mengadopsi model bahasa besar (LLM) dalam riset mereka. Ketergantungan pada model AI global menuntut kesadaran akan hak kekayaan intelektual atas data yang diinput ke dalam sistem. Ketika seorang peneliti mengunggah data riset ke platform AI untuk membantu analisis, ada risiko tersirat bahwa informasi tersebut menjadi bagian dari pengetahuan umum yang kemudian dikomersialkan oleh pemilik platform.

Industri teknologi di Indonesia, yang kini gencar mengembangkan solusi AI berbasis bahasa lokal, perlu merumuskan standar etika data yang lebih ketat. Transparansi mengenai apa yang terjadi dengan data pengguna setelah diunggah ke server merupakan poin yang sering kali terlewatkan dalam syarat dan ketentuan penggunaan. Tanpa kebijakan privasi data riset yang jelas, inovator lokal berisiko kehilangan keunggulan kompetitif mereka kepada perusahaan global yang memiliki akses ke data tersebut.

Kasus ini juga menyoroti perlunya regulasi yang lebih spesifik mengenai penggunaan data intelektual dalam melatih kecerdasan buatan. Sejauh ini, hukum hak cipta di banyak negara belum sepenuhnya mampu menjangkau ranah 'ide' atau 'teknik penyelesaian masalah' yang dipelajari oleh model AI dari data yang disuplai pengguna. OpenAI, hingga saat ini, belum memberikan tanggapan komprehensif mengenai tuntutan para matematikawan untuk membuka transparansi dataset mereka.

Thom menekankan bahwa beban pembuktian saat ini berada di pundak OpenAI. Sebagai pihak yang mengendalikan infrastruktur data, hanya mereka yang mampu melakukan audit internal untuk membuktikan apakah riset pihak ketiga benar-benar diintegrasikan ke dalam proses penalaran model mereka. Penolakan untuk melakukan audit ini, menurut Thom, merupakan bentuk ketidakjujuran intelektual yang mencederai kepercayaan komunitas ilmiah.

Ke depannya, tren ini diprediksi akan memicu gelombang tuntutan transparansi yang lebih besar dari berbagai sektor profesional. Jika perusahaan AI terus berlindung di balik ambiguitas teknis, bukan tidak mungkin akan muncul boikot dari kalangan akademisi atau pengembangan platform AI mandiri yang lebih menghargai kedaulatan data pengguna. Ketegangan ini menjadi sinyal bahwa era 'data bebas' untuk melatih AI tengah berakhir, digantikan oleh era tuntutan akuntabilitas yang lebih ketat.

Mengapa Ini Penting

Isu ini penting bagi industri teknologi Indonesia karena menyentuh batasan antara kolaborasi AI dan pencurian kekayaan intelektual. Peneliti lokal yang menggunakan alat AI harus waspada bahwa data riset yang diinput bisa menjadi bagian dari pelatihan model yang nantinya digunakan oleh perusahaan global untuk bersaing. Kasus ini menyoroti perlunya standar privasi data riset yang lebih ketat agar inovasi lokal tidak 'diambil alih' secara tidak langsung oleh sistem AI raksasa.

Pertanyaan Umum

Apa isi utama artikel "OpenAI Dituduh Gunakan Riset Matematika Rahasia untuk Melatih Model AI"?

Matematikawan Andreas Thom menuding OpenAI menggunakan riset rahasia miliknya untuk melatih model AI tanpa izin, memicu kekhawatiran soal etika dan transparansi data.

Mengapa Artificial Intelligence ini penting?

Isu ini penting bagi industri teknologi Indonesia karena menyentuh batasan antara kolaborasi AI dan pencurian kekayaan intelektual. Peneliti lokal yang menggunakan alat AI harus waspada bahwa data riset yang diinput bisa menjadi bagian dari pelatihan model yang nantinya digunakan oleh perusahaan global untuk bersaing. Kasus ini menyoroti perlunya standar privasi data riset yang lebih ketat agar in

Sumber Asli
The Verge
Tanggal
10 September 2026
Waktu Baca
5 menit