Depok (ANTARA) - Di tengah ledakan kecerdasan artifisial, big data, dan berbagai platform digital yang semakin menentukan bagaimana pengetahuan diproduksi, pertanyaan penting bagi dunia akademik kini bukan lagi sekadar “seberapa banyak data yang dapat kita olah?”, tetapi “siapa yang mengendalikan data, siapa yang menentukan maknanya, dan siapa yang memperoleh manfaat darinya?”

Pesan tersebut mengemuka dalam Sharing Session Penelitian “From Data Cleaning to Data Sovereignty: Building Trustworthy Text Mining for Research” yang diselenggarakan oleh Unit Riset dan Inovasi Berdampak Sekolah Vokasi Universitas Indonesia bersama Klinik Digital, bertempat di Magister Terapan Industri Kreatif, Sekolah Vokasi Universitas Indonesia.

Kegiatan menghadirkan Assoc. Prof. Dr. Zulhamri Abdullah, Department of Communication, Faculty of Modern Languages and Communication, Universiti Putra Malaysia (UPM), dengan Dr. Devie Rahmawati, CICS dari Klinik Digital sebagai moderator, Youna C Bachtiar (Head of UPM Delegation), Andhita Yukihana R & Mila Viendyasari, Pengurus Yayasan Ruang Karya Berdampak (RKD). Turut hadir Dr. Dewi Kartika Sari, Ketua Program Studi Magister Terapan Industri Kreatif Sekolah Vokasi UI.

Dalam paparannya, Zulhamri mengingatkan bahwa text mining memungkinkan peneliti mengolah data bahasa dalam jumlah sangat besar, mulai dari transkrip wawancara, dokumen kebijakan, berita, komentar daring hingga jawaban terbuka survei. Namun, kemampuan komputasi tidak menggantikan manusia dalam menentukan makna dan interpretasi.

“Teknologi dapat membantu kita menemukan pola, tetapi interpretasi tetap merupakan tugas manusia dan harus berpijak pada teori. Karena itu, semakin kuat kemampuan teknologi kita membaca data, semakin besar pula tanggung jawab peneliti untuk memastikan bahwa kesimpulan yang dihasilkan dapat dipercaya,” ujar Zulhamri.

Salah satu pesan penting dalam diskusi adalah bahwa data cleaning bukan sekadar pekerjaan teknis. Menurut Zulhamri, setiap keputusan untuk menghapus, mengubah, menyeragamkan atau mempertahankan bagian tertentu dari data berpotensi mengubah bukti yang akhirnya digunakan untuk menghasilkan kesimpulan penelitian. Bahkan penghapusan satu kata dapat mengubah makna frasa “not trustworthy”, misalnya, menjadi menyesatkan apabila kata “not” terhapus dalam proses pembersihan.

“Data cleaning adalah keputusan metodologis. Setiap tindakan terhadap data mengubah evidence. Karena itu, peneliti harus mampu menjelaskan apa yang dibersihkan, apa yang dipertahankan, dan mengapa keputusan tersebut dibuat,” jelas Zulhamri.

Lulusan Cambridge University ini, juga mengingatkan bahaya menganggap keluaran AI atau algoritma sebagai kebenaran final. Dalam topic modelling, misalnya, komputer menemukan pola statistik, bukan tema sosial yang otomatis memiliki makna. Sekumpulan kata seperti school, teacher, online, child, dan access dapat berbicara tentang pendidikan digital, ketimpangan, atau persoalan lain; konteks dokumen dan interpretasi penelitilah yang menentukan.

“A sophisticated model does not remove the need for human judgement. Model yang kuat tetap membutuhkan validasi, pembacaan konteks, dan keterbukaan terhadap ketidakpastian,” tambahnya.

Diskusi kemudian bergerak dari persoalan metodologi menuju isu yang lebih mendasar: kedaulatan data.

Devie Rahmawati mengatakan bahwa perkembangan AI membuat masyarakat perlu memiliki pemahaman baru mengenai data. Menurutnya, selama ini masyarakat diajarkan menggunakan teknologi, tetapi belum cukup dibiasakan mempertanyakan apa yang terjadi terhadap data mereka setelah menekan tombol “I Agree”.

“Kita sangat berhati-hati ketika orang asing meminta dompet kita, tetapi setiap hari kita menyerahkan potongan identitas digital kepada berbagai platform hanya dengan satu klik. Karena itu, pertanyaan literasi digital ke depan tidak cukup lagi ‘apakah aplikasi ini berguna?’. Kita perlu membiasakan masyarakat bertanya: siapa memegang dataku, untuk apa digunakan, dan apakah kendalinya masih berada pada saya?” kata pengurus Yayasan RKD ini.

“Kedaulatan data tidak dimulai hanya dari pusat data atau server, tetapi dimulai dari keputusan kecil jutaan warga, apakah saya mengklik tautan ini, memberikan akses lokasi, mengunggah dokumen ke AI, membagikan foto anak, atau menyerahkan data pribadi kepada sebuah aplikasi. Kedaulatan nasional pada akhirnya juga dibangun dari kapasitas warga untuk menjaga kedaulatan atas dirinya sendiri,” tegas Devie.

Kedaulatan Data Berbicara tentang Control, Context, Location, dan Benefit

Zulhamri mengafirmasi bahwa data sovereignty memang bergerak lebih jauh daripada sekadar data governance. Jika tata kelola data mengatur manusia, kebijakan, prosedur dan teknologi sepanjang siklus hidup data, kedaulatan data mempertanyakan siapa yang memiliki otoritas sah atas pengumpulan, penyimpanan, analisis, pembagian hingga penghapusan data.

“Kepemilikan file tidak otomatis menyelesaikan persoalan kedaulatan data. Sebuah universitas mungkin secara legal menyimpan data wawancara, tetapi komunitas yang menghasilkan data tersebut tetap dapat memiliki kepentingan yang sah terhadap bagaimana data mereka ditafsirkan, digunakan kembali, dan bagaimana manfaat penelitian dikembalikan kepada mereka,” ujar Zulhamri.

Devie menilai bahwa di era AI, trust atau kepercayaan harus diperlakukan sebagai bagian dari infrastruktur digital.

“Kita sering membicarakan infrastruktur digital dalam bahasa kabel, cloud, server dan komputasi. Padahal ada infrastruktur yang tidak terlihat tetapi menentukan apakah seluruh sistem itu dapat bertahan: kepercayaan. Teknologi dapat berkembang jauh lebih cepat daripada kemampuan masyarakat memahaminya. Karena itu, bagi Klinik Digital, kedaulatan data pada akhirnya adalah tentang membangun kembali trust, agar manusia memahami apa yang terjadi terhadap datanya dan mempunyai kapasitas untuk menentukan pilihan,” ujar Devie.

Zulhamri mengafirmasi pentingnya dimensi tersebut. Materinya menegaskan bahwa teks yang tersedia secara publik sekalipun tidak otomatis bebas risiko, dimana peneliti tetap harus mempertimbangkan privasi, persetujuan, representasi, keamanan dan kemungkinan kerugian. Bahkan penghilangan nama belum tentu mencegah identifikasi seseorang apabila kutipan masih mengandung pekerjaan, lokasi, atau pengalaman yang sangat spesifik.

Dari Kampus Menuju Masyarakat

Klinik Digital memandang forum ilmiah di Vokasi UI ini sebagai bagian dari pembangunan ekosistem pengetahuan mengenai kedaulatan data.

“Kami ingin sedang mengembangkan program DATAKU, yang akan mempunyai akar akademik yang kuat. Klinik Digital tidak ingin berbicara kedaulatan data hanya sebagai slogan. Kita harus mempertemukan riset, etika, teknologi dan kebutuhan sehari-hari masyarakat. Dari kampus, pengetahuan itu harus turun menjadi sesuatu yang dapat digunakan keluarga, guru, mahasiswa, UMKM dan masyarakat luas,” kata Mila Viendyasari, Executive Director Yayasan RKD, yang menaungi Klinik Digital

Semangat tersebut sejalan dengan kesimpulan utama paparan Zulhamri mengenai empat disiplin dalam membangun trustworthy text mining yaitu CLEAN dengan tujuan yang terdokumentasi, EXPLAIN setiap keputusan yang berdampak, VALIDATE model dan interpretasi, serta GOVERN data secara bertanggung jawab.

“Melalui kolaborasi akademik lintas negara seperti bersama UPM, Malaysia, serta rencana pengembangan program DATAKU, Klinik Digital mendorong satu perubahan sederhana tetapi fundamental yaitu masyarakat tidak cukup hanya menjadi penghasil data dalam ekonomi digital, melainkan masyarakat perlu memiliki pengetahuan, kapasitas, dan kendali yang lebih besar atas data serta identitas digitalnya sendiri,” tutup Andhita Yukihana, Yayasan RKD.



Pewarta: Feru Lantara
Uploader : Naryo

COPYRIGHT © ANTARA 2026