Pendahuluan
Perkembangan Machine Learning (ML) telah memberikan banyak manfaat dalam berbagai bidang, seperti keamanan siber, kesehatan, keuangan, dan layanan digital. Kemampuan model ML dalam membuat prediksi sangat bergantung pada kualitas data yang digunakan selama proses pelatihan. Namun, ketergantungan terhadap data juga menjadi salah satu kelemahan sistem AI. Salah satu ancaman yang memanfaatkan kelemahan tersebut adalah data poisoning attack, yaitu serangan dengan cara memanipulasi data pelatihan agar memengaruhi kinerja model AI.
Memahami Data Pelatihan pada Machine Learning
Data pelatihan merupakan kumpulan informasi yang digunakan oleh model machine learning untuk mempelajari pola dan membuat keputusan. Semakin baik kualitas data yang digunakan, semakin besar kemungkinan model menghasilkan prediksi yang akurat.
Sebelum digunakan, data pelatihan biasanya melalui proses pengumpulan, pembersihan, dan validasi. Jika terdapat data yang salah atau telah dimanipulasi, model dapat mempelajari pola yang keliru dan menghasilkan keputusan yang tidak sesuai.
Apa Itu Data Poisoning Attack?
Data poisoning attack adalah serangan yang dilakukan dengan memasukkan data yang telah dimanipulasi ke dalam kumpulan data pelatihan model AI. Tujuannya adalah memengaruhi cara model mempelajari pola sehingga menghasilkan prediksi yang salah atau menurunkan tingkat akurasinya.
Serangan ini terjadi pada tahap pelatihan model, berbeda dengan adversarial attack yang biasanya menargetkan model ketika digunakan untuk melakukan prediksi. Karena terjadi pada data awal, data poisoning dapat sulit dideteksi apabila proses validasi data tidak dilakukan dengan baik.
Dampak terhadap Model AI
Data poisoning dapat menyebabkan penurunan performa model, seperti meningkatnya kesalahan prediksi atau berkurangnya kemampuan model dalam mengenali pola yang benar. Dalam sistem yang digunakan untuk keamanan atau pengambilan keputusan penting, kondisi ini dapat menimbulkan risiko yang lebih besar.
Selain menurunkan akurasi, manipulasi data pelatihan juga dapat mengurangi kepercayaan pengguna terhadap sistem AI karena hasil yang diberikan tidak lagi dapat diandalkan.

Contoh Skenario
Sebuah perusahaan menggunakan model machine learning untuk mendeteksi transaksi mencurigakan. Jika sebagian data pelatihan berhasil dimanipulasi sehingga transaksi berbahaya dianggap sebagai aktivitas normal, model dapat mempelajari pola yang salah. Ketika digunakan, sistem tersebut berpotensi gagal mengenali aktivitas yang seharusnya dideteksi.
Upaya Mitigasi
Risiko data poisoning dapat dikurangi dengan menerapkan proses validasi data yang ketat sebelum data digunakan untuk pelatihan. Pengembang juga perlu memantau sumber data, melakukan pemeriksaan terhadap perubahan data, serta menggunakan metode deteksi anomali untuk menemukan pola yang tidak wajar.
Selain itu, penggunaan data dari sumber terpercaya, audit dataset secara berkala, dan pengujian model setelah proses pelatihan dapat membantu memastikan model tetap bekerja dengan baik.
Kesimpulan
Data poisoning attack merupakan ancaman yang menargetkan tahap pelatihan model machine learning dengan memanipulasi data yang digunakan. Serangan ini dapat menyebabkan model mempelajari pola yang salah dan menghasilkan keputusan yang tidak akurat. Oleh karena itu, pengelolaan data yang aman, validasi dataset, serta pemantauan proses pelatihan menjadi langkah penting untuk menjaga keamanan dan keandalan sistem AI.









