Pendahuluan
Perkembangan kecerdasan buatan (Artificial Intelligence atau AI) telah mendorong pemanfaatan machine learning di berbagai sektor, seperti kesehatan, transportasi, dan keamanan siber. Kinerja model machine learning sangat bergantung pada kualitas data pelatihan (training data). Oleh karena itu, data menjadi salah satu komponen yang rentan terhadap serangan siber. Salah satu ancaman yang mulai banyak mendapat perhatian adalah clean-label poisoning, yaitu teknik manipulasi data yang sulit dikenali karena tidak mengubah label pada data pelatihan.
Memahami Data Poisoning
Data poisoning merupakan serangan yang dilakukan dengan menyisipkan data yang telah dimanipulasi ke dalam dataset pelatihan. Tujuan utama serangan ini adalah memengaruhi perilaku model sehingga menghasilkan prediksi yang keliru. Berdasarkan tekniknya, data poisoning terdiri atas beberapa jenis, seperti label poisoning, backdoor poisoning, dan clean-label poisoning. Berbeda dengan adversarial attack yang menyerang model saat proses inferensi, data poisoning terjadi sebelum model selesai dilatih sehingga dampaknya dapat bertahan selama model digunakan.
Apa Itu Clean-Label Poisoning?
Clean-label poisoning adalah teknik serangan yang mempertahankan label data tetap benar, tetapi mengubah karakteristik atau fitur data secara halus. Perubahan tersebut umumnya tidak terlihat oleh manusia maupun proses validasi sederhana. Akibatnya, data beracun (poisoned data) tampak seperti data normal sehingga dapat lolos ke dalam proses pelatihan. Penyerang memanfaatkan kondisi ini untuk menyebabkan model salah mengklasifikasikan target tertentu tanpa menurunkan tingkat akurasi model secara signifikan.
Mekanisme Serangan
Serangan dimulai dengan menentukan target yang ingin dimanipulasi. Selanjutnya, penyerang membuat sejumlah sampel yang telah dimodifikasi menggunakan teknik optimasi sehingga memiliki karakteristik yang dapat memengaruhi proses pembelajaran model. Sampel tersebut kemudian disisipkan ke dalam dataset pelatihan. Setelah model selesai dilatih, kesalahan prediksi biasanya hanya muncul pada target tertentu, sedangkan performa model terhadap data lain tetap terlihat normal. Kondisi ini menjadikan clean-label poisoning lebih sulit dideteksi dibandingkan jenis data poisoning lainnya.

Dampak, Deteksi, dan Mitigasi
Serangan clean-label poisoning berpotensi mengurangi keandalan sistem AI, terutama pada aplikasi yang memerlukan tingkat akurasi tinggi, seperti pengenalan wajah, diagnosis medis, dan kendaraan otonom. Untuk mendeteksi serangan ini, peneliti mengembangkan berbagai pendekatan, antara lain analisis outlier, pemeriksaan representasi fitur (feature space analysis), dan pelacakan asal-usul data (data provenance). Sementara itu, mitigasi dapat dilakukan melalui kurasi dataset, pembersihan data sebelum pelatihan (data sanitization), penerapan metode robust training, serta pemantauan model secara berkala. Seiring meningkatnya adopsi AI, pengembangan teknik deteksi dan mitigasi menjadi tantangan penting dalam penelitian keamanan machine learning.
Kesimpulan
Clean-label poisoning menunjukkan bahwa ancaman terhadap sistem AI tidak selalu berasal dari eksploitasi perangkat lunak, tetapi juga dari manipulasi data pelatihan. Karena label data tetap benar dan perubahan yang dilakukan sangat halus, serangan ini sulit dideteksi menggunakan metode pemeriksaan konvensional. Oleh sebab itu, penerapan tata kelola data yang baik, validasi dataset yang lebih ketat, serta pengembangan metode pelatihan yang tahan terhadap manipulasi data menjadi langkah penting untuk menjaga keamanan dan keandalan sistem machine learning di masa mendatang.








