Lompat ke isi

Pembelajaran mesin adversarial

Ensiklopedia Pengetahuan Universitas Islam Sultan Agung
Revisi sejak 23 Agustus 2026 04.04 oleh Maintenance script (bicara | kontrib) (Impor teks terkontrol dari Wikipedia bahasa Indonesia; revisi 29317180; atribusi sumber disertakan.)
(beda) ← Revisi sebelumnya | Revisi terkini (beda) | Revisi selanjutnya → (beda)

Pembelajaran mesin adversarial (AI) merupakan teknologi yang sangat berkembang pesat, dan berkembang pada berbagai sektor bidang kehidupan masyarakat sosial. Kemajuan AI genaratif teks dan gambar juga memengaruhi perkembangan kecerdasan buatan (AI) karena peranannya sangat penting dalam kehidupan. Di mana AI sangat dibutuhkan karena kecerdasan buatan ini dianggap oleh masyarakat sebagai tempat yang aman, andal dan tangguh untuk penyedia berbagai informasi. Kecerdasan buatan sangat berkembang pesat dan berpengaruh besar, namun sangat rentan terhadap kegagalan sistem, kebocoran data dan ancaman keamanan. Sehingga diperlukan pengawasan yang lebih terhadap pengembangan sistem model kecerdasan buatan ini. Serangan ini dikenal dengan istilah adversarial machine learning. Hal ini dapat mengeksploitasi kelemahan dalam model AI sehingga, dapat memanipulasi data yang berpotensi kesalahan dalam klasifikasi yang disenga hal ini sangat berbahaya bagi sistem AI sendiri.

Adversarial Machine Learning sering kali menambahkann distorsi yang tidak terlihat oleh pengamat manusia. Di mana ia mengubah label prediksi dan dikaitan dengan sumber data atau gambar yang diambil. Dengan adanya adversarial machine learning ini dapat membantu manusia untuk menjelaskan sesuatu pembelajaran mesin yang terawasi dan tidak terawasi oleh manusia. Serta juga dapat memprediksi berbagai macam serangan yang akan terjadi dengan teknik algoritmanya.

Cara kerja Adversarial

Serangan adversarial ini memanfaatkan cara kerja kecerdasan buatan (AI), karena kerentanan dan keterbatasan yang melekat pada sistem model AI. Sistem ini bekerja dengan cara memaipulasi data masuk sehingga menghasilkan suatu model yang salah atau keliru. Pada sistem ini biasanya dimanfaatkan dengan beberapa langkah yaitu pemahaman sistem, manipulasi model dan ekspoilitasi sistem target.

Pertama mereka mengalisis model penyerangan dengan cara mempelajari algoritma, proses pemerolehan data, serta menggunakan rekayasa balik model yang nanti akan memecah model AI dan mengidentifikasi kelemahan sistem. Kedua merancang input yang akan disalah artikan oleh sistem dan memodifikasi data yang masuk dalam pemerolahan bahasa alami sistem. Ketiga membuat sistem berperilaku tidak terduga dengan tujuan dapat meretas keamanan sistem. Setelah sistem rusak maka keaman sistem sulit untuk diketahui begitulah adversarial bekerja.

Jenis-Jenis Serangan Adversarial

White box attacks memanfaatkan sistem informasi untuk perubahan kata. Selain itu ada juga serangan dengan cara merusak proses pembuatan model, yang bertujuan untuk penurunan akurasi dan kerentanan yang disengaja. Black box attacks adalah serangan dengan memanfaatkan output dan input suatu sistem, hal ini bisa dengan serangan model tiruan. Dan juga sering kali mereka menebak model arah perubahan input yang memengaruhi output. Selanjutnya ada rondomized smoothing yang bekerja dengan cara menambahkan noise acak dalam proses inferensi. Teknik ini dapat memitigasi serangan adversarial terhadap prediksi model yang lebih stabil. Jenis- jenis serangan seperti ini sangat bahaya karena penyerangan tidak butuh akses internal model sehingga lebih realistis serta dapat menargetkan pelayanan komersial kecerdasan buatan (AI).

Keuntungan dan Kekurangan

Kelebihan

Adversarial training sangat menguntungkan, karena cara sistemnya bekerja dengan menipu model. Sistem tujuan ini sangat bisa kita gunakan dalam hal meningkatan kualitas model sistem yang sedang kita kembangkan. Sistem training ini juga melatih sistem kita untuk tahan terhadap serangan dan kesalahan. Dengan mempelajari adversarial ini dapat kita ketahui bagaimana cara menjaga kemampuan generalisasi serta kalibrasi dan kepercayaan model yang lebih baik.

Kekurangan

Kekurangan utama dalam Pembelajaran Mesin Adversarial, terutama terkait dengan Generative Adversarial Networks (GANs) dan kerentanan model terhadap serangan, adalah ketidakstabilan dan kesulitan pelatihan, di mana GAN sering mengalami Mode Collapse yaitu Generator hanya menghasilkan variasi data yang terbatas dan proses pelatihannya rentan terhadap gradien yang menghilang; selain itu, model Deep Learning secara umum menunjukkan kerentanan yang signifikan terhadap Adversarial Attacks, di mana manipulasi kecil pada data input, yang tidak terdeteksi oleh manusia, dapat menyebabkan kesalahan klasifikasi yang fatal dengan tingkat keyakinan tinggi, menyoroti kurangnya ketahanan (robustness) model dalam menghadapi gangguan, dan seringkali membutuhkan biaya komputasi yang tinggi untuk implementasi teknik pertahanan yang efektif.

Galeri

Referensi

Sumber dan atribusi

Konten artikel ini diadaptasi dari Wikipedia bahasa Indonesia, revisi 29317180 (2026-06-06T01:39:31Z), yang tersedia berdasarkan lisensi Creative Commons Atribusi-BerbagiSerupa (CC BY-SA). Mohon gunakan konten ini secara bijak serta sesuai dengan ketentuan lisensi yang berlaku.