Modul 2 — Keselamatan, Etika dan Responsible AI
Mesej Utama
Boleh menggunakan AI tidak bermaksud semua maklumat boleh dimasukkan ke dalam AI.
Apa yang Akan Dipelajari
Selepas modul ini, peserta dapat:
- mengenal pasti risiko data, ketepatan, bias, akses dan hak cipta;
- mengelaskan contoh maklumat kepada boleh guna, perlu sanitasi atau jangan masukkan;
- menggunakan kaedah STOP–CHECK–USE; dan
- menerangkan mengapa akauntabiliti kekal pada manusia.
Responsible AI dalam Sektor Awam
Garis panduan JDN menekankan tujuh prinsip etika untuk mengekalkan kepercayaan awam:
- Privasi dan keselamatan data — lindungi data peribadi serta sensitif.
- Ketelusan — penggunaan dan proses AI perlu dapat diterangkan dengan sewajarnya.
- Akauntabiliti — tanggungjawab terhadap penggunaan dan kesan AI perlu jelas.
- Keadilan — elakkan bias atau diskriminasi yang tidak wajar.
- Keterangkuman — pastikan manfaat dan akses tidak mengecualikan kumpulan tertentu.
- Kebolehpercayaan dan daya tahan — sistem perlu konsisten, selamat dan tahan terhadap ancaman.
- Kelestarian — pertimbangkan kesan jangka panjang kepada masyarakat serta persekitaran.
Model Lampu Isyarat Data
Model ini ialah alat pembelajaran praktikal, bukan pengganti klasifikasi rasmi kerajaan atau polisi agensi.
Hijau — Boleh Digunakan untuk Latihan
- Data rekaan.
- Data awam yang telah diterbitkan secara rasmi.
- Templat kosong.
- Kandungan yang telah dinyahkenal pasti dengan sempurna.
- Fakta program rekaan dalam portal ini.
Kuning — Berhenti dan Semak
- Dokumen dalaman yang belum diterbitkan.
- Draf keputusan atau minit yang belum disahkan.
- Data yang mungkin mengenal pasti individu apabila digabungkan.
- Maklumat operasi, kewangan atau perolehan.
- Maklumat pihak ketiga.
Tindakan: minimumkan data, sanitasi, semak polisi dan gunakan hanya platform serta kaedah yang diluluskan.
Merah — Jangan Masukkan Semasa Latihan
- Kata laluan, token, API key atau maklumat log masuk.
- Maklumat terperingkat.
- Nombor pengenalan, maklumat bank dan rekod individu sebenar.
- Butiran kes, siasatan atau keputusan sensitif.
- Data pelanggan atau pegawai sebenar yang tidak dibenarkan.
Sanitasi Data
Gunakan empat langkah:
- Buang — keluarkan perkara yang tidak diperlukan.
- Samarkan — ganti nama dan pengenal unik dengan label neutral.
- Minimumkan — berikan hanya maklumat yang perlu untuk tugasan.
- Semak semula — pastikan individu atau kes tidak boleh dikenal pasti daripada gabungan butiran.
Tidak Sesuai
Analisis aduan Encik Amir, No. K/P 900101-10-1234, alamat Jalan Melur 8, nombor telefon 012-3456789.
Lebih Selamat untuk Latihan
Analisis aduan rekaan berikut. Semua nama, nombor pengenalan, alamat dan maklumat hubungan telah dibuang. Kenal pasti isu, nada pelanggan dan cadangan tindakan umum. Jangan membuat keputusan kelayakan.
Perlindungan Google Workspace Bukan Kebenaran Automatik
Google menyatakan bahawa bagi edisi Workspace yang layak, Gemini menggunakan kawalan akses sedia ada dan kandungan pelanggan tidak digunakan untuk melatih model generatif di luar domain tanpa kebenaran. Walau bagaimanapun:
- perlindungan platform tidak menggantikan undang-undang dan polisi agensi;
- pegawai masih perlu mematuhi klasifikasi serta tujuan penggunaan;
- akses kepada fail tidak semestinya bermaksud sesuai menggunakan fail itu dengan AI;
- tetapan lesen, retention, DLP dan pentadbir boleh berbeza; dan
- aplikasi pihak ketiga mungkin mempunyai terma yang berbeza.
Lima Risiko Output
1. Halusinasi
AI boleh menghasilkan fakta, nama, tarikh atau rujukan yang tidak wujud.
2. Bias
Cadangan mungkin mencerminkan pola berat sebelah dalam data atau arahan.
3. Automasi Berlebihan
Pengguna mungkin menerima cadangan kerana ia kelihatan profesional tanpa semakan mencukupi.
4. Hak Cipta dan Asal Kandungan
Jangan menganggap semua output bebas digunakan. Semak sumber, lesen dan keperluan atribusi.
5. Perkongsian dan Akses
Dokumen yang betul masih boleh terdedah jika tetapan perkongsian salah.
STOP — CHECK — USE
STOP
- Adakah data ini perlu dimasukkan?
- Adakah platform dan akaun ini diluluskan?
- Adakah kandungan perlu disanitasi?
CHECK
- Fakta, tarikh, nama dan angka.
- Sumber dan versi dokumen.
- Polisi, konteks dan bidang kuasa.
- Bias, keterangkuman dan nada.
- Hak cipta serta status imej sintetik.
- Akses fail dan penerima.
USE
- Edit output supaya sesuai dengan tujuan sebenar.
- Dapatkan pengesahan pegawai berkenaan jika diperlukan.
- Nyatakan penggunaan AI jika diwajibkan oleh polisi atau konteks.
- Pegawai yang menggunakan output kekal bertanggungjawab.
Jika Berlaku Kesilapan atau Pendedahan
- Hentikan perkongsian atau penggunaan lanjut.
- Jangan menyembunyikan kejadian.
- Simpan maklumat yang diperlukan untuk pelaporan tanpa menyebarkannya lagi.
- Maklumkan penyelia serta saluran ICT, keselamatan atau perlindungan data mengikut prosedur agensi.
- Ikuti arahan pemulihan dan dokumentasikan tindakan.
Cuba — “Boleh, Sanitasi atau Jangan?”
Gunakan kad dalam data-classification-cards.csv. Letakkan setiap situasi dalam salah satu kategori:
- Boleh digunakan
- Perlu sanitasi dan semakan
- Jangan dimasukkan
Selepas memilih, terangkan sebab dan kawalan yang diperlukan.
Semak Kefahaman
- Adakah saya menggunakan data minimum?
- Bolehkah individu dikenal pasti semula?
- Adakah fakta, tarikh, nama dan angka disahkan?
- Adakah fail dikongsi hanya kepada pihak yang sepatutnya?
- Siapakah manusia yang bertanggungjawab terhadap output akhir?
Bawa Pulang
Keselamatan AI bermula sebelum prompt ditulis dan berakhir hanya selepas output disemak, digunakan serta dikongsi dengan betul.