Toolkit6 menit baca
AI Safety Checklist
Mengaudit input, output, izin, dan tindakan sebelum dipakai.
Setelah lesson ini, kamu bisa
Mengaudit input, output, izin, dan tindakan sebelum dipakai.
Progress tersimpan di browser dan perangkat ini.
Gunakan sebelum memasukkan data, sebelum mempercayai output, dan sebelum mengirim, menerbitkan, atau menjalankan hasil AI.
1. STOP: apa dampaknya?
- Saya tahu tujuan penggunaan AI.
- Saya tahu siapa yang dapat terdampak jika hasilnya salah.
- Saya tahu apakah ini tugas berisiko rendah, sedang, tinggi, atau sangat tinggi.
- Untuk kesehatan, hukum, keuangan, keselamatan, dan keputusan tentang orang, AI bukan sumber atau pengambil keputusan tunggal.
Jika dampaknya tinggi dan tidak ada pihak berwenang untuk review, berhenti.
2. INPUT: data apa yang masuk?
MERAH — jangan masukkan
- Tidak ada password, OTP, PIN, token, private key, atau recovery code.
- Tidak ada nomor identitas, rekening, kartu, atau data finansial lengkap.
- Tidak ada data pelanggan mentah atau rekam medis teridentifikasi.
- Tidak ada rahasia dagang atau materi yang dilarang kontrak.
- Tidak ada konten ilegal atau eksploitatif.
KUNING — cek izin dan minimalkan
- Dokumen internal sudah diizinkan.
- Catatan meeting dan data klien sudah diminimalkan.
- Nama, email, telepon, alamat, ID, dan detail unik sudah dihapus.
- Metadata dan revision history file sudah diperiksa.
- Data tidak dapat diidentifikasi ulang dari kombinasi detail.
- Data personal yang tersedia publik tetap diperlakukan sebagai data personal.
HIJAU — pilihan terbaik untuk latihan
- Saya memakai skenario fiktif, data publik nonpersonal yang boleh digunakan ulang, teks milik sendiri yang tidak rahasia, atau contoh yang sudah diuji tidak mudah diidentifikasi ulang.
3. ACCOUNT: tool dan tier sesuai?
- Saya membaca kebijakan organisasi, kampus, atau klien.
- Saya memakai akun yang disetujui untuk jenis data ini.
- Saya memahami apakah chat dapat dipakai untuk model improvement.
- Saya memahami kemungkinan human review dan retention.
- Saya memenuhi syarat usia akun dan, jika diwajibkan, sudah mendapat izin orang tua, sekolah, atau admin organisasi.
- Saya sudah memeriksa Connected Apps dan izin minimum.
- Saya tidak menganggap “training off” sebagai izin memasukkan semua rahasia.
Rujukan resmi:
4. PROMPT: batas dan sumber jelas?
- Tugas dan tujuan jelas.
- AI diminta memakai hanya sumber tertentu jika diperlukan.
- AI diminta tidak menebak jika informasi kurang.
- Fakta, inferensi, dan ide diminta terpisah.
- Format membuat hasil mudah diperiksa.
- AI diminta mengajukan pertanyaan klarifikasi.
- Tidak ada instruksi untuk menyamarkan plagiarisme atau menipu.
5. OUTPUT: verifikasi sebelum percaya
Fakta
- Nama, angka, tanggal, kutipan, dan komitmen diperiksa.
- Semua link penting dibuka.
- Isi sumber benar-benar mendukung klaim.
- Tanggal dan versi sumber masih relevan.
- Sumber primer diprioritaskan.
- Klaim penting dibandingkan dengan sumber lain.
SIFT
- Stop: saya tidak langsung membagikan.
- Investigate: saya memeriksa siapa sumbernya.
- Find: saya mencari coverage yang lebih kuat.
- Trace: saya kembali ke konteks atau dokumen asli.
Kualitas
- Output cocok dengan tujuan dan audiens.
- Tidak ada informasi yang ditambahkan diam-diam.
- Asumsi ditandai.
- Kekurangan dan ketidakpastian terlihat.
- Saya tidak tertipu oleh tone yang percaya diri.
6. FAIRNESS: siapa yang terlewat atau dirugikan?
- Kriteria keputusan relevan dan dapat dijelaskan.
- Atribut sensitif atau proxy yang tidak diperlukan dihapus.
- Kasus berbeda sudah diuji.
- Aksesibilitas dipertimbangkan.
- Pihak terdampak memiliki review manusia dan mekanisme koreksi.
- AI tidak mengambil keputusan final tentang manusia.
7. RIGHTS: apakah input dan output boleh dipakai?
- Saya punya hak atau izin atas input dan aset referensi.
- Saya membaca Terms tool dan tier yang dipakai.
- Saya memeriksa apakah penggunaan logo, merek, karakter, wajah, suara, dan karya pihak lain memerlukan izin atau lisensi, atau memiliki pengecualian hukum yang relevan.
- Saya tidak menganggap penggunaan komersial otomatis diizinkan.
- Saya memeriksa kemiripan yang mencurigakan.
- Kontribusi manusia terhadap hasil terdokumentasi.
- Disclosure dilakukan jika diwajibkan.
- Proyek berisiko tinggi mendapat review legal yang sesuai.
Catatan: hak memakai output menurut Terms tidak otomatis berarti output dilindungi copyright atau bebas melanggar hak pihak lain.
8. DEEPFAKE: verifikasi identitas lewat kanal lain
- Saya tidak menilai keaslian hanya dari wajah atau suara.
- Saya mencari sumber unggahan pertama dan kanal resmi.
- Saya mencari coverage lain atau versi lebih panjang.
- Untuk permintaan uang atau data, saya menghentikan komunikasi.
- Saya menghubungi pihak terkait lewat nomor atau kanal yang sudah dikenal.
- Saya tidak membagikan konten sensasional sebelum konteks terverifikasi.
9. ACTION: apa yang terjadi setelah output?
- Manusia memberi approval sebelum dikirim, dipublikasikan, atau dijalankan.
- Tindakan otomatis memakai izin minimum.
- Ada log yang cukup untuk audit.
- Ada batas biaya, frekuensi, dan penerima.
- Ada error handling.
- Ada cara pause dan rollback.
- Pengujian dilakukan dengan data nonproduksi.
10. RECORD: apa yang perlu dicatat?
- Tool, tier, dan tanggal dicatat.
- Versi prompt yang dipakai dicatat.
- Sumber dan langkah verifikasi dicatat.
- Keputusan manusia dicatat.
- Data sensitif tidak disimpan di log.
- Retention dan akses dokumen hasil sesuai kebijakan.
Keputusan akhir
Pilih satu:
- JALAN: risiko rendah dan checklist terpenuhi.
- JALAN SETELAH MITIGASI: ada perbaikan spesifik yang harus selesai.
- ESKALASI: perlu persetujuan atau ahli.
- BERHENTI: data, dampak, atau kontrol tidak memadai.
Mitigasi atau alasan keputusan:
Reviewer: Tanggal: Review berikutnya:
Materi ini adalah panduan literasi, bukan nasihat hukum, medis, keuangan, atau keamanan profesional.