Ke mana sebenarnya data rahasia yang ditempel itu pergi
Tidak ada satu pun di halaman ini yang soal peretas. Data rahasia yang ditempel menciptakan salinan lewat cara kerja biasa dan terdokumentasi dari produk chat, dan salinan itulah masalahnya.
Ada empat mekanisme yang berperan. Pertama, retensi: apa yang Anda tempel menjadi bagian dari percakapan yang tersimpan, dengan jadwal yang terdokumentasi. OpenAI misalnya menjadwalkan chat yang dihapus untuk dimusnahkan permanen dalam 30 hari, dan aktivitas Gemini milik Google berada di bawah pengaturan hapus otomatis yang defaultnya 18 bulan, yang dibahas caranya diubah di cara menghapus akun Gemini. Kedua, default pelatihan: tingkatan konsumen di OpenAI, Anthropic, dan Google bisa memakai percakapan untuk melatih model kecuali Anda mematikan pengaturannya, sedangkan tingkatan bisnis dan API defaultnya mati. Ketiga, peninjauan: ketiga penyedia ini menyatakan bahwa percakapan yang ditandai bisa dibaca orang, yang merupakan praktik keamanan rutin dan tetap berarti seseorang bisa saja melihat apa yang Anda tempel. Keempat, berbagi: percakapan yang dibagikan lewat tautan membawa semua isinya, termasuk dokumen yang Anda unggah tiga pesan sebelum bagian yang ingin Anda tunjukkan ke orang lain.
Tidak ada satu pun dari ini yang berupa skandal. Semuanya bersama-sama berarti satu hal: kolom chat adalah tempat teks disimpan, kadang dipelajari, dan sesekali dilihat. Tempel sesuai itu. Sisa halaman ini hanyalah kalimat itu diterapkan ke kasus-kasus spesifik, dan apakah AI aman digunakan membahas pertanyaan keamanan yang lebih luas di sekitarnya.
Daftar terlarang: enam hal yang bisa diganti placeholder secara gratis
Hal-hal ini tidak punya alasan sah untuk masuk kolom chat, sebab modelnya tidak membutuhkannya untuk membantu Anda. Semuanya bisa diganti dengan placeholder tanpa mengubah jawaban yang Anda terima.
| Jangan pernah tempel | Kenapa beda dari data lain | Yang harus dilakukan sebagai gantinya |
|---|---|---|
| Kata sandi, API key, token akses, kode dua faktor | Kredensial berharga bagi siapa pun yang pernah melihatnya, dan memutar ulang yang bocor adalah kerja yang bisa Anda hindari | Ketik PASSWORD atau KEY di tempatnya; jawabannya tidak akan berubah |
| Nomor kartu, rekening, atau routing lengkap | Penipuan pembayaran butuh persis string ini dan tidak ada yang lain | "kartu saya" dan "rekening saya" sudah cukup untuk pertanyaan soal uang apa pun |
| Identitas pemerintah: NIK, paspor, ID nasional, nomor pajak | Pencurian identitas dibangun dari data ini, dan tidak bisa diputar ulang seperti kata sandi | Model tidak pernah butuh angka aslinya untuk menjelaskan formulir atau proses |
| Data pribadi orang lain: nama dengan alamat, detail kesehatan, catatan HR | Itu informasi milik mereka, dan hukum privasi di sebagian besar tempat menganggap membagikannya sebagai tindakan Anda, bukan tindakan chatbotnya | Ganti nama asli dengan Orang A dan Orang B sebelum menempel |
| Dokumen ber-NDA atau kebijakan kerahasiaan perusahaan | Pertanyaannya soal kontrak, dan "saya tempel ke chatbot" adalah pengungkapan, terlepas dari ada tidaknya akibat buruk sesudahnya | Ajukan pertanyaan dengan struktur dokumennya, minus detail yang dilindungi |
| Apa pun yang tidak akan Anda kirim lewat email ke konsultan luar tanpa kontrak | Ini ujian yang menangkap semua yang terlewat baris-baris di atas | Kalau jawabannya tidak, samarkan sampai jawabannya ya |
Baris terakhir itu meringkas seluruh tabel. Chat AI adalah pihak luar yang belum Anda tandatangani apa pun dengannya, sekadar sedang membantu. Kalibrasi sama persis seperti untuk pihak itu.
Hal-hal yang tidak terpikir orang
Daftar keras di atas mudah diikuti karena hal-halnya terlihat sensitif. Yang justru menjerat orang yang sudah berhati-hati adalah yang terlihat biasa saja.
- Tangkapan layar. Pesan error yang ingin Anda bagikan datang bersama tray notifikasi, tab yang sedang terbuka, subjek email dari orang lain, dan pengingat kalender di sudut. Potong hanya ke bagian yang Anda tanyakan.
- File kode dengan rahasia di dalamnya. GitGuardian menghitung 23,8 juta rahasia baru bocor di commit GitHub publik selama 2024, dan config atau file .env yang ditempel dengan key aktif di dalamnya adalah versi kesalahan yang sama di jendela chat. Cari kata key, secret, token, dan password di file sebelum menempelnya.
- Transkrip dan rekaman rapat. Semua orang di rapat itu berbicara ke orang-orang di ruangan, dan tidak satu pun dari mereka menyetujui diunggah ke chat. Ringkasan yang Anda tulis sendiri tidak punya masalah seperti itu.
- Spreadsheet dengan kolom pelanggan. Pertanyaannya soal rumus; yang ditempel malah membawa setiap email pelanggan di sheet itu. Hapus dulu kolom identitasnya, atau tempel sepuluh baris strukturnya saja, bukan seluruh sheet.
- Kontrak dengan nama pihak lawan. Memahami satu klausul butuh klausulnya, dan hampir tidak pernah butuh siapa yang menandatangani. Meringkas dokumen dengan AI bekerja sama baiknya pada file yang sudah disamarkan.
- Kalender dan kotak masuk yang diekspor. Satu file, ratusan nama, waktu, dan subjek milik orang lain. Tanyakan soal masalah penjadwalannya, tempel bentuk minggunya, simpan hasil ekspornya.
Pola di keenam hal itu sama: bagian sensitifnya biasanya ada di konteks di sekitar apa yang Anda butuhkan, dan memotong ke yang Anda butuhkan menghilangkannya. Pemotongan itu makan waktu tiga puluh detik.
Apa yang sebenarnya aman
Inti dari daftar terlarang yang singkat adalah semua di luar itu bisa dipakai, dan sebagian besar tempel-menempel sehari-hari tidak membawa masalah sama sekali: draf dan catatan Anda sendiri, informasi publik, pertanyaan umum sepersonal apa pun topiknya, kode Anda sendiri tanpa rahasia tertanam, dan dokumen apa pun yang sudah Anda samarkan sampai sesuai kebutuhan pertanyaannya.
Kebiasaan yang memungkinkan semua ini adalah menyamarkan sebelum menempel, dan alasannya berhasil adalah karena model bernalar berdasarkan struktur, bukan identitas. Coba sendiri sekali: minta surat ke pemilik rumah soal pemanas yang rusak dengan nama tercantum, lalu dengan [PEMILIK RUMAH] menggantikannya, dan bandingkan. "Jelaskan klausul kontrak ini" tidak membaik saat modelnya tahu perusahaan mana yang menandatangani. Pada kasus langka ketika sebuah nama benar-benar penting, Anda bisa menambahkannya kembali sendiri ke hasilnya, dibandingkan alternatif berupa tempelan tanpa penyamaran yang tidak bisa ditarik kembali.
Dua pengaturan menyelesaikan sisanya. Periksa toggle pelatihan aplikasi chat Anda sekali saja, sebab default pada konsumen tidak menguntungkan Anda, dan kenali angka retensi aplikasi Anda. Yang seharusnya dipublikasikan penyedia terlihat seperti halaman data Whizi: apa yang disimpan, berapa lama, dan apa yang hilang saat dihapus. Jawaban Whizi sendiri di sana: unggahan kedaluwarsa setelah maksimum 30 hari, dan konten Anda tidak melatih model milik Whizi maupun dijual sebagai data pelatihan. Alat apa pun yang Anda pakai setiap hari sebaiknya menjawab pertanyaan yang sama di suatu tempat yang bisa Anda kutip. Kalau Anda sedang memilih di antara berbagai langganan berdasarkan tolok ukur ini persis, apakah langganan AI pihak ketiga aman menelusuri standar yang sama di seluruh kategori ini.
Aturan yang menggantikan seluruh halaman ini begitu jadi kebiasaan: kalau Anda tidak akan mengirimnya lewat email ke konsultan luar tanpa kontrak, jangan tempel itu. Selebihnya, tempel dengan bebas dan ganti saja nama-namanya.
- Jauhkan kata sandi, API key, dan kode dua faktor dari setiap chat, di setiap paket, di setiap penyedia.
- Ganti nomor kartu, nomor rekening, dan ID pemerintah dengan placeholder; jawabannya tidak akan berubah.
- Ganti nama orang lain dengan Orang A dan Orang B sebelum menempel apa pun tentang mereka.
- Perlakukan materi ber-NDA dan rahasia perusahaan sebagai larangan kontraktual, bukan sekadar pertimbangan.
- Potong tangkapan layar sampai ke hal persis yang Anda tanyakan.
- Cari kata key, secret, token, dan password di kode sebelum menempel sebuah file.
- Matikan pelatihan pada percakapan Anda di aplikasi mana pun yang menawarkan pengaturan itu.
- Kenali angka retensi dan penghapusan aplikasi Anda, dan pilih alat yang mempublikasikannya.
Pertanyaan Umum
Apa yang tidak boleh diceritakan ke chatbot AI?
Kredensial apa pun (kata sandi, API key, kode dua faktor), nomor pembayaran dan rekening lengkap, identitas pemerintah, data pribadi orang lain, dan apa pun yang tercakup NDA atau kebijakan kerahasiaan perusahaan. Ujian yang mencakup sisanya: kalau Anda tidak akan mengirimnya lewat email ke konsultan luar tanpa kontrak, jangan tempel itu.
Amankah menempel dokumen kerja ke AI?
Pekerjaan Anda sendiri, yang sudah disamarkan sesuai kebutuhan pertanyaan, umumnya aman dan sangat berguna. Dua batas keras justru bersifat kontraktual, bukan teknis: materi ber-NDA, dan apa pun yang dibatasi kebijakan perusahaan Anda. Untuk selebihnya, hapus dulu nama pihak lawan, data pelanggan, dan kredensial tertanam, dan modelnya akan mengerjakan tugas yang sama pada versi yang sudah disamarkan.
Bisakah orang lain melihat apa yang saya ketik ke chat AI?
Tidak secara sembarangan, tapi salinannya nyata: percakapan disimpan sesuai kebijakan penyedia, tingkatan konsumen bisa memakainya untuk pelatihan kecuali Anda memilih keluar, percakapan yang ditandai bisa ditinjau orang, dan apa pun di percakapan yang Anda bagikan lewat tautan ikut terbawa. Daftar terlarang ini ada karena keempat salinan itu, dan masing-masing adalah perilaku penyedia yang terdokumentasi.
Apakah menghapus chat benar-benar menghilangkannya?
Tergantung penyedianya, dan justru itulah kenapa angka retensi seharusnya ada di halaman data yang bisa Anda baca sebelum Anda membutuhkannya. Penghapusan biasanya menghilangkan percakapan dari akun Anda dengan cepat dan dari sistem sesuai jadwal yang dinyatakan, dengan jendela retensi hukum terbatas. Periksa kebijakan penyedia Anda untuk jadwalnya, dan pilih alat yang menyatakan satu jadwal jelas.
Apakah lebih aman menempel teks sensitif ke paket berbayar?
Tingkatan berbayar di penyedia besar berkisar sekitar $20 sebulan dan biasanya membawa default pelatihan yang lebih ketat daripada tingkatan konsumen gratis, jadi arahnya benar, tapi tidak ada tingkatan yang mengubah daftar terlarang. Kredensial yang ditempel ke paket paling perusahaan di dunia sekalipun tetap kredensial yang sudah Anda ungkapkan. Upgrade untuk defaultnya; tetap samarkan apa pun keadaannya.