สิ่งที่ห้ามพิมพ์ลงแชต AI เด็ดขาด (และสิ่งที่พิมพ์ได้สบายใจ)

คำตอบโดยสรุป

ห้ามวางรหัสผ่าน API key รหัสยืนยันตัวตนสองขั้นตอน หมายเลขบัตรหรือบัญชีแบบเต็ม หรือหมายเลขบัตรประชาชนลงแชต AI เด็ดขาด และให้ปฏิบัติกับข้อมูลส่วนตัวของคนอื่น งานลูกค้าภายใต้ NDA และภาพหน้าจอที่ยังไม่ปกปิดข้อมูลในแบบเดียวกัน ร่างงานของคุณเอง เอกสารที่ปกปิดข้อมูลแล้ว และคำถามทั่วไป ปลอดภัยดี เหตุผลคือเรื่องการเก็บข้อมูลและค่าเริ่มต้นการฝึกโมเดล ไม่ใช่เรื่องแฮก

ข้อมูลลับที่คุณวางลงไปจริง ๆ แล้วไปอยู่ที่ไหน

ไม่มีอะไรในหน้านี้เกี่ยวกับแฮกเกอร์เลย ข้อมูลลับที่คุณวางลงไปสร้างสำเนาขึ้นมาผ่านการทำงานปกติที่มีการบันทึกไว้ของผลิตภัณฑ์แชต และสำเนาเหล่านั้นแหละคือปัญหา

มีกลไกสี่อย่างที่ทำงานอยู่ อย่างแรก การเก็บรักษาข้อมูล สิ่งที่คุณวางลงไปกลายเป็นส่วนหนึ่งของบทสนทนาที่ถูกเก็บไว้ ตามตารางเวลาที่มีการระบุไว้ชัดเจน ตัวอย่างเช่น OpenAI กำหนดให้แชตที่ถูกลบถูกลบถาวรภายใน 30 วัน และกิจกรรมของ Google Gemini อยู่ภายใต้การตั้งค่าลบอัตโนมัติที่ค่าเริ่มต้นคือ 18 เดือน ซึ่ง วิธีลบบัญชี Gemini ของคุณ ครอบคลุมวิธีเปลี่ยนค่านี้ อย่างที่สอง ค่าเริ่มต้นการฝึกโมเดล ระดับผู้ใช้ทั่วไปของ OpenAI, Anthropic และ Google สามารถนำบทสนทนาไปใช้พัฒนาโมเดลได้ เว้นแต่คุณจะปิดการตั้งค่านั้นเอง ในขณะที่ระดับธุรกิจและ API มีค่าเริ่มต้นเป็นปิดอยู่แล้ว อย่างที่สาม การตรวจสอบ ผู้ให้บริการทั้งสามรายระบุว่าบทสนทนาที่ถูกตั้งค่าสถานะไว้อาจถูกคนอ่านได้ ซึ่งเป็นแนวปฏิบัติด้านความปลอดภัยตามปกติ แต่ก็ยังหมายความว่ามนุษย์คนหนึ่งอาจได้เห็นสิ่งที่คุณวางลงไปในที่สุด อย่างที่สี่ การแชร์ บทสนทนาที่แชร์เป็นลิงก์จะพาทุกอย่างในนั้นไปด้วย รวมถึงเอกสารที่คุณอัปโหลดไว้สามข้อความก่อนส่วนที่คุณอยากโชว์ให้ใครดูจริง ๆ

ไม่มีข้อไหนในนี้เป็นเรื่องอื้อฉาว แต่รวมกันแล้วมันบอกสิ่งเดียวกัน คือกล่องแชตเป็นที่ที่ข้อความถูกเก็บไว้ บางทีก็ถูกนำไปเรียนรู้ และบางทีก็มีคนเห็น วางข้อมูลให้เหมาะสมกับความจริงนี้ ส่วนที่เหลือของหน้านี้ก็แค่เอาประโยคนั้นไปใช้กับกรณีเฉพาะเจาะจง และ AI ปลอดภัยที่จะใช้ไหม ครอบคลุมคำถามเรื่องความปลอดภัยที่กว้างกว่านี้

รายการห้ามเด็ดขาด: หกอย่างที่ใส่ตัวแทนคำแทนได้ฟรี ๆ

รายการเหล่านี้ไม่มีเหตุผลที่ชอบธรรมใด ๆ ที่จะเข้าไปอยู่ในกล่องแชต เพราะโมเดลไม่จำเป็นต้องมีมันเพื่อช่วยคุณ ทุกรายการแทนที่ด้วยตัวแทนคำได้โดยไม่ทำให้คำตอบที่ได้เปลี่ยนไปเลย

ห้ามวางเด็ดขาดต่างจากข้อมูลอื่นอย่างไรให้ทำแบบนี้แทน
รหัสผ่าน, API key, โทเคนเข้าถึง, รหัสยืนยันตัวตนสองขั้นตอนข้อมูลยืนยันตัวตนมีค่ากับใครก็ตามที่เคยเห็นมัน และการเปลี่ยนรหัสที่หลุดไปแล้วคืองานที่คุณเลี่ยงได้พิมพ์ PASSWORD หรือ KEY แทนตำแหน่งนั้น คำตอบจะไม่เปลี่ยน
หมายเลขบัตร บัญชี หรือ routing number แบบเต็มการฉ้อโกงการชำระเงินต้องใช้ตัวเลขชุดนี้เป๊ะ ๆ เท่านั้น"บัตรของฉัน" หรือ "บัญชีของฉัน" ใช้แทนได้สบายในคำถามเรื่องเงินทุกแบบ
หมายเลขประจำตัวจากรัฐ: เลขประกันสังคม พาสปอร์ต บัตรประชาชน เลขผู้เสียภาษีการขโมยข้อมูลระบุตัวตนสร้างจากตัวเลขพวกนี้ และเปลี่ยนใหม่แบบรหัสผ่านไม่ได้โมเดลไม่เคยต้องการเลขจริงเพื่ออธิบายแบบฟอร์มหรือขั้นตอนใด ๆ เลย
ข้อมูลส่วนตัวของคนอื่น: ชื่อคู่กับที่อยู่ ข้อมูลสุขภาพ บันทึก HRมันคือข้อมูลของพวกเขา และกฎหมายความเป็นส่วนตัวในหลายพื้นที่ถือว่าการแชร์เป็นการกระทำของคุณ ไม่ใช่ของแชตบอตเปลี่ยนชื่อจริงเป็นบุคคล A และบุคคล B ก่อนวาง
เอกสารภายใต้ NDA หรือนโยบายรักษาความลับของนายจ้างคำถามนี้เป็นเรื่องสัญญา และ "ฉันวางมันลงในแชตบอต" คือการเปิดเผยไม่ว่าจะมีอะไรแย่เกิดขึ้นตามมาหรือไม่ถามคำถามด้วยโครงสร้างของเอกสาร โดยตัดรายละเอียดที่ได้รับการคุ้มครองออก
อะไรก็ตามที่คุณจะไม่ส่งอีเมลให้ที่ปรึกษาภายนอกโดยไม่มีสัญญานี่คือบททดสอบที่จับทุกอย่างที่แถวด้านบนพลาดไปถ้าคำตอบคือไม่ ให้ปกปิดข้อมูลจนกว่าคำตอบจะเป็นใช่

แถวสุดท้ายคือทั้งตารางที่ถูกบีบอัดลงมา แชต AI คือบุคคลภายนอกที่คุณไม่ได้เซ็นสัญญาอะไรด้วยเลย แต่กำลังช่วยเหลือคุณอยู่ ให้ปรับตัวให้เหมาะสมแบบเดียวกับที่คุณจะทำกับคนแบบนั้น

สิ่งที่ไม่มีใครนึกถึง

รายการห้ามเด็ดขาดด้านบนทำตามง่าย เพราะสิ่งเหล่านั้นดูอ่อนไหวชัดเจนอยู่แล้ว สิ่งที่วางลงไปแล้วจับคนที่ระมัดระวังได้จริง ๆ คือสิ่งที่ดูไม่อ่อนไหวเลย

  • ภาพหน้าจอ ข้อความแสดงข้อผิดพลาดที่คุณตั้งใจจะแชร์มาพร้อมกับถาดการแจ้งเตือน แท็บที่เปิดอยู่ หัวข้ออีเมลจากคนอื่น และการเตือนความจำในปฏิทินตรงมุมจอ ครอปให้เหลือแค่ส่วนที่คุณกำลังถามถึง
  • ไฟล์โค้ดที่มีความลับซ่อนอยู่ GitGuardian นับได้ว่ามีความลับใหม่ 23.8 ล้านรายการรั่วไหลใน public GitHub commit ในปี 2024 และการวางไฟล์ config หรือ .env ที่มีคีย์ที่ใช้งานจริงอยู่ ก็คือความผิดพลาดแบบเดียวกันในเวอร์ชันหน้าต่างแชต ค้นหาคำว่า key, secret, token และ password ในไฟล์ก่อนที่จะวางมันลงไป
  • บทถอดเสียงและการบันทึกการประชุม ทุกคนในที่ประชุมนั้นพูดกับคนในห้อง ไม่มีใครยินยอมให้อัปโหลดขึ้นแชตเลย บทสรุปที่คุณเขียนขึ้นเองไม่มีปัญหาแบบนั้น
  • สเปรดชีตที่มีคอลัมน์ลูกค้า คำถามคือเรื่องสูตรคำนวณ แต่สิ่งที่วางลงไปมีอีเมลลูกค้าทุกคนในชีตติดไปด้วย ลบคอลัมน์ที่ระบุตัวตนออกก่อน หรือวางแค่สิบแถวของโครงสร้างแทนทั้งชีต
  • สัญญาที่มีชื่อคู่สัญญา การเข้าใจข้อสัญญาต้องการแค่ตัวข้อสัญญา แทบไม่ต้องรู้เลยว่าใครเป็นคนเซ็น สรุปเอกสารด้วย AI ทำงานได้ดีพอ ๆ กันกับไฟล์ที่ปกปิดข้อมูลแล้ว
  • ปฏิทินและกล่องข้อความที่ส่งออกมา ไฟล์เดียวมีชื่อ เวลา และหัวข้อของคนอื่นหลายร้อยรายการ ถามเรื่องปัญหาการจัดตารางเวลา วางแค่โครงร่างของสัปดาห์ แล้วเก็บไฟล์ที่ส่งออกไว้กับตัว

แบบแผนของทั้งหกข้อนี้คือ ส่วนที่อ่อนไหวมักเป็นบริบทที่อยู่รอบสิ่งที่คุณต้องการ และการครอปให้เหลือแค่สิ่งที่ต้องการก็ตัดส่วนนั้นออกไปได้ การครอปนั้นใช้เวลาแค่สามสิบวินาที

สิ่งที่พิมพ์ได้สบายใจ

ประเด็นของการมีรายการห้ามเด็ดขาดที่สั้น คือทุกอย่างที่อยู่นอกรายการนั้นใช้งานได้ และการวางข้อมูลในชีวิตประจำวันส่วนใหญ่ไม่มีปัญหาอะไรเลย ทั้งร่างงานและโน้ตของคุณเอง ข้อมูลสาธารณะ คำถามทั่วไปไม่ว่าหัวข้อจะเป็นเรื่องส่วนตัวแค่ไหน โค้ดของคุณเองที่ไม่มีความลับฝังอยู่ และเอกสารใด ๆ ที่คุณปกปิดข้อมูลลงจนเหลือแค่สิ่งที่คำถามต้องการ

นิสัยที่ทำให้เรื่องนี้เป็นไปได้คือการปกปิดข้อมูลก่อนวาง และเหตุผลที่มันได้ผลก็เพราะโมเดลให้เหตุผลจากโครงสร้าง ไม่ใช่จากตัวตน ลองทดสอบเองสักครั้ง ขอจดหมายถึงเจ้าของบ้านเรื่องเครื่องทำความร้อนเสีย แบบมีชื่อจริงอยู่ในนั้น แล้วลองอีกครั้งด้วย [LANDLORD] แทนชื่อ แล้วเทียบกันดู "อธิบายข้อสัญญานี้" ไม่ได้ดีขึ้นเลยเวลาโมเดลรู้ว่าบริษัทไหนเซ็นสัญญา ในกรณีหายากที่ชื่อจริง ๆ มีความสำคัญ คุณเพิ่มมันกลับเข้าไปในผลลัพธ์เองได้ เทียบกับทางเลือกอื่นคือการวางข้อมูลที่ไม่ได้ปกปิดซึ่งเรียกคืนไม่ได้

สองการตั้งค่าที่ทำให้เรื่องนี้สมบูรณ์ ตรวจสวิตช์การฝึกโมเดลของแอปแชตของคุณสักครั้ง เพราะค่าเริ่มต้นสำหรับผู้ใช้ทั่วไปไม่ได้เข้าข้างคุณ และรู้ตัวเลขการเก็บรักษาข้อมูลของแอปที่คุณใช้ สิ่งที่ผู้ให้บริการควรเผยแพร่มีหน้าตาแบบ หน้าข้อมูลของ Whizi คือ อะไรถูกเก็บไว้ นานแค่ไหน และการลบเอาอะไรออกไปบ้าง คำตอบของ Whizi เองในหน้านั้นคือ ไฟล์ที่อัปโหลดหมดอายุภายในสูงสุด 30 วัน และเนื้อหาของคุณไม่ถูกนำไปฝึกโมเดลที่ Whizi เป็นเจ้าของ และไม่ถูกขายเป็นข้อมูลฝึก เครื่องมือใดก็ตามที่คุณใช้ทุกวันควรตอบคำถามชุดเดียวกันนี้ได้ในที่ที่คุณอ้างอิงได้ ถ้าคุณกำลังเลือกระหว่างค่าสมัครโดยดูจากแกนนี้เป๊ะ ๆ ค่าสมัคร AI จากบุคคลที่สามปลอดภัยไหม เดินผ่านมาตรฐานเดียวกันนี้ทั่วทั้งหมวดหมู่

กฎที่แทนทั้งหน้านี้ได้เมื่อมันกลายเป็นนิสัย คือถ้าคุณจะไม่ส่งอีเมลอันนี้ให้ที่ปรึกษาภายนอกโดยไม่มีสัญญา ก็อย่าวางมันลงไป ส่วนที่เหลือทั้งหมด วางได้อย่างสบายใจ แค่เปลี่ยนชื่อออกไป

เช็กลิสต์การทำงาน
  • อย่าใส่รหัสผ่าน API key และรหัสยืนยันตัวตนสองขั้นตอนลงในแชตใด ๆ ไม่ว่าจะแผนไหนหรือผู้ให้บริการรายใด
  • แทนที่หมายเลขบัตร หมายเลขบัญชี และบัตรประชาชนด้วยตัวแทนคำ คำตอบจะไม่เปลี่ยน
  • เปลี่ยนชื่อคนอื่นเป็นบุคคล A และบุคคล B ก่อนวางอะไรที่เกี่ยวกับพวกเขา
  • ปฏิบัติกับข้อมูลภายใต้ NDA และความลับของนายจ้างว่าเป็นข้อห้ามตามสัญญา ไม่ใช่เรื่องที่ใช้ดุลพินิจเอง
  • ครอปภาพหน้าจอให้เหลือแค่สิ่งที่คุณกำลังถามถึงพอดี
  • ค้นหาคำว่า key, secret, token และ password ในโค้ดก่อนวางไฟล์ลงไป
  • ปิดการฝึกโมเดลจากบทสนทนาของคุณ ถ้าแอปมีการตั้งค่านี้ให้
  • รู้ตัวเลขการเก็บรักษาและการลบข้อมูลของแอปที่คุณใช้ และเลือกเครื่องมือที่เผยแพร่ตัวเลขเหล่านี้

คำถามที่พบบ่อย

มีอะไรบ้างที่ห้ามบอกแชตบอต AI เด็ดขาด

ข้อมูลยืนยันตัวตนทุกชนิด (รหัสผ่าน API key รหัสยืนยันตัวตนสองขั้นตอน) หมายเลขการชำระเงินและบัญชีแบบเต็ม หมายเลขประจำตัวจากรัฐ ข้อมูลส่วนตัวของคนอื่น และอะไรก็ตามที่อยู่ภายใต้ NDA หรือนโยบายรักษาความลับของนายจ้าง บททดสอบที่ครอบคลุมส่วนที่เหลือคือ ถ้าคุณจะไม่ส่งอีเมลอันนี้ให้ที่ปรึกษาภายนอกโดยไม่มีสัญญา ก็อย่าวางมันลงไป

วางเอกสารงานลงแชต AI ปลอดภัยไหม

งานของคุณเอง ที่ปกปิดข้อมูลลงจนเหลือแค่สิ่งที่คำถามต้องการ โดยทั่วไปปลอดภัยและมีประโยชน์มาก ข้อจำกัดหนักสองข้อเป็นเรื่องสัญญามากกว่าเรื่องเทคนิค คือเอกสารภายใต้ NDA และอะไรก็ตามที่นโยบายของนายจ้างจำกัดไว้ ส่วนที่เหลือทั้งหมด ให้ลบชื่อคู่สัญญา ข้อมูลลูกค้า และข้อมูลยืนยันตัวตนที่ฝังอยู่ก่อน แล้วโมเดลจะทำงานเดียวกันได้กับเวอร์ชันที่ปกปิดข้อมูลแล้ว

คนอื่นเห็นสิ่งที่ฉันพิมพ์ลงแชต AI ได้ไหม

ไม่ใช่แบบสุ่มดูเล่น ๆ แต่สำเนาที่เกิดขึ้นเป็นเรื่องจริง บทสนทนาถูกเก็บไว้ตามนโยบายของผู้ให้บริการ ระดับผู้ใช้ทั่วไปอาจนำไปใช้ฝึกโมเดลเว้นแต่คุณจะปิดตัวเลือกนั้น บทสนทนาที่ถูกตั้งค่าสถานะไว้อาจถูกคนตรวจสอบได้ และอะไรก็ตามในบทสนทนาที่คุณแชร์เป็นลิงก์จะติดไปด้วย รายการห้ามเด็ดขาดมีอยู่เพราะสำเนาทั้งสี่แบบนี้ และแต่ละแบบก็เป็นพฤติกรรมของผู้ให้บริการที่มีการบันทึกไว้ชัดเจน

การลบแชตลบมันออกไปจริง ๆ ไหม

ขึ้นอยู่กับผู้ให้บริการ นี่แหละคือเหตุผลที่ตัวเลขการเก็บรักษาข้อมูลควรอยู่ในหน้าข้อมูลที่คุณอ่านได้ก่อนที่จะต้องใช้มัน โดยทั่วไปการลบจะเอาบทสนทนาออกจากบัญชีของคุณทันที และออกจากระบบตามตารางเวลาที่ระบุไว้ โดยมีหน้าต่างการเก็บข้อมูลตามกฎหมายแบบจำกัดอยู่บ้าง ตรวจนโยบายของผู้ให้บริการของคุณเพื่อดูตารางเวลา และเลือกเครื่องมือที่ระบุตารางเวลาไว้ชัดเจน

วางข้อความอ่อนไหวลงแผนเสียเงินปลอดภัยกว่าไหม

ระดับเสียเงินของผู้ให้บริการรายใหญ่ตกราวเดือนละ $20 และมักมีค่าเริ่มต้นการฝึกโมเดลที่เข้มงวดกว่าระดับฟรีสำหรับผู้ใช้ทั่วไป ทิศทางจึงถูกต้อง แต่ไม่มีระดับไหนเปลี่ยนรายการห้ามเด็ดขาดได้ ข้อมูลยืนยันตัวตนที่วางลงในแผนระดับองค์กรที่ดีที่สุดในโลกก็ยังเป็นข้อมูลยืนยันตัวตนที่คุณเปิดเผยไปแล้วอยู่ดี อัปเกรดเพื่อค่าเริ่มต้นที่ดีกว่า แต่ปกปิดข้อมูลไม่ว่าจะแผนไหนก็ตาม