לאן סוד שהודבק בעצם הולך
שום דבר בעמוד הזה לא קשור להאקרים. סוד שהודבק יוצר עותקים דרך הפעולה הרגילה והמתועדת של מוצרי צ'אט, והעותקים הם הבעיה.
ארבעה מנגנונים עושים את העבודה. ראשית, שמירת מידע: מה שאתם מדביקים הופך לחלק משיחה שמורה, לפי לוח זמנים מתועד. OpenAI, לדוגמה, מתזמנת מחיקה סופית של שיחות שנמחקו בתוך 30 יום, ופעילות Gemini של גוגל נמצאת תחת הגדרת מחיקה אוטומטית שברירת המחדל שלה היא 18 חודשים, ואיך למחוק חשבון Gemini מסביר איך לשנות זאת. שנית, ברירות מחדל של אימון: המסלולים הצרכניים ב-OpenAI, ב-Anthropic וב-Google יכולים להשתמש בשיחות לשיפור מודלים אלא אם כבים את ההגדרה, בעוד שמסלולי עסקים ו-API ברירת המחדל שלהם כבויה. שלישית, סקירה: שלושת הספקים מציינים ששיחות שסומנו יכולות להיקרא על ידי אנשים, שזו פרקטיקת בטיחות שגרתית, ועדיין אומרת שאדם עלול להסתכל על מה שהדבקתם. רביעית, שיתוף: שיחה ששותפה כקישור נושאת איתה הכול, כולל המסמך שהעליתם שלוש הודעות לפני החלק שרציתם להראות למישהו.
אף אחד מאלה לא שערורייה. כולם יחד אומרים דבר אחד: תיבת צ'אט היא מקום שבו טקסט נשמר, לפעמים נלמד ממנו, ולעיתים נצפה. הדביקו בהתאם. שאר העמוד הזה הוא בסך הכול המשפט הזה מיושם על מקרים ספציפיים, והאם בטוח להשתמש ב-AI מסביר את שאלת הבטיחות הרחבה יותר סביב זה.
רשימת הלעולם לא: שישה פריטים שממלא מקום מחליף בחינם
לפריטים האלה אין שום סיבה לגיטימית להיכנס לתיבת צ'אט, כי המודל לא צריך אותם כדי לעזור לכם. כל אחד מהם אפשר להחליף בממלא מקום מבלי לשנות את התשובה שתקבלו.
| לעולם אל תדביקו | במה זה שונה ממידע אחר | מה לעשות במקום |
|---|---|---|
| סיסמאות, מפתחות API, אסימוני גישה, קודי אימות דו-שלבי | פרט גישה בעל ערך לכל מי שאי פעם רואה אותו, וסבב מחדש של פרט שדלף זו עבודה שאפשר להימנע ממנה | הקלידו PASSWORD או KEY במקום שבו זה היה אמור להופיע; התשובה לא תשתנה |
| מספרי כרטיס, חשבון או ניתוב מלאים | הונאת תשלום זקוקה בדיוק למחרוזות האלה ולכלום אחר | "הכרטיס שלי" ו"החשבון שלי" עובדים מצוין בכל שאלה כספית |
| מזהים ממשלתיים: תעודת זהות, דרכון, מספרי מס | גניבת זהות נבנית מאלה, ואי אפשר לסובב אותם כמו סיסמה | המודל אף פעם לא צריך את המספר האמיתי כדי להסביר טופס או תהליך |
| מידע אישי של אנשים אחרים: שמות עם כתובות, פרטים רפואיים, רשומות משאבי אנוש | זה המידע שלהם, וחוק הפרטיות ברוב המקומות מתייחס לשיתוף שלו כמעשה שלכם, לא של הצ'אטבוט | החליפו שמות אמיתיים ב"אדם א" ו"אדם ב" לפני ההדבקה |
| מסמכים תחת NDA או מדיניות סודיות של מעסיק | השאלה חוזית, ו"הדבקתי את זה לצ'אטבוט" היא חשיפה בין אם קרה משהו רע לאחר מכן ובין אם לא | שאלו את השאלה עם המבנה של המסמך, בלי הפרטים המוגנים |
| כל דבר שלא הייתם שולחים במייל ליועץ חיצוני בלי חוזה | זה המבחן שתופס את כל מה שהשורות למעלה החמיצו | אם התשובה היא לא, השחירו עד שהתשובה תהיה כן |
השורה האחרונה היא הטבלה כולה בגרסה מכווצת. צ'אט AI הוא גורם חיצוני שלא חתמתם איתו על שום דבר, שנותן שירות. כווננו בדיוק כמו שהייתם עושים עבור זה.
הפריטים שאף אחד לא חושב עליהם
הרשימה הקשה למעלה קלה לעקוב אחריה כי הפריטים נראים רגישים. הדברים שבאמת תופסים אנשים זהירים הם אלה שלא נראים כך.
- צילומי מסך. הודעת השגיאה שהתכוונתם לשתף מגיעה עם מגש ההתראות שלכם, הכרטיסיות הפתוחות, שורת נושא של מייל ממישהו אחר, ותזכורת יומן בפינה. חתכו רק את מה שאתם שואלים עליו.
- קבצי קוד עם סודות בפנים. GitGuardian ספרה 23.8 מיליון סודות חדשים שדלפו בקומיטים ציבוריים ב-GitHub במהלך 2024, וקובץ קונפיגורציה או .env שהודבק עם מפתח פעיל בפנים הוא הגרסה של אותה טעות בחלון הצ'אט. חפשו בקובץ key, secret, token ו-password לפני שהוא נכנס.
- תמלולי פגישות והקלטות. כל מי שהיה בפגישה דיבר עם האנשים בחדר, ואף אחד מהם לא הסכים להעלאה לצ'אט. סיכומים שכתבתם בעצמכם לא נושאים בעיה כזאת.
- גיליונות עם עמודת לקוחות. השאלה היא על הנוסחה; ההדבקה כוללת כל מייל של לקוח בגיליון. מחקו קודם את עמודות הזיהוי, או הדביקו עשר שורות של מבנה במקום את כל הגיליון.
- חוזים עם שמות של הצד השני. הבנת סעיף דורשת את הסעיף, וכמעט אף פעם לא דורשת מי חתם עליו. סיכום מסמכים עם AI עובד בדיוק אותו דבר על קובץ מוצנע.
- יומנים ותיבות דואר מיוצאים. קובץ אחד, מאות שמות, זמנים ונושאים של אנשים אחרים. שאלו על בעיית התזמון, הדביקו את צורת השבוע, שמרו את הייצוא.
התבנית לאורך כל השישה: החלק הרגיש הוא בדרך כלל ההקשר סביב מה שאתם צריכים, וחיתוך למה שאתם צריכים מסיר אותו. החיתוך הזה לוקח שלושים שניות.
מה בעצם בסדר גמור
המטרה של רשימת לעולם לא קצרה היא שכל מה שמחוצה לה שמיש, ורוב ההדבקה היומיומית לא נושאת שום בעיה: הטיוטות וההערות שלכם, מידע ציבורי, שאלות כלליות לא משנה כמה אישי הנושא, הקוד שלכם בלי סודות מוטמעים, וכל מסמך שהשחרתם עד למה שהשאלה צריכה.
ההרגל המאפשר הוא השחרה לפני ההדבקה, והסיבה שזה עובד היא שמודלים מנמקים לפי מבנה ולא לפי זהות. בדקו זאת בעצמכם פעם אחת: בקשו את המכתב לבעל הבית על החימום המקולקל עם השם בפנים, ואז עם [בעל הבית] במקומו, והשוו. "הסבר את סעיף החוזה הזה" לא משתפר כשהמודל יודע אילו חברות חתמו. במקרה הנדיר שבו שם באמת חשוב, אפשר להחזיר אותו בעצמכם לתוך הפלט, לעומת האלטרנטיבה של הדבקה לא מוצנעת שאי אפשר לבטל.
שתי הגדרות משלימות את העבודה. בדקו את מתג האימון של אפליקציית הצ'אט שלכם פעם אחת, כי ברירות המחדל הצרכניות לא לטובתכם, והכירו את מספרי שמירת המידע של האפליקציה שלכם. מה שספק אמור לפרסם נראה כמו עמוד המידע והפרטיות של Whizi: מה נשמר, לכמה זמן, ומה מחיקה מסירה. התשובות של Whizi עצמה שם: העלאות פגות תוקף לאחר עד 30 יום, והתוכן שלכם לא מאמן מודלים בבעלות Whizi ולא נמכר כמידע לאימון. כל כלי שאתם משתמשים בו יומיומית אמור לענות על אותן שאלות איפשהו שתוכלו לצטט. אם אתם בוחרים בין מנויים בדיוק על הציר הזה, האם מנוי AI של צד שלישי בטוח עובר על אותו תקן לכל הקטגוריה.
הכלל שמחליף את כל העמוד הזה ברגע שהוא הופך להרגל: אם לא הייתם שולחים את זה במייל ליועץ חיצוני בלי חוזה, אל תדביקו את זה. כל השאר, הדביקו בחופשיות והחליפו את השמות.
- שמרו סיסמאות, מפתחות API וקודי אימות דו-שלבי הרחק מכל צ'אט, בכל תוכנית, אצל כל ספק.
- החליפו מספרי כרטיס, מספרי חשבון ותעודות זהות ממשלתיות בממלאי מקום; התשובה לא תשתנה.
- החליפו שמות של אנשים אחרים ב"אדם א" ו"אדם ב" לפני שמדביקים משהו עליהם.
- התייחסו לחומר תחת NDA או סודיות מעסיק כאסור חוזית, לא כשיקול דעת.
- חתכו צילומי מסך בדיוק לדבר שאתם שואלים עליו.
- חפשו בקוד key, secret, token ו-password לפני הדבקת קובץ.
- כבו את האימון על השיחות שלכם במקום שהאפליקציה מציעה את ההגדרה.
- הכירו את מספרי שמירת המידע והמחיקה של האפליקציה שלכם, והעדיפו כלים שמפרסמים אותם.
שאלות נפוצות
מה אסור לספר לצ'אטבוט AI?
כל סוג של פרטי גישה (סיסמאות, מפתחות API, קודי אימות דו-שלבי), מספרי תשלום וחשבון מלאים, מזהים ממשלתיים, מידע אישי של אנשים אחרים, וכל דבר שמכוסה ב-NDA או במדיניות סודיות של מעסיק. המבחן שמכסה את כל השאר: אם לא הייתם שולחים את זה במייל ליועץ חיצוני בלי חוזה, אל תדביקו את זה.
האם בטוח להדביק מסמכי עבודה ל-AI?
העבודה שלכם, מושחרת עד למה שהשאלה צריכה, בדרך כלל בסדר גמור ושימושית מאוד. שתי המגבלות הקשות הן חוזיות ולא טכניות: חומר תחת NDA, וכל דבר שמדיניות המעסיק שלכם מגבילה. לכל השאר, הסירו קודם שמות של הצד השני, מידע לקוחות ופרטי גישה מוטמעים, והמודל יעשה את אותה עבודה על הגרסה המוצנעת.
האם אנשים אחרים יכולים לראות מה אני מקליד לצ'אט AI?
לא באופן מזדמן, אבל העותקים אמיתיים: שיחות נשמרות לפי מדיניות הספק, מסלולים צרכניים עשויים להשתמש בהן לאימון אלא אם מבטלים את זה, שיחות שסומנו יכולות להיסקר על ידי אנשים, וכל דבר בשיחה ששיתפתם בקישור נוסע איתה. רשימת הלעולם לא קיימת בגלל ארבעת העותקים האלה, וכל אחד מהם הוא התנהגות מתועדת של ספק.
האם מחיקת שיחה באמת מסירה אותה?
זה תלוי בספק, וזאת בדיוק הסיבה שמספרי שמירת מידע צריכים להיות בעמוד מידע שאפשר לקרוא לפני שצריכים אותו. מחיקה בדרך כלל מסירה את השיחה מהחשבון שלכם באופן מיידי ומהמערכות לפי לוח זמנים מוצהר, עם חלונות שמירה חוקיים מוגבלים. בדקו את מדיניות הספק שלכם ללוח הזמנים, והעדיפו כלים שמצהירים על אחד.
האם בטוח יותר להדביק טקסט רגיש בתוכנית בתשלום?
מסלולים בתשלום אצל הספקים הגדולים עולים בערך $20 לחודש, ובדרך כלל נושאים ברירות מחדל מחמירות יותר לאימון מהמסלולים הצרכניים החינמיים, אז הכיוון נכון, אבל שום מסלול לא משנה את רשימת הלעולם לא. פרט גישה שהודבק במסלול הכי עסקי בעולם עדיין פרט גישה שחשפתם. שדרגו בשביל ברירות המחדל; השחירו בכל מקרה.