Czego nigdy nie wklejać do czatu AI (i co jest naprawdę bezpieczne)

Krótka odpowiedź

Nigdy nie wklejaj do czatu AI haseł, kluczy API, kodów dwuskładnikowych, pełnych numerów kart czy kont ani numerów dokumentów tożsamości, i traktuj tak samo dane osobowe innych ludzi, pracę klienta objętą NDA i nieocenzurowane zrzuty ekranu. Twoje własne szkice, ocenzurowane dokumenty i ogólne pytania są bezpieczne. Powód to retencja i domyślne ustawienia treningu, nie hakowanie.

Gdzie naprawdę trafia wklejony sekret

Nic na tej stronie nie dotyczy hakerów. Wklejony sekret tworzy kopie poprzez zwykłe, udokumentowane działanie produktów czatowych, i to te kopie są problemem.

Za to odpowiadają cztery mechanizmy. Po pierwsze, retencja: to, co wklejasz, staje się częścią zapisanej rozmowy, według udokumentowanego harmonogramu. OpenAI na przykład planuje trwałe usunięcie skasowanych czatów w ciągu 30 dni, a aktywność Google Gemini podlega ustawieniu automatycznego usuwania, które domyślnie wynosi 18 miesięcy, a jak usunąć konto Gemini opisuje, jak to zmienić. Po drugie, domyślne ustawienia treningu: warstwy konsumenckie OpenAI, Anthropic i Google mogą wykorzystywać rozmowy do ulepszania modeli, dopóki nie wyłączysz tego ustawienia, podczas gdy warstwy biznesowe i API mają to domyślnie wyłączone. Po trzecie, przegląd: wszyscy trzej dostawcy stwierdzają, że oflagowane rozmowy mogą być czytane przez ludzi, co jest rutynową praktyką bezpieczeństwa, a mimo to oznacza, że człowiek może w końcu spojrzeć na to, co wkleiłeś. Po czwarte, udostępnianie: rozmowa udostępniona jako link niesie ze sobą wszystko, co w niej jest, łącznie z dokumentem, który przesłałeś trzy wiadomości przed fragmentem, który chciałeś komuś pokazać.

Żadne z nich nie jest skandalem. Razem wszystkie oznaczają jedno: okienko czatu to miejsce, gdzie tekst jest przechowywany, czasem wykorzystywany do nauki, a czasem widziany. Wklejaj odpowiednio do tego. Reszta tej strony to po prostu to zdanie zastosowane do konkretnych przypadków, a czy AI jest bezpieczne omawia szersze pytanie o bezpieczeństwo wokół tego tematu.

Lista nigdy: sześć rzeczy, które placeholder zastąpi za darmo

Te rzeczy nie mają żadnego uzasadnionego powodu, żeby trafić do okienka czatu, ponieważ model nie potrzebuje ich, żeby ci pomóc. Każdą z nich można zastąpić placeholderem, nie zmieniając otrzymywanej odpowiedzi.

Nigdy nie wklejajCzym różni się od innych danychCo zrobić zamiast tego
Hasła, klucze API, tokeny dostępu, kody dwuskładnikoweDane logowania są cenne dla każdego, kto je kiedykolwiek zobaczy, a rotacja wyciekniętych danych to praca, której możesz uniknąćWpisz HASŁO albo KLUCZ w tym miejscu; odpowiedź się nie zmieni
Pełne numery kart, kont czy rozliczenioweOszustwo płatnicze potrzebuje dokładnie tych ciągów znaków i niczego więcej"moja karta" i "moje konto" działają dobrze w każdym pytaniu o pieniądze
Numery identyfikacyjne państwowe: SSN, paszport, dowód osobisty, numery podatkoweKradzież tożsamości jest budowana z tych danych, a nie da się ich zmienić jak hasłaModel nigdy nie potrzebuje prawdziwego numeru, żeby wyjaśnić formularz albo proces
Dane osobowe innych ludzi: imiona i nazwiska z adresami, dane zdrowotne, akta kadroweTo ich informacje, a prawo o ochronie prywatności w większości miejsc traktuje ich udostępnienie jako twój czyn, nie chatbotaZamień prawdziwe imiona na Osoba A i Osoba B przed wklejeniem
Dokumenty objęte NDA albo polityką poufności pracodawcySprawa jest kontraktowa, a "wkleiłem to do chatbota" to ujawnienie, niezależnie od tego, czy potem stanie się coś złegoZadaj pytanie ze strukturą dokumentu, bez chronionych szczegółów
Wszystko, czego nie wysłałbyś mailem do zewnętrznego konsultanta bez umowyTo test, który łapie wszystko, co ominęły wiersze powyżejJeśli odpowiedź brzmi nie, cenzuruj, dopóki odpowiedź nie zabrzmi tak

Ostatni wiersz to cała tabela w skrócie. Czat AI to strona zewnętrzna, z którą niczego nie podpisałeś, a mimo to jest pomocna. Kalibruj się dokładnie tak, jak zrobiłbyś to w takiej sytuacji.

Rzeczy, o których nikt nie myśli

Twardą listę powyżej łatwo jest przestrzegać, bo te rzeczy wyglądają na wrażliwe. To, co naprawdę łapie ostrożnych ludzi, to rzeczy, które tak nie wyglądają.

  • Zrzuty ekranu. Komunikat błędu, który chciałeś pokazać, przychodzi razem z twoim panelem powiadomień, otwartymi kartami, tematem maila od kogoś innego i przypomnieniem z kalendarza w rogu. Przytnij do tego, o co pytasz.
  • Pliki z kodem z sekretami w środku. GitGuardian naliczył 23,8 miliona nowych sekretów wyciekłych w publicznych commitach GitHub w 2024 roku, a wklejony config czy plik .env z żywym kluczem w środku to wersja tego samego błędu w okienku czatu. Przeszukaj plik pod kątem key, secret, token i password, zanim go wkleisz.
  • Transkrypcje i nagrania spotkań. Każdy na tym spotkaniu mówił do ludzi w pokoju, a żaden z nich nie zgodził się na przesłanie tego do czatu. Streszczenia, które sam napisałeś, nie mają tego problemu.
  • Arkusze kalkulacyjne z kolumną klientów. Pytanie dotyczy formuły; wklejenie obejmuje każdy adres e-mail klienta w arkuszu. Najpierw usuń kolumny identyfikujące albo wklej dziesięć wierszy struktury zamiast całego arkusza.
  • Umowy z nazwami kontrahentów. Zrozumienie klauzuli wymaga klauzuli, a niemal nigdy nie wymaga wiedzy, kto ją podpisał. Streszczanie dokumentów za pomocą AI działa dokładnie tak samo dobrze na ocenzurowanym pliku.
  • Wyeksportowane kalendarze i skrzynki odbiorcze. Jeden plik, setki imion, nazwisk, godzin i tematów innych ludzi. Zapytaj o problem z planowaniem, wklej kształt tygodnia, zatrzymaj eksport.

Wzorzec widoczny we wszystkich sześciu: wrażliwa część to zwykle kontekst wokół tego, czego potrzebujesz, a przycięcie do tego, czego potrzebujesz, go usuwa. To przycięcie to trzydzieści sekund.

Co jest naprawdę bezpieczne

Sens krótkiej listy nigdy polega na tym, że wszystko poza nią jest do użycia, a większość codziennego wklejania nie niesie żadnego problemu: twoje własne szkice i notatki, informacje publiczne, ogólne pytania, niezależnie jak osobisty jest temat, twój własny kod bez osadzonych sekretów oraz dowolny dokument ocenzurowany do tego, czego wymaga pytanie.

Nawykiem, który to umożliwia, jest cenzurowanie przed wklejeniem, a działa on dlatego, że modele rozumują na podstawie struktury, a nie tożsamości. Sprawdź to sam, raz: poproś o list do właściciela mieszkania w sprawie zepsutego ogrzewania z imieniem w środku, a potem z [WŁAŚCICIEL] w jego miejscu, i porównaj. "Wyjaśnij tę klauzulę umowy" nie wypada lepiej, gdy model wie, które firmy ją podpisały. W rzadkim przypadku, gdy imię naprawdę ma znaczenie, możesz dopisać je z powrotem do wyniku samodzielnie, w przeciwieństwie do alternatywy w postaci nieocenzurowanego wklejenia, którego nie da się cofnąć.

Dwa ustawienia kończą sprawę. Sprawdź raz przełącznik treningu w swojej aplikacji czatu, bo domyślne ustawienia konsumenckie nie działają na twoją korzyść, i poznaj liczby dotyczące retencji w swojej aplikacji. To, co dostawca powinien publikować, wygląda jak strona danych Whizi: co jest przechowywane, jak długo i co usuwa skasowanie. Własne odpowiedzi Whizi tam zapisane: przesłane pliki wygasają po maksymalnie 30 dniach, a twoja treść nie trenuje modeli należących do Whizi i nie jest sprzedawana jako dane treningowe. Każde narzędzie, którego używasz codziennie, powinno odpowiadać na te same pytania gdzieś, gdzie możesz to zacytować. Jeśli wybierasz między subskrypcjami dokładnie na tej osi, czy subskrypcja AI od zewnętrznego dostawcy jest bezpieczna przechodzi przez ten sam standard w całej kategorii.

Zasada, która zastępuje całą tę stronę, gdy stanie się nawykiem: jeśli nie wysłałbyś tego mailem do zewnętrznego konsultanta bez umowy, nie wklejaj tego. Wszystko inne wklejaj swobodnie, tylko zamień imiona.

Lista kontrolna
  • Trzymaj hasła, klucze API i kody dwuskładnikowe z dala od każdego czatu, na każdym planie, u każdego dostawcy.
  • Zamień numery kart, numery kont i dokumentów tożsamości na placeholdery; odpowiedź się nie zmieni.
  • Zamień imiona innych ludzi na Osoba A i Osoba B, zanim wkleisz cokolwiek o nich.
  • Traktuj materiały objęte NDA i poufnością pracodawcy jako kontraktowo zakazane, a nie kwestię oceny sytuacji.
  • Przytnij zrzuty ekranu dokładnie do tego, o co pytasz.
  • Przeszukaj kod pod kątem key, secret, token i password, zanim wkleisz plik.
  • Wyłącz trening na swoich rozmowach tam, gdzie aplikacja oferuje takie ustawienie.
  • Znaj liczby dotyczące retencji i usuwania w swojej aplikacji i wybieraj narzędzia, które je publikują.

Najczęstsze pytania

Czego nigdy nie mówić chatbotowi AI?

Danych logowania dowolnego rodzaju (hasła, klucze API, kody dwuskładnikowe), pełnych numerów płatności i kont, identyfikatorów państwowych, danych osobowych innych ludzi oraz wszystkiego objętego NDA albo polityką poufności pracodawcy. Test, który obejmuje resztę: jeśli nie wysłałbyś tego mailem do zewnętrznego konsultanta bez umowy, nie wklejaj tego.

Czy bezpiecznie jest wklejać dokumenty firmowe do AI?

Twoja własna praca, ocenzurowana do tego, czego wymaga pytanie, jest ogólnie bezpieczna i ogromnie użyteczna. Dwa twarde ograniczenia są kontraktowe, nie techniczne: materiały objęte NDA i wszystko, co ogranicza polityka twojego pracodawcy. Przy wszystkim innym najpierw usuń nazwy kontrahentów, dane klientów i osadzone dane logowania, a model wykona tę samą pracę na ocenzurowanej wersji.

Czy inni ludzie widzą, co wpisuję do czatu AI?

Nie od tak, ale kopie są prawdziwe: rozmowy są przechowywane zgodnie z polityką dostawcy, warstwy konsumenckie mogą je wykorzystywać do treningu, dopóki nie zrezygnujesz, oflagowane rozmowy mogą być przeglądane przez ludzi, a wszystko w rozmowie, którą udostępnisz linkiem, wędruje razem z nim. Lista nigdy istnieje z powodu tych czterech kopii, a każda z nich to udokumentowane zachowanie dostawcy.

Czy usunięcie czatu naprawdę go usuwa?

To zależy od dostawcy, i właśnie dlatego liczby dotyczące retencji powinny być na stronie danych, którą możesz przeczytać, zanim ich potrzebujesz. Usunięcie zwykle szybko usuwa rozmowę z twojego konta i z systemów według podanego harmonogramu, z ograniczonymi oknami retencji prawnej. Sprawdź politykę swojego dostawcy w poszukiwaniu harmonogramu i wybieraj narzędzia, które taki harmonogram podają.

Czy bezpieczniej jest wklejać wrażliwy tekst do płatnego planu?

Płatne warstwy u dużych dostawców kosztują około $20 miesięcznie i zwykle mają surowsze domyślne ustawienia treningu niż darmowe warstwy konsumenckie, więc kierunek jest właściwy, ale żaden plan nie zmienia listy nigdy. Dane logowania wklejone do najbardziej korporacyjnego planu na świecie wciąż są danymi logowania, które ujawniłeś. Zaktualizuj plan ze względu na domyślne ustawienia; cenzuruj niezależnie od tego.