Je ChatGPT bezpečný? Co nikdy nevkládat do AI chatu (a co je naopak v pořádku)

Krátká odpověď

Do AI chatu nikdy nevkládejte hesla, API klíče, dvoufaktorové kódy, plná čísla karet či účtů ani rodná čísla a čísla dokladů, a stejně přistupujte k cizím osobním údajům, klientské práci pod NDA a necenzurovaným snímkům obrazovky. Vaše vlastní koncepty, začerněné dokumenty a obecné dotazy jsou v pořádku. Důvodem je uchovávání dat a výchozí nastavení pro trénování modelů, ne hackeři.

Kam vložené tajemství doopravdy putuje

Tato stránka není o hackerech. Vložené tajemství vytváří kopie díky běžnému, zdokumentovanému fungování chatovacích produktů, a problémem jsou právě tyto kopie.

Za vším stojí čtyři mechanismy. Za prvé uchovávání dat: to, co vložíte, se stává součástí uložené konverzace podle zdokumentovaného harmonogramu. OpenAI například plánuje trvalé odstranění smazaných konverzací do 30 dnů a aktivita v Googlu Gemini spadá pod nastavení automatického mazání, které je standardně na 18 měsíců, což řeší jak smazat účet Gemini. Za druhé výchozí nastavení trénování: spotřebitelské úrovně u OpenAI, Anthropic i Google mohou konverzace používat ke zlepšování modelů, pokud toto nastavení nevypnete, zatímco firemní a API úrovně to mají standardně vypnuté. Za třetí kontrola: všichni tři poskytovatelé uvádějí, že označené konverzace si mohou přečíst lidé, což je běžná bezpečnostní praxe a stále to znamená, že se na to, co jste vložili, může nakonec podívat člověk. Za čtvrté sdílení: konverzace sdílená odkazem s sebou nese úplně vše, včetně dokumentu, který jste nahráli tři zprávy před částí, kterou jste chtěli někomu ukázat.

Žádná z těchto věcí není skandál. Dohromady ale znamenají jedno: chatovací okno je místo, kde se text uchovává, někdy se z něj model učí a občas ho někdo vidí. Vkládejte podle toho. Zbytek této stránky je jen tato věta aplikovaná na konkrétní případy a je AI bezpečné používat se věnuje širší otázce bezpečnosti kolem toho.

Seznam zakázaného: šest položek, které zdarma nahradí zástupný text

Tyto položky nemají žádný legitimní důvod ocitnout se v chatovacím okně, protože model je k tomu, aby vám pomohl, nepotřebuje. Každou z nich lze nahradit zástupným textem, aniž by se odpověď, kterou dostanete, jakkoliv změnila.

Nikdy nevkládejteČím se to liší od jiných datCo udělat místo toho
Hesla, API klíče, přístupové tokeny, dvoufaktorové kódyPřihlašovací údaj je cenný pro kohokoliv, kdo ho kdy uvidí, a rotace uniklého údaje je práce navíc, které se lze vyhnoutNapište místo toho PASSWORD nebo KEY, odpověď se nezmění
Plná čísla karet, účtů nebo bankovní kódyPlatební podvod potřebuje přesně tyto řetězce a nic jinéhoVe finanční otázce klidně stačí "moje karta" a "můj účet"
Identifikační údaje od státu: rodné číslo, cestovní pas, národní ID, daňová číslaKrádež identity se staví právě na těchto údajích a nelze je jako heslo jednoduše obměnitModel nikdy nepotřebuje skutečné číslo, aby vysvětlil formulář nebo postup
Cizí osobní data: jména s adresami, zdravotní údaje, personální záznamyJsou to cizí informace a zákony o ochraně osobních údajů ve většině zemí jejich sdílení posuzují jako váš čin, ne čin chatbotaPřed vložením nahraďte skutečná jména za Osobu A a Osobu B
Dokumenty pod NDA nebo firemní politikou mlčenlivostiJde o smluvní záležitost a věta "vložil jsem to do chatbota" je porušením mlčenlivosti bez ohledu na to, jestli se pak něco staneZeptejte se na strukturu dokumentu bez chráněných konkrétních údajů
Cokoliv, co byste bez smlouvy neposlali externímu konzultantovi e-mailemTohle je test, který zachytí vše, co předchozí řádky přehlédlyPokud je odpověď ne, začerňujte, dokud odpověď nebude ano

Poslední řádek je celá tabulka v jedné větě. AI chat je vnější strana, se kterou jste nic nepodepsali a která vám právě pomáhá. Přistupujte k ní přesně tak.

Věci, na které nikdo nemyslí

Tvrdý seznam výše se dodržuje snadno, protože položky v něm vypadají citlivě. Vklady, na kterých se skutečně chytí i opatrní lidé, jsou ty, které tak vůbec nevypadají.

  • Snímky obrazovky. Chybová hláška, kterou jste chtěli sdílet, přijde společně s vaší lištou oznámení, otevřenými panely, předmětem e-mailu od někoho jiného a upomínkou z kalendáře v rohu. Ořízněte snímek jen na tu věc, na kterou se ptáte.
  • Soubory s kódem obsahující tajné údaje. Podle GitGuardian bylo v roce 2024 ve veřejných commitech na GitHubu odhaleno 23,8 milionu nových unikajících tajných údajů, a vložený konfigurační soubor nebo .env s živým klíčem uvnitř je stejná chyba, jen v okně chatu. Před vložením souboru v něm vyhledejte key, secret, token a password.
  • Přepisy a nahrávky schůzek. Všichni na dané schůzce mluvili k lidem v místnosti a nikdo z nich nesouhlasil s nahráním do chatu. Shrnutí, která jste si napsali sami, tento problém nemají.
  • Tabulky se sloupcem zákazníků. Otázka se týká vzorce, ale vložení obsahuje e-mail každého zákazníka z listu. Nejprve smažte identifikační sloupce, nebo místo celého listu vložte deset řádků struktury.
  • Smlouvy se jmény protistrany. K pochopení klauzule stačí klauzule samotná a téměř nikdy není potřeba vědět, kdo ji podepsal. Shrnování dokumentů pomocí AI funguje na začerněném souboru stejně dobře.
  • Exportované kalendáře a schránky. Jeden soubor, stovky cizích jmen, časů a předmětů. Ptejte se na problém s plánováním, vložte tvar týdne a export si nechte pro sebe.

Vzorec je u všech šesti stejný: citlivá je obvykle část okolo toho, co skutečně potřebujete, a oříznutí na to podstatné ji odstraní. To ořezání zabere třicet vteřin.

Co je naopak v pořádku

Smyslem krátkého seznamu zakázaného je, že vše ostatní je použitelné, a naprostá většina běžného vkládání nepředstavuje žádný problém: vlastní koncepty a poznámky, veřejné informace, obecné dotazy bez ohledu na to, jak osobní je téma, vlastní kód bez vložených tajných údajů a jakýkoliv dokument začerněný na to, co otázka potřebuje.

Klíčovým návykem je začernění textu před vložením a funguje to proto, že modely uvažují nad strukturou, ne nad identitou. Vyzkoušejte si to sami: požádejte o dopis pronajímateli kvůli rozbitému topení nejprve se jménem a poté s [PRONAJÍMATEL] místo něj, a porovnejte. "Vysvětli mi tuto smluvní klauzuli" se nezlepší tím, že model ví, které společnosti ji podepsaly. V vzácném případě, kdy na jméně skutečně záleží, ho můžete do výstupu doplnit sami, což je lepší varianta než nezačerněné vložení, které už nevrátíte zpět.

Dvě nastavení dotáhnou práci do konce. Jednou zkontrolujte přepínač trénování ve své chatovací aplikaci, protože výchozí nastavení u spotřebitelských verzí nehrají ve váš prospěch, a znejte čísla o uchovávání dat u své aplikace. To, co by měl poskytovatel zveřejnit, vypadá jako stránka Whizi o datech a soukromí: co se ukládá, na jak dlouho a co odstranění maže. Vlastní odpověď Whizi zní: nahrané soubory expirují nejpozději po 30 dnech a váš obsah netrénuje modely vlastněné Whizi ani se neprodává jako tréninková data. Jakýkoliv nástroj, který používáte denně, by měl na stejné otázky umět odpovědět někde, na co se dá odkázat. Pokud si vybíráte mezi předplatnými přesně podle tohoto kritéria, je předplatné AI od třetí strany bezpečné prochází stejným měřítkem celou kategorii.

Pravidlo, které jednou nahradí celou tuto stránku, jakmile se stane návykem: pokud byste to bez smlouvy neposlali e-mailem externímu konzultantovi, nevkládejte to. Vše ostatní vkládejte klidně a jen zaměňte jména.

Kontrolní seznam
  • Hesla, API klíče a dvoufaktorové kódy nedávejte do žádného chatu, na žádném plánu, u žádného poskytovatele.
  • Čísla karet, čísla účtů a doklady od státu nahraďte zástupným textem, odpověď se tím nezmění.
  • Cizí jména před vložením nahraďte za Osobu A a Osobu B.
  • K materiálům pod NDA nebo firemní mlčenlivostí přistupujte jako ke smluvně zakázaným, ne jako k věci úsudku.
  • Snímky obrazovky ořízněte přesně na to, na co se ptáte.
  • Před vložením souboru v něm vyhledejte key, secret, token a password.
  • Vypněte trénování na svých konverzacích všude, kde to aplikace umožňuje.
  • Znejte čísla o uchovávání a mazání dat u své aplikace a upřednostňujte nástroje, které je zveřejňují.

Časté dotazy

Co byste nikdy neměli říct AI chatbotovi?

Jakékoliv přihlašovací údaje (hesla, API klíče, dvoufaktorové kódy), plná platební a účetní čísla, doklady od státu, cizí osobní údaje a cokoliv kryté NDA nebo firemní politikou mlčenlivosti. Test, který pokryje zbytek: pokud byste to bez smlouvy neposlali e-mailem externímu konzultantovi, nevkládejte to.

Je bezpečné vkládat pracovní dokumenty do AI?

Vlastní práce začerněná na to, co otázka potřebuje, je obecně v pořádku a nesmírně užitečná. Dvě tvrdé hranice jsou smluvní, ne technické: materiál pod NDA a cokoliv omezené firemní politikou zaměstnavatele. U všeho ostatního nejprve odstraňte jména protistrany, zákaznická data a vložené přihlašovací údaje, a model odvede stejnou práci i na začerněné verzi.

Vidí ostatní lidé, co píšu do AI chatu?

Ne běžně, ale kopie jsou reálné: konverzace se uchovávají podle politiky poskytovatele, spotřebitelské úrovně je mohou používat k trénování, pokud to nevypnete, označené konverzace si mohou prohlédnout lidé a vše v konverzaci sdílené odkazem cestuje spolu s ní. Seznam zakázaného existuje kvůli těmto čtyřem kopiím a každá z nich je zdokumentovaným chováním poskytovatele.

Smaže smazání konverzace skutečně vše?

Záleží na poskytovateli, a přesně proto čísla o uchovávání dat patří na stránku o datech, kterou si můžete přečíst dřív, než je budete potřebovat. Smazání obvykle konverzaci z vašeho účtu odstraní okamžitě a ze systémů podle uvedeného harmonogramu, s omezenými lhůtami pro uchovávání ze zákona. Zkontrolujte politiku svého poskytovatele kvůli harmonogramu a upřednostňujte nástroje, které nějaký uvádějí.

Je bezpečnější vkládat citlivý text do placeného plánu?

Placené úrovně u velkých poskytovatelů vyjdou zhruba na $20 měsíčně a obvykle mají přísnější výchozí nastavení trénování než bezplatné spotřebitelské úrovně, takže směr je správný, ale žádná úroveň nemění seznam zakázaného. Přihlašovací údaj vložený do nejfiremnějšího plánu na světě je pořád přihlašovací údaj, který jste vyzradili. Upgradujte kvůli výchozím nastavením, začerňujte bez ohledu na plán.