Kam vložené tajemství doopravdy putuje
Tato stránka není o hackerech. Vložené tajemství vytváří kopie díky běžnému, zdokumentovanému fungování chatovacích produktů, a problémem jsou právě tyto kopie.
Za vším stojí čtyři mechanismy. Za prvé uchovávání dat: to, co vložíte, se stává součástí uložené konverzace podle zdokumentovaného harmonogramu. OpenAI například plánuje trvalé odstranění smazaných konverzací do 30 dnů a aktivita v Googlu Gemini spadá pod nastavení automatického mazání, které je standardně na 18 měsíců, což řeší jak smazat účet Gemini. Za druhé výchozí nastavení trénování: spotřebitelské úrovně u OpenAI, Anthropic i Google mohou konverzace používat ke zlepšování modelů, pokud toto nastavení nevypnete, zatímco firemní a API úrovně to mají standardně vypnuté. Za třetí kontrola: všichni tři poskytovatelé uvádějí, že označené konverzace si mohou přečíst lidé, což je běžná bezpečnostní praxe a stále to znamená, že se na to, co jste vložili, může nakonec podívat člověk. Za čtvrté sdílení: konverzace sdílená odkazem s sebou nese úplně vše, včetně dokumentu, který jste nahráli tři zprávy před částí, kterou jste chtěli někomu ukázat.
Žádná z těchto věcí není skandál. Dohromady ale znamenají jedno: chatovací okno je místo, kde se text uchovává, někdy se z něj model učí a občas ho někdo vidí. Vkládejte podle toho. Zbytek této stránky je jen tato věta aplikovaná na konkrétní případy a je AI bezpečné používat se věnuje širší otázce bezpečnosti kolem toho.
Seznam zakázaného: šest položek, které zdarma nahradí zástupný text
Tyto položky nemají žádný legitimní důvod ocitnout se v chatovacím okně, protože model je k tomu, aby vám pomohl, nepotřebuje. Každou z nich lze nahradit zástupným textem, aniž by se odpověď, kterou dostanete, jakkoliv změnila.
| Nikdy nevkládejte | Čím se to liší od jiných dat | Co udělat místo toho |
|---|---|---|
| Hesla, API klíče, přístupové tokeny, dvoufaktorové kódy | Přihlašovací údaj je cenný pro kohokoliv, kdo ho kdy uvidí, a rotace uniklého údaje je práce navíc, které se lze vyhnout | Napište místo toho PASSWORD nebo KEY, odpověď se nezmění |
| Plná čísla karet, účtů nebo bankovní kódy | Platební podvod potřebuje přesně tyto řetězce a nic jiného | Ve finanční otázce klidně stačí "moje karta" a "můj účet" |
| Identifikační údaje od státu: rodné číslo, cestovní pas, národní ID, daňová čísla | Krádež identity se staví právě na těchto údajích a nelze je jako heslo jednoduše obměnit | Model nikdy nepotřebuje skutečné číslo, aby vysvětlil formulář nebo postup |
| Cizí osobní data: jména s adresami, zdravotní údaje, personální záznamy | Jsou to cizí informace a zákony o ochraně osobních údajů ve většině zemí jejich sdílení posuzují jako váš čin, ne čin chatbota | Před vložením nahraďte skutečná jména za Osobu A a Osobu B |
| Dokumenty pod NDA nebo firemní politikou mlčenlivosti | Jde o smluvní záležitost a věta "vložil jsem to do chatbota" je porušením mlčenlivosti bez ohledu na to, jestli se pak něco stane | Zeptejte se na strukturu dokumentu bez chráněných konkrétních údajů |
| Cokoliv, co byste bez smlouvy neposlali externímu konzultantovi e-mailem | Tohle je test, který zachytí vše, co předchozí řádky přehlédly | Pokud je odpověď ne, začerňujte, dokud odpověď nebude ano |
Poslední řádek je celá tabulka v jedné větě. AI chat je vnější strana, se kterou jste nic nepodepsali a která vám právě pomáhá. Přistupujte k ní přesně tak.
Věci, na které nikdo nemyslí
Tvrdý seznam výše se dodržuje snadno, protože položky v něm vypadají citlivě. Vklady, na kterých se skutečně chytí i opatrní lidé, jsou ty, které tak vůbec nevypadají.
- Snímky obrazovky. Chybová hláška, kterou jste chtěli sdílet, přijde společně s vaší lištou oznámení, otevřenými panely, předmětem e-mailu od někoho jiného a upomínkou z kalendáře v rohu. Ořízněte snímek jen na tu věc, na kterou se ptáte.
- Soubory s kódem obsahující tajné údaje. Podle GitGuardian bylo v roce 2024 ve veřejných commitech na GitHubu odhaleno 23,8 milionu nových unikajících tajných údajů, a vložený konfigurační soubor nebo .env s živým klíčem uvnitř je stejná chyba, jen v okně chatu. Před vložením souboru v něm vyhledejte key, secret, token a password.
- Přepisy a nahrávky schůzek. Všichni na dané schůzce mluvili k lidem v místnosti a nikdo z nich nesouhlasil s nahráním do chatu. Shrnutí, která jste si napsali sami, tento problém nemají.
- Tabulky se sloupcem zákazníků. Otázka se týká vzorce, ale vložení obsahuje e-mail každého zákazníka z listu. Nejprve smažte identifikační sloupce, nebo místo celého listu vložte deset řádků struktury.
- Smlouvy se jmény protistrany. K pochopení klauzule stačí klauzule samotná a téměř nikdy není potřeba vědět, kdo ji podepsal. Shrnování dokumentů pomocí AI funguje na začerněném souboru stejně dobře.
- Exportované kalendáře a schránky. Jeden soubor, stovky cizích jmen, časů a předmětů. Ptejte se na problém s plánováním, vložte tvar týdne a export si nechte pro sebe.
Vzorec je u všech šesti stejný: citlivá je obvykle část okolo toho, co skutečně potřebujete, a oříznutí na to podstatné ji odstraní. To ořezání zabere třicet vteřin.
Co je naopak v pořádku
Smyslem krátkého seznamu zakázaného je, že vše ostatní je použitelné, a naprostá většina běžného vkládání nepředstavuje žádný problém: vlastní koncepty a poznámky, veřejné informace, obecné dotazy bez ohledu na to, jak osobní je téma, vlastní kód bez vložených tajných údajů a jakýkoliv dokument začerněný na to, co otázka potřebuje.
Klíčovým návykem je začernění textu před vložením a funguje to proto, že modely uvažují nad strukturou, ne nad identitou. Vyzkoušejte si to sami: požádejte o dopis pronajímateli kvůli rozbitému topení nejprve se jménem a poté s [PRONAJÍMATEL] místo něj, a porovnejte. "Vysvětli mi tuto smluvní klauzuli" se nezlepší tím, že model ví, které společnosti ji podepsaly. V vzácném případě, kdy na jméně skutečně záleží, ho můžete do výstupu doplnit sami, což je lepší varianta než nezačerněné vložení, které už nevrátíte zpět.
Dvě nastavení dotáhnou práci do konce. Jednou zkontrolujte přepínač trénování ve své chatovací aplikaci, protože výchozí nastavení u spotřebitelských verzí nehrají ve váš prospěch, a znejte čísla o uchovávání dat u své aplikace. To, co by měl poskytovatel zveřejnit, vypadá jako stránka Whizi o datech a soukromí: co se ukládá, na jak dlouho a co odstranění maže. Vlastní odpověď Whizi zní: nahrané soubory expirují nejpozději po 30 dnech a váš obsah netrénuje modely vlastněné Whizi ani se neprodává jako tréninková data. Jakýkoliv nástroj, který používáte denně, by měl na stejné otázky umět odpovědět někde, na co se dá odkázat. Pokud si vybíráte mezi předplatnými přesně podle tohoto kritéria, je předplatné AI od třetí strany bezpečné prochází stejným měřítkem celou kategorii.
Pravidlo, které jednou nahradí celou tuto stránku, jakmile se stane návykem: pokud byste to bez smlouvy neposlali e-mailem externímu konzultantovi, nevkládejte to. Vše ostatní vkládejte klidně a jen zaměňte jména.
- Hesla, API klíče a dvoufaktorové kódy nedávejte do žádného chatu, na žádném plánu, u žádného poskytovatele.
- Čísla karet, čísla účtů a doklady od státu nahraďte zástupným textem, odpověď se tím nezmění.
- Cizí jména před vložením nahraďte za Osobu A a Osobu B.
- K materiálům pod NDA nebo firemní mlčenlivostí přistupujte jako ke smluvně zakázaným, ne jako k věci úsudku.
- Snímky obrazovky ořízněte přesně na to, na co se ptáte.
- Před vložením souboru v něm vyhledejte key, secret, token a password.
- Vypněte trénování na svých konverzacích všude, kde to aplikace umožňuje.
- Znejte čísla o uchovávání a mazání dat u své aplikace a upřednostňujte nástroje, které je zveřejňují.
Časté dotazy
Co byste nikdy neměli říct AI chatbotovi?
Jakékoliv přihlašovací údaje (hesla, API klíče, dvoufaktorové kódy), plná platební a účetní čísla, doklady od státu, cizí osobní údaje a cokoliv kryté NDA nebo firemní politikou mlčenlivosti. Test, který pokryje zbytek: pokud byste to bez smlouvy neposlali e-mailem externímu konzultantovi, nevkládejte to.
Je bezpečné vkládat pracovní dokumenty do AI?
Vlastní práce začerněná na to, co otázka potřebuje, je obecně v pořádku a nesmírně užitečná. Dvě tvrdé hranice jsou smluvní, ne technické: materiál pod NDA a cokoliv omezené firemní politikou zaměstnavatele. U všeho ostatního nejprve odstraňte jména protistrany, zákaznická data a vložené přihlašovací údaje, a model odvede stejnou práci i na začerněné verzi.
Vidí ostatní lidé, co píšu do AI chatu?
Ne běžně, ale kopie jsou reálné: konverzace se uchovávají podle politiky poskytovatele, spotřebitelské úrovně je mohou používat k trénování, pokud to nevypnete, označené konverzace si mohou prohlédnout lidé a vše v konverzaci sdílené odkazem cestuje spolu s ní. Seznam zakázaného existuje kvůli těmto čtyřem kopiím a každá z nich je zdokumentovaným chováním poskytovatele.
Smaže smazání konverzace skutečně vše?
Záleží na poskytovateli, a přesně proto čísla o uchovávání dat patří na stránku o datech, kterou si můžete přečíst dřív, než je budete potřebovat. Smazání obvykle konverzaci z vašeho účtu odstraní okamžitě a ze systémů podle uvedeného harmonogramu, s omezenými lhůtami pro uchovávání ze zákona. Zkontrolujte politiku svého poskytovatele kvůli harmonogramu a upřednostňujte nástroje, které nějaký uvádějí.
Je bezpečnější vkládat citlivý text do placeného plánu?
Placené úrovně u velkých poskytovatelů vyjdou zhruba na $20 měsíčně a obvykle mají přísnější výchozí nastavení trénování než bezplatné spotřebitelské úrovně, takže směr je správný, ale žádná úroveň nemění seznam zakázaného. Přihlašovací údaj vložený do nejfiremnějšího plánu na světě je pořád přihlašovací údaj, který jste vyzradili. Upgradujte kvůli výchozím nastavením, začerňujte bez ohledu na plán.