Ce nu lipești niciodată într-un chat de IA (și ce e de fapt în regulă)

Răspuns rapid

Nu lipi niciodată parole, chei API, coduri cu doi factori, numere complete de card sau de cont, sau numere de identitate guvernamentale într-un chat de IA, și tratează la fel datele personale ale altor persoane, munca de client sub NDA, și capturile de ecran neredactate. Ciornele tale proprii, documentele redactate, și întrebările generale sunt în regulă. Motivul e retenția și setările implicite de antrenament, nu hacking-ul.

Unde ajunge de fapt un secret lipit

Nimic de pe această pagină nu e despre hackeri. Un secret lipit creează copii prin funcționarea obișnuită, documentată, a produselor de chat, iar copiile sunt problema.

Patru mecanisme fac treaba. Primul, retenția: ce lipești devine parte dintr-o conversație stocată, după un program documentat. OpenAI, de exemplu, programează chaturile șterse pentru eliminare permanentă în 30 de zile, iar activitatea Gemini a Google stă sub o setare de ștergere automată care implicit e 18 luni, ceea ce cum îți ștergi contul Gemini acoperă cum se schimbă. Al doilea, setările implicite de antrenament: nivelurile pentru consumatori la OpenAI, Anthropic și Google pot folosi conversațiile pentru a îmbunătăți modelele dacă nu dezactivezi setarea, în timp ce nivelurile business și API sunt implicit dezactivate. Al treilea, revizuirea: toți cei trei furnizori declară că oamenii pot citi conversațiile semnalate, ceea ce e o practică de siguranță obișnuită și tot înseamnă că un om poate ajunge să se uite la ce ai lipit. Al patrulea, partajarea: o conversație partajată ca link poartă tot ce e în ea, inclusiv documentul pe care l-ai încărcat cu trei mesaje înainte de partea pe care voiai s-o arăți cuiva.

Niciunul dintre acestea nu e un scandal. Toate împreună înseamnă un singur lucru: o casetă de chat e un loc unde textul e păstrat, uneori învățat, și ocazional văzut. Lipește în consecință. Restul acestei pagini e doar acea propoziție aplicată la cazuri specifice, iar dacă IA e sigură de folosit acoperă întrebarea mai largă de siguranță din jurul ei.

Lista interzisă: șase lucruri pe care un substituent le înlocuiește gratuit

Aceste lucruri nu au niciun motiv legitim să intre într-o casetă de chat, pentru că modelul nu are nevoie de ele ca să te ajute. Fiecare dintre ele poate fi înlocuit cu un substituent fără să schimbe răspunsul pe care îl primești.

Nu lipi niciodatăDe ce e diferit de alte dateCe să faci în schimb
Parole, chei API, token-uri de acces, coduri cu doi factoriO credențială e valoroasă pentru oricine o vede vreodată, iar rotirea uneia scurse e muncă pe care o poți evitaScrie PAROLĂ sau CHEIE unde ar trebui să fie; răspunsul nu se va schimba
Numere complete de card, de cont sau de rutareFrauda cu plăți are nevoie exact de aceste șiruri și de nimic altceva"cardul meu" și "contul meu" funcționează bine în orice întrebare despre bani
Identificatori guvernamentali: SSN, pașaport, act de identitate național, cod fiscalFurtul de identitate se construiește din acestea, și nu pot fi rotite ca o parolăModelul nu are niciodată nevoie de numărul real ca să explice un formular sau un proces
Datele personale ale altor persoane: nume cu adrese, detalii medicale, dosare de resurse umaneE informația lor, iar legea confidențialității în majoritatea locurilor tratează partajarea ei ca fiind fapta ta, nu a chatbotuluiÎnlocuiește numele reale cu Persoana A și Persoana B înainte să lipești
Documente sub NDA sau sub o politică de confidențialitate a angajatoruluiÎntrebarea e contractuală, și "l-am lipit într-un chatbot" e o divulgare indiferent dacă se întâmplă ceva rău după aceeaPune întrebarea cu structura documentului, fără detaliile protejate
Orice n-ai trimite prin email unui consultant din afară fără un contractAcesta e testul care prinde tot ce au ratat rândurile de mai susDacă răspunsul e nu, redactează până răspunsul devine da

Ultimul rând e tot tabelul comprimat. Un chat de IA e o parte externă cu care n-ai semnat nimic, care te ajută. Calibrează exact cum ai face pentru asta.

Lucrurile la care nimeni nu se gândește

Lista strictă de mai sus e ușor de urmat pentru că lucrurile par sensibile. Lipirile care chiar prind oamenii atenți sunt cele care nu par.

  • Capturi de ecran. Mesajul de eroare pe care voiai să-l distribui vine cu tava ta de notificări, filele deschise, un subiect de email de la altcineva, și un memento de calendar în colț. Decupează la lucrul despre care întrebi.
  • Fișiere de cod cu secrete în interior. GitGuardian a numărat 23,8 milioane de secrete noi scurse în commit-uri publice pe GitHub în timpul lui 2024, iar un fișier de configurare sau .env lipit, cu o cheie activă în el, e versiunea din fereastra de chat a aceleiași greșeli. Caută în fișier cuvintele key, secret, token, și password înainte să-l lipești.
  • Transcrieri și înregistrări de ședințe. Toată lumea din acea ședință a vorbit cu cei din cameră, și niciunul nu a consimțit la o încărcare într-un chat. Rezumatele pe care le-ai scris tu însuți nu poartă această problemă.
  • Foi de calcul cu o coloană de clienți. Întrebarea e despre formulă; lipirea include emailul fiecărui client din foaie. Șterge mai întâi coloanele de identificare, sau lipește zece rânduri de structură în loc de toată foaia.
  • Contracte cu numele contrapărții. Înțelegerea unei clauze are nevoie de clauză, și aproape niciodată de cine a semnat-o. Rezumarea documentelor cu IA funcționează la fel de bine pe un fișier redactat.
  • Calendare și căsuțe poștale exportate. Un fișier, sutele de nume, ore și subiecte ale altor persoane. Întreabă despre problema de programare, lipește forma săptămânii, păstrează exportul.

Tiparul din toate cele șase: partea sensibilă e de obicei contextul din jurul a ce ai nevoie, iar decuparea la ce ai nevoie o elimină. Acea decupare durează treizeci de secunde.

Ce e de fapt în regulă

Rostul unei liste interzise scurte e că tot ce e în afara ei e utilizabil, iar majoritatea lipirilor de zi cu zi nu poartă nicio problemă: propriile tale ciorne și notițe, informații publice, întrebări generale oricât de personal ar fi subiectul, propriul tău cod fără secrete incluse, și orice document pe care l-ai redactat până la ce are nevoie întrebarea.

Obiceiul care face totul posibil e redactarea înainte de lipire, iar motivul pentru care funcționează e că modelele raționează pe structură, nu pe identitate. Testează asta o dată: cere scrisoarea către proprietarul tău despre încălzirea stricată cu numele inclus, apoi cu [PROPRIETAR] în locul lui, și compară. "Explică această clauză de contract" nu se îmbunătățește când modelul știe ce companii au semnat. În cazul rar în care un nume chiar contează, îl poți adăuga înapoi în rezultat tu însuți, față de alternativa unei lipiri neredactate pe care n-o mai poți retrage.

Două setări termină treaba. Verifică o dată comutatorul de antrenament al aplicației tale de chat, pentru că setările implicite pentru consumatori nu sunt în favoarea ta, și cunoaște cifrele de retenție ale aplicației tale. Ce ar trebui să publice un furnizor arată ca pagina de date a Whizi: ce e stocat, pentru cât timp, și ce elimină ștergerea. Răspunsurile proprii ale Whizi de acolo: încărcările expiră după cel mult 30 de zile, iar conținutul tău nu antrenează modelele deținute de Whizi și nu e vândut ca date de antrenament. Orice unealtă pe care o folosești zilnic ar trebui să răspundă la aceleași întrebări undeva unde poți cita. Dacă alegi între abonamente exact pe această axă, dacă un abonament de IA terț e sigur parcurge același standard pe toată categoria.

Regula care înlocuiește toată această pagină odată ce devine obicei: dacă n-ai trimite-o prin email unui consultant din afară fără un contract, nu o lipi. Orice altceva, lipește liber și înlocuiește numele.

Listă de verificare
  • Ține parolele, cheile API și codurile cu doi factori departe de orice chat, pe orice plan, la orice furnizor.
  • Înlocuiește numerele de card, numerele de cont și actele de identitate guvernamentale cu substituenți; răspunsul nu se va schimba.
  • Înlocuiește numele altor persoane cu Persoana A și Persoana B înainte să lipești ceva despre ele.
  • Tratează materialul sub NDA și confidențial al angajatorului ca fiind interzis contractual, nu ca o decizie de judecată.
  • Decupează capturile de ecran exact la lucrul despre care întrebi.
  • Caută în cod cuvintele key, secret, token și password înainte să lipești un fișier.
  • Dezactivează antrenamentul pe conversațiile tale acolo unde aplicația oferă setarea.
  • Cunoaște cifrele de retenție și ștergere ale aplicației tale, și preferă uneltele care le publică.

Întrebări frecvente

Ce nu ar trebui să spui niciodată unui chatbot de IA?

Credențiale de orice fel (parole, chei API, coduri cu doi factori), numere complete de plată și de cont, identificatori guvernamentali, informațiile personale ale altor persoane, și orice e acoperit de un NDA sau de o politică de confidențialitate a angajatorului. Testul care acoperă restul: dacă n-ai trimite-o prin email unui consultant din afară fără un contract, nu o lipi.

E sigur să lipești documente de muncă în IA?

Propria ta muncă, redactată la ce are nevoie întrebarea, e în general în regulă și enorm de utilă. Cele două limite stricte sunt contractuale, nu tehnice: materialul sub NDA, și orice restricționează politica angajatorului tău. Pentru orice altceva, elimină mai întâi numele contrapărții, datele clienților și credențialele incluse, iar modelul va face aceeași treabă pe versiunea redactată.

Pot alte persoane să vadă ce tastez într-un chat de IA?

Nu în mod obișnuit, dar copiile sunt reale: conversațiile sunt reținute conform politicii furnizorului, nivelurile pentru consumatori le pot folosi pentru antrenament dacă nu renunți, conversațiile semnalate pot fi revizuite de oameni, iar orice e într-o conversație pe care o partajezi printr-un link călătorește cu ea. Lista interzisă există din cauza acestor patru copii, și fiecare e un comportament documentat al furnizorului.

Ștergerea unui chat chiar îl elimină?

Depinde de furnizor, motiv pentru care cifrele de retenție aparțin exact unei pagini de date pe care o poți citi înainte să ai nevoie de ele. Ștergerea elimină de obicei conversația din contul tău prompt și din sisteme după un program declarat, cu ferestre limitate de retenție legală. Verifică politica furnizorului tău pentru program, și preferă uneltele care declară unul.

E mai sigur să lipești text sensibil într-un plan plătit?

Nivelurile plătite la marii furnizori costă cam $20 pe lună și de obicei poartă setări implicite de antrenament mai stricte decât nivelurile gratuite pentru consumatori, deci direcția e corectă, dar niciun nivel nu schimbă lista interzisă. O credențială lipită în cel mai enterprise plan de pe pământ tot e o credențială pe care ai divulgat-o. Fă upgrade pentru setările implicite; redactează indiferent.