Hva skal man ikke dele med ChatGPT (og hva som faktisk er greit)

Kort svar

Lim aldri inn passord, API-nøkler, tofaktorkoder, fullstendige kort- eller kontonumre, eller offentlige ID-numre i en AI-chat, og behandle andres personopplysninger, kundearbeid under NDA og usladdede skjermbilder på samme måte. Dine egne utkast, sladdede dokumenter og generelle spørsmål er greit. Årsaken er lagrings- og treningsstandarder, ikke hacking.

Hvor en limt inn hemmelighet faktisk havner

Ingenting på denne siden handler om hackere. En limt inn hemmelighet skaper kopier gjennom de vanlige, dokumenterte funksjonene til chat-produkter, og kopiene er problemet.

Fire mekanismer gjør jobben. Først lagring: det du limer inn blir en del av en lagret samtale, etter en dokumentert tidsplan. OpenAI, for eksempel, planlegger slettede chatter for permanent fjerning innen 30 dager, og Googles Gemini-aktivitet ligger under en autoslett-innstilling som er satt til 18 måneder som standard, noe hvordan slette Gemini-kontoen din dekker hvordan du endrer. For det andre treningsstandarder: forbrukernivåene hos OpenAI, Anthropic og Google kan bruke samtaler til å forbedre modeller med mindre du skrur av innstillingen, mens bedrifts- og API-nivåer er avslått som standard. For det tredje gjennomgang: alle tre leverandørene oppgir at flaggede samtaler kan leses av mennesker, noe som er vanlig sikkerhetspraksis og likevel betyr at et menneske kan ende opp med å se det du limte inn. For det fjerde deling: en samtale som deles som en lenke, bærer med seg alt i den, inkludert dokumentet du lastet opp tre meldinger før delen du ville vise noen.

Ingen av disse er en skandale. Alle sammen betyr én ting: en chatboks er et sted der tekst blir lagret, noen ganger lært av, og av og til sett. Lim inn deretter. Resten av denne siden er akkurat den setningen brukt på konkrete tilfeller, og er AI trygt å bruke dekker det bredere sikkerhetsspørsmålet rundt det.

Aldri-listen: seks ting en plassholder erstatter gratis

Disse tingene har ingen legitim grunn til å havne i en chatboks, fordi modellen ikke trenger dem for å hjelpe deg. Hver av dem kan erstattes med en plassholder uten at svaret du får, endres.

Lim aldri innHvorfor det er annerledes enn andre dataHva du bør gjøre i stedet
Passord, API-nøkler, tilgangstokener, tofaktorkoderLegitimasjon er verdifull for alle som noen gang ser den, og å rotere en du har lekket er arbeid du kan unngåSkriv PASSORD eller NØKKEL der det skulle stått; svaret endres ikke
Fullstendige kort-, konto- eller rutingnumreBetalingssvindel trenger nettopp disse strengene og ingenting annet«kortet mitt» og «kontoen min» fungerer fint i ethvert pengespørsmål
Offentlige identifikatorer: fødselsnummer, pass, nasjonal ID, skattenummerIdentitetstyveri bygges på disse, og de kan ikke roteres slik et passord kanModellen trenger aldri det ekte nummeret for å forklare et skjema eller en prosess
Andres personopplysninger: navn med adresser, helseopplysninger, HR-posterDet er deres informasjon, og personvernlovgivning de fleste steder behandler deling av den som din handling, ikke chatbotensBytt ut ekte navn med Person A og Person B før du limer inn
Dokumenter underlagt NDA eller en arbeidsgivers konfidensialitetspolicySpørsmålet er kontraktsmessig, og «jeg limte det inn i en chatbot» er en avsløring uansett om noe ille skjer etterpåStill spørsmålet med dokumentets struktur, minus de beskyttede detaljene
Alt du ikke ville sendt på e-post til en ekstern konsulent uten kontraktDette er testen som fanger opp alt radene over gikk glipp avHvis svaret er nei, sladd til svaret blir ja

Den siste raden er hele tabellen komprimert. En AI-chat er en ekstern part du ikke har signert noe med, som er hjelpsom. Kalibrer akkurat slik du ville gjort for det.

Tingene ingen tenker på

Den harde listen over er lett å følge fordi tingene virker sensitive. Det som faktisk fanger forsiktige folk, er tingene som ikke ser slik ut.

  • Skjermbilder. Feilmeldingen du ville dele, kommer med varslingsfeltet ditt, åpne faner, en e-postoverskrift fra noen andre, og en kalenderpåminnelse i hjørnet. Beskjær til det du faktisk spør om.
  • Kodefiler med hemmeligheter inni. GitGuardian talte 23,8 millioner nye hemmeligheter lekket i offentlige GitHub-commits i løpet av 2024, og en limt inn config- eller .env-fil med en aktiv nøkkel er chat-vindu-versjonen av samme feil. Søk gjennom en fil etter key, secret, token og password før den limes inn.
  • Møtetranskripsjoner og opptak. Alle i det møtet snakket til folkene i rommet, og ingen av dem samtykket til en chat-opplasting. Sammendrag du skrev selv, har ikke dette problemet.
  • Regneark med en kundekolonne. Spørsmålet handler om formelen; det du limer inn inneholder hver kunde-e-post i arket. Slett de identifiserende kolonnene først, eller lim inn ti rader med struktur i stedet for hele arket.
  • Kontrakter med motpartsnavn. Å forstå en klausul krever klausulen, og nesten aldri hvem som signerte den. Å oppsummere dokumenter med AI fungerer akkurat like godt på en sladdet fil.
  • Eksporterte kalendere og innbokser. Én fil, hundrevis av andre menneskers navn, tider og emner. Spør om planleggingsproblemet, lim inn ukens form, behold eksporten.

Mønsteret på tvers av alle seks: den sensitive delen er som regel konteksten rundt det du trenger, og å beskjære til det du trenger, fjerner den. Den beskjæringen tar tretti sekunder.

Hva som faktisk er greit

Poenget med en kort aldri-liste er at alt utenfor den er brukbart, og det meste av hverdagslig innliming utgjør ingen risiko i det hele tatt: dine egne utkast og notater, offentlig informasjon, generelle spørsmål uansett hvor personlig temaet er, din egen kode uten innebygde hemmeligheter, og ethvert dokument du har sladdet ned til det spørsmålet trenger.

Vanen som muliggjør dette, er å sladde før du limer inn, og grunnen til at det fungerer, er at modeller resonnerer over struktur snarere enn identitet. Test det selv én gang: be om brevet til utleieren din om den ødelagte varmen med navnet i, deretter med [UTLEIER] i stedet, og sammenlign. «Forklar denne kontraktsklausulen» blir ikke bedre av at modellen vet hvilke selskaper som signerte. I det sjeldne tilfellet der et navn faktisk betyr noe, kan du legge det tilbake i resultatet selv, som alternativ til en usladdet innliming du ikke kan ta tilbake.

To innstillinger fullfører jobben. Sjekk chat-appens treningsbryter én gang, fordi standardinnstillingene for forbrukere ikke er i din favør, og kjenn appens lagringstall. Det en leverandør bør publisere, ser ut som Whizis side om data og personvern: hva som lagres, hvor lenge, og hva sletting fjerner. Whizis egne svar der: opplastinger utløper etter opptil 30 dager, og innholdet ditt trener ikke Whizi-eide modeller og selges ikke som treningsdata. Ethvert verktøy du bruker daglig, bør kunne svare på de samme spørsmålene et sted du kan sitere. Hvis du velger mellom abonnementer nettopp på denne aksen, går er et tredjeparts AI-abonnement trygt gjennom den samme standarden på tvers av hele kategorien.

Regelen som erstatter hele denne siden når den blir en vane: hvis du ikke ville sendt det på e-post til en ekstern konsulent uten kontrakt, ikke lim det inn. Alt annet, lim inn fritt og bytt ut navnene.

Sjekkliste
  • Hold passord, API-nøkler og tofaktorkoder unna enhver chat, på ethvert abonnement, hos enhver leverandør.
  • Erstatt kortnumre, kontonumre og offentlige ID-er med plassholdere; svaret endres ikke.
  • Bytt ut andres navn med Person A og Person B før du limer inn noe om dem.
  • Behandle NDA-materiale og arbeidsgiver-konfidensielt materiale som kontraktsmessig forbudt, ikke som en vurderingssak.
  • Beskjær skjermbilder til akkurat det du spør om.
  • Søk gjennom kode etter key, secret, token og password før du limer inn en fil.
  • Skru av trening på samtalene dine der appen tilbyr innstillingen.
  • Kjenn appens lagrings- og slettetall, og foretrekk verktøy som publiserer dem.

Vanlige spørsmål

Hva bør man aldri fortelle en AI-chatbot?

Legitimasjon av alle slag (passord, API-nøkler, tofaktorkoder), fullstendige betalings- og kontonumre, offentlige identifikatorer, andres personopplysninger, og alt som dekkes av en NDA eller en arbeidsgivers konfidensialitetspolicy. Testen som dekker resten: hvis du ikke ville sendt det på e-post til en ekstern konsulent uten kontrakt, ikke lim det inn.

Er det trygt å lime inn arbeidsdokumenter i AI?

Ditt eget arbeid, sladdet til det spørsmålet trenger, er som regel greit og enormt nyttig. De to harde grensene er kontraktsmessige snarere enn tekniske: materiale underlagt NDA, og alt arbeidsgiverens policy begrenser. For alt annet, fjern motpartsnavn, kundedata og innebygd legitimasjon først, så gjør modellen samme jobb på den sladdede versjonen.

Kan andre se hva jeg skriver i en AI-chat?

Ikke tilfeldig, men kopiene er reelle: samtaler lagres i henhold til leverandørens policy, forbrukernivåer kan bruke dem til trening med mindre du reserverer deg, flaggede samtaler kan gjennomgås av mennesker, og alt i en samtale du deler via lenke, følger med den. Aldri-listen finnes på grunn av disse fire kopiene, og hver av dem er dokumentert leverandøratferd.

Fjerner sletting av en chat den faktisk?

Det avhenger av leverandøren, som er nøyaktig hvorfor lagringstall hører hjemme på en dataside du kan lese før du trenger det. Sletting fjerner vanligvis samtalen fra kontoen din umiddelbart og fra systemene etter en oppgitt tidsplan, med begrensede juridiske lagringsvinduer. Sjekk leverandørens policy for tidsplanen, og foretrekk verktøy som oppgir en.

Er det tryggere å lime inn sensitiv tekst i et betalt abonnement?

Betalte nivåer hos de store leverandørene koster rundt $20 i måneden og har som regel strengere treningsstandarder enn gratis forbrukernivåer, så retningen er riktig, men ingen nivåer endrer aldri-listen. Legitimasjon limt inn i den mest bedriftsrettede planen på jorden er fortsatt legitimasjon du har avslørt. Oppgrader for standardinnstillingene; sladd uansett.