Ce qu'il ne faut jamais coller dans un chat IA (et ce qui est vraiment sans risque)

Réponse rapide

Ne collez jamais de mots de passe, clés API, codes à deux facteurs, numéros complets de carte ou de compte, ou numéros d'identité gouvernementale dans un chat IA, et traitez de la même façon les données personnelles d'autres personnes, le travail client sous NDA et les captures d'écran non caviardées. Vos propres brouillons, documents caviardés et questions générales sont sans risque. La raison, c'est la conservation et les réglages d'entraînement par défaut, pas le piratage.

Où va vraiment un secret collé

Rien sur cette page ne parle de pirates. Un secret collé crée des copies par le fonctionnement ordinaire et documenté des produits de chat, et ce sont les copies qui posent problème.

Quatre mécanismes font le travail. D'abord, la conservation : ce que vous collez devient une partie d'une conversation stockée, selon un calendrier documenté. OpenAI, par exemple, programme la suppression définitive des conversations supprimées sous 30 jours, et l'activité Gemini de Google se trouve sous un réglage de suppression automatique qui vaut par défaut 18 mois, ce que comment supprimer votre compte Gemini explique comment changer. Ensuite, les réglages d'entraînement par défaut : les paliers grand public chez OpenAI, Anthropic et Google peuvent utiliser les conversations pour améliorer les modèles sauf si vous désactivez le réglage, tandis que les paliers entreprise et API sont désactivés par défaut. Ensuite, la relecture : les trois fournisseurs déclarent que les conversations signalées peuvent être lues par des personnes, ce qui est une pratique de sécurité courante et signifie quand même qu'une personne peut finir par regarder ce que vous avez collé. Enfin, le partage : une conversation partagée par lien porte tout ce qu'elle contient, y compris le document que vous avez téléversé trois messages avant la partie que vous vouliez montrer à quelqu'un.

Rien de tout cela n'est un scandale. Tout cela ensemble signifie une chose : une fenêtre de chat est un endroit où le texte est conservé, parfois appris, et parfois vu. Collez en conséquence. Le reste de cette page n'est que cette phrase appliquée à des cas précis, et l'IA est-elle sûre à utiliser couvre la question de sécurité plus large qui l'entoure.

La liste des jamais : six éléments qu'un espace réservé remplace gratuitement

Ces éléments n'ont aucune raison légitime d'entrer dans une fenêtre de chat, parce que le modèle n'en a pas besoin pour vous aider. Chacun d'eux peut être remplacé par un espace réservé sans changer la réponse que vous obtenez.

Ne collez jamaisPourquoi c'est différent des autres donnéesQue faire à la place
Mots de passe, clés API, jetons d'accès, codes à deux facteursUn identifiant a de la valeur pour quiconque le voit un jour, et faire tourner un identifiant que vous avez laissé fuiter est un travail que vous pouvez éviterTapez MOTDEPASSE ou CLÉ là où il irait ; la réponse ne changera pas
Numéros complets de carte, de compte ou d'acheminementLa fraude au paiement a besoin exactement de ces chaînes et de rien d'autre« ma carte » et « mon compte » fonctionnent très bien dans n'importe quelle question d'argent
Identifiants gouvernementaux : numéro de sécurité sociale, passeport, carte d'identité nationale, numéros fiscauxLe vol d'identité se construit à partir de ceux-ci, et ils ne peuvent pas être renouvelés comme un mot de passeLe modèle n'a jamais besoin du vrai numéro pour expliquer un formulaire ou un processus
Données personnelles d'autres personnes : noms avec adresses, détails de santé, dossiers RHCe sont leurs informations, et le droit de la confidentialité dans la plupart des endroits traite le partage comme votre acte, pas celui du chatbotRemplacez les vrais noms par Personne A et Personne B avant de coller
Documents sous NDA ou politique de confidentialité employeurLa question est contractuelle, et « je l'ai collé dans un chatbot » est une divulgation, que quelque chose de grave se produise ensuite ou nonPosez la question avec la structure du document, sans les détails protégés
Tout ce que vous n'enverriez pas par e-mail à un consultant externe sans contratC'est le test qui attrape tout ce que les lignes ci-dessus ont manquéSi la réponse est non, caviardez jusqu'à ce que la réponse soit oui

La dernière ligne résume tout le tableau. Un chat IA est une partie extérieure avec qui vous n'avez rien signé, en train de vous aider. Calibrez exactement comme vous le feriez pour cela.

Les éléments auxquels personne ne pense

La liste stricte ci-dessus est facile à suivre parce que les éléments ont l'air sensibles. Les collages qui piègent vraiment les gens prudents sont ceux qui n'en ont pas l'air.

  • Captures d'écran. Le message d'erreur que vous vouliez partager arrive avec votre zone de notifications, vos onglets ouverts, un objet d'e-mail de quelqu'un d'autre et un rappel de calendrier dans le coin. Recadrez sur ce dont vous parlez.
  • Fichiers de code avec des secrets à l'intérieur. GitGuardian a recensé 23,8 millions de nouveaux secrets divulgués dans des commits GitHub publics en 2024, et un fichier de config ou .env collé avec une clé active dedans est la version fenêtre de chat de la même erreur. Cherchez key, secret, token et password dans un fichier avant de le coller.
  • Transcriptions et enregistrements de réunion. Tout le monde dans cette réunion a parlé aux personnes présentes dans la salle, et aucune d'elles n'a consenti à un téléversement dans un chat. Les résumés que vous avez rédigés vous-même ne posent pas ce problème.
  • Tableurs avec une colonne client. La question porte sur la formule ; le collage inclut chaque e-mail client de la feuille. Supprimez d'abord les colonnes identifiantes, ou collez dix lignes de structure au lieu de la feuille entière.
  • Contrats avec noms de contreparties. Comprendre une clause a besoin de la clause, et presque jamais de qui l'a signée. Résumer des documents avec l'IA fonctionne tout aussi bien sur un fichier caviardé.
  • Calendriers et boîtes de réception exportés. Un fichier, des centaines de noms, horaires et objets d'autres personnes. Posez la question sur le problème de planning, collez la forme de la semaine, gardez l'export.

Le schéma commun à ces six cas : la partie sensible est en général le contexte autour de ce dont vous avez besoin, et recadrer sur ce dont vous avez besoin l'enlève. Ce recadrage prend trente secondes.

Ce qui est vraiment sans risque

Le but d'une liste de jamais courte, c'est que tout ce qui est en dehors est utilisable, et la plupart des collages du quotidien ne posent aucun problème : vos propres brouillons et notes, l'information publique, les questions générales même sur un sujet personnel, votre propre code sans secrets intégrés, et tout document que vous avez caviardé jusqu'à ce dont la question a besoin.

L'habitude qui permet tout cela, c'est le caviardage avant de coller, et la raison pour laquelle ça marche, c'est que les modèles raisonnent sur la structure plutôt que sur l'identité. Testez-le vous-même une fois : demandez la lettre à votre propriétaire sur le chauffage en panne avec le nom dedans, puis avec [PROPRIETAIRE] à sa place, et comparez. « Expliquez cette clause de contrat » ne s'améliore pas quand le modèle sait quelles entreprises ont signé. Dans le rare cas où un nom compte vraiment, vous pouvez le rajouter vous-même dans la sortie, contre l'alternative d'un collage non caviardé que vous ne pouvez pas reprendre.

Deux réglages terminent le travail. Vérifiez une fois le bouton d'entraînement de votre application de chat, parce que les réglages grand public par défaut ne sont pas en votre faveur, et connaissez les chiffres de conservation de votre application. Ce qu'un fournisseur devrait publier ressemble à la page de données de Whizi : ce qui est stocké, pendant combien de temps, et ce que la suppression enlève. Les propres réponses de Whizi là-bas : les téléversements expirent au bout de 30 jours maximum, et votre contenu n'entraîne pas les modèles propriétaires de Whizi et n'est pas vendu comme donnée d'entraînement. Tout outil que vous utilisez quotidiennement devrait répondre aux mêmes questions quelque part que vous pouvez citer. Si vous choisissez entre des abonnements exactement sur cet axe, un abonnement IA tiers est-il sûr applique la même norme à toute la catégorie.

La règle qui remplace toute cette page une fois qu'elle devient une habitude : si vous ne l'enverriez pas par e-mail à un consultant externe sans contrat, ne le collez pas. Tout le reste, collez-le librement et changez les noms.

Liste de vérification
  • Gardez les mots de passe, clés API et codes à deux facteurs hors de chaque chat, sur chaque forfait, chez chaque fournisseur.
  • Remplacez les numéros de carte, de compte et les identifiants gouvernementaux par des espaces réservés ; la réponse ne changera pas.
  • Remplacez les noms d'autres personnes par Personne A et Personne B avant de coller quoi que ce soit à leur sujet.
  • Traitez le matériel sous NDA ou confidentialité employeur comme contractuellement interdit, pas comme un jugement à faire au cas par cas.
  • Recadrez les captures d'écran sur exactement ce dont vous parlez.
  • Cherchez key, secret, token et password dans un fichier de code avant de le coller.
  • Désactivez l'entraînement sur vos conversations là où l'application propose le réglage.
  • Connaissez les chiffres de conservation et de suppression de votre application, et préférez les outils qui les publient.

Questions fréquentes

Que ne faut-il jamais dire à un chatbot IA ?

Tout identifiant (mots de passe, clés API, codes à deux facteurs), les numéros complets de paiement et de compte, les identifiants gouvernementaux, les informations personnelles d'autres personnes, et tout ce que couvre un NDA ou une politique de confidentialité employeur. Le test qui couvre le reste : si vous ne l'enverriez pas par e-mail à un consultant externe sans contrat, ne le collez pas.

Est-ce sûr de coller des documents de travail dans l'IA ?

Votre propre travail, caviardé jusqu'à ce dont la question a besoin, est en général sans risque et énormément utile. Les deux limites strictes sont contractuelles plutôt que techniques : le matériel sous NDA, et ce que la politique de votre employeur restreint. Pour tout le reste, retirez d'abord les noms de contreparties, les données clients et les identifiants intégrés, et le modèle fera le même travail sur la version caviardée.

D'autres personnes peuvent-elles voir ce que je tape dans un chat IA ?

Pas de façon anodine, mais les copies sont réelles : les conversations sont conservées selon la politique du fournisseur, les paliers grand public peuvent les utiliser pour l'entraînement sauf si vous désactivez cette option, les conversations signalées peuvent être relues par des personnes, et tout ce qu'une conversation contient voyage avec elle si vous la partagez par lien. La liste des jamais existe à cause de ces quatre copies, et chacune est un comportement documenté par le fournisseur.

Supprimer un chat le retire-t-il vraiment ?

Cela dépend du fournisseur, ce qui est exactement pourquoi les chiffres de conservation ont leur place sur une page de données que vous pouvez lire avant d'en avoir besoin. La suppression retire en général la conversation de votre compte rapidement et des systèmes selon un calendrier annoncé, avec des fenêtres de conservation légale limitées. Vérifiez la politique de votre fournisseur pour le calendrier, et préférez les outils qui en annoncent un.

Est-il plus sûr de coller du texte sensible sur un forfait payant ?

Les paliers payants des grands fournisseurs coûtent environ $20 par mois chacun et portent en général des réglages d'entraînement par défaut plus stricts que les paliers gratuits grand public, donc la direction est la bonne, mais aucun palier ne change la liste des jamais. Un identifiant collé dans le forfait le plus entreprise de la planète reste un identifiant que vous avez divulgué. Passez au forfait supérieur pour les réglages ; caviardez quand même.