Para onde um segredo colado realmente vai
Nada nesta página é sobre hackers. Um segredo colado cria cópias através do funcionamento comum e documentado dos produtos de chat, e as cópias são o problema.
Quatro mecanismos fazem esse trabalho. Primeiro, retenção: o que você cola vira parte de uma conversa armazenada, seguindo um cronograma documentado. A OpenAI, por exemplo, programa chats excluídos para remoção permanente em até 30 dias, e a atividade do Gemini do Google fica sob uma configuração de exclusão automática que por padrão é de 18 meses, e como excluir sua conta do Gemini mostra como mudar isso. Segundo, os padrões de treinamento: os planos de consumidor da OpenAI, da Anthropic e do Google podem usar conversas para melhorar os modelos, a menos que você desligue a configuração, enquanto os planos empresariais e de API vêm desligados por padrão. Terceiro, revisão: os três fornecedores afirmam que conversas sinalizadas podem ser lidas por pessoas, o que é uma prática de segurança rotineira e ainda assim significa que um humano pode acabar olhando o que você colou. Quarto, compartilhamento: uma conversa compartilhada como link carrega tudo o que há nela, incluindo o documento que você enviou três mensagens antes da parte que queria mostrar a alguém.
Nenhum desses pontos, sozinho, é um escândalo. Todos juntos significam uma coisa: uma caixa de chat é um lugar onde o texto fica guardado, às vezes aprendido e ocasionalmente visto. Cole levando isso em conta. O resto desta página é só essa frase aplicada a casos específicos, e a IA é segura de usar cobre a questão de segurança mais ampla em volta disso.
A lista do nunca: seis itens que um placeholder substitui de graça
Estes itens não têm nenhum motivo legítimo para entrar em uma caixa de chat, porque o modelo não precisa deles para te ajudar. Cada um pode ser substituído por um placeholder sem mudar a resposta que você recebe.
| Nunca cole | Por que é diferente de outros dados | O que fazer em vez disso |
|---|---|---|
| Senhas, chaves de API, tokens de acesso, códigos de dois fatores | Uma credencial é valiosa para qualquer pessoa que a veja, e trocar uma que vazou é trabalho que dá para evitar | Digite SENHA ou CHAVE no lugar; a resposta não muda |
| Números completos de cartão, conta ou agência | A fraude de pagamento precisa exatamente dessas strings e nada mais | "meu cartão" e "minha conta" funcionam bem em qualquer pergunta sobre dinheiro |
| Documentos oficiais: SSN, passaporte, documento nacional de identidade, números fiscais | O roubo de identidade é construído a partir disso, e eles não podem ser trocados como uma senha | O modelo nunca precisa do número real para explicar um formulário ou um processo |
| Dados pessoais de outras pessoas: nomes com endereços, detalhes de saúde, registros de RH | É informação delas, e a lei de privacidade na maioria dos lugares trata compartilhar isso como um ato seu, não do chatbot | Troque nomes reais por Pessoa A e Pessoa B antes de colar |
| Documentos sob NDA ou política de confidencialidade do empregador | A questão é contratual, e "eu colei isso em um chatbot" é uma divulgação, aconteça algo ruim depois ou não | Faça a pergunta com a estrutura do documento, sem os detalhes protegidos |
| Qualquer coisa que você não mandaria por e-mail a um consultor externo sem contrato | Este é o teste que pega tudo o que as linhas acima deixaram passar | Se a resposta for não, remova dados até a resposta virar sim |
A última linha é a tabela inteira resumida. Um chat de IA é um terceiro com quem você não assinou nada, sendo prestativo. Calibre exatamente como você faria para isso.
Os itens em que ninguém pensa
A lista rígida acima é fácil de seguir porque os itens parecem sensíveis. Os pedaços colados que realmente pegam pessoas cuidadosas são os que não parecem.
- Prints de tela. A mensagem de erro que você queria mostrar chega junto com a sua bandeja de notificações, as suas abas abertas, o assunto de um e-mail de outra pessoa e um lembrete de calendário no canto. Recorte para mostrar só o que você está perguntando.
- Arquivos de código com segredos dentro. A GitGuardian contou 23,8 milhões de novos segredos vazados em commits públicos do GitHub durante 2024, e um arquivo de configuração ou .env colado com uma chave ativa dentro é a versão em janela de chat do mesmo erro. Procure no arquivo por key, secret, token e password antes de colar.
- Transcrições e gravações de reunião. Todo mundo naquela reunião falou com as pessoas presentes na sala, e nenhuma delas consentiu com um upload para um chat. Resumos que você mesmo escreveu não carregam esse problema.
- Planilhas com uma coluna de clientes. A pergunta é sobre a fórmula; o que você cola inclui o e-mail de cada cliente na planilha. Apague as colunas identificáveis antes, ou cole dez linhas de estrutura em vez da planilha inteira.
- Contratos com nomes das partes. Entender uma cláusula precisa da cláusula, e quase nunca precisa de quem assinou. Resumir documentos com IA funciona exatamente igual em um arquivo com os dados removidos.
- Calendários e caixas de entrada exportados. Um arquivo, centenas de nomes, horários e assuntos de outras pessoas. Pergunte sobre o problema de agendamento, cole o formato da semana, guarde a exportação.
O padrão nos seis casos: a parte sensível costuma ser o contexto em volta do que você precisa, e recortar para o que você precisa remove isso. Esse recorte leva trinta segundos.
O que realmente tudo bem
O objetivo de uma lista do nunca curta é que tudo fora dela é utilizável, e a maior parte do que se cola no dia a dia não traz problema nenhum: os seus próprios rascunhos e anotações, informações públicas, perguntas gerais por mais pessoal que seja o tema, o seu próprio código sem segredos embutidos, e qualquer documento que você tenha reduzido só ao que a pergunta precisa.
O hábito que viabiliza isso é remover dados antes de colar, e o motivo de funcionar é que os modelos raciocinam sobre estrutura, não sobre identidade. Teste você mesmo uma vez: peça a carta para o seu proprietário sobre o aquecimento quebrado com o nome dentro, depois com [PROPRIETÁRIO] no lugar, e compare. "Explique esta cláusula do contrato" não melhora quando o modelo sabe quais empresas assinaram. No caso raro em que um nome realmente importa, você pode colocá-lo de volta na saída você mesmo, contra a alternativa de um texto colado sem edição que você não consegue desfazer.
Duas configurações fecham o trabalho. Confira uma vez o botão de treinamento do seu app de chat, porque os padrões para o consumidor não jogam a seu favor, e conheça os números de retenção do seu app. O que um fornecedor deveria publicar se parece com a página de dados da Whizi: o que é armazenado, por quanto tempo, e o que a exclusão remove. As respostas da própria Whizi lá: os uploads expiram em até 30 dias, e o seu conteúdo não treina modelos de propriedade da Whizi e não é vendido como dado de treinamento. Qualquer ferramenta que você usa todo dia deveria responder às mesmas perguntas em algum lugar que você possa citar. Se você está escolhendo entre assinaturas exatamente por esse critério, uma assinatura de IA de terceiros é segura percorre o mesmo padrão em toda a categoria.
A regra que substitui esta página inteira assim que vira hábito: se você não mandaria por e-mail a um consultor externo sem contrato, não cole. Tudo o mais, cole livremente e troque os nomes.
- Mantenha senhas, chaves de API e códigos de dois fatores fora de todo chat, em todo plano, em todo fornecedor.
- Substitua números de cartão, número de conta e documentos oficiais por placeholders; a resposta não muda.
- Troque nomes de outras pessoas por Pessoa A e Pessoa B antes de colar qualquer coisa sobre elas.
- Trate material sob NDA e confidencial do empregador como proibido por contrato, não como uma questão de julgamento.
- Recorte os prints exatamente para a coisa sobre a qual você está perguntando.
- Procure no código por key, secret, token e password antes de colar um arquivo.
- Desligue o treinamento nas suas conversas onde o app oferecer essa configuração.
- Conheça os números de retenção e exclusão do seu app, e prefira ferramentas que os publicam.
Perguntas frequentes
O que você nunca deve contar a um chatbot de IA?
Credenciais de qualquer tipo (senhas, chaves de API, códigos de dois fatores), números completos de pagamento e conta, documentos oficiais, informações pessoais de outras pessoas, e qualquer coisa coberta por um NDA ou política de confidencialidade do empregador. O teste que cobre o resto: se você não mandaria por e-mail a um consultor externo sem contrato, não cole.
É seguro colar documentos de trabalho em uma IA?
O seu próprio trabalho, reduzido só ao que a pergunta precisa, geralmente é tranquilo e enormemente útil. Os dois limites rígidos são contratuais, não técnicos: material sob NDA, e qualquer coisa que a política do seu empregador restrinja. Para tudo o mais, remova primeiro nomes das outras partes, dados de clientes e credenciais embutidas, e o modelo vai fazer o mesmo trabalho na versão com os dados removidos.
Outras pessoas conseguem ver o que eu digito em um chat de IA?
Não de forma casual, mas as cópias são reais: as conversas são retidas conforme a política do fornecedor, os planos de consumidor podem usá-las para treinamento a menos que você opte por sair, conversas sinalizadas podem ser revisadas por pessoas, e qualquer coisa em uma conversa que você compartilha por link viaja junto com ela. A lista do nunca existe por causa dessas quatro cópias, e cada uma delas é um comportamento documentado do fornecedor.
Excluir um chat realmente remove ele?
Depende do fornecedor, e é exatamente por isso que os números de retenção pertencem a uma página de dados que você pode ler antes de precisar deles. A exclusão normalmente remove a conversa da sua conta rapidamente e dos sistemas em um cronograma declarado, com janelas limitadas de retenção legal. Confira a política do seu fornecedor para o cronograma, e prefira ferramentas que declaram um.
É mais seguro colar texto sensível em um plano pago?
Os planos pagos dos grandes fornecedores custam cerca de $20 por mês e geralmente têm padrões de treinamento mais rígidos do que os planos gratuitos de consumidor, então a direção está certa, mas nenhum plano muda a lista do nunca. Uma credencial colada no plano mais corporativo do mundo continua sendo uma credencial que você divulgou. Faça upgrade pelos padrões; remova dados sensíveis de qualquer forma.