用AI安全吗?一个诚实的回答,而不是一句安慰

你按下发送后消息去了哪里、什么情况下对话会被拿去训练、有哪几样东西绝对不该贴进去,以及那个比数据泄露更常让人吃亏的风险。

你的消息到底去了哪里

你打出一个问题,按下发送,大约两秒后答案出现。这个速度让整件事感觉像是在你手机上完成的。并不是。你的文字离开了你的设备,穿过互联网抵达一座塞满专用芯片的数据中心,那是做这个模型的公司的地盘,在那里被处理,然后再回来。聊天机器人一点也不像一个离线运转的计算器应用。它更接近发一封邮件,或者把照片传到云盘:真正干活的地方是别人的电脑。如果这项技术本身对你还很模糊,AI到底是什么用大白话讲了最底下那一层。

一旦你的文字落在某家公司的服务器上,接下来发生什么,就由那家公司的政策和它的访问控制决定,而不是由你这一端的任何东西决定。这也把文件的问题放回了它该有的比例。聊天机器人不能自己跑去翻你的手机、你的邮箱或你的工作硬盘。它看到的是你递给它的东西,加上你安装应用时授予的那些权限。今天花两分钟就很值:打开手机设置,找到这个应用,如果你从不用那些功能,就把相机、麦克风和相册权限关掉。下面是真正会到达服务商那边的东西。

  • 你输入或粘贴的文字。 全部,包括你从某份文件里复制过来、自己都没再看一遍的那一段。
  • 你上传的文件。 一份PDF、一张照片、一个表格。只有你选中的那些,也只在你选中的那一刻。
  • 账号和连接信息。 你的邮箱地址、根据IP地址推断的大致位置、你的设备类型和应用版本。
  • 你设备上的其他一切都不会。 不包括你的相册、你的通讯录、你的其他应用,也不包括你没上传的文档。
  • 有时还有你过去的对话。 现在很多应用支持跨对话的记忆,这很方便,也意味着旧消息可能在新对话里重新冒出来。

训练、方案档位,以及那个没人打开的设置

“AI会不会偷走你的数据”背后的恐惧,通常比偷窃要具体得多。人们真正想知道的是,自己的文字会不会进到下一个版本的模型里,以及会不会有陌生人看到。行业里的模式足够一致,可以描述出来,尽管每家服务商的措辞都不同,而且每隔几个月就会改一次。大致上:账号越像一个企业账号,你的内容被用于训练的可能性就越低,而且这个承诺越可能写进合同,而不只是一个设置开关。

你用的是哪一种通常的模式该去看什么
免费个人账号对话可能被用于改进模型,除非你主动关闭那个关闭开关,以及它现在开着没有
付费个人方案(约每月20美元)默认设置往往和免费版一样,开关也是同一个别以为付了钱它就变了,很多时候并没有
商业、团队或企业方案用你的内容做训练通常默认关闭,并写进合同你们管理员的后台,因为这可能不由你决定
开发者或API接入内容通常默认排除在训练之外服务商的API数据使用说明页

每个主流的个人版应用里都有这个开关。它藏在数据控制、数据与隐私,或者活动记录这类标题下面,而服务商挪动它的频率高到在这里写出菜单路径,一个月内就会过时。现在就去把它找出来,趁你还没往里放任何敏感内容。这是每个应用只做一次的五分钟活儿。

人们做完之后会发现两件意外的事。第一,关掉训练几乎总是对之后生效,而不是往回追溯,所以你已经进行过的对话,可能仍留在它原本所在的那个池子里。第二,关闭的意思是“不用于训练”,不是“从不存储”。服务商一般会把对话保留一段时间,用于滥用监控、安全审核和客服支持,常见是30天左右,然后才执行删除。你自己删掉的对话同样如此。想知道你所用服务商的具体规定,请去读他们的政策,而不是读某篇总结它的文章,包括这一篇。

绝不粘贴清单,以及那个不花钱的解法

有些东西永远不该进聊天框,不管哪家服务商,不管什么设置。不是因为泄露有多大概率发生,而是因为一旦你错这一次,损害就是永久的。身份证号发出去了就收不回来。

  • 政府证件号码。 身份证、社保号、护照、驾照、纳税人识别号。
  • 银行卡和账户信息。 完整卡号、安全码、账号和汇款代码,尤其是加密钱包助记词。
  • 密码和访问密钥。 包括那个你信誓旦旦马上就要改掉的临时密码。
  • 别人的私事。 父母的诊断结果、朋友的工资、客户的家庭住址。那份同意权不在你手上,你无权代他们给出。
  • 任何受工作保密协议约束的内容。 未公布的财务数据、客户名单、雇主拥有的代码、保密协议下的文件。在你自己拿主意之前,先确认单位有没有指定可用的工具。
  • 未做脱敏的合同和法律文件。 一份签过字的协议通常带着姓名、地址和签名,而模型回答你的问题根本不需要这些。

解法一点都不花哨,但确实管用:粘贴之前,把敏感部分换成占位符。模型读的是结构和语言,不是身份,所以一条写着[房东]的条款,得到的分析和写着真名的那条完全一样。假设你想弄懂租约里的一条条款。你不该贴整份租约,而应该发这个:

请分析这条住宅租约中的条款。承租人是[承租人],出租人是[出租人],月租金是[金额],房屋位于[地址]。条款:“承租人应负责房屋内部的一切维修和保养,不设上限。”

然后你读完答案,自己把真实数值填回去。在新手真正拿去问AI的那些活儿上,总结、起草、解释和检查,用占位符带来的质量损失几乎是零。上传文件也是同一个习惯:先把文档脱敏再上传,用AI总结PDF那篇一步步讲了怎么做。

更可能咬你一口的那个风险

隐私是人们会问的风险。准确性才是真正让他们付出代价的风险。AI模型无论是答对还是在编,输出文字时的自信程度都是同一个调门,当它捏造一条判例引证、一个用药剂量、一个退款期限,或者一个带小数点的统计数字时,声音里不会有半点颤抖。新手把流畅当成有学问,因为在人身上通常确实如此。这个本能是最该先改掉的东西,而最快的疗法,是去核对三四个你原本笃定的答案,看看会翻出什么。

第二种失败是时效。模型学的是截止到某个日期之前收集的文本,所以价格、纳税起征点、法律、产品功能,以及最近几个月的任何事,都可能悄悄过时,听起来却毫无破绽地像是最新的。有些应用会联网搜索来打这个补丁,有些不会,而且它们很少会告诉你刚才到底搜没搜。当一个答案取决于一个实时数字时,直接问它有没有搜索,然后无论如何都去原始出处核一遍那个数字。

第三种造成的伤害才是真的:把一个流畅的答案当成建议。AI确实很擅长帮你为一场医疗、法律或财务的谈话做准备。它会解释某个术语是什么意思、你的选项分别叫什么、哪些问题值得问。它不是医生,不是律师,也不是持牌顾问。它不知道你的既往情况,不能给你做检查,也不会在超出自己能力范围时告诉你。在看诊之前用它,而不是拿它代替看诊。AI为什么会出错讲清了背后的机制,而懂了机制,你就更容易在行动之前抓住一个错误的答案。

五个你真能坚持下来的习惯

安全建议一旦每次都要费劲,就必然失败。下面这五条只让你一次性花大约十分钟,之后每次只需几秒钟,所以它们能在忙碌的一周里活下来。

  1. 今天就把数据设置检查一遍,只此一次。 打开设置,找到数据控制或隐私,决定你的对话能不能被用于训练,然后就过去了。只有换应用时才需要再来一遍。
  2. 默认使用占位符。 [姓名]、[公司]、[金额]。让它成为条件反射,而不是每次现判断,因为你赶时间的时候,最先失灵的正是判断。
  3. 凡是你要据此行动的,一律核实。 如果一个答案会让你打款、签字、吃药,或者把某个数字报给老板,那就去聊天机器人之外的地方确认一遍。
  4. 工作账号和个人账号分开。 工作材料用单位批准的工具,其他一切用你自己的账号。这保护你的程度,至少不亚于保护单位。
  5. 把每个答案都当作初稿。 在它被发到任何地方之前,用你自己的话重写一遍。你在编辑的过程中会抓到错误,而且成品听起来像你,而不像软件。

这些都不能把风险降到零,谁跟你说能,谁就是在卖东西。它们做到的,是把剩下的风险挪进一个你早就生活其中的类别:你的邮件躺在别人的服务器上,你的照片在别人的云里,而你很久以前就判定这笔交换是划算的。AI就是同一笔交换,只是另一头换成了一批更年轻的公司,所以它值得的是同样的日常谨慎,而不是恐慌或盲信。

关于账号还有一个实际的提醒。你每多注册一家服务商,就多一份隐私政策、多一个数据保留期限、多一个要去翻找的数据控制项,所以四个账号意味着这套检查要做四遍,而且你至少会忘掉一个。集中起来能减少你要负责的政策数量:Whizi把GPT、Claude、Gemini和图像模型放在一份订阅之下,于是你要管的设置页面从四个变成一个,代价是这条链上又多了一家公司。这是一笔交换,不是安全保证,而那份绝不粘贴清单在哪种情况下都完全一样。至于这一切有用的另一半,如何使用AI排好了第一周的真实任务,而怎么跟AI说话讲了什么样的措辞能从任何模型那里问出更好的答案。

操作清单
  • 把你的AI应用打开一次,找到管训练的那个数据控制项。
  • 默认你发出去的一切都离开了设备,正躺在服务商的服务器上。
  • 粘贴之前,把姓名、数字和地址换成占位符。
  • 永远不要发送证件号码、银行卡信息、密码或助记词。
  • 别把别人的医疗、财务和法律信息放进对话。
  • 凡是你要据此行动的答案,都到聊天机器人之外的来源核实一遍。
  • 工作材料和个人材料使用不同的账号。

常见问题

用ChatGPT安全吗?

对起草、总结、解释这类日常任务来说是安全的,前提是拿出你对待任何云服务时的那份谨慎。你的消息是在OpenAI的服务器上处理的,不是在你的设备上,所以真正的安全问题是你发了什么,而不是这个应用可不可信。在设置里把数据控制检查一次,别把证件号和密码放进对话,凡是你要据此行动的事实都核实一遍。

AI会偷走你的数据吗?

用偷这个词并不贴切。主流服务商都在公开政策里写明了收集什么、如何使用,真正的问题是你的对话会不会被用来改进未来的模型,而在个人版方案里这往往是一个你能控制的设置。更稳妥的假设是:你输入的任何内容都可能被保存一段时间,并在极少数情况下被人工查看,请据此决定你要发什么。

把个人信息放进AI对话安全吗?

普通的个人背景,比如你的职业、你所在的城市、你的处境,一般没问题,而且通常能让答案更好。可识别的号码则是另一类:任何政府证件、银行卡、账户或密码信息,永远不要发,别人的私人信息也一样。改用[姓名]、[金额]这样的占位符,对答案质量几乎没有影响。

AI能看到我手机或电脑上的文件吗?

不能。聊天机器人无法自己浏览你的设备、你的相册或你的工作硬盘。只有当你主动上传某个文件时它才看得到,而且只看得到那一个文件。如果某个应用拥有你从不使用的相机或相册权限,你可以在手机设置里收回,不会损失任何东西。

用AI处理工作文件安全吗?

这取决于你的雇主,而不取决于AI。很多公司都有指定的工具,配的是企业方案,合同上写明内容不会被用于训练,而用个人账号处理保密材料,即使什么都没泄露,也可能违反你签的协议。先问清楚什么是被批准的,工作就用那个账号,并养成把客户名称和财务数字脱敏的习惯。