你的訊息實際上去了哪裡
你打出一個問題,按下傳送,大約兩秒鐘答案就出現了。這樣的速度會讓人覺得整件事是在你的手機上發生的。其實不是。你的文字離開了你的裝置,透過網路傳到一座資料中心,那裡塞滿了打造這個模型的公司所擁有的專用晶片,在那裡被處理過後,才傳回來給你。聊天機器人一點也不像離線運作的計算機應用程式,它比較接近寄一封電子郵件,或把一張照片上傳到雲端服務:真正有用的運算,發生在別人的電腦上。如果你對這項技術本身還是一頭霧水,什麼是AI用白話說明了最基本的部分。
一旦你的文字放到了一家公司的伺服器上,接下來會發生什麼事,就由那家公司的政策和它的存取控管決定,跟你這端有任何實體東西無關。這也讓「檔案」這個問題有了合理的比例。聊天機器人不會自己跑去翻你的手機、你的信箱,或你的工作硬碟。它只看得到你親手交給它的東西,加上你在安裝這款應用程式時授予的權限。今天值得花兩分鐘做的事:打開手機設定,找到這款應用程式,如果你從沒用過相機、麥克風或照片圖庫這些功能,就把權限關掉。以下是真正會傳到供應商那裡的內容。
- 你打出來或貼上的文字。全部都算,包括你從文件裡複製過來、卻沒有重新讀一遍的那一段。
- 你附加的檔案。PDF、照片、試算表。只有你選中的那些,而且只在你選中的那個當下。
- 帳號和連線資訊。你的電子郵件地址、從你的IP位址推算出的大致所在位置、你的裝置類型和應用程式版本。
- 你裝置上的其他東西都不會傳出去。不包括你的照片圖庫、你的聯絡人、你的其他應用程式,也不包括你沒有附加的文件。
- 有時候,還有你過去的對話。現在許多應用程式會在不同對話之間保留記憶,這很方便,但也代表舊訊息可能在新對話裡再度出現。
訓練、方案等級,以及那個沒人打開過的設定
「AI會不會偷走你的資料」這句話背後的恐懼,通常比「偷竊」這個詞來得狹窄。大家真正想知道的,是自己說的話最後會不會被放進下一版模型裡,以及會不會被陌生人看到。這個產業的模式,一致到足以說清楚,儘管每家供應商的措辭都不一樣,而且每隔幾個月就會改寫一次。大致上來說:帳號越像商用帳號,你的內容被用來訓練的機率就越低,這項承諾也越可能寫進合約裡,而不只是設定裡的一個開關。
| 你用的是哪一種帳號 | 常見的做法 | 該檢查什麼 |
|---|---|---|
| 免費個人帳號 | 除非你選擇退出,否則對話可能被用來改善模型 | 退出開關在哪裡,以及它是不是開著的 |
| 付費個人方案(大約每月20美元) | 通常跟免費方案的預設值一樣,開關也一樣 | 別以為付費就改變了這一點,因為通常沒有 |
| 企業、團隊或商用方案 | 訓練通常預設是關閉的,而且寫進合約裡 | 你的管理員後台,因為這個選擇可能不是你能決定的 |
| 開發者或API存取 | 內容通常預設不會用來訓練 | 供應商的API資料使用頁面 |
這個開關存在於每一款主流的個人應用程式裡。它通常放在「資料控管」「資料與隱私」,或「活動紀錄」這類標題底下,而且供應商調整選單位置的頻率之高,讓這裡寫下確切路徑,一個月內就可能過時。現在就去找到它,趁你還沒在裡面放進任何敏感內容之前。這是每款應用程式只需要做一次的五分鐘工作。
真的去做的人,通常會被兩件事嚇一跳。第一,關閉訓練幾乎都只適用於之後的對話,不會回溯過去,所以你之前已經有過的對話,可能還留在它原本所在的那個資料池裡。第二,「關閉」的意思是「不會被用來訓練」,不是「從未被儲存過」。供應商通常會把聊天記錄保留一段時間,用於防濫用監控、安全審查和客服支援,之後才會刪除;舉例來說,OpenAI表示,除非有法律要求保留,否則已刪除的對話會在30天內從它的系統中移除。你自己刪除的對話也是同樣的道理。如果你想知道你的供應商的確切做法,去讀它的政策,而不是任何摘要文章,包括這一篇在內。如果你在考慮的供應商,是一項多模型訂閱服務,而不是某間實驗室本身,第三方AI訂閱安全嗎把同一張表套用到中間這一層。
絕對不該貼上的清單,以及一個不花一毛錢的解法
有些東西,不管在哪一家供應商、哪一種設定底下,都絕對不該放進對話框裡。不是因為外洩的機率有多高,而是因為一旦出錯一次,傷害就是永久的。身分證字號送出去之後,你沒辦法收回。以下是簡短版,絕對不該貼進AI對話的內容有完整清單,包括大家常忘記的截圖、程式碼檔案和逐字稿。
- 政府核發的證件號碼。社會安全碼、健保或國民年金編號、護照、駕照、稅籍編號。
- 卡片和銀行資料。完整的卡號、安全碼、帳戶和匯款代碼,尤其是加密貨幣的助記詞。
- 密碼和存取金鑰。包括那組你發誓馬上就會換掉的臨時密碼。
- 其他人的私事。父母的診斷結果、朋友的薪水、客戶的住家地址。這種同意權不是你能代替別人給的。
- 任何受工作保密協議約束的內容。尚未公開的財務數字、客戶名單、屬於雇主的程式碼、有保密協議(NDA)的文件。在你自己決定之前,先確認你的公司有沒有核准的工具。
- 未經處理的合約和法律文件。一份簽署過的協議,通常帶有姓名、地址和簽名,而這些都不是模型回答你問題所需要的東西。
解法一點也不炫,但很有效:貼上之前,先把敏感的部分換成代稱。至於各家供應商的細節,哪些應用程式預設會用聊天記錄訓練、退出選項各自藏在哪裡,隱私保護最完善的AI聊天機器人比較持續更新現況並附上日期。模型讀的是結構和語言,不是身分,所以一個寫著[房東]的條款,跟一個寫著真實姓名的條款,得到的分析是一樣的。假設你想請它解釋一條租約條款,與其貼上整份租約,你可以送出這樣的內容:
幫我審閱這條住宅租約條款。房客是[房客],房東是[房東],月租金是[金額],物件地址是[地址]。條款內容:「房客應負責房屋內部的一切維修與保養,且不設上限。」
接著你自己讀答案,把真實的數值填回去。對新手實際會拿去用AI處理的工作,摘要、起草、解釋和查核來說,用代稱造成的品質損失幾乎是零。同樣的習慣也適用於上傳檔案:附加文件之前先做遮蔽處理,用AI摘要PDF這篇指南一步一步示範了怎麼做。
更可能咬你一口的風險
隱私是大家會問的風險,準確度才是真正會讓人付出代價的風險。一套AI模型,不管是答對了還是在瞎編,寫出來的文字都是同一種穩定的篤定語氣,就算它捏造出一則判例引註、一項用藥劑量、一個退款期限,或一個帶著小數點的統計數字,語氣也不會有一絲動搖。新手會把流暢當成知識,因為對人類來說,流暢通常確實代表知識。這種直覺才是你最該先戒掉的,最快的辦法,就是拿幾個你原本很確定的答案,查核個三、四則,看看會查到什麼。
第二種失誤跟時間有關。模型是從蒐集到某個截止日期為止的文字裡學習的,所以價格、稅務門檻、法規、產品功能,以及最近幾個月發生的任何事,都可能悄悄地過時,聽起來卻完全像是最新資訊。有些應用程式會搜尋網路來補上這個缺口,有些不會,而且很少有應用程式會明確告訴你剛剛用的是哪一種。當一個答案取決於一個即時數字時,直接問它有沒有搜尋,然後不管答案是什麼,都自己到原始出處核對那個數字。
第三種才是真正造成傷害的:把一個流暢的答案當成建議。AI確實很擅長幫你為醫療、法律或財務方面的對話做準備。它會解釋一個術語的意思、你有哪些選項的正式名稱,以及哪些問題值得問。但它不是醫生、律師,也不是持照的顧問。它不了解你的病史,沒辦法為你檢查,也不會告訴你它已經超出能力範圍。把它用在約診之前,而不是用它來取代約診。為什麼AI會出錯解釋了背後的機制,理解這一點,能讓你在據以行動之前,更容易抓出錯誤的答案。
五個你真的會持續做的習慣
安全建議一旦要求你每次都得花力氣,就注定會失敗。以下這五項,只需要你一開始花大約十分鐘,之後每次只要幾秒鐘,這就是為什麼它們能撐過忙碌的一週,還被你真的做到。
- 今天就檢查一次資料設定。打開設定,找到資料控管或隱私選項,決定你的對話能不能被用來訓練,然後就不用再管它了。只有換應用程式的時候才需要重做一次。
- 預設就用代稱。[姓名]、[公司]、[金額]。讓這變成一個反射動作,而不是每次臨場判斷,因為在你趕時間的時候,臨場判斷正是最容易失靈的環節。
- 任何你會據以行動的內容都要查核。如果一個答案會讓你匯錢、簽文件、服藥,或把一個數字報給主管,就到聊天機器人以外的地方確認它。
- 工作帳號和個人帳號分開。工作相關的內容用雇主核准的工具,其他一切用你自己的帳號。這樣做保護你的程度,至少不亞於保護公司。
- 把每個答案都當成初稿。在它送出去任何地方之前,用你自己的話重寫一遍。你會在編輯的過程中抓出錯誤,而且結果聽起來會像你自己寫的,而不像軟體寫的。
這一切都不會把風險降到零,任何跟你說能降到零的人,都是想賣你東西。它做到的,是把剩下的風險,搬進一個你早就已經在過的生活類別裡:你的電子郵件放在別人的伺服器上,你的照片放在別人的雲端服務裡,而你早就決定這筆交易划得來。AI是同一種交易,只是換了一批比較新的公司在另一端,所以它值得的,是同樣的一般謹慎,而不是恐慌,也不是盲目信任。
關於帳號,有一個實用的提醒。你註冊的每一家供應商,都是另一份隱私政策、另一個保留期限,以及另一項要去找出來的資料控管,所以有四個帳號,就代表要把這套檢查跑四遍,而且至少會忘記其中一個。整合起來,能減少你要負責的政策數量:Whizi把GPT、Claude、Gemini和圖片模型都放進同一份訂閱裡,讓你只要管理一個設定畫面,而不是四個,代價是在這條鏈裡多加了一家公司。這是一種取捨,不是安全保證,而且不管怎麼選,絕對不該貼上的清單都是一樣的。至於這一切裡真正實用的那一半,如何使用AI整理了頭一週該做的真實任務,怎麼跟AI對話則講解了能從任何模型那裡問出更好答案的措辭方式。
- 打開你的AI應用程式一次,找到掌管訓練選項的資料控管設定
- 假設你送出的每一件東西,都會離開你的裝置,存放在供應商的伺服器上
- 貼上之前,先把姓名、數字和地址換成代稱
- 絕對不要傳送政府證件號碼、卡片資料、密碼或助記詞
- 別把其他人的醫療、財務和法律細節放進對話裡
- 任何你會據以行動的答案,都要拿聊天機器人以外的來源查核
- 工作內容和個人內容,各自使用不同的帳號
常見問題
ChatGPT安全嗎?
對起草、摘要、解釋這類日常任務來說是安全的,只要你用對待任何雲端服務同樣的謹慎態度來用它。你的訊息是在OpenAI的伺服器上處理的,而不是在你的裝置上,所以實際的安全問題,在於你送出了什麼,而不是這款應用程式值不值得信任。到設定裡檢查一次資料控管,別把證件號碼和密碼放進對話裡,任何你打算據以行動的事實都要先查核。
AI會偷走你的資料嗎?
「偷竊」這個說法本身就用錯了框架。主要供應商都在公開的政策裡說明它們蒐集什麼、怎麼使用,真正的問題在於,你的對話會不會被用來改善未來的模型,而這在個人方案裡,通常是一項你能自己控制的設定。比較保險的假設是:你打的任何內容,都可能被儲存一段時間,在罕見情況下也可能被人工審閱,所以要根據這一點來決定你要送出什麼。
把個人資訊放進AI對話安全嗎?
一般的個人背景資訊,像是你的工作、你住的城市,或你的處境,通常沒問題,還常常能讓答案更好。可辨識身分的號碼是另一類:絕對不要放進政府證件、卡片、銀行或密碼資料,也不要放進屬於其他人的私人資訊。改用[姓名]、[金額]這類代稱,這幾乎不會影響答案品質。
AI能看到我手機或電腦上的檔案嗎?
不能。聊天機器人沒辦法自己瀏覽你的裝置、你的照片圖庫,或你的工作硬碟。它只有在你刻意附加或上傳一個檔案時才看得到,而且只看得到那一個檔案。如果一款應用程式有你從沒用過的相機或照片權限,你可以在手機設定裡撤銷它,不會有任何損失。
用AI處理工作文件安全嗎?
這取決於你的雇主,而不是AI本身。許多公司都有核准的工具,搭配商用方案,並以合約明訂內容不會用來訓練,而就算什麼都沒外洩,用個人帳號處理機密資料,也可能違反你的合約。問清楚公司核准的是什麼工具,工作就用那個帳號,並養成習慣,遮蔽客戶姓名和財務數字。