用 AI 要注意的資料安全與隱私:一份給一般使用者的完整指南
把公司文件貼進 ChatGPT,把身分證照片丟給 AI 辨識,這些動作可能正在外洩你的機密與個資。這篇指南用具體情境,教你判斷哪些資料不能給 AI,以及如何在享受便利的同時保護自己與公司。
為什麼「用 AI」本身就是一種資料外洩風險
多數人第一次用 ChatGPT 或 Gemini 時,直覺是把手邊的東西整段貼上去,請 AI 幫忙潤稿、摘要或翻譯。這個動作看似無害,實際上等於把那段內容送到一家外部公司的伺服器。差別在於,你送出去的到底是一篇公開的部落格草稿,還是客戶的完整名單、公司尚未公布的財報、或病患的病歷。
AI 服務的運作前提,是你的輸入內容會離開你的裝置,傳到雲端被模型處理。這一步無法省略,也不是「本機運算」。因此真正的問題不是「AI 會不會偷看」,而是「我送出去的這份資料,本來就該不該離開我的掌控範圍」。只要用這個角度思考,很多判斷會立刻變清楚。
先搞懂:你的對話到底會被拿去做什麼
不同服務、不同方案,對你資料的處理方式差很多,大致可分成三種情況。
第一種是「可能被用來訓練模型」。免費版的消費級聊天機器人,預設常會把你的對話納入未來模型的訓練素材。這代表你貼進去的內容,理論上有機會以某種形式影響到日後模型的輸出,雖然不是逐字複製,但對機密資料而言仍是風險。
第二種是「只做即時處理,不拿去訓練」。多數企業方案,例如 ChatGPT Enterprise、Team,或透過 API 呼叫的服務,通常承諾不會用你的資料訓練模型,資料保留期也較短或可設定。
第三種是「本機或私有部署」。也就是模型跑在你自己的電腦或公司內部伺服器,資料完全不外流,適合高度敏感的場景,代價是效果與便利性通常不如雲端旗艦模型。
關鍵動作:花五分鐘去你用的服務的設定頁,找到「資料控制」或「Data Controls」,關掉「用我的對話改善模型」這類選項。這是成本最低、效益最高的一步。
哪些資料絕對不要貼進一般 AI 聊天視窗
以下這份清單,是判斷「該不該送出去」時可以直接對照的紅線。
- 個人身分資料:身分證字號、護照號碼、健保卡號、詳細住址、金融帳號、信用卡號。
- 帳號密碼與金鑰:任何密碼、API 金鑰、資料庫連線字串、SSH 私鑰。
- 客戶與員工個資:完整姓名搭配電話、Email、消費紀錄的名單。這在台灣受《個人資料保護法》規範。
- 公司機密:未公開財報、報價單、合約條款、原始碼中的商業邏輯、併購或人事機密。
- 醫療與法律敏感資訊:病歷、診斷、正在進行的訴訟細節。
- 受保密協議(NDA)約束的一切內容。
實務上最常見的外洩,不是駭客入侵,而是員工為了「快一點」,把整份客戶 Excel 或整段程式碼貼進免費版 AI。2023 年就發生過大企業員工把機密原始碼貼進 ChatGPT,導致公司全面禁用的知名案例。
具體情境:該怎麼做才安全
情境一:想請 AI 幫忙潤飾一封含客戶名字的信
錯誤做法:整封信含客戶全名、公司名、報價數字直接貼上。
正確做法:把敏感欄位改成代號再貼,例如把客戶名換成「A 公司」、把金額換成「XX 萬」。等 AI 潤好文字,再把真實資料填回去。這個「去識別化」的小動作,能保留 AI 的幫助,同時不洩漏可辨識的個資。
情境二:想用 AI 分析一份客戶名單
如果只是想做分類或找規律,先把「可以識別個人」的欄位(姓名、電話、Email、身分證號)整欄刪掉或雜湊化,只留下你真正要分析的欄位(例如購買品類、金額區間、地區)。分析結果再自己對回原表。
情境三:公司要導入 AI 工具給全體員工用
請直接採用企業方案而非免費版,並確認合約載明「不用於訓練」、資料儲存區域、以及保留期限。同時制定一份內部使用規範,明確列出上面那份紅線清單,並提供一個「合規的內部 AI 入口」,員工才不會私下用免費版繞過管制。
免費版與企業版的差異對照
| 面向 | 消費級免費版 | 企業/API 方案 |
|---|---|---|
| 是否用於訓練 | 預設常會(可手動關閉) | 通常明確承諾不會 |
| 資料保留 | 期限較長或不透明 | 可設定、通常較短 |
| 存取控管 | 個人帳號,難稽核 | 可管理成員、留存稽核紀錄 |
| 合約保障 | 一般消費者條款 | 有企業級資料處理協議 |
| 適合資料 | 公開、非敏感內容 | 內部營運資料(仍須遵守紅線) |
這張表的重點:免費版不是不能用,而是只適合處理「就算流出去也無所謂」的內容。
除了聊天內容,這些地方也在洩漏你
資料安全不只是聊天框裡打什麼。以下幾個容易被忽略的角落同樣重要。
第一,第三方外掛與非官方 App。市面上很多「串接 ChatGPT」的外掛或瀏覽器擴充,會要求讀取你的網頁內容、剪貼簿甚至郵件。這些第三方的資料處理往往不透明,安裝前務必確認來源與權限。
第二,圖片與檔案上傳。上傳的照片可能含 GPS 位置的 EXIF 資訊、螢幕截圖裡可能有旁邊分頁露出的機密。上傳前先檢查畫面裡有沒有不該出現的東西。
第三,把 AI 接進自己系統時的金鑰管理。如果你用 API 開發,切勿把 API 金鑰寫死在前端網頁或公開的程式碼倉庫,這等於把鑰匙掛在門外。
第四,語音與截圖類 AI 助理。有些桌面助理會持續截取螢幕或錄音,安裝前要理解它的擷取範圍與上傳時機。
給個人與企業的實用檢查清單
個人層級,養成三個習慣就能擋掉多數風險。第一,送出前問自己一句:「這段內容如果被公開,我能接受嗎?」不能就別貼。第二,關閉訓練選項並定期清理對話紀錄。第三,敏感欄位一律先代號化或刪除。
企業層級,建議依序完成四件事。一是選用有資料處理協議的企業方案;二是公告一份白紙黑字的紅線清單與使用規範;三是提供合規的官方入口,降低員工私自使用免費版的誘因;四是定期教育訓練,因為工具會更新、人員會流動,規範需要反覆提醒才會落地。
常見的錯誤觀念
很多人以為「我把對話刪掉就沒事了」。事實上,刪除介面上的紀錄,不等於伺服器端與已納入訓練的資料同步消失,能否用來訓練取決於你事前有沒有關閉選項。也有人以為「反正資料很多,AI 不會記得我這一筆」,但個資的風險不在於機率,而在於一旦發生就是實質傷害,且在台灣可能觸及法律責任。
最後要理解的是,資料安全與使用 AI 並不衝突。真正成熟的用法,是清楚知道哪些內容可以放心交給雲端、哪些必須留在自己手上,然後在這條界線內盡情享受 AI 帶來的效率。把界線畫清楚,你就能用得又快又安心。
常見問題
免費版 ChatGPT 貼進去的內容會被拿去訓練嗎?
消費級免費版預設常會把對話納入模型改善用途,但你可以到設定的「資料控制(Data Controls)」把「用我的內容改善模型」關掉。企業版與透過 API 的呼叫通常明確承諾不用於訓練。建議先關閉再使用。
把客戶名單貼給 AI 分析會違反個資法嗎?
在台灣,可辨識特定個人的資料受《個人資料保護法》規範,未經妥善處理就傳給外部服務有風險。安全做法是先把姓名、電話、身分證號等可識別欄位刪除或去識別化,只保留要分析的欄位。
刪除對話紀錄就代表資料不見了嗎?
不一定。介面上刪除不等於伺服器端立即抹除,也無法回收已納入訓練的資料。真正有效的做法是事前就關閉訓練選項,並選用資料保留期短、可稽核的方案。
有沒有完全不外流資料的 AI 使用方式?
有,就是本機或私有部署的模型,資料完全留在自己的電腦或公司內部伺服器。缺點是效果與便利性通常不如雲端旗艦模型,適合高度敏感的場景。
公司要導入 AI,最該先做的一件事是什麼?
採用有資料處理協議的企業方案,並公告一份明確的紅線清單,列出絕對不能貼進 AI 的資料類型,同時提供合規的官方入口,避免員工私下改用免費版繞過管制。