實用工具

AI 提示詞個資遮蔽工具

在把文字貼進 ChatGPT 或其他 AI 之前,先遮蔽電話號碼、電子郵件、身分證與卡號、IBAN、IP 位址和 API 金鑰。

瀏覽器本機執行AI 開發工具1.1萬
免費

輸入

0 B

結果

結果會顯示在這裡。

客服工單、日誌和客戶電子郵件正是大家最常貼進 AI 助理的文字,而它們充滿了個人資料。這個工具會找出文字中的識別資訊,在內容離開你的電腦之前先替換掉。它沿用 Presidio(data-privacy-stack/presidio,MIT)的做法——這是源自微軟的開源個資(PII)框架——並精簡成瀏覽器在沒有語言模型的情況下也能可靠完成的部分:每種識別資訊各有一個比對樣式,再由驗證器剔除形似的假貨——卡號用 Luhn 檢查碼,中國大陸居民身分證號碼用 GB 11643 檢查碼加上真實存在的出生日期,IBAN 則用 mod-97 檢查。

它是怎麼運作的

  • 可偵測電子郵件地址;中國大陸的手機與市話號碼;以 + 或 00 開頭的國際號碼;(415) 555-2671 格式的北美號碼;18 位數的中國大陸居民身分證號碼;卡號;IBAN;IPv4 與 IPv6 位址;以及 OpenAI、Anthropic、AWS、GitHub、GitLab、Slack、Google 和 Hugging Face 的 API 金鑰、JWT 和 PEM 私鑰。
  • [PHONE_1] 這類編號標籤會讓相同的值每次都得到相同的標籤,模型仍能分辨兩位不同的客戶;星號遮蔽保留大家熟悉的樣子,例如 138****8000;假值看起來像真的,但都取自不可能屬於任何人的範圍。
  • 發現項目表會列出每一項的行號、類型、遮蔽後的值和替換內容,而且絕不完整顯示原始值。
  • 所有處理都在你的瀏覽器中完成;而且因為這個工具處理的是敏感文字,即使是已登入的會員,網站也不會保留任何紀錄。

你的資料去了哪裡

哪也沒去。本工具完全在你的瀏覽器裡執行:你貼上的文字由頁面處理,不會傳輸到任何伺服器,也不會寫進任何紀錄。

本工具會接觸金鑰與憑證,因此任何一次執行都不會被儲存,連你自己的歷史裡也不會有。

它要花多少

本工具完全免費,不需要登入,也不消耗點數。

常見問題

能找出姓名和街道地址嗎?
不能。要可靠地辨識姓名或地址,需要專門為此訓練的語言模型,而用比對樣式去猜,會漏掉很多,又會把一般詞彙誤判出來。送出前請讀一遍遮蔽後的文字,並手動替換姓名;編號標籤的樣式讓你很容易保持一致,例如 [NAME_1]。
為什麼某個號碼沒有被偵測出來?
每一項偵測結果都必須通過驗證器,所以檢查碼錯誤的卡號、出生日期不可能存在的身分證號碼,或是沒通過 mod-97 的 IBAN,都會被刻意略過——它們不是真實的識別資訊。沒有國碼或括號的十位數純數字也會被跳過,因為訂單編號和時間戳記看起來一模一樣。
假值是從哪裡來的?
來自保留給測試用、或本來就不可能存在的範圍:user1@example.com、以 100 開頭的中國大陸手機號碼、虛構的 555-01xx 區段中的美國號碼、使用不存在的地區碼 000000 且檢查碼正確的身分證號碼、支付業者公開的測試卡號,以及文件專用範圍 192.0.2.0/24 和 2001:db8::/32 中的 IP。
能把原始值放回 AI 的回答裡嗎?
用編號標籤的話,可以手動完成:保留發現項目表,把回答中的 [EMAIL_1] 等標籤換回來。表格只顯示遮蔽後的值,所以請保留你的原始文字,作為對照關係的依據。

背後的開源專案

本工具是獨立實作,並未打包第三方函式庫。data-privacy-stack/presidio(MIT)在程式碼層面做的是同一件事——如果你需要在自己的程式裡實作它,從那裡開始,而不是呼叫一個網頁。

data-privacy-stack/presidio

也常被稱作

  • 個資遮蔽
  • 個資去識別化
  • 資料遮罩工具
  • pii 遮蔽
  • chatgpt 個資 保護
  • 敏感資料 移除