免費文件去識別化工具:在瀏覽器本機製作去識別化檔案
上傳 Word、Excel、PowerPoint 或文字型 PDF,複核辨識出的敏感值,再產生去識別化副本,全程不上傳原檔。Office 檔案保留原結構;文字型 PDF 版面近似保留。
- 原檔不上傳,瀏覽器本機處理
- Office 保結構 · PDF 近似保版面
- 免費,免註冊
全程在瀏覽器內完成:本機解析檔案、辨識敏感實體並替換為佔位符、產生去識別化檔案——你的檔案與敏感資訊不會離開本裝置。(辨識模型,以及去識別化 PDF 時所需的字型等靜態資源,會從 CDN 下載,均不含你的任何內容。)
- 上傳設定1
- 複核實體2
- 下載去識別化檔案3
如何製作去識別化檔案?
- 01
選擇 Word、Excel、PPT 或 PDF 檔案
選擇 DOCX、XLSX、PPTX 或文字型 PDF。檔案在 Web Worker 內本機解析,原檔不會離開你的裝置。
- 02
複核需要去識別化的資訊
正則與本機 AI(NER)模型會標出人名、身分證字號、手機號、電子郵件、銀行卡/統一社會信用代碼和機構,你可確認或調整要遮蔽的內容。
- 03
產生並下載去識別化檔案
確認的實體會被替換為 ⟦NAME_1⟧ 之類的佔位符。Office 檔案保留原結構;文字型 PDF 會真刪除命中原文,並在原位置附近回填打碼文字。
文件去識別化工具常見問題
文件去識別化工具會處理哪些敏感資訊?
被辨識並確認的敏感實體——人名、身分證字號、手機號、電子郵件、銀行卡/統一社會信用代碼和機構(正則 + 本機 NER 模型)——會被替換為 ⟦NAME_1⟧ 之類的穩定佔位符。未被辨識為敏感實體的文字會保持原樣、不受保護,分享前請先覆核結果。
這個文件去識別化網頁會上傳原檔嗎?
不會。解析、辨識與去識別化全部在瀏覽器(及 Web Worker)內完成,你的文件和敏感資訊不會離開本裝置。頁面可能從 CDN 下載 AI 辨識模型,以及去識別化 PDF 時所需的字型等靜態資源;這些資源請求不含你的任何文件內容。
去識別化檔案之後還能還原原值嗎?
不能。本工具產生的是用於分享的單向去識別化副本,不儲存對應表、無法逆向佔位符。若需要真實值,請保留你的原始檔案。
這和翻譯工具有什麼不同?
本頁只做去識別化、不做翻譯,不會把文件正文送給翻譯服務。翻譯主流程分兩條路徑:BYOK 把打碼文字和 Key 直送所選服務商;代管模式經 Veil Translate 轉送打碼文字給 Cloudflare Workers AI。漏辨識的敏感資訊仍可能留在正文中。
支援 Word、Excel、PPT 和 PDF 文件去識別化嗎?
支援 DOCX 正文、XLSX 儲存格文字、PPTX 投影片文字與演講者備忘稿,以及文字型 PDF。Word 頁首頁尾文字、PPT 圖表或 SmartArt 內嵌文字、掃描 PDF、加密 PDF、旋轉或直排 PDF 文字不處理。Office 檔案保留原結構;PDF 版面近似保留,不保證完全一致。
這是完全離線的文件去識別化工具嗎?
不是。文件內容只在瀏覽器本機處理、原檔不會上傳,但頁面會從 CDN 下載本機辨識模型和 PDF 字型等靜態資源;這些請求不包含你的文件內容。