脱敏翻译
文档先脱敏再 AI 翻译:把 PII 留在本地
很多团队并不是不想用 AI 翻译,而是不想把客户姓名、身份证号、手机号、邮箱、银行账号和公司名随正文一起发出去。文档匿名化翻译的关键,是先把敏感实体替换成稳定占位符。
Veil Translate 把 PII 识别、复核、打码和还原都放在浏览器内完成。出网的是打码文本和用户选择的翻译请求,不是原始敏感值。
短答案
文档先脱敏再 AI 翻译,就是先把姓名、证件号、邮箱、电话、银行账号和机构名等 PII 在浏览器本地替换成稳定占位符,再发送打码文本。模型翻译正文并保留占位符,浏览器随后在本机还原真实值。
什么是先脱敏再翻译
先脱敏再翻译,不是把整篇文档加密后交给模型,而是把可识别的敏感实体替换成可读占位符,例如 ⟦EMAIL_1⟧、⟦ID_1⟧、⟦BANK_1⟧。
模型负责翻译普通正文并保留占位符;浏览器收到译文后,再用本地映射表把占位符还原成真实值。
适合哪些文档
适合合同、NDA、简历、候选人资料、报价单、客户清单、财务表格和跨境商务材料,尤其是需要保留 Word、Excel、PPT 或文本型 PDF 版式的文件。
如果只想生成匿名化副本而不翻译,也可以使用单独的文档匿名化工具页;如果要翻译,则使用可还原的占位符映射。
打码示例
候选人赵蕾的邮箱是 zhaolei@example.com,身份证号为 110101199003070012。
候选人⟦NAME_1⟧的邮箱是⟦EMAIL_1⟧,身份证号为⟦ID_1⟧。
The candidate ⟦NAME_1⟧ has the email ⟦EMAIL_1⟧ and ID number ⟦ID_1⟧.
隐私边界
这不是「加密后翻译」。被识别并确认的敏感实体会被占位符替代;剩余去标识化正文仍以明文发送给你选择的翻译服务。
中文和英文源文档的自动识别覆盖更好;其他语言源文档建议在复核页主动补录需要保护的值。
常见问题
文档脱敏和文档匿名化有什么区别?
在这里二者都指把敏感实体替换成占位符。翻译模式保留本地映射表用于还原;匿名化-only 页面生成不可逆的打码副本。
翻译前做 PII 打码会影响译文质量吗?
通常不会影响主体语义。占位符会作为实体位置保留下来,提示模型原样透传,再由浏览器本地还原。
术语库里的固定译法会不会出网?
术语命中后会以 TERM 占位符参与翻译,源词和指定译法按本地规则处理,避免把术语原值直接发出。
我需要自己的 API Key 吗?
使用自带 Key 模式时需要。请求由浏览器直连你选择的 OpenAI 兼容端点。