为什么翻译应用不该把你的数据传回服务器

去年,一家德国医院因违反 GDPR 被罚款 46 万欧元。事情的起因并非传统意义上的数据泄露——一名工作人员使用 Google Translate 将患者的土耳其语病历翻译成德语,而患者的病史、诊断结果和治疗记录就此被发送至 Google 的服务器处理。

院方认为,这次翻译是出于患者救治的必要性。但监管机构认定,在未经当事人明确同意的情况下,将可识别健康数据发送给美国科技公司,违反了 GDPR 第 9 条。最终监管机构胜诉。

这并非个例,而是一个被大多数人忽视的简单事实所导致的必然结果:每次使用云端翻译,你所翻译的文字都会被发送到别人的服务器上处理。

你翻译的内容去了哪里

当你在 Google Translate 中输入或朗读文字时,数据会传输到 Google 的服务器,经由其神经机器翻译系统处理后,结果再返回你的设备。Google 的隐私政策表明,他们可能使用这些数据来"改善 Google 服务"。

"改善服务"在实践中意味着什么?意味着你翻译过的内容可以用于训练未来的翻译模型;意味着你的翻译规律会被分析;意味着这些数据存储在 Google 的服务器上,受美国法律约束,包括可能面临政府的数据调取请求。

Microsoft Translator 采用类似的模式。iTranslate 通过云端 API 转发请求。DeepL 在其自有服务器上处理(他们声称翻译完成后会删除数据,但数据仍然离开了你的设备)。

翻译菜单上的某个菜名,这点代价或许可以接受。但涉及敏感内容时,这个代价就不值得了。

敏感翻译的困境

想想人们实际上在翻译什么:

  • 医疗信息 — 患者翻译症状、诊断、处方、化验结果
  • 法律文件 — 合同、移民申请、法庭通知
  • 商业往来 — 谈判内容、内部战略讨论、财务条款
  • 私人消息 — 与家人、伴侣、朋友的私密对话
  • 政务沟通 — 税务表格、签证申请、社会服务通知

以上每一类信息,人们都有合理的隐私期待。然而每天都有数百万人通过云端翻译服务处理这些内容,浑然不知自己的数据流向何处。

2024 年 Cisco 的一项调查发现,48% 的员工曾将公司机密数据粘贴到 AI 工具中,包括翻译服务。Cyberhaven 的另一项研究则发现,粘贴至 ChatGPT 的数据中有 11% 属于机密内容(其底层架构理念与云端翻译服务相通)。

问题不在于 Google 或 Microsoft 心怀恶意,而在于这种架构本身就存在风险。传输中的数据可能被截获;存储中的数据可能遭到泄露;存放在第三方服务器上的数据,受你未曾选择的法律管辖。

本地翻译:另一条路

本地翻译从根本上消除了这类风险——因为数据根本不会被发送到任何地方。

原理很简单:手机不再作为向云端服务器发送文字的瘦客户端,翻译模型直接在手机的处理器上运行。语音识别在本地完成,文字翻译在本地完成,摄像头拍摄的内容在本地处理。任何数据都不离开设备。

不久前,这在技术上还无法实现——翻译模型体积太大,手机算力太弱。但情况已经改变。现代手机配备了神经处理单元(NPU),能够以生产级速度运行量化 AI 模型。Gemma(20 亿参数)、Whisper、Parakeet 等模型在装入手机内存的同时,能提供与云端服务相当的翻译质量。

Traverba 完全基于这一架构构建。全部 108 种语言、语音识别、摄像头 OCR、屏幕翻译,乃至通过蓝牙进行的多人对话,均无需任何服务器连接即可运行。这里的隐私保障不是政策层面的承诺("我们不会查看你的数据"),而是架构层面的保障——你的数据在物理上就不可能离开设备,因为根本没有服务器可以发送。

谁最需要私密翻译

医疗工作者与患者 — 医疗翻译是最常见的使用场景之一,也是最敏感的场景之一。护士用 Google Translate 与不讲英语的患者沟通,实际上是将受保护的健康信息发送给了 Google 服务器。使用本地翻译,对话就留在房间里。

律师与法律从业者 — 律师-客户特权并不延伸到第三方服务器。通过云端服务翻译特权通信,可以说在某种程度上构成了特权放弃。本地翻译让特权信息真正受到保护。

商业从业者 — 商业机密、谈判立场、财务数据和战略规划都会被频繁翻译。使用云端翻译,意味着这些信息的副本将存在于你的组织控制范围之外。

移民与难民 — 翻译使用者中最脆弱的群体,是那些与移民机构沟通、填写庇护申请,或翻译关乎其命运的法律文件的人。他们往往最缺乏评估隐私风险的能力,却又最承担不起数据暴露的后果。

记者与社会活动人士 — 在存在监控顾虑的国家,云端翻译会留下你阅读和交流内容的记录。本地翻译不留任何痕迹。

家庭暴力幸存者 — 通过云端服务翻译安全计划、庇护所地址或法律选项等相关通信,会产生数据痕迹,可能通过共享账户或法律程序被他人获取。

合规层面的考量

对于企业和机构而言,合规方面的含义一目了然:

  • GDPR(欧盟)— 将个人数据发送至美国云端服务器,需要具备充分的保障措施。Schrems II 裁决废除了隐私盾协议,使欧盟数据在美国云端处理的合法性变得错综复杂。
  • HIPAA(美国医疗)— 通过云端翻译服务处理受保护的健康信息,需要与翻译提供商签订业务伙伴协议(BAA)。Google 不为 Google Translate 提供 BAA。
  • FERPA(美国教育)— 通过云端服务翻译学生记录,可能违反 FERPA 的信息披露限制。
  • 律师-客户特权 — 如前所述,通过云端翻译特权通信存在特权放弃风险。

本地翻译完全绕开了上述所有问题,因为任何数据都不会传输给第三方。

质量之问

最显而易见的质疑:本地翻译是否以牺牲质量换取隐私?

两年前,答案是确实如此。本地模型的效果明显逊于云端模型。

到 2026 年,这一差距已大幅缩小。对于最常用的语言对(英语对西班牙语、中文、法语、德语、日语、韩语、葡萄牙语、阿拉伯语),在日常使用中,大多数用户已无法区分本地翻译与云端翻译的质量差异。稀有语言对和高度专业化领域仍存在一定差距,但对于 90% 的现实翻译需求而言,本地翻译的质量已完全达到生产级水准。

Traverba 专门将不同语言路由至对应的专业模型(英语使用 Parakeet,中日韩使用 Qwen3,广覆盖使用 Whisper),而非采用单一的通用模型。这种针对每种语言的优化,进一步缩小了剩余的质量差距。

你今天就能做的事

  1. 审视你的翻译习惯。 你实际上在翻译什么?如果涉及任何敏感内容(医疗、法律、财务、个人),你就存在隐私风险。

  2. 试用本地翻译。 Traverba 免费、支持 108 种语言、完全离线可用。Apple Translate 可在约 20 种语言上实现本地翻译。用你常用的场景测试一下。

  3. 制定组织层面的政策。 如果你管理一个团队,明确规定哪些翻译工具适用于哪个敏感级别。公开内容使用云端翻译没问题,但将机密数据用云端翻译处理,是一个随时可能引爆的政策违规点。

  4. 考虑你所翻译的对象。 如果你为患者、客户、学生或其他弱势群体提供翻译,他们的数据与你的数据同样值得保护。

翻译行业正在经历与电子邮件、即时通讯和搜索引擎当年相同的隐私审视。私密翻译所需的技术今天已经存在,问题在于我们是否选择使用它。


Traverba 是一款免费的本地翻译应用,支持 108 种语言,完全离线可用。任何数据都不会离开你的手机。现已上架 Google PlayApp Store。了解更多请访问 traverba.com