Почему ваше приложение-переводчик не должно отправлять данные на сервер

В прошлом году немецкая больница была оштрафована на 460 000 евро за нарушение GDPR. Причиной стал не традиционный взлом данных. Сотрудник использовал Google Translate для перевода медицинских карт с турецкого на немецкий. История болезни пациента, диагноз и записи о лечении были отправлены на серверы Google для обработки.

Больница утверждала, что перевод был необходим для оказания медицинской помощи. Регулятор настаивал на том, что передача идентифицируемых медицинских данных американской технологической компании без явного согласия нарушает статью 9 GDPR. Регулятор выиграл.

Это не исключительный случай. Это закономерный результат простого факта, который большинство людей упускают из виду: каждый раз, когда вы пользуетесь облачным переводчиком, переводимый текст отправляется на чужой сервер и обрабатывается там.

Что происходит с вашим переведённым текстом

Когда вы вводите текст или говорите в Google Translate, данные передаются на серверы Google, обрабатываются их нейронной системой машинного перевода, и результат возвращается на ваше устройство. В политике конфиденциальности Google говорится, что компания может использовать эти данные для «улучшения сервисов Google».

Что означает «улучшение сервисов» на практике? Это означает, что ваш переведённый текст может использоваться для обучения будущих моделей перевода. Это означает, что паттерны ваших переводов анализируются. Это означает, что данные хранятся на серверах Google и подпадают под действие законодательства США, включая возможные запросы со стороны государственных органов.

Microsoft Translator работает по схожей модели. iTranslate использует облачные API. DeepL обрабатывает данные на своих серверах (компания заявляет, что удаляет данные после перевода, но они всё равно покидают ваше устройство).

Для бытовых переводов вроде «что означает этот пункт меню» такой компромисс вполне приемлем. Для чего-либо чувствительного — нет.

Проблема конфиденциального перевода

Подумайте, что люди реально переводят:

  • Медицинскую информацию — пациенты переводят симптомы, диагнозы, рецепты, результаты анализов
  • Юридические документы — договоры, миграционные анкеты, судебную переписку
  • Деловую переписку — переговоры, обсуждения внутренней стратегии, финансовые условия
  • Личные сообщения — приватные переписки с родственниками, партнёрами, друзьями
  • Взаимодействие с государством — налоговые формы, визовые заявления, общение с социальными службами

Каждая из этих категорий содержит информацию, которую люди обоснованно считают личной. Тем не менее миллионы людей регулярно пропускают всё это через облачные переводческие сервисы, не осознавая, куда попадают их данные.

По данным опроса Cisco 2024 года, 48% сотрудников вставляют конфиденциальные корпоративные данные в инструменты на основе ИИ, включая переводческие сервисы. Отдельное исследование Cyberhaven показало, что 11% данных, вставленных в ChatGPT (который разделяет архитектурные концепции с облачными переводчиками), было конфиденциальным.

Проблема не в том, что Google или Microsoft что-то злоумышленно делают с вашими данными. Проблема в том, что сама архитектура создаёт риск. Данные в процессе передачи могут быть перехвачены. Хранящиеся данные могут быть взломаны. Данные на сторонних серверах подпадают под юрисдикции, которые вы не выбирали.

Альтернатива: перевод на устройстве

Перевод на устройстве полностью устраняет этот класс рисков, поскольку данные никуда не отправляются.

Идея проста: вместо того чтобы телефон выступал тонким клиентом, передающим текст на облачный сервер, модели перевода работают непосредственно на процессоре вашего телефона. Ваш голос распознаётся локально. Ваш текст переводится локально. Снимки с камеры обрабатываются локально. Ничего не покидает устройство.

Ещё недавно это было нереализуемо на практике: модели перевода были слишком большими, а телефоны — слишком медленными. Ситуация изменилась. Современные смартфоны оснащены нейронными процессорами (NPU), способными запускать квантизированные модели ИИ с производительностью, сопоставимой с облачными сервисами. Такие модели, как Gemma (2 миллиарда параметров), Whisper и Parakeet, обеспечивают качество, сравнимое с облачными сервисами, при этом умещаясь в памяти телефона.

Traverba построена полностью на этой архитектуре. Все 108 языков, распознавание речи, OCR через камеру, перевод экрана и даже групповые беседы через Bluetooth работают без подключения к серверу. Гарантия конфиденциальности здесь — не обещание в политике («мы не будем смотреть на ваши данные»), а архитектурная гарантия: ваши данные физически не могут покинуть устройство, потому что не существует сервера, на который их можно было бы отправить.

Кому приватный перевод нужен больше всего

Медицинские работники и пациенты — медицинский перевод является одним из самых распространённых сценариев использования и одним из самых чувствительных. Медсестра, использующая Google Translate для общения с пациентом, не говорящим по-английски, тем самым передаёт защищённую медицинскую информацию на серверы Google. При переводе на устройстве разговор остаётся в пределах палаты.

Юристы и правоведы — адвокатская тайна не распространяется на сторонние серверы. Можно утверждать, что перевод привилегированных сообщений через облачные сервисы нарушает режим профессиональной тайны. Перевод на устройстве сохраняет конфиденциальность привилегированных данных.

Бизнес-специалисты — коммерческие тайны, переговорные позиции, финансовые данные и стратегические планы регулярно подвергаются переводу. Облачный перевод означает, что копия этих сведений оказывается вне контроля вашей организации.

Мигранты и беженцы — одними из наиболее уязвимых пользователей переводческих сервисов являются люди, общающиеся с миграционными органами, заполняющие заявления об убежище или переводящие юридические документы, от которых зависит их судьба. Они, как правило, меньше всего способны оценить риски для конфиденциальности и больше всего теряют в случае утечки данных.

Журналисты и активисты — в странах с развитой слежкой облачный перевод создаёт запись того, что вы читаете и о чём общаетесь. Перевод на устройстве не оставляет следов.

Пережившие домашнее насилие — перевод сообщений о планировании безопасности, местах убежищ или юридических возможностях через облачные сервисы создаёт информационный след, который может быть доступен через общие аккаунты или в ходе судебного разбирательства.

Аспект соответствия требованиям

Для организаций последствия с точки зрения соответствия нормативным требованиям очевидны:

  • GDPR (ЕС) — передача персональных данных на серверы в США требует надлежащих гарантий. Решение Schrems II упразднило Privacy Shield, сделав облачную обработку данных ЕС в США юридически запутанной.
  • HIPAA (здравоохранение США) — обработка защищённой медицинской информации облачными переводческими сервисами требует заключения Соглашения о деловом партнёрстве (BAA) с поставщиком перевода. Google не предлагает BAA для Google Translate.
  • FERPA (образование США) — перевод сведений об учениках через облачные сервисы может нарушать ограничения FERPA на раскрытие информации.
  • Адвокатская тайна — как было отмечено выше, облачный перевод привилегированных сообщений создаёт риск утраты их конфиденциального статуса.

Перевод на устройстве обходит все эти проблемы, поскольку данные не передаются ни одной третьей стороне.

Вопрос качества

Очевидное возражение: не жертвует ли перевод на устройстве качеством ради конфиденциальности?

Два года назад ответ был однозначным: да. Локальные модели заметно уступали облачным.

В 2026 году разрыв существенно сократился. Для наиболее распространённых языковых пар (английский с испанским, китайским, французским, немецким, японским, корейским, португальским, арабским) локальные модели обеспечивают качество, которое большинство пользователей не могут отличить от облачного перевода в повседневном использовании. Разрыв сохраняется для редких языковых пар и узкоспециализированных областей, однако для 90% реальных задач локальное качество вполне пригодно для практического применения.

Traverba специально направляет языки в специализированные модели (Parakeet для английского, Qwen3 для CJK, Whisper для широкого охвата), а не использует одну универсальную модель. Такая оптимизация по языкам позволяет устранить значительную часть оставшегося разрыва в качестве.

Что можно сделать уже сегодня

  1. Проанализируйте свои привычки перевода. Что вы реально переводите? Если это включает что-либо конфиденциальное — медицинскую, юридическую, финансовую или личную информацию — значит, вы подвергаете конфиденциальность риску.

  2. Попробуйте переводчик на устройстве. Traverba бесплатна и работает офлайн с 108 языками. Apple Translate работает локально приблизительно для 20 языков. Протестируйте их на своих типичных сценариях.

  3. Установите политику в организации. Если вы руководите командой, определите, какие переводческие инструменты разрешены для каких уровней конфиденциальности. Облачный перевод для публичного контента допустим. Облачный перевод конфиденциальных данных — нарушение политики, которое рано или поздно произойдёт.

  4. Думайте о тех, для кого вы переводите. Если вы переводите для пациентов, клиентов, студентов или других уязвимых групп, их данные заслуживают той же защиты, что и ваши.

Переводческая отрасль переживает то же переосмысление конфиденциальности, через которое прошли электронная почта, мессенджеры и поисковики. Технология для приватного перевода существует уже сегодня. Вопрос в том, выберем ли мы её.


Traverba — бесплатный переводчик на устройстве, поддерживающий 108 языков с полноценной офлайн-работой. Данные не покидают ваш телефон. Доступен в Google Play и App Store. Узнать больше: traverba.com.