- BrainTools - https://www.braintools.ru -

Как общаться с ИИ и не потерять данные?

Разбудите меня ночью и спросите «что нельзя делать с ИИ», и я отвечу «грузить конфиденциальные данные». Это правило должно быть записано у нас на подкорке как таблица умножения. Должно, но не факт, что оно срабатывает во всех 100% случаев, тем более если играться с ИИ не в рабочих, а личных целях. Ну что такого может случиться, если я просто попрошу модель перевести кусок текста с эльфийского синдарина на обычный человеческий?

Если вы такой же тревожный параноик, как я, то внутри для вас несколько простых настроек для чатов с ИИ, чтобы спать спокойно. Да, это не абсолютная гарантия, что ничего никуда не утечет и модель ничему от вас не научится, но, как говорится, береженого Бог бережет.

А еще я покажу полный цикл подключения вашего ключа в ИИ-клиент на примере ChatBox. Будет интересно тем, кто только начинает свое знакомство с миром ИИ и хочет попробовать безопасно внедрить его в свои процессы.

Как общаться с ИИ и не потерять данные? - 1

Всем привет! С вами бэкенд-разработчик из команды Evolution Bare Metal [1]в Cloud.ru. Я, как и все большее количество людей, увлекаюсь всякими ИИ-штуками и, как человек, заботящийся о своем бюджете, все подобные развлечения хочется за ноль рублей. Да, вариантов бесплатного (ну или почти) доступа к ИИ достаточно, но надо понимать, что возможности обезопасить себя и свои данные в бесплатных версиях куда скромнее, чем в платных, но все-таки они есть.

В общем долой лирику, перейду сразу к главному.

Базовая гигиена при работе с ИИ

Начнем с суровой правды: полностью избежать опасности утечки данных при работе с популярными общедоступными моделями нельзя (ChatGPT, ГигаЧат, Gemini и тд.), это факт. Как минимум, переписки в ИИ-чатах проверяются на этичность и безопасность. Их сканируют автоматические фильтры, а часть диалогов попадает на ручную проверку сотрудникам и подрядчикам поставщиков моделей. Кроме того, в корпоративных аккаунтах историю могут видеть администраторы организации, а в отдельных случаях — правоохранительные органы по запросу.

Вот самый базовый минимум того, что вы можете сделать, чтобы не сливать ваши данные в ИИ.

Отключите передачу данных, чтобы модель не обучалась на ваших диалогах
Как это сделать по шагам — описываю ниже [2]. Здесь важно сказать, что это действие только на будущее, то есть информация из старых чатов уже могла быть использована для переобучения нейросети. Еще такой момент: если вы подключили к модели, например, какой-нибудь мессенджер, то в нем тоже надо отключить передачу персональных данных. Также стоит следить за обновлениями пользовательских соглашений, там все может поменяться в любой момент.

Маскируйте данные
Замените конфиденциальные данные заглушками вида {номер телефона}, {имя} и тд. Если данных много и руками их обрабатывать не хочется, есть готовые инструменты, чтобы автоматизировать эту задачу, например Redacto [3] или Гарда Маскирование [4]. Только в этом случае надо помнить, что результат надо проверять все-равно вручную, потому что алгоритм может ошибаться: пропустить значение, неправильно определить тип данных или в принципе заменить что-то не то.

Удаляйте чаты и начинайте новые сессии
Чем длиннее диалог, тем больше связанной приватной информации остается в кеше модели. В случае утечки или взлома аккаунта злоумышленники получат огромный массив данных о вас, вашем проекте или кодовой базе. Поэтому старые чаты важно регулярно удалять, а для новых задач открывать свежие сессии.

Чтобы при этом не приходилось каждый раз заново настраивать ИИ под себя, задавайте требуемое поведение [5] нейросети прямо в первом промпте. А в некоторых сервисах, например Gemini или ChatGPT, можно один раз создать кастомного бота с преднастроенными инструкциями, он как раз избавит от необходимости задавать поведение [6] и обучать модель в диалогах.

Остерегайтесь уязвимостей
При скачивании моделей из открытых источников, например из Hugging Face, следите за тем, чтобы не было вредоносных инъекций в файлах по типу .pkl.

Вредоносная инъекция простым языком — это вирус, внедренный в модель. Чтобы проверить, что все чисто, можно использовать утилиты, например Model Scanner от HiddenLayer [7].

Также старайтесь скачивать популярные модели от известных авторов во избежание скрытых сборов данных и запросов в сеть.

Пример небезопасного файла в модели в библиотеке Hugging Face

Пример небезопасного файла в модели в библиотеке Hugging Face

Проверяйте то, что отправляете в модель
Если берете готовый промпт с какого-нибудь сайта, надо быть готовыми к неприятному сюрпризу: опасная команда может быть зашита где-то в середине длинного промпта или вообще быть невидимой, потому что покрашена в цвет фона страницы. Поэтому лучше сначала скопировать промпт в Word и применить один цвет ко всему тексту — так все тайное станет явным.

Максимально проверяйте результат генерации ИИ
Если вам нужно сгенерить картинку, например, для рекламы, убедитесь, что на ней нет персонажей, значков и лого, на которые у кого-то уже есть авторские права. То есть нельзя просить ИИ изобразить персонажей Nintendo, потому что Nintendo в праве заявить о своих правах. Стоит проверить результат генерации через поиск по изображению в Яндексе или Гугле.

Важно понимать, что с авторским правом в ИИ сфере все совсем не просто, подробнее эту проблему разбирал мой коллега из команды юристов в этой статье [8].

Этих рекомендаций должно быть достаточно для начала :) Если знаете еще какие-то полезные настройки, напишите в комментариях.

Как выключить передачу данных в бесплатных моделях

Спойлер: абсолютно все модели используют диалоги для обучения [9], но не во всех моделях можно ограничить передачу данных.

Вот список самых популярных поставщиков и мини-инструкции к ним.

OpenAI (ChatGPT)

Используются ли данные для обучения модели — используются [10].

Как отключить передачу данных
Зайти в настройки —> управление данными и выключить функцию «Совершенствовать модель для всех».

Как общаться с ИИ и не потерять данные? - 3

В крайнем случае можно написать напрямую [11] в компанию с запросом на удаление информации о переданных ваших данных в чатах. Хоть реальных случаев, когда кто-то так делал, я не знаю, но по условиям ToS информация о вас не должна быть передана, однако у модераторов доступ все равно сохранится.

Как общаться с ИИ и не потерять данные? - 4

Google (Gemini)

Используются ли данные для обучения модели — используются [12].

Как отключить передачу данных
Ограничить передачу данных можно через отключение чатов, но тогда все диалоги будут удаляться автоматически через 72 часа после создания, а старые чаты, созданные до установки ограничения, так и будут продолжать использоваться – их лучше удалить вручную.

Идем в настройки —> история (в мобильном приложении сразу следующий пункт) —> история действий в приложении Gemini —> выключаем параметр.

Как общаться с ИИ и не потерять данные? - 5

DeepSeek

Используются ли данные для обучения модели — используются [13].

Как отключить передачу данных
Идем в настройки —> данные —> выключаем функцию «Улучшите модель для всех».

Здесь та же история со старыми чатами – даже с выключенной передачей данных они будут доступны для модерации разработчику модели в течении нескольких дней.

Как общаться с ИИ и не потерять данные? - 6

Anthropic (Claude)

Используются ли данные для обучения модели — используются [14].

Как отключить передачу данных
Идем в настройки —> раздел Privacy —> выключаем две функции: Location Metadata и Help improve our AI models.

В Claude старые чаты после выключения передачи данных не будут доступны для обучения модели, если этот процесс уже не начался. Но они будут доступны для модерации.

Как общаться с ИИ и не потерять данные? - 7

Сбер (GigaChat)

Используются ли данные для обучения модели — используются [15].

Как отключить передачу данных
В веб-чате и мобильном приложении никак 😊

Яндекс (Алиса AI)

Используются ли данные для обучения модели — используются [16].

Как отключить передачу данных
Нужно зайти в Яндекс ID, потому что напрямую из приложения отключить передачу данных не получится. Путь такой: безопасность —> управление доступами —> Алиса —> отключить функцию «Помогите Алисе стать лучше».

Как общаться с ИИ и не потерять данные? - 8
Как общаться с ИИ и не потерять данные? - 9

Локальный запуск. Самая безопасная модель — на вашем компьютере

Локальное развертывание модели на собственном ПК или сервере на каком-нибудь хостинге – это самый безопасный из возможных вариантов, хотя тут тоже есть свои подводные камни.

Подготовка

Для запуска модели на своем ПК потребуется Ollama (есть и другие софты, но он один из самых популярных), там есть документация [17] о том, как установить и добавить нужные модели. Тут уже по умолчанию предлагается большой выбор моделей для загрузки. Ollama поддерживает модели, у которых есть версия в формате GGUF, вы можете скачать их из библиотеки Hugging Face, они также считаются наиболее безопасными.

С самой моделью после развертывания можно общаться через чат-интерфейс как с любым чат-ботом. При запуске приложения также поднимается сервер, который можно указать в любом ИИ-клиенте для подключения модели в этот клиент.

Важно сказать, что локальное поднятие модели требует больших вычислительных мощностей ПК, а еще лучше отдельного сервера, который вы можете, например, арендовать в облаке [18].

Также хорошей практикой будет запуск модели в отдельном Docker-контейнере для еще большей изоляции ИИ от вашего ПК.

Давайте пройдем базовый процесс запуска локальной модели вместе:

Качаем Ollama [19] и открываем приложение.

Как общаться с ИИ и не потерять данные? - 10

Чтобы выбраться из сильно ограниченного выбора моделей, скачаем что-нибудь из библиотеки Ollama [20]. Например, возьмем самую простенькую модель [21] для демонстрации.

Откроем терминал и скачаем введя в терминале команду

ollama pull llama3.2:1b
Как общаться с ИИ и не потерять данные? - 11

Видим сообщение success, а значит, все готово. Возвращаемся в приложение. Видим, что скачанная модель появилась в доступных.

Как общаться с ИИ и не потерять данные? - 12

Давайте что-нибудь напишем.

Как общаться с ИИ и не потерять данные? - 13

Готово. Модель развернута локально и данные никуда дальше моего компьютера не уходят.

Для этой мини-инструкции я скачал очень маленькую модель. Для реальной работы стоит качать модели побольше, например qwen3-coder:30b, qwen3.6:35b, но на эти модели требуется большой объем оперативной памяти [22], хотя бы от 40 ГБ. Из варианта попроще можно посмотреть на llama3.1:8b (8 ГБ оперативной памяти), а еще лучше сразу поискать модели конкретно под ваши нужды.

Подключение API

Я работаю в компании-облачном провайдере, поэтому инструкцию покажу на сервисах Cloud.ru. Но вы можете повторить шаги в принципе в любом облаке.

Покажу, как подключить API-ключ на примере open source решения — популярного у нас в компании кроссплатформенного ИИ-клиента ChatBox и воспользуюсь нашим сервисом Evolution Foundation Models [23].

Качаем приложение ChatBox [24] и после установки заходим в настройки.

Как общаться с ИИ и не потерять данные? - 14

Далее открываем вкладку «Поставщик модели».

Как общаться с ИИ и не потерять данные? - 15

Здесь мы можем подключить все популярные модели, введя API-ключ, полученный на официальном сайте поставщика. Если у вас есть ключ, то все просто:

  1. найдите поставщика, у которого вы получили ключ;

  2. вставьте ключ в поле «API-ключ»;

  3. проверьте на какой-нибудь модельке.

В этом случае можно закрыть меню настроек, перейти в чат и начать использование. Но советую прочитать дальше, так как там больше интересных возможностей ChatBox.

Как общаться с ИИ и не потерять данные? - 16

Если поставщик не представлен в ChatBox по умолчанию, то нажимаем «Добавить» и вводим название своего поставщика или любое название, которое будет для вас понятным. Режим API — «Совместимо с API OpenAI».

Как общаться с ИИ и не потерять данные? - 17

Далее заполняем поля «API-ключ» и «Хост API» (информация о нем должна быть на сайте поставщика).

Как общаться с ИИ и не потерять данные? - 18

Затем нажимаем «Получить», тут подтянутся все доступные у поставщика модели. Для примера выберем следующие: zai-org/GLM-5.1, Qwen/Qwen3-Embedding-0.6B, Qwen/Qwen3-Reranker-0.6B, нажав на зеленый плюсик.

Как общаться с ИИ и не потерять данные? - 19

Затем нам нужно слегка подредактировать модели. Нажимаем на шестеренку у модели. Для GLM-5.1 ставим три галочки на «Видение», «Логика», «Использование инструментов». Оставляем «Тип модели» — «Чат». Также тут можно указать окно контекста (размер хранимой истории сообщений).

Как общаться с ИИ и не потерять данные? - 20

Для Qwen3-Embedding выставляем «Тип модели» — «Векторное представление», это нужно для последующей работы с RAG (локальной базой данных на основе документов и файлов).

Как общаться с ИИ и не потерять данные? - 21

И для Qwen3-Reranker выставляем «Тип модели» — «Переранжировать», также для RAG.

Как общаться с ИИ и не потерять данные? - 22

Затем возвращаемся в настройки и выбираем «База знаний», это и есть наш RAG.

Как общаться с ИИ и не потерять данные? - 23

Тут как-нибудь называем нашу базу знаний. Выбираем модель эмбединга, там как раз будут предложены Qwen3-Embedding и Qwen3-Reranker.

Как общаться с ИИ и не потерять данные? - 24

И наконец перетаскиваем или загружаем сюда нужные файлы. Я загрузил документацию по фотоаппарату.

Как общаться с ИИ и не потерять данные? - 25

Теперь попробуем обратится к модели и нашей новой базе сразу. Обязательно нажимаем на иконку книжки в окне чата и выбираем нашу базу знаний. А справа в окне чата выбираем модель.

Как общаться с ИИ и не потерять данные? - 26

Делаем запрос. Как видно, моделька ходит в нашу базу знаний, чтобы взять оттуда информацию.

Как общаться с ИИ и не потерять данные? - 27

Та-да! Мы получили ответ.

Как общаться с ИИ и не потерять данные? - 28

Еще можно поэкспериментировать с настройками чатов: заранее задать поведение для чата, выставить максимальный размер контекста или температуру (влияет на случайность [25] ответа модели).

Подведем итоги

Бесплатные нейросети — это удобный и доступный инструмент, но за эту бесплатность мы платим своими данными, а иногда и данными, и деньгами. Все основные поставщики (как зарубежные, так и отечественные) используют наши данные для обучения моделей. Возможность полностью отключить передачу данных есть у многих, но не у всех. И даже там, где эта возможность есть, данные все равно уходят на модерацию или сохраняются в логах.

Полностью исключить риск утечки данных при работе с моделями нельзя. Но можно его минимизировать: использовать плейсхолдеры вместо реальных данных, регулярно очищать чаты, проверять скачиваемые модели на вредоносные инъекции и внимательно читать то, что отправляете в модель.

Самый приватный вариант – это локальное развертывание модели через Ollama (желательно в Docker-контейнере). Но он требует вычислительных мощностей и некоторой технической подготовки.

Если вам требуется конфиденциальность — собирайте свой ИИ-клиент (по типу ChatBox) с платным API-ключом, запускайте модель локально или на выделенном сервере. А если пользуетесь бесплатными сервисами, соблюдайте базовые правила цифровой гигиены и помните: ваши данные — ваша ответственность.

Автор: AcidBliss

Источник [26]


Сайт-источник BrainTools: https://www.braintools.ru

Путь до страницы источника: https://www.braintools.ru/article/35005

URLs in this post:

[1] Evolution Bare Metal : https://cloud.ru/products/evolution-bare-metal?utm_source=habr&utm_medium=article&utm_campaign=bezopasnost_v_eru_ai_03092026

[2] описываю ниже: #%D0%BD%D0%B0%D1%81%D1%82%D1%80%D0%BE%D0%B9%D0%BA%D0%B8%20%D1%87%D0%B0%D1%82%D0%BE%D0%B2

[3] Redacto: https://redactoapp.ru/

[4] Гарда Маскирование: https://garda.ai/products/data-protection/datamasking

[5] поведение: http://www.braintools.ru/article/9372

[6] поведение: http://www.braintools.ru/article/5593

[7] Model Scanner от HiddenLayer: https://www.hiddenlayer.com/solutions/model-scanning

[8] статье: https://habr.com/ru/companies/cloud_ru/articles/936446/

[9] обучения: http://www.braintools.ru/article/5125

[10] используются: https://openai.com/ru-RU/policies/row-privacy-policy/

[11] написать напрямую: https://privacy.openai.com/policies/ru/

[12] используются: https://support.google.com/gemini/answer/13594961

[13] используются: https://cdn.deepseek.com/policies/en-US/deepseek-privacy-policy.html

[14] используются: https://privacy.claude.com/ru/articles/7996868-%D0%B8%D1%81%D0%BF%D0%BE%D0%BB%D1%8C%D0%B7%D1%83%D1%8E%D1%82%D1%81%D1%8F-%D0%BB%D0%B8-%D0%BC%D0%BE%D0%B8-%D0%B4%D0%B0%D0%BD%D0%BD%D1%8B%D0%B5-%D0%B4%D0%BB%D1%8F-%D0%BE%D0%B1%D1%83%D1%87%D0%B5%D0%BD%D0%B8%D1%8F-%D0%BC%D0%BE%D0%B4%D0%B5%D0%BB%D0%B8

[15] используются: https://developers.sber.ru/docs/ru/policies/gigachat-agreement/individuals

[16] используются: https://aistudio.yandex.ru/ru/security

[17] документация: https://docs.ollama.com/quickstart

[18] арендовать в облаке: https://cloud.ru/products/evolution-compute?utm_source=habr&utm_medium=article&utm_campaign=bezopasnost_v_eru_ai_03092026

[19] Качаем Ollama: https://ollama.com/download

[20] из библиотеки Ollama: https://ollama.com/library

[21] простенькую модель: https://ollama.com/library/llama3.2

[22] памяти: http://www.braintools.ru/article/4140

[23] Evolution Foundation Models: https://cloud.ru/products/evolution-foundation-models?utm_source=habr&utm_medium=article&utm_campaign=bezopasnost_v_eru_ai_03092026

[24] Качаем приложение ChatBox: https://chatboxai.app/en/guide/getting-started/download

[25] случайность: http://www.braintools.ru/article/6560

[26] Источник: https://habr.com/ru/companies/cloud_ru/articles/1077298/?utm_source=habrahabr&utm_medium=rss&utm_campaign=1077298

www.BrainTools.ru

Rambler's Top100