Короче, пробовал давать разные тексты в ChatGPT и кое-что подмечал. Персональные данные — точно табу, не стоит пихать номера паспортов, адреса, телефоны. Даже если нейросеть вроде и не хранит чётко, в истории или логах потом может всплыть. Ещё не советую кидать приватные пароли или ключи от сервисов — вдруг утечка. Если работаете с кодом, то секретные API-ключи тоже лучше подчищать.
Ещё момент — коммерческую или конфиденциальную инфу: договоры, внутренние документы. Лучше обезличивать или вытаскивать только общие части, иначе рискуете, что она потом где-то появится в ответах. Иногда видел, что нейросети могут случайно выдать часть того, что видели раньше, если это в токсичных данных. Так что лучше проверять, что ты загружаешь.
Чтобы не париться, я иногда просто прогоняю текст через скрипт на поиск приватных данных — ну или самому быстро глянуть, нет ли там сведений, которые попадать не должны. Как у вас с этим? Кто-то настраивает какие-то фильтры или есть простые лайфхаки для защиты своих данных при работе с AI?