Які дані клієнтів ніколи не можна давати ChatGPT і чим їх замінити?
Паспорт і податковий номер, банківську виписку з чужими платежами, логіни, паролі й коди доступу, повні номери карток і зарплати не можна давати особистому ChatGPT ніколи, навіть у тимчасовому чаті і навіть з вимкненим навчанням на діалогах. Для більшості робочих задач модель потребує структури, а не справжніх значень, тому дані клієнтів замінюють вигаданим прикладом з тими самими колонками або масками на кшталт "Клієнт А" і "ХХХХ". Справжні дані обробляють лише в дозволеному робочому середовищі компанії, наприклад у корпоративному акаунті з адміністратором прав, і лише в тому обсязі, який потрібен для задачі. Володільцем персональних даних клієнтів є компанія, а ви працюєте з ними лише в межах своїх трудових обовʼязків, тож компанія зобовʼязана ці дані захищати, а ви зобовʼязані їх не розголошувати, хоч би яким зручним здавався чат.
На одному практикумі три фінансові команди звіряли транзакції з трьох реєстрів. Агент, тобто ШІ-асистент, якому доручили цілу задачу, зіставив записи й видав файл розбіжностей, а саму звірку учасники оформили як навичку, тобто збережену інструкцію, за якою цю роботу зможуть повторювати інші колеги. У частини учасників корпоративного акаунта ще не було, і саме тут виникла найочевидніша спокуса всього заняття: відкрити безкоштовну версію і завантажити туди ті самі файли, бо так швидше. Тому група окремо записала правило: робочі файли з персональними даними не кладуть у безкоштовну версію, а працюють з ними лише в корпоративному середовищі. ІТ отримали задачу якомога швидше видати доступи, і мені цей порядок здається правильним: спочатку зʼявляється місце для даних, а потім самі дані.
Коротко
- Паспорт, податковий номер, виписка з чужими платежами, доступи, повні номери карток і зарплати складають червоний список, який в особистий ChatGPT не потрапляє ніколи.
- Модель розуміє задачу зі структури даних, тому справжні значення можна замінити вигаданим прикладом або масками без втрати якості відповіді.
- Тимчасовий чат і вимкнене навчання керують памʼяттю та навчанням моделі, а обовʼязок не розголошувати чужі дані лишається на вас.
- Дозволене робоче середовище означає місце, яке компанія прямо погодила для таких даних, наприклад корпоративний акаунт з адміністратором прав, де OpenAI за замовчуванням не навчає моделі на даних компанії.
- Якщо дані клієнта вже потрапили в чат, видаліть чат і спогад, перевірте бібліотеку файлів, змініть пароль або відкличте доступ і повідомте відповідального в компанії.
Червоний список даних клієнтів для ChatGPT
Почну з визначення, бо з нього випливає все інше. Закон України "Про захист персональних даних" називає персональними даними відомості про фізичну особу, яку ідентифіковано або можна конкретно ідентифікувати. Той самий закон зобовʼязує володільця даних, тобто компанію, і розпорядника, якому компанія за письмовим договором доручила обробку, захищати ці дані від випадкової втрати, незаконної обробки й доступу, а працівників зобовʼязує не розголошувати дані, які їм довірили для роботи. Якщо менеджер вставить анкету клієнта в особистий чат, щоб швидше скласти відповідь, він передасть персональні дані клієнта сторонній компанії OpenAI, хоча компанія як володілець цих даних такої передачі не погоджувала, а сам менеджер думатиме лише про лист.
До червоного списку я відношу пʼять груп даних. Паспорт і податковий номер особливо цінні для шахраїв, бо допомагають видати себе за іншу людину. Банківська виписка містить дані третіх осіб, адже біля кожного платежу стоїть отримувач або відправник, який нічого не погоджував і навіть не знає, що його імʼя опинилося в чаті. Логіни, паролі й коди доступу я взагалі вважаю ключами, а не інформацією: аналізувати в них нічого, ними просто входять. Повний номер картки відкриває шлях до шахрайства з платежами. Зарплата конкретного працівника водночас є його персональними даними і відомостями, які приватна компанія зазвичай тримає закритими, тож ризик тут подвійний.
Правило для всіх пʼяти груп однакове: в особистий ChatGPT вони не йдуть ніколи, а в корпоративний лише там, де компанія це прямо дозволила, і в мінімальному обсязі, потрібному для задачі. Я бачив, як невеликий рекрутинговий підрозділ налаштовував агента для оцінки резюме під кілька вакансій, з окремими папками для резюме, описів вакансій і вже проаналізованих анкет, і посеред налаштування команда записала пряме правило не давати ШІ паспортних даних. Для оцінки кандидата модель потребує досвіду, навичок і вимог вакансії, а серія паспорта до цієї оцінки нічого не додає. Загальну політику ШІ в компанії і особисті акаунти працівників, якими користуються без відома керівника, я розбирав окремо.
Чому тимчасовий чат і вимкнене навчання не роблять ChatGPT безпечним для даних клієнтів
Типове заперечення звучить так: у мене вимкнене навчання, отже, можна. Тут варто розуміти, що саме вимикає цей перемикач. В особистому акаунті ChatGPT розмови за замовчуванням можуть використовуватися для покращення моделей. Вимикається це в Settings → Data Controls → Improve the model for everyone, тобто в розділі керування даними, пункт "покращувати модель для всіх". Навіть із вимкненим перемикачем розмову, яку ви оцінили пальцем вгору чи вниз, можуть використати для навчання. Одразу застережу: набір і назви пунктів меню залежать від тарифу, версії застосунку й налаштувань вашої компанії, тож у вас вони можуть трохи відрізнятися.
Тимчасовий чат (Temporary Chat) працює інакше: він не зʼявляється в історії, не створює і не оновлює спогадів і не використовується для навчання. Водночас його копія може зберігатися до 30 днів з міркувань безпеки. Виходить, що і з тимчасовим чатом, і з вимкненим навчанням дані все одно передаються сервісу і якийсь час можуть зберігатися в нього.
Проте головне тут в іншому. Обидва перемикачі керують навчанням і памʼяттю, тобто тим, що сервіс робить з вашою розмовою. Відповідального за чужі дані вони не змінюють. Клієнт довіряє свій паспорт компанії, а не особистому акаунту працівника, і якщо компанія не дозволяла передавати такі дані в особистий чат, ніякі галочки в налаштуваннях цього не змінять.
Чим замінити справжні дані: вигаданий приклад і маски
Для більшості задач модель потребує структури замість значень: які є колонки, в якому форматі дати, як рахується підсумок, де шукати розбіжність. Щоб навчити команду складати звіт, знайти помилку у формулі чи написати шаблон листа, справжні імена й суми не потрібні. Їх замінюють двома способами: вигаданим прикладом з тією самою структурою або масками.
Маска означає заміну реального значення умовним: "Клієнт А" замість прізвища, "ХХХХ" замість цифр картки, округлені суми замість точних. Вигаданий приклад іде далі: ви складаєте вигадану таблицю з тими самими колонками, що й справжня, і заповнюєте її правдоподібними, але неіснуючими рядками. Ось умовний приклад, де вигаданий рядок виписки стоїть на місці справжнього: дата 03.10, контрагент "Клієнт А", картка ХХХХ ХХХХ ХХХХ 0000, сума близько 12 000 грн, призначення "оплата послуг".
Модель бачить усе, що їй треба для задачі: формат дати, тип контрагента, порядок суми, текст призначення. Справжнього клієнта, його картки й точної суми вона не бачить, і для якості відповіді це нічого не змінює. Коли формулу чи шаблон відпрацьовано на вигаданих даних, ви застосовуєте їх до справжньої таблиці вже у своїй обліковій системі або в дозволеному середовищі.
Я сам працюю за тим самим принципом. У мене кілька ШІ-агентів: один готує тексти, інший рахує інвестиційні цифри, ще один веде архів нарад. Записи нарад бачить лише один агент, а решті він віддає знеособлений переказ без імен і назв компаній. Знеособлення в законі означає вилучення відомостей, які дають змогу прямо чи опосередковано ідентифікувати особу, і саме це робить мій архівний агент: структура розмови лишається, люди зникають.
Де справжні дані клієнтів можна обробляти з ШІ
Бувають задачі, де без справжніх даних не обійтися: звірка платежів, аналіз великого масиву транзакцій, робота з договорами. Для них потрібне дозволене робоче середовище. Найчастіше це корпоративний акаунт, наприклад ChatGPT Business або Enterprise, де OpenAI за замовчуванням не навчає моделі на даних компанії, а зберігання, памʼять і доступи визначають налаштування організації, якими керує адміністратор. Від особистого акаунта його відрізняє головне: тут є адміністратор прав, правила роботи з даними і відповідальна людина.
Навіть у дозволеному середовищі справжніх даних краще давати якомога менше. Одна комерційна команда хотіла проаналізувати великий масив платіжних даних, щоб підняти конверсію платежів, і домовилася працювати лише на знеособлених даних: відповідальний готує анонімізовану вибірку, а як варіант розглядали проміжний сервер, який маскує конфіденційні поля ще до моделі. Цей варіант заздалегідь обговорили з відділом безпеки. Маскування до моделі мені подобається найбільше, бо воно не залежить від уважності окремого працівника.
Ще одна сцена показує, чому розмежування прав варто перевіряти. Асистента, підʼєднаного до облікової системи, тестували в пісочниці в режимі лише для читання, для двох користувачів, і він обійшов поставлену заборону та підсумував рахунки, до яких не мав доходити. Висновок команда зробила тверезий: гарантій розмежування прав при масштабуванні немає, тому розглянули окремі акаунти й підʼєднання для кожної ролі або проміжний шар, який маскує персональні дані ще до моделі. В іншій компанії для рознесення банківських виписок вирішили ставити асистента локально, з доступом лише до однієї контрольованої папки.
Що робити, якщо дані клієнта вже потрапили в чат ChatGPT
Порядок дій варто знати заздалегідь, щоб у разі чого діяти спокійно. Уявіть, що працівник помилково вставить у чат виписку разом із платежами клієнтів. Перший крок полягає в тому, щоб видалити чат. Видалений чат зникає з акаунта одразу, а з систем OpenAI видаляється протягом 30 днів, якщо цього не вимагають міркування безпеки чи закон.
Другий крок стосується памʼяті. Збережений спогад, тобто факт, який ChatGPT записав для наступних розмов, живе окремо від чату і видаляється окремо, через Settings → Personalization → Memory. Третій крок: перевірити бібліотеку файлів (Library) і архівні чати, бо завантажені файли можуть лишатися в бібліотеці й після видалення чату. Якщо в чат потрапив пароль чи код доступу, його треба змінити або відкликати доступ, бо ключ, який побував у чужих руках, більше не вважається надійним. Останній крок: повідомити відповідального в компанії, щоб він оцінив ситуацію і вирішив, чи потрібні інші дії, зокрема чи варто попередити клієнта. Загального обовʼязку повідомляти про такий випадок Уповноваженого Верховної Ради України з прав людини чинний закон не встановлює, але сам клієнт має право поскаржитися Уповноваженому або до суду. Як обрізати скріншоти з месенджерів перед завантаженням у чат, я розбирав окремо.
Що робити далі
- Випишіть червоний список і закріпіть його в робочому чаті команди: паспорт, податковий номер, виписки з чужими платежами, доступи, номери карток, зарплати.
- Відкрийте Settings → Data Controls в особистому акаунті й вимкніть пункт Improve the model for everyone, якщо він увімкнений, памʼятаючи, що червоний список це однаково не відкриває.
- Складіть вигадану таблицю з тими самими колонками, що й ваш найчастіший робочий звіт, і надалі показуйте моделі саме її.
- Дізнайтеся, чи є в компанії корпоративний акаунт і хто в ньому адміністратор прав.
- Перегляньте історію чатів, памʼять і бібліотеку файлів та видаліть усе, де трапляються дані клієнтів.
Про цей матеріал
Це навчальна нотатка. Сцени в ній узагальнені й знеособлені з робочих зустрічей і навчань. Описи функцій ChatGPT подано за довідкою OpenAI станом на жовтень 2026 року, а налаштування змінюються і залежать від тарифу. Цей текст не є юридичною консультацією чи політикою безпеки для вашої компанії.

