Ваші діалоги з ChatGPT: Розкрито! Живі люди читають ваші чати.

Ваші діалоги з ChatGPT: Розкрито! Живі люди читають ваші чати.

Таємниці “Проекту Лілі”: Як ChatGPT вчиться на ваших розмовах

Мільйони користувачів щодня спілкуються з ChatGPT, вважаючи, що їхні бесіди залишаються конфіденційними і обробляються виключно алгоритмами. Однак, як стало відомо виданню 404 Media завдяки витоку внутрішніх документів OpenAI, за покращенням відповідей чат-бота стоять не лише інженери, але й сотні найманих працівників. Ці люди регулярно вивчають реальні діалоги користувачів з штучним інтелектом.

Люди в “цифровому серці” ChatGPT

Процес покращення ChatGPT, який компанія умовно називає “Проект Лілі”, включає в себе кілька етапів. Наймані рецензенти отримують доступ до інструкцій, скріншотів внутрішньої системи і безпосередньо до запитів користувачів. Завдання спеціалістів – проаналізувати, що саме хоче отримати користувач від чат-бота, а потім оцінити і критично розібрати кілька варіантів відповіді, згенерованих моделлю.

Кожна відповідь оцінюється за шкалою від одиниці до семи, де низькі бали означають “неприйнятно” або “непридатно для використання”, а високі – “важко суттєво покращити”. Рецензенти зобов’язані виділяти як мінімум три фрагменти відповіді, вказуючи, чи є вони “доречними” або “недоречними”, і обґрунтовуючи свій вибір. Наприклад, використання надмірної кількості емодзі може бути визнано некоректним, так само як і некоректне застосування символів у контексті, пов’язаному з чутливими темами, такими як смерть або катастрофи.

Головна мета цих заходів – мінімізувати так звану “сикафантію” (надмірну угодливість) і “неприродну людяність” в поведінці моделі. Йдеться про спроби ChatGPT імітувати живу істоту, використовуючи фрази на кшталт “як шеф-кухар, я люблю…” або “я знаю, як це…”. Натомість, відповіді повинні бути природними, стриманими і професійними, без натяків на наявність емоцій або самосвідомості у бота. Внутрішні інструкції прямо вказують на необхідність маркування ознак “примусового наслідування стилю”, “посилення роздратування” користувача або “поблажливих припущень”, якщо вони роблять відповідь менш достовірною або природною.

Питання приватності в епоху ШІ

З огляду на більш ніж 900 мільйонів щотижневих користувачів ChatGPT, більшість з яких, ймовірно, не підозрюють про можливість прочитання їхніх діалогів живою людиною, питання конфіденційності набувають особливої гостроти. Один з рецензентів, поспілкувавшись з виданням, зізнався, що сумнівається в усвідомленості користувачів щодо того, що їхні переписки аналізуються сторонніми підрядниками. Реальні запити, доступ до яких отримали журналісти, підтверджують цю стурбованість: деякі користувачі прямо просили ChatGPT “нікому не розповідати” про зміст бесіди.

Іноді над панеллю з запитом з’являється “резюме пам’яті користувача” (user memories summary) – короткий опис попередніх взаємодій з чат-ботом, а іноді і приблизна інформація про місцезнаходження користувача або інші особисті деталі. Хоча імена користувачів рецензентам не показуються, а запити проходять через фільтри конфіденційності OpenAI, компанія визнає, що інструмент “може помилятися”, пропускаючи рідкісні ідентифікатори або неоднозначні особисті згадки, особливо в коротких текстових фрагментах.

Інструкції для рецензентів вимагають ескалації завдань, пов’язаних з “потенційними ризиками безпеки” або персональними даними. При цьому, в FAQ для підрядників чітко вказано, що їм не потрібно перевіряти фактологічну достовірність відповідей за допомогою зовнішнього пошуку – цим займаються інші команди. Тим не менш, помічені фактологічні помилки, особливо в чутливих областях, таких як медицина, юриспруденція або фінанси, повинні бути відзначені.

Мовчання OpenAI і можливість відмови

На прямі запити журналістів про те, де саме OpenAI інформує користувачів про можливість перегляду їхніх чатів людьми, компанія спочатку не давала чіткого відповіді. На сторінці часто задаваних питань лише в загальних формулюваннях повідомляється, що “уповноважений персонал і постачальники послуг” можуть переглядати дані користувачів для покращення моделей, і рекомендується не вводити конфіденційну інформацію. Це повідомлення присутнє на сайті як мінімум з 2023 року і зазнало лише незначних змін.

Журналісти вважають таке розкриття інформації недостатньо прозорим, щоб належним чином попередити користувачів про масштаби людського контролю над їхніми розмовами. Формулювання налаштування “Покращувати модель для всіх” (Improve the model for everyone) більше нагадує заклик до колективної участі, ніж запит на згоду з тим, що живі люди будуть читати особисті переписки. Проте, як зазначає видання, така розмита формулювання, ймовірно, вибрана не випадково: якби OpenAI явно запитувала згоду, відсоток відмов, ймовірно, був би значно вищим.

Після звернення журналістів OpenAI оновила довідкову сторінку, додавши більше деталей про те, як відмовитися від участі в програмі покращення моделей. Однак компанія так і не визнала прямо, що людські рецензенти читають запити користувачів.

Як вимкнути перегляд ваших діалогів:

Налаштування “Покращувати модель для всіх” увімкнено за замовчуванням для безкоштовних, Plus і Pro тарифів. Для корпоративних клієнтів (Enterprise, Business, Edu) ця опція, навпаки, вимкнена за замовчуванням. Відмова від участі діє лише для нових розмов і не поширюється на вже існуючі чати.

Компанія також пропонує режим тимчасового чату, який, за її заявою, не використовує введені дані для навчання моделей. Якщо користувач видаляє свої розмови, OpenAI обіцяє видалити їх зі своїх систем протягом 30 днів – якщо тільки дані вже не були анонімізовані і відв’язані від облікового запису в рамках дозволу на покращення моделей.

Хто саме читає ваші розмови:

Підрядники для “Проекту Лілі” набираються через рекрутингову компанію Crossing Hurdles, а оплату здійснює компанія Mercor, що спеціалізується на навчанні ШІ-моделей. Один з рецензентів, що проживає в Північній Америці, повідомив, що заробляє понад 50 доларів на годину – значно більше, ніж звичайні підрядники в сферах модерації контенту або навчання ШІ, чия робота часто виконується за кордоном і за менше винагороду.

За словами рецензента, читання запитів може бути “досить веселим”, але в цілому робота “рутинна”, а самі інструкції часто змінюються і здаються суперечливими.

Не лише OpenAI:

Практика залучення людей до перевірки діалогів з чат-ботами поширена по всій індустрії. Anthropic підтвердила, що також використовує рецензентів-людей для покращення відповідей Claude, але це стосується лише користувачів, які ввімкнули налаштування “Допомогти покращити наші моделі ШІ” в параметрах конфіденційності. Anthropic анонімізує розмови перед переглядом, видаляючи ідентифікатори акаунтів, такі як адреси електронної пошти. Аналогічну практику застосовує і Google: в Gemini присутнє попередження про те, що люди можуть переглядати частину збережених чатів.

Дослідник Центру демократії і технологій Міхаль Лурія зазначила, що людський перегляд діалогів з чат-ботами може бути критично важливим для безпеки, особливо в пошуку балансу між складною поведінкою ботів. Однак, за її словами, інтерфейси чат-ботів створюють хибне відчуття інтимності і приватності “один на один”, тоді як насправді на іншому кінці можуть бути живі рецензенти. Це суттєво відрізняється від модерації контенту в соціальних мережах, де публікація вже передбачає очікування публічності.