Ваші діалоги з ChatGPT: Розкрито! Живі люди читають ваші чати.

Ваші діалоги з ChatGPT: Розкрито! Живі люди читають ваші чати.

Тайны “Проекта Лили”: Как ChatGPT учится на ваших разговорах

Миллионы пользователей ежедневно общаются с ChatGPT, полагая, что их беседы остаются конфиденциальными и обрабатываются исключительно алгоритмами. Однако, как стало известно изданию 404 Media благодаря утечке внутренних документов OpenAI, за улучшением ответов чат-бота стоят не только инженеры, но и сотни наемных работников. Эти люди регулярно изучают реальные диалоги пользователей с искусственным интеллектом.

Люди в “цифровом сердце” ChatGPT

Процесс улучшения ChatGPT, который компания условно называет “Проект Лили”, включает в себя несколько этапов. Наемные рецензенты получают доступ к инструкциям, скриншотам внутренней системы и непосредственно к запросам пользователей. Задача специалистов – проанализировать, что именно хочет получить пользователь от чат-бота, а затем оценить и критически разобрать несколько вариантов ответа, сгенерированных моделью.

Каждый ответ оценивается по шкале от единицы до семи, где низкие баллы означают “неприемлемо” или “непригодно для использования”, а высокие – “трудно существенно улучшить”. Рецензенты обязаны выделять как минимум три фрагмента ответа, указывая, являются ли они “уместными” или “неуместными”, и обосновывая свой выбор. Например, использование излишнего количества эмодзи может быть признано некорректным, так же как и некорректное применение символов в контексте, связанном с чувствительными темами, такими как смерть или катастрофы.

Главная цель этих мер – минимизировать так называемую “сикофантию” (чрезмерную угодливость) и “неестественную человечность” в поведении модели. Речь идет о попытках ChatGPT имитировать живое существо, используя фразы вроде “как шеф-повар, я люблю…” или “я знаю, каково это…”. Вместо этого, ответы должны быть естественными, сдержанными и профессиональными, без намеков на наличие эмоций или самосознания у бота. Внутренние инструкции прямо указывают на необходимость маркировки признаков “наигранного подражания стилю”, “усиления раздражения” пользователя или “снисходительных предположений”, если они делают ответ менее достоверным или естественным.

Вопросы приватности в эпоху ИИ

С учетом более чем 900 миллионов еженедельных пользователей ChatGPT, большинство из которых, вероятно, не подозревают о возможности прочтения их диалогов живым человеком, вопросы конфиденциальности приобретают особую остроту. Один из рецензентов, пообщавшись с изданием, признался, что сомневается в осознанности пользователей относительно того, что их переписки анализируются сторонними подрядчиками. Реальные запросы, доступ к которым получили журналисты, подтверждают эту обеспокоенность: некоторые пользователи напрямую просили ChatGPT “никому не рассказывать” о содержании беседы.

Иногда над панелью с запросом появляется “резюме памяти пользователя” (user memories summary) – краткое описание предыдущих взаимодействий с чат-ботом, а иногда и приблизительная информация о местоположении пользователя или другие личные детали. Хотя имена пользователей рецензентам не показываются, а запросы проходят через фильтры конфиденциальности OpenAI, компания признает, что инструмент “может ошибаться”, пропуская редкие идентификаторы или неоднозначные личные упоминания, особенно в коротких текстовых фрагментах.

Инструкции для рецензентов требуют эскалации задач, связанных с “потенциальными рисками безопасности” или персональными данными. При этом, в FAQ для подрядчиков четко указано, что им не требуется проверять фактологическую достоверность ответов с помощью внешнего поиска – этим занимаются другие команды. Тем не менее, замеченные фактологические ошибки, особенно в чувствительных областях, таких как медицина, юриспруденция или финансы, должны быть отмечены.

Молчание OpenAI и возможность отказа

На прямые запросы журналистов о том, где именно OpenAI информирует пользователей о возможности просмотра их чатов людьми, компания изначально не давала четкого ответа. На странице часто задаваемых вопросов лишь в общих формулировках сообщается, что “уполномоченный персонал и поставщики услуг” могут просматривать данные пользователей для улучшения моделей, и рекомендуется не вводить конфиденциальную информацию. Это уведомление присутствует на сайте как минимум с 2023 года и претерпевало лишь незначительные изменения.

Журналисты считают такое раскрытие информации недостаточно прозрачным, чтобы должным образом предупредить пользователей о масштабах человеческого контроля над их разговорами. Формулировка настройки “Улучшать модель для всех” (Improve the model for everyone) больше напоминает призыв к коллективному участию, чем запрос на согласие с тем, что живые люди будут читать личные переписки. Впрочем, как отмечает издание, такая размытая формулировка, вероятно, выбрана не случайно: если бы OpenAI явно запрашивала согласие, процент отказов, скорее всего, был бы значительно выше.

После обращения журналистов OpenAI обновила справочную страницу, добавив больше деталей о том, как отказаться от участия в программе улучшения моделей. Однако компания так и не признала прямо, что человеческие рецензенты читают запросы пользователей.

Как отключить просмотр ваших диалогов:

Настройка “Улучшать модель для всех” включена по умолчанию для бесплатных, Plus и Pro тарифов. Для корпоративных клиентов (Enterprise, Business, Edu) эта опция, напротив, отключена по умолчанию. Отказ от участия действует только для новых разговоров и не распространяется на уже существующие чаты.

Компания также предлагает режим временного чата, который, по ее заявлению, не использует введенные данные для обучения моделей. Если пользователь удаляет свои разговоры, OpenAI обещает удалить их из своих систем в течение 30 дней – если только данные уже не были анонимизированы и отвязаны от учетной записи в рамках разрешения на улучшение моделей.

Кто именно читает ваши разговоры:

Подрядчики для “Проекта Лили” набираются через рекрутинговую компанию Crossing Hurdles, а оплату осуществляет компания Mercor, специализирующаяся на обучении ИИ-моделей. Один из рецензентов, проживающий в Северной Америке, сообщил, что зарабатывает более 50 долларов в час – значительно больше, чем обычные подрядчики в сферах модерации контента или обучения ИИ, чья работа часто выполняется за рубежом и за меньшее вознаграждение.

По словам рецензента, чтение запросов может быть “довольно забавным”, но в целом работа “рутинная”, а сами инструкции часто меняются и кажутся противоречивыми.

Не только OpenAI:

Практика привлечения людей к проверке диалогов с чат-ботами распространена по всей индустрии. Anthropic подтвердила, что также использует рецензентов-людей для улучшения ответов Claude, но это касается только пользователей, включивших настройку “Помочь улучшить наши модели ИИ” в параметрах конфиденциальности. Anthropic анонимизирует разговоры перед просмотром, удаляя идентификаторы аккаунтов, такие как адреса электронной почты. Аналогичную практику применяет и Google: в Gemini присутствует предупреждение о том, что люди могут просматривать часть сохраненных чатов.

Исследователь Центра демократии и технологий Михаль Лурия отметила, что человеческий просмотр диалогов с чат-ботами может быть критически важен для безопасности, особенно в поиске баланса между сложным поведением ботов. Однако, по ее словам, интерфейсы чат-ботов создают ложное ощущение интимности и приватности “один на один”, тогда как на самом деле на другом конце могут находиться живые рецензенты. Это существенно отличается от модерации контента в социальных сетях, где публикация уже предполагает ожидание публичности.