Сотрудники OpenAI читают ваши переписки с ChatGPT: что это значит для пользователей

Сотрудники OpenAI читают ваши переписки с ChatGPT: что это значит для пользователей

Расследование 404 Media показало: сотни подрядчиков OpenAI вручную читают диалоги пользователей ChatGPT и оценивают ответы по шкале от 1 до 7. Разбираем, какие данные попадают к людям, как отключить обучение на ваших чатах и что делать, чтобы снизить риски.

OpenAI платит сотни внешних подрядчиков за то, что они вручную читают реальные диалоги пользователей ChatGPT. Человек на другой стороне экрана видит ваш запрос, оценивает четыре варианта ответа по шкале от 1 до 7 и отмечает, где бот подлизывается, ставит лишние галочки или выдумывает себе человеческую биографию. Это не хакерская атака и не утечка: так работает один из этапов обучения модели, и о нём компания упоминает в малозаметном разделе FAQ.

Издание 404 Media раскрыло внутреннюю программу OpenAI под кодовым названием Project Lily. Подрядчики получают более $50 в час через сторонние кадровые компании. Ваши переписки обезличивают: имена, email и другие прямые идентификаторы удаляют. Но фильтр приватности, по признанию самой компании, иногда ошибается и пропускает чувствительные детали.

Если вы не хотите, чтобы новые чаты попадали в обучение, настройку «Improve the model for everyone» нужно отключить вручную. По умолчанию она включена для личных аккаунтов Free, Plus и Pro. Ниже разберём, что именно видят проверяющие, какие данные остаются в зоне риска и как снизить риски за несколько минут.

Что произошло: расследование 404 Media и программа Project Lily

Новость появилась благодаря расследованию издания 404 Media. Журналисты получили материалы о внутренней программе OpenAI, которую внутри компании называли Project Lily: живые люди читают фрагменты диалогов с ChatGPT и выставляют оценку качеству ответов.

Оценка идёт по шкале от 1 до 7. Ревьюеры (так называют сотрудников, которые вручную проверяют ответы ИИ) работают с реальными переписками пользователей, а не с абстрактными тестовыми примерами. Оплата у части подрядчиков превышает $50 в час, причём платят сторонние кадровые компании, а не сама OpenAI напрямую. Формально это не штатные сотрудники OpenAI, но данные они видят те же.

Как именно проходит проверка диалогов

Рабочий день ревьюера выглядит так: на экране появляется запрос пользователя, человек коротко описывает намерение автора, затем читает четыре варианта ответа и ставит каждому оценку от 1 до 7. Автоматики на этом шаге нет, решение принимает человек.

Инструкции довольно конкретные. Штрафуют лишние галочки-эмодзи, приманки для вовлечения и перегруженное форматирование. Отдельное правило: следить, чтобы ChatGPT не приписывал себе человеческий опыт. Фразу вроде «Как шеф-повар, я люблю готовить на открытом огне» модель получает минус, потому что у бота нет биографии и вкусовых привычек.

В расследовании встречались запросы, где пользователи прямо просили «оставить это между нами». Такая фраза не меняет настройки сервиса и не закрывает диалог от проверки.

Зачем OpenAI это делает

Ручная проверка решает несколько практических задач. Первая: снизить льстивость. Модели обучены на одобрении, поэтому склонны хвалить пользователя за посредственные идеи. Вторая: убрать шаблонные фразы и украшательства, из-за которых ответ похож на рекламный буклет. Третья: сделать речь естественнее и убрать «человекоподобность» там, где она выглядит фальшиво.

Это стандартный этап разработки больших языковых моделей. Автоматические метрики не ловят тонкие вещи: сарказм, ложное сочувствие, странный тон в чувствительной теме. Живой оценщик ловит. Компания улучшает продукт, подрядчики получают деньги, пользователи получают менее льстивый чат. Проблема не в цели, а в том, что об этом процессе мало кто знает.

Какие данные могут попасть к людям: обезличивание и его пределы

Перед проверкой переписку обрабатывает автоматический фильтр. Он удаляет имена, адреса электронной почты, номера телефонов и другие прямые идентификаторы. Такой процесс называют обезличиванием данных: персональная информация извлекается из текста, чтобы связать диалог с конкретным человеком стало сложнее.

Полной анонимности обезличивание не даёт. OpenAI признаёт, что фильтр может ошибаться: он пропускает редкие идентификаторы и неоднозначный личный контекст. По обрывкам фраз ревьюер способен восстановить город, профессию, привычки или детали личной жизни, даже если фамилия в тексте не звучит.

Сводка памяти: что ревьюеры знают о вас

В интерфейсе подрядчиков иногда появлялся блок с краткой сводкой пользовательских «воспоминаний». Функция памяти в ChatGPT сохраняет контекст из прошлых разговоров, чтобы ответы были точнее. В сводке могут оказаться факты, которые вы упоминали месяцами ранее.

Пример: если вы писали, что живёте в Казани, работаете маркетологом и растите двоих детей, эти детали попадут в сводку. По отдельности кусочки выглядят безобидно, вместе они описывают конкретного человека довольно подробно. Это не значит, что каждый ревьюер видит всю вашу историю. Риск в том, что иногда он видит больше, чем вы ожидали.

Примеры чувствительных данных, которые могут утечь

Чаще всего в чаты попадают одни и те же категории: медицинские вопросы, юридические консультации, финансовые детали, рабочие документы, разборы личных отношений. Каждый такой запрос может содержать то, что вы не рассказали бы постороннему.

Совет даёт сама OpenAI: не вводите конфиденциальную информацию. Звучит просто, но проверка на практике выглядит так. Перед отправкой сообщения спросите себя, готовы ли вы прочитать этот текст вслух незнакомому человеку. Если нет, переформулируйте вопрос без реальных деталей: вместо названия компании и суммы сделки подойдут общие слова.

Как отключить использование ваших чатов для обучения

Управление данными живёт в разделе Data Controls. Это часть настроек ChatGPT, где собраны переключатели приватности: история чатов, обучение на ваших данных, экспорт и удаление аккаунта. Один из них отвечает за то, попадут ли новые диалоги в обучающую выборку.

Для личных аккаунтов Free, Plus и Pro настройка «Improve the model for everyone» включена по умолчанию. Решение об использовании ваших чатов уже принято за вас, а отключить его нужно вручную.

Пошаговая инструкция: где найти переключатель

  1. Откройте ChatGPT и войдите в аккаунт.
  2. Кликните по своему имени или аватару в углу экрана.
  3. Выберите Settings (настройки).
  4. Перейдите в раздел Data Controls.
  5. Найдите пункт «Improve the model for everyone» и переключите его в положение «выкл.».

Названия пунктов могут немного отличаться на разных устройствах и в разных версиях приложения, но логика одна: искать нужно настройки данных, а не оформление или голос. Если вы давно не заходили в этот раздел, проверьте его сейчас: обновления иногда сбрасывают состояние переключателей.

Что меняется после отключения, а что нет

Отключение останавливает использование только новых диалогов. Уже обезличенные и поставленные в очередь чаты остаются в цикле обучения. Задним числом отозвать их нельзя.

Настройка не влияет на другие способы обработки данных. OpenAI продолжает хранить переписки для безопасности, разбора нарушений и соблюдения закона. Отключённый переключатель ограничивает один конкретный канал, а не делает вас невидимым для сервиса.

У корпоративных аккаунтов Enterprise, Business и Edu поведение другое: передачу данных для обучения OpenAI отключает автоматически. Если рабочая задача требует обсудить чувствительные детали, корпоративный тариф снижает риск. Подробный разбор настроек сразу для нескольких ассистентов, включая ChatGPT, Claude, Copilot и Grok, мы собрали в отдельном материале о том, какие данные собирают ИИ-ассистенты и как ограничить их использование для обучения моделей.

Это только у OpenAI? Anthropic и Google делают то же самое

Ручная проверка диалогов не уникальна. Схожие механики подтвердили два других крупных разработчика чат-ботов, и это меняет вывод: речь про распространённый подход к обучению моделей, а не про особенность одной компании.

Anthropic и Claude: что известно

Anthropic подтверждает, что использует ревьюеров для Claude, если пользователь оставил обучение на своих данных включённым. Логика та же, что у OpenAI: по умолчанию данные могут попадать в обучение, и отключать это нужно самому. Компания также советует не вводить конфиденциальную информацию в чат.

Google и Gemini: предупреждение о чтении чатов

У Google для Gemini есть отдельное предупреждение: часть сохранённых чатов читают люди. Формулировка заметнее, чем строчка в FAQ у OpenAI. Детали обезличивания Google не раскрывает, но саму практику подтверждает открыто.

Вывод простой: смена сервиса не решает проблему. Пользователи Claude уже сталкивались с другой историей приватности, когда общие ссылки на приватные диалоги попадали в поиск Google: разбор той утечки. Проверять настройки стоит в любом AI-чате, которым вы пользуетесь регулярно. Общую картину того, как индустрия балансирует между скоростью и безопасностью, мы разбирали в материале о том, кто задаёт темп в AI-индустрии в 2026 году.

Насколько прозрачна OpenAI: что сказано в FAQ и о чём молчат

Формально OpenAI ничего не скрывает. В документации есть упоминание о том, что люди могут просматривать диалоги, и есть рекомендация не делиться конфиденциальными данными. Вопрос в том, где эта информация лежит.

Человеческий просмотр описан в малозаметном разделе FAQ. Всплывающего окна при регистрации нет, письма пользователям не приходят. Настройка «Improve the model for everyone» включена по умолчанию, значит, чтобы отказаться, нужно сначала узнать о её существовании. Компания следует букве закона: согласие описано в документах, которые вы принимаете при регистрации. До духа прозрачности остаётся расстояние, потому что заметная информация живёт не в FAQ, а на первом экране настроек.

Для пользователя это значит одно: юридической формальности достаточно, чтобы практика считалась законной, но недостаточно, чтобы вы о ней знали. Поэтому решения о приватности приходится принимать самостоятельно. Схожая логика работает и в других сюжетах вокруг OpenAI: публичные заявления руководства, слухи о будущих моделях, подготовка к регулированию. Что именно известно о переговорах Сэма Альтмана и планах компании, мы разобрали отдельно.

Что делать пользователю: практический чек-лист для защиты приватности

Ни один переключатель не даёт полной анонимности в чате с ИИ. Снизить риски можно, и для этого хватит нескольких действий.

  1. Отключите «Improve the model for everyone» в Data Controls. Это останавливает использование новых диалогов для обучения.
  2. Не вводите конфиденциальную информацию: паспортные данные, суммы сделок, медицинские диагнозы, пароли, служебные документы.
  3. Проверьте настройки в других сервисах: Claude, Gemini, Copilot. У каждого свой переключатель обучения и своя формулировка.
  4. Для рабочих задач используйте корпоративный аккаунт Enterprise, Business или Edu, где передача данных для обучения отключена автоматически.
  5. Перечитывайте политику конфиденциальности хотя бы раз в несколько месяцев. Правила меняются чаще, чем принято думать.

И главный фильтр ничего не стоит: если сомневаетесь, не вводите. Обезличивание снижает риск, но не отменяет его, а фильтр приватности ошибается. Привычка переформулировать запрос без реальных деталей защищает надёжнее любой настройки.

Есть вопрос или заметили неточность? Напишите нам.

Отправить тому, кому пригодится

Ссылка сохранит весь материал без сокращений.

По почте

Заметили неточность? Сообщить редакции