OpenAI нанимает людей для чтения чатов ChatGPT: какие данные они видят

Компания привлекла подрядчиков для оценки ответов на чат, а в разговорах пользователей, которые они просматривают, иногда может содержаться личная и конфиденциальная информация.
OpenAI нанимает людей для чтения чатов ChatGPT: какие данные они видят
16 сентября 2026, 13:16
читати українською

OpenAI привлекает подрядчиков, которые просматривают реальные разговоры пользователей ChatGPT для оценки ответов и улучшения моделей.

Об этом сообщило расследование 404 Media, основанное на внутренних документах, рабочих инструкциях, материалах Slack и примерах реальных запросов. Компания использует фильтры для удаления персональных данных, но признает, что они могут пропускать отдельную конфиденциальную информацию.

Речь идет о внутреннем проекте OpenAI под названием Project Lily. По данным 404 Media, к нему привлечены сотни подрядчиков, просматривающих запросы реальных пользователей и оценивающих ответы ChatGPT.

Рецензенты получают реальные запросы и часть контекста предварительного взаимодействия пользователя с чатом. Их задача – определить, что именно хотел получить пользователь, а затем оценить несколько вариантов ответа ChatGPT.

В то же время в материалах, которые получило 404 Media, не указано, какую модель обучают в рамках Project Lily — действующую или будущую.

По данным издания, работники оценивают, насколько ответ ChatGPT соответствует запросу пользователя, является ли он полезным, точным, естественным и понятным.

Отдельное внимание уделяется стилю ответов. В частности, рецензенты должны отмечать чрезмерное использование эмодзы, искусственную манеру изложения, подхалимство, покровительственный тон и попытки чата выдавать себя за человека.

В инструкциях также отмечается, что ChatGPT не должен ссылаться на личный опыт, которого у него нет. Например, нежелательными считаются формулировки типа "как повар, я люблю..." или "я знаю, как это".

После анализа ответа рецензенты выставляют ему оценку от 1 до 7 и объясняют свое решение. При этом даже полезный ответ может получить низкую оценку, если он слишком длинный, перегруженный или не отвечает стилистическим требованиям.

Один из сотрудников, с которым поговорило 404 Media, заявил, что эта работа является монотонной, а правила оценки часто меняются и могут противоречить друг другу. По его словам, оплата составляет более 50 долларов в час.

Могут ли рецензенты увидеть личные данные

OpenAI заявляет, что перед передачей разговоров подрядчикам использует Privacy Filter, который должен обнаруживать и удалять персональную информацию.

При этом компания признает, что такой фильтр не является безошибочным. Он может не распознать редкие идентификаторы или неоднозначные частные упоминания, особенно когда контекст разговора короткий.

По информации 404 Media, рецензенты не видят имен пользователей. Однако в некоторых случаях вместе с запросом им может быть доступно краткое резюме пользовательской памяти — информация о предыдущих темах, интересах и контексте взаимодействия с ChatGPT. У таких резюме потенциально может быть информация о местожительстве или других личных деталях.

Отдельно издание отмечает, что проверка таких разговоров отличается от анализа безопасности, во время которого OpenAI может просматривать контент, связанный с потенциальной угрозой причинения вреда себе или другим.

Что говорит OpenAI об использовании чатов

OpenAI официально сообщает, что разговоры пользователей индивидуальных сервисов, в частности ChatGPT, могут использоваться для улучшения моделей, если пользователь не отказался от этого. Для этого в настройках ChatGPT есть параметр "Improve the model for everyone". После его отключения новые разговоры не используются для тренировки моделей.

Компания также предлагает Temporary Chat. Такие разговоры не появляются в истории, не создают воспоминаний и не используются для улучшения моделей. В то же время, OpenAI отмечает, что временные чаты могут сохраняться в течение 30 дней для целей безопасности.

В марте 2026 г. OpenAI также объясняла, что использует Privacy Filter на различных этапах подготовки данных, в частности для разговоров пользователей, которые позволили использование контента для улучшения моделей.

Пользователи могут самостоятельно проверить настройки использования данных в ChatGPT: Settings → Data Controls → "Improve the model for everyone".

Читайте также