OpenAI наймає людей для читання чатів ChatGPT: які дані вони бачать
OpenAI залучає підрядників, які переглядають реальні розмови користувачів із ChatGPT для оцінювання відповідей і покращення моделей.
Про це повідомило розслідування 404 Media, яке ґрунтується на внутрішніх документах, робочих інструкціях, матеріалах Slack та прикладах реальних запитів. При цьому компанія використовує фільтри для видалення персональних даних, але визнає, що вони можуть пропускати окрему конфіденційну інформацію.
Йдеться про внутрішній проєкт OpenAI під назвою Project Lily. За даними 404 Media, до нього залучені сотні підрядників, які переглядають запити реальних користувачів і оцінюють відповіді ChatGPT.
Рецензенти отримують реальні запити та частину контексту попередньої взаємодії користувача з чатботом. Їхнє завдання — визначити, що саме хотів отримати користувач, а потім оцінити кілька варіантів відповіді ChatGPT.
Водночас у матеріалах, які отримало 404 Media, не вказано, яку саме модель навчають у межах Project Lily — чинну чи майбутню.
За даними видання, працівники оцінюють, наскільки відповідь ChatGPT відповідає запиту користувача, чи є вона корисною, точною, природною та зрозумілою.
Окрему увагу приділяють стилю відповідей. Зокрема, рецензенти мають відзначати надмірне використання емодзі, штучну манеру викладу, підлабузництво, покровительський тон та спроби чатбота видавати себе за людину.
В інструкціях також наголошується, що ChatGPT не повинен посилатися на особистий досвід, якого в нього немає. Наприклад, небажаними вважаються формулювання на кшталт "як кухар, я люблю..." або "я знаю, як це".
Після аналізу відповіді рецензенти виставляють їй оцінку від 1 до 7 та пояснюють своє рішення. При цьому навіть корисна відповідь може отримати низьку оцінку, якщо вона надто довга, перевантажена або не відповідає стилістичним вимогам.
Один із працівників, з яким поговорило 404 Media, заявив, що ця робота є монотонною, а правила оцінювання часто змінюються та можуть суперечити одне одному. За його словами, оплата становить понад 50 доларів на годину.
Чи можуть рецензенти побачити особисті дані
OpenAI заявляє, що перед передачею розмов підрядникам використовує Privacy Filter, який має виявляти та видаляти персональну інформацію.
При цьому компанія визнає, що такий фільтр не є безпомилковим. Він може не розпізнати рідкісні ідентифікатори або неоднозначні приватні згадки, особливо коли контекст розмови короткий.
За інформацією 404 Media, рецензенти не бачать імен користувачів. Однак у деяких випадках разом із запитом їм може бути доступне коротке резюме пам'яті користувача — інформація про попередні теми, інтереси та контекст взаємодії з ChatGPT. У таких резюме потенційно може бути інформація про місце проживання або інші особисті деталі.
Окремо видання зазначає, що перевірка таких розмов відрізняється від безпекового аналізу, під час якого OpenAI може переглядати контент, пов'язаний із потенційною загрозою заподіяння шкоди собі чи іншим.
Що каже OpenAI про використання чатів
OpenAI офіційно повідомляє, що розмови користувачів індивідуальних сервісів, зокрема ChatGPT, можуть використовуватися для покращення моделей, якщо користувач не відмовився від цього. Для цього в налаштуваннях ChatGPT є параметр "Improve the model for everyone". Після його вимкнення нові розмови не використовуються для тренування моделей.
Компанія також пропонує Temporary Chat. Такі розмови не з'являються в історії, не створюють спогадів і не використовуються для покращення моделей. Водночас OpenAI зазначає, що тимчасові чати можуть зберігатися протягом 30 днів для цілей безпеки.
У березні 2026 року OpenAI також пояснювала, що використовує Privacy Filter на різних етапах підготовки даних, зокрема для розмов користувачів, які дозволили використання контенту для покращення моделей.
Користувачі можуть самостійно перевірити налаштування використання даних у ChatGPT: Settings → Data Controls → "Improve the model for everyone".
Читайте також