OpenAI показує ваші чати живим людям
За даними 404 Media, сотні контрактних працівників OpenAI читають реальні чати ChatGPT, оцінюючи відповіді за шкалою від 1 до 7 — щоб зменшити зайву лестощі та «людську» поведінку моделі. Набирають їх через Crossing Hurdles, платить Mercor; один заробляє понад $50/год. Чати анонімізують, але фільтр приватності іноді помиляється.
Про людський перегляд OpenAI згадує лише в схованому пункті FAQ, який майже не змінювався з 2023 року. За замовчуванням увімкнено «Improve the model for everyone» — саме воно дозволяє читати ваші чати. Anthropic і Google теж використовують ручну перевірку.
Що саме оцінюють рев'юери
За даними розслідування 404 Media, заснованого на внутрішніх документах компанії та розмовах із джерелами, сотні контрактних працівників OpenAI читають реальні розмови користувачів ChatGPT і оцінюють відповіді за шкалою від 1 до 7. Завдання — зменшити зайву лестощі (flattery) моделі та надто «людську» манеру спілкування.
Один з рев'юерів розповів виданню, що, на його думку, користувачі не здогадуються, що їхні чати читають люди. Це підтверджується змістом переглянутих запитів: у частині розмов люди прямо просили ChatGPT зберегти вміст у таємниці. OpenAI використовує фільтр приватності для анонімізації промптів, але визнає, що він іноді помиляється — тобто чутливі особисті дані можуть потрапити до рев'юера в незамаскованому вигляді.
Рев'юерів набирають через платформу Crossing Hurdles, оплату проводить компанія Mercor, що спеціалізується на розмітці даних для навчання ШІ. За словами одного з рев'юерів у Північній Америці, заробіток перевищує $50 на годину.
Чому про це мало хто знав
Коли 404 Media запитало OpenAI, де саме користувачам прямо повідомляють про людський перегляд чатів, компанія спершу не відповіла. Пізніше з'ясувалося, що згадка є — але лише в одному пункті FAQ, який пояснює, що «уповноважений персонал і постачальники послуг» можуть переглядати дані користувачів для покращення моделі, та радить не вводити чутливу інформацію. Цей текст висить на сторінці щонайменше з 2023 року і майже не змінювався.
404 Media вважає таке розкриття занадто прихованим і розмитим, щоб користувач усвідомлював масштаб людського перегляду. Назва налаштування «Improve the model for everyone» звучить як дружня спільна ініціатива, а не як згода на те, що ваші розмови читатимуть живі люди. Видання припускає, що така обтічна формула — свідомий вибір: якби OpenAI прямо питала про згоду на читання чатів людьми, відсоток тих, хто відмовився б, був би, ймовірно, високим.
Це стандартна практика галузі
Людська перевірка відповідей — поширений елемент донавчання моделей, і OpenAI тут не виняток. Anthropic підтвердила 404 Media, що також використовує людських рев'юерів для перевірки відповідей Claude і покращення майбутніх моделей — це стосується користувачів, у яких у налаштуваннях приватності увімкнено опцію Help improve our AI models. Перед переглядом Anthropic анонімізує розмови, прибираючи дані акаунту, зокрема адреси електронної пошти.
Google теж застосовує людських рев'юерів: у Gemini компанія прямо зазначає, що люди можуть переглядати збережені чати.
Що перевірити у власних налаштуваннях
- Знайти в налаштуваннях ChatGPT опцію «Improve the model for everyone» — вона увімкнена за замовчуванням і саме вона дозволяє передавати чати на людський перегляд.
- Врахувати, що вимкнення діє лише на нові розмови: уже наявних чатів це не стосується.
- Для чутливих чи одноразових запитів користуватися режимом тимчасового чату — за заявою OpenAI, дані з нього не використовують для навчання моделі.
- У Claude перевірити стан опції
Help improve our AI modelsу налаштуваннях приватності; у Gemini враховувати, що збережені чати можуть переглядати люди.
Незалежно від налаштувань варто пам'ятати: фільтр приватності OpenAI недосконалий, тож не варто вводити в чат дані, які не можна показати сторонній людині, навіть за вимкненої опції навчання.