Что произошло
14 сентября 2026 года 404 Media опубликовало расследование о том, как OpenAI улучшает ChatGPT руками людей. По внутренним документам и реальным запросам, которые видело издание, компания нанимает сотни подрядчиков для чтения потока запросов пользователей. Подрядчики читают и целые диалоги, а затем ставят оценки ответам модели и пишут критику.
Цель, по документам, такая: научить ChatGPT не приписывать себе человеческие чувства и меньше льстить пользователю. Издание напоминает, что чрезмерная льстивость модели 4o упоминается в нескольких судебных исках как одна из причин самоубийств. В документах проект называется Project Lily.
Пересказы вышли в тот же день и на следующий: Sostav и другие издания повторили главные тезисы без новых деталей.
Что видят рецензенты и что говорит OpenAI
По расследованию, рецензенты не видят имён пользователей. OpenAI сообщила изданию, что старается удалять личную информацию до того, как запросы попадут к людям, но признала, что чувствительные детали всё равно могут пройти.
Один из работающих с запросами на вопрос, знают ли пользователи, что их чаты читают люди, ответил: «Нет. Не думаю, что они представляют себе, что какой-то подрядчик где-то анализирует их разговоры».
404 Media отдельно отмечает: проверка людьми остаётся важной и малозаметной частью того, почему модели улучшаются, наряду со сбором данных из интернета и работой инженеров. Anthropic подтвердила изданию, что тоже использует проверку людьми.
Термины из текста. Рецензент, или разметчик, это человек, который читает запрос и ответ модели и ставит оценку; на этих оценках модель дообучают. Дообучение это донастройка уже обученной модели на новых примерах, о чём подробнее в статье LLM: что это.
Что написано в правилах самой OpenAI
Расследование не противоречит официальным документам, и в этом главный урок. В справке OpenAI о том, как данные используются для обучения, на 16 сентября 2026 года сказано прямо:
- для личных сервисов, ChatGPT и Codex, компания может использовать содержимое переписок для обучения моделей;
- отказаться можно, выключив «Improve the model for everyone» в настройках ChatGPT (раздел Data Controls) или выбрав «Do not train on my content» на портале приватности; после этого новые переписки для обучения не берутся;
- временный чат (Temporary Chat) не попадает ни в историю, ни в обучение;
- если вы поставили ответу «палец вверх» или «вниз», весь диалог может уйти в обучение даже при выключенной настройке;
- для бизнес-продуктов, ChatGPT Business, ChatGPT Enterprise и API, обучение на входах и выходах по умолчанию выключено; включить передачу данных можно только явно.
То есть чтение переписок людьми это часть процесса, на который пользователь личного тарифа согласился по умолчанию, без утечки и без нарушения правил. Новость 404 Media показала масштаб этого процесса: сотни людей и целые диалоги.
Цифры и даты
| Что | Значение |
|---|---|
| Дата расследования 404 Media | 14 сентября 2026 |
| Подрядчиков, читающих запросы | сотни |
| Пользователей ChatGPT | более 900 млн, по 404 Media |
| Что видят рецензенты | запросы и целые диалоги, без имён пользователей |
| Личные тарифы ChatGPT и Codex | обучение включено по умолчанию, выключается в настройках |
| ChatGPT Business, Enterprise, API | обучение выключено по умолчанию |
Что это значит бизнесу
Первое: переписка с клиентами, договоры, финансовые таблицы и внутренние документы, которые сотрудник вставляет в личный ChatGPT с настройками по умолчанию, могут оказаться перед глазами подрядчика в рамках штатного процесса.
Для компаний, которые обязаны защищать персональные данные клиентов по договорам и закону, это прямой риск, а не вопрос удобства настроек.
Второе: у проблемы есть 3 решения помимо запрета. Выключить обучение в личном аккаунте, использовать временный чат для разовых задач с чужими данными или перейти на бизнес-тариф либо API, где обучение выключено по умолчанию. Как устроен ChatGPT и чем отличаются его тарифы, разбирали в полном гайде по ChatGPT.
Третье: если переписку с клиентами ведёт ИИ-агент компании, важно, через что он работает. Агент на API получает те же гарантии, что бизнес-тариф, и данные клиентов не идут в обучение; как выстроить такого ИИ-продавца, описано в отдельной статье.
Для тех, кому нельзя отправлять данные за пределы своих серверов вовсе, остаются открытые модели на собственном оборудовании.
Четвёртое: «палец вверх» тоже отправляет диалог. Сотрудникам, которые работают с чужими данными в ChatGPT, стоит объяснить, что кнопка оценки означает передачу всего разговора, даже при выключенном обучении.
Что делать уже сейчас
- Открыть в ChatGPT настройки, раздел Data Controls, и выключить «Improve the model for everyone» на всех аккаунтах, где сотрудники работают с данными клиентов.
- Для разовых задач с чужими документами включать временный чат.
- Запретить оценивать ответы «пальцем» в диалогах с данными клиентов, потому что оценка отправляет весь диалог.
- Если ИИ используется в работе с клиентами постоянно, перевести это на бизнес-тариф, API или платформу, где обучение на данных выключено, и зафиксировать это во внутреннем регламенте.
Чего ждать
Расследование 404 Media уже вызвало вопросы к OpenAI о том, сколько данных проходит через людей и как именно удаляется личная информация.
Ждать стоит двух вещей: уточнения формулировок в правилах OpenAI, где сегодня стоит мягкое «стараемся удалять», и новых материалов о том, как устроена проверка людьми у Anthropic и Google. Запрет на чтение переписок людьми маловероятен: без этого модели не улучшаются, и это подтверждают все 3 компании.
