Что произошло
OpenAI напомнила о режиме нулевого хранения данных для клиентов, работающих через программный доступ. Смысл обещания: запрос и ответ модели не сохраняются после того, как запрос обработан; сотрудники компании не имеют доступа к содержимому; данные корпоративных клиентов не идут на обучение моделей, если клиент явно этого не разрешил.
Одновременно компания открыла предварительный доступ к системе, которую назвала Private Safety Processing. Она разбирает не отдельные обращения, а закономерности в цепочке связанных — при этом содержимое остаётся закрытым для людей.
Зачем понадобилась вторая система
Модели всё чаще выполняют длинные задачи с большой самостоятельностью. При такой работе опасное намерение не видно в одном запросе — оно собирается из нескольких.
Пример, который приводит Bloomberg: пользователь спрашивает про уязвимости программ, затем про удалённый доступ, затем про средства обнаружения угроз. По отдельности вопросы законны и встречаются у любого системного администратора. Вместе они складываются в подготовку атаки.
Как это устроено
- проверка автоматическая, содержимое переписки людям не показывают;
- при срабатывании передаётся узкий сигнал о типе активности, а не текст;
- если нужно разбирательство, клиент может поделиться данными добровольно;
- при использовании хранилища OpenAI содержимое шифруется ключами клиента, копии ключей у компании нет.
По данным Bloomberg, систему тестируют Microsoft и Databricks, запуск и публикация отчёта намечены на сентябрь. Продуктовую политику компании курирует Алеа Хоуз.
Что это значит для бизнеса
Разница между чатом и программным доступом стала осязаемой. Обещание не хранить данные относится к работе через API и корпоративные договоры, а не к обычной подписке, где история переписки хранится по умолчанию. Если что такое API для вас пока абстракция, начать стоит именно с этого различия — от него зависит режим ваших данных.
Российским компаниям придётся считать иначе. Сервисы OpenAI официально в России не работают, а персональные данные клиентов регулируются 152-ФЗ: их нельзя просто так отправлять в зарубежный сервис. Практический вывод — обезличивать данные до отправки в любую внешнюю модель и знать, куда именно уходит запрос вашего подрядчика.
Вопрос к подрядчику стал конкретнее. Раньше он звучал как «а это безопасно», теперь его можно задать по пунктам: хранятся ли запросы, кто может их прочитать, используются ли они для обучения, где физически находится сервис.
Появился и запасной путь. Когда данные нельзя отдавать наружу, работает вариант с моделью на своём оборудовании: открытые нейросети уступают флагманам в качестве, но данные не покидают контур компании.
Что это значит для специалиста
- Тому, кто внедряет ИИ. В договоре с подрядчиком уместны отдельные пункты про хранение и обучение на ваших данных. Устные заверения тут не работают.
- Разработчику. Режим нулевого хранения включается не сам: это условие доступа, которое надо запросить и подтвердить. Проверьте, на каком режиме работает ваш ключ.
- Юристу и владельцу бизнеса. Обезличивание до отправки закрывает большую часть вопросов: без имён, телефонов и номеров договоров запрос перестаёт быть персональными данными.
- Тем, кто выбирает модель. Условия по данным различаются у разных поставщиков сильнее, чем качество ответов, — и при выборе нейросети под задачу этот критерий стоит держать рядом с ценой.
Что делать уже сейчас
- Составьте список того, что уходит в нейросети. Переписки с клиентами, договоры, выгрузки из CRM, финансовые таблицы — по каждому пункту ответьте, кому принадлежит сервис.
- Введите правило обезличивания. Имена, телефоны, адреса и номера договоров заменяются на метки до отправки запроса.
- Спросите подрядчика письменно. Хранит ли, кто читает, обучает ли на ваших данных, где расположены серверы.
- Разделите задачи по чувствительности. Тексты для сайта — можно во внешнюю модель; персональные данные клиентов — только в контур, который вы контролируете.
- Назначьте ответственного. Пока нет человека, который отвечает за работу с данными в ИИ, правила существуют только на бумаге.
Чего ждать дальше
Условия по данным станут предметом конкуренции наравне с ценой и качеством. Корпоративные клиенты уже спрашивают об этом на первом же созвоне, и поставщики отвечают продуктовыми обещаниями, а не строчкой в пользовательском соглашении.
Второе — надзор без чтения переписки будет развиваться дальше. Задача «поймать злоупотребление и не заглянуть в данные» решается техническими средствами, и это заметно меняет разговор о приватности: книга Евгения Черешнева о жизни рядом с ИИ описывает ровно этот сдвиг — от вопроса «кто читает» к вопросу «что система знает о вас, не читая».
Частые вопросы
Это касается обычной подписки на ChatGPT?
Нет. Речь про программный доступ и корпоративные договоры. В обычной подписке история переписки сохраняется, а настройки хранения задаются в аккаунте.
Значит ли это, что данные полностью защищены?
Обещание касается хранения и доступа сотрудников. Ответственность за то, какие данные вы отправляете, остаётся на вас — особенно если это персональные данные клиентов.
Как система ищет угрозы, если данные не хранятся?
Проверка идёт автоматически по закономерностям в цепочке обращений. Наружу передаётся сигнал о типе активности, а не текст запросов.
Что делать российской компании?
Работать с обезличенными данными, спрашивать подрядчика об условиях хранения и держать чувствительные задачи на моделях, которые запускаются в своём контуре.
