Чаты с ChatGPT читают третьи лица: OpenAI нанимает людей для проверки переписок пользователей ChatGPT

от автора

OpenAI использует человеческих рецензентов для анализа реальных диалогов пользователей ChatGPT. Проект получил название Project Lily. Об этом сообщает 404 Media, изучив внутренние документы компании, инструкции для подрядчиков и примеры пользовательских запросов.

OpenAI нанимает сотни людей, которые получают реальные пользовательские запросы и целые фрагменты переписок. Их задача — оценивать качество ответов модели и помогать компании улучшать последующие версии ChatGPT.

Живой ревьюер сначала изучает запрос и ответ ChatGPT, затем кратко описывает задачу пользователя и оценивает работу модели от 1 до 7. Люди проверяют не только очевидные ошибки: они оценивают насколько ответ соответствует запросу, не поддакивает ли модель пользователю и не создаёт ли впечатление, что у неё есть человеческие эмоции или личные намерения.

Кто читает эти чаты

OpenAI привлекает для этой работы внешних подрядчиков. Людей нанимают через Crossing Hurdles, которая затем направляет их к Mercor — компании, занимающейся наймом специалистов и подготовкой данных для ИИ. Эти подрядчики получают более $50 в час и признаются, что по их мнению, большинство пользователей не предполагают, что чат может просматривать человек.

Рецензентам хотя бы не показывают имена пользователей. OpenAI применяет собственный Privacy Filter, который должен удалять персональные данные до того, как разговор попадёт в обучающий процесс. Но даже сами OpenAI признают, что фильтр не гарантирует полного удаления чувствительной информации. Поэтому рецензент способен увидеть личные обстоятельства, профессиональные детали или другую чувствительную информацию, если она содержалась непосредственно в сообщениях. 404 Media приводит примеры разговоров, в которых пользователи прямо просили ChatGPT сохранить информацию в тайне. (очень надежно, конечно, не делайте так)

Сам факт человеческой проверки не является чем-то новым для разработки ИИ. Модели давно обучаются с использованием человеческой разметки и оценки ответов. Необычным выглядит масштаб работы с реальными пользовательскими диалогами и разрыв между формулировкой настройки и тем, что происходит на практике.

Почему OpenAI имеет право использовать эти разговоры

Ключевой здесь параметр «Improve the model for everyone». Для пользовательских версий ChatGPT он позволяет OpenAI использовать новые разговоры для улучшения и обучения моделей.

OpenAI прямо указывает в своей документации: если этот параметр включён, компания может использовать содержимое разговоров для обучения моделей. В мае 2026 года OpenAI также отдельно описала использование Privacy Filter при работе с пользовательскими чатами.

Как отключить

Для личных аккаунтов настройка включена по умолчанию, а отключить её можно в Settings → Data Controls → Improve the model for everyone. После отключения новые разговоры не используются для обучения моделей.
Есть и другой вариант — Temporary Chat. Такие разговоры не используются для обучения моделей, не появляются в истории и не создают память; OpenAI хранит их до 30 дней для целей безопасности.

Для Business, Enterprise и API OpenAI по умолчанию не использует входные и выходные данные для обучения моделей.

OpenAI после обращения 404 Media обновила справочную страницу, добавив дополнительные сведения о механизме отказа от обучения. При этом в документации прямо не появилось предупреждение о том, что пользовательские запросы могут читать люди.

ссылка на оригинал статьи https://habr.com/ru/articles/1082830/