Подрядчики OpenAI читают переписки пользователей ChatGPT — так компания улучшает ответы нейросети
Перед передачей чатов рецензентам OpenAI удаляет из них личные данные, однако признаёт, что система фильтрации может пропускать конфиденциальную информацию
OpenAI привлекает «сотни» подрядчиков для просмотра реальных переписок пользователей с ChatGPT и оценки ответов чат-бота, пишет 404 Media со ссылкой на внутренние документы компании. Работники не видят имён пользователей: перед передачей им чатов специальная модель должна удалять личную информацию — но некоторые персональные данные могут остаться. Пользователи Free, Plus и Pro могут запретить использование своих переписок для улучшения моделей, отключив соответствующий параметр в настройках ChatGPT.
Подрядчики оценивают ответы ChatGPT по семибалльной шкале
Внутри OpenAI работа получила кодовое название «Проект Лилия», утверждает 404 Media. Сначала подрядчик читает реальный запрос пользователя и описывает, что он хотел узнать у ChatGPT, после чего оценивает несколько сгенерированных ответов.
Каждому ответу присваивают оценку от 1 до 7, где единица означает «неприемлемо», а семь — что ответ трудно существенно улучшить. Рецензент также должен письменно объяснить оценку и отметить минимум три удачных или неудачных фрагмента.

По данным издания, подрядчики помогают сделать ответы менее угодливыми, избегать неуместных эмодзи и типичных ИИ-шаблонов, а также не допускать ситуаций, когда чат-бот приписывает себе человеческие качества или личный опыт.
Фактическую точность ответов рецензенты специально не проверяют. Однако они могут отмечать обнаруженные ошибки или отсутствие источников в темах с повышенным риском, включая медицину, право и финансы.
В переписках могут оставаться личные данные
OpenAI сообщила 404 Media, что перед отправкой переписок подрядчикам обрабатывает их с помощью модели Privacy Filter. Она должна удалять из сообщений личную информацию.
При этом в компании признали, что фильтр может ошибаться и пропускать отдельные конфиденциальные данные.
Использование переписок можно отключить в настройках
После публикации материала OpenAI сослалась на свой справочный раздел, где указано, что сообщения могут просматриваться людьми для улучшения ответов системы. При этом на вопрос 404 Media о том, получают ли пользователи отдельное уведомление о проверке, компания не ответила.
Переписки не будут использоваться для улучшения моделей, если в настройках ChatGPT отключить параметр «Совершенствовать модель для всех», заявили в OpenAI. Для пользователей тарифов Free, Plus и Pro эта настройка включена по умолчанию.

По словам собеседника 404 Media, работавшего в «Проекте Лилия», ему платили более $50 в час. Он назвал работу однообразной и отметил, что инструкции для рецензентов часто менялись.