OpenAI наняла сотни подрядчиков читать переписки в ChatGPT

OpenAI наняла сотни подрядчиков читать переписки в ChatGPT

404 Media провело расследование на основе слитых внутренних документов OpenAI и разговоров с источниками и выяснило: компания нанимает сотни внешних подрядчиков, которые читают настоящие переписки пользователей с ChatGPT. Ревьюеры оценивают ответы бота по шкале от одного до семи, и их задача, снизить в ответах чрезмерную лесть и излишне «человеческое» поведение модели.

Один из ревьюеров сказал 404 Media, что, по его мнению, пользователи не догадываются, что их переписку читают живые люди. Это подтверждают и сами просмотренные промпты: в части из них пользователи прямо просили ChatGPT сохранить содержание в тайне. Промпты анонимизируют, но в них всё равно могут оставаться чувствительные личные данные, OpenAI использует фильтр приватности, но признаёт, что он может ошибаться.

Подрядчиков набирают через сервис Crossing Hurdles, а платит им компания Mercor, которая специализируется на подготовке данных для обучения ИИ. По словам одного ревьюера из Северной Америки, он зарабатывает больше $50 в час.

Отключить использование своих чатов для такой проверки можно через настройку «Улучшить модель для всех», она включена по умолчанию, но применяется только к новым разговорам. Есть и режим временного чата, который, по заявлению OpenAI, не использует введённые данные для обучения модели.

Когда 404 Media спросило OpenAI, где именно пользователям явно сообщают о проверке живыми людьми, компания сначала не ответила. На странице FAQ говорится, что доступ к данным пользователей для улучшения модели может получать авторизованный персонал и сервис-провайдеры, и там же советуют не вводить чувствительную информацию, эта формулировка висит на сайте с 2023 года и почти не менялась. По мнению 404 Media, такое раскрытие слишком спрятано и слишком расплывчато, чтобы пользователи понимали реальный масштаб проверки людьми, а формулировка «Улучшить модель для всех» звучит скорее как дружелюбный вклад в общее дело, чем как согласие на чтение переписки человеком.

Практика человеческой проверки распространена по всей индустрии: Anthropic подтвердила 404 Media, что тоже использует ревьюеров-людей для проверки ответов Claude и улучшения будущих моделей, это касается пользователей, у которых включена настройка «Help improve our AI models», а перед проверкой Anthropic анонимизирует переписку, убирая данные аккаунта вроде email. Google также использует ревьюеров-людей и в Gemini отдельно указывает, что сохранённые чаты могут просматривать люди.

Ключевые факты

  • OpenAI нанимает сотни внешних подрядчиков, которые читают реальные переписки пользователей ChatGPT и оценивают ответы по шкале от 1 до 7, чтобы снизить лесть и излишне «человеческое» поведение модели
  • Подрядчиков набирают через Crossing Hurdles, платит им компания Mercor; один ревьюер из Северной Америки сообщил доход выше $50 в час
  • Промпты анонимизируют, но они всё равно могут содержать чувствительные личные данные; часть пользователей прямо просила ChatGPT не разглашать содержание разговора
  • Отключить участие своих чатов в проверке можно через настройку «Улучшить модель для всех» (только для новых чатов) или через режим временного чата
  • Anthropic подтвердила, что тоже использует ревьюеров-людей для проверки ответов Claude; Google также использует ревьюеров-людей и упоминает это в Gemini

Почему это важно

Материал показывает разрыв между тем, как пользователи представляют себе работу с ИИ-чат-ботом, и тем, что происходит с их данными на деле: сотни живых людей читают переписки, чтобы улучшать поведение модели, а сами пользователи, по словам одного из ревьюеров, об этом не догадываются. Это детальное подтверждение масштаба такой практики у OpenAI на основе внутренних документов, а не только формулировок политики конфиденциальности.

Кому это важно

Пользователям ChatGPT, Claude и Gemini, которые делятся с чат-ботами личной или чувствительной информацией и рассчитывают, что переписку не увидит человек. Важно это и для тех, кто следит за практиками сбора данных в индустрии ИИ в целом, расследование показывает, что проверка ответов людьми распространена не только у OpenAI, но и у Anthropic с Google.

Как это применить

Пользователям ChatGPT, которые не хотят, чтобы их новые переписки читали ревьюеры, стоит отключить настройку «Улучшить модель для всех» (она включена по умолчанию и действует только на новые разговоры) или пользоваться режимом временного чата, который, по заявлению OpenAI, не использует введённые данные для обучения модели. Аналогично у Anthropic есть настройка «Help improve our AI models», а Google предупреждает о возможном просмотре сохранённых чатов в Gemini.

Можно ли доверять

Материал 404 Media основан на слитых внутренних документах OpenAI и разговорах с несколькими источниками, включая действующих ревьюеров, а факт использования ревьюеров-людей подтвердила Anthropic, а Google тоже использует ревьюеров-людей и упоминает это в Gemini. При этом расследование не приводит точное число подрядчиков (только «сотни»), не называет общий объём просмотренных переписок и не описывает, ответила ли OpenAI по существу на вопрос о раскрытии информации после первоначального молчания.

Риски и подводные камни

Хотя промпты анонимизируют, в них могут оставаться чувствительные личные данные, а используемый OpenAI фильтр приватности, по признанию самой компании, может ошибаться. Часть пользователей, читавших которых промпты, прямо просила ChatGPT сохранить содержание в тайне, то есть не осознавала, что их всё равно может увидеть человек. Уведомление о проверке человеком спрятано в FAQ и почти не менялось с 2023 года, а формулировка настройки «Улучшить модель для всех» подаётся скорее как дружелюбный вклад в общее дело, чем как явное согласие на чтение переписки людьми.