Amazon использовал стримы Twitch для обучения ИИ без явного согласия, теперь можно отключить

Amazon использовал стримы Twitch для обучения ИИ без явного согласия, теперь можно отключить

Twitch обновил настройки аккаунта: теперь стримеры могут отключить использование своего контента, постов, трансляций и видео, для обучения ИИ-моделей материнской компании Amazon. Новая опция находится в разделе «Безопасность и конфиденциальность» настроек и называется «Обучение генеративного ИИ» (Generative AI Training). До сих пор при этом переключатель по умолчанию был включён, то есть контент использовался для обучения, если пользователь не отказывался сам. Точно неизвестно, с какого момента платформа начала использовать материалы стримеров для обучения систем Amazon, сама по себе новая настройка это не проясняет.

Даже при отключении опции Twitch и Amazon сохраняют право использовать контент канала для других целей, перечисленных в политике конфиденциальности Twitch: ИИ-функции для роста и монетизации стримеров (например, помощь в спонсорских кампаниях в реальном времени), рекомендации для зрителей и инструменты модерации сообщества вроде AutoMod.

На специальном форуме более 16 000 авторов выразили несогласие с тем, что их контент по умолчанию используется для обучения ИИ-систем Amazon, эта практика стала известна только после обновления настроек. Волна недовольства поднялась после трансляции, на которой руководитель отдела по работе с сообществом Twitch Мэри Киш (Mary Kish) объявила об изменениях; она признала, что нововведение вызовет негативную реакцию. Руководитель отдела продукта Twitch Майк Минтон (Mike Minton) в том, что он сам назвал «откровенным ответом», заявил, что включённая по умолчанию опция была необходима, поскольку иначе «никто бы не стал участвовать» в этом процессе.

Минтон также отметил, что подобные механизмы, не уникальная особенность Twitch, и выразил уверенность, что другие компании, разрабатывающие ИИ-системы, тоже собирают контент с Twitch и других сервисов для обучения своих моделей. «Я не знаю наверняка, сказал он, но считаю вполне разумным предположить, что практически любой общедоступный контент так или иначе используется для обучения моделей, с разрешения или без. Так что нужно признать: многое здесь находится за пределами даже нашего прямого контроля».

Пользовательское соглашение Twitch, действующее с марта 2024 года, уже давало Twitch и его сублицензиатам право использовать, воспроизводить, изменять, адаптировать, распространять и создавать производные произведения на основе контента пользователей. Однако прямого указания на то, что материалы могут применяться для обучения генеративных ИИ-моделей, в документе до сих пор не было.

История Twitch иллюстрирует более широкую проблему: нехватку качественных данных для обучения ИИ-моделей. Хотя такие компании, как OpenAI, заключили соглашения с рядом издателей (включая материнскую компанию Wired, Condé Nast) об использовании их контента, доступные источники данных сокращаются по мере роста спроса. Meta уже давно использует посты и изображения, которыми пользователи делятся в Facebook и Instagram, для обучения своих ИИ-моделей; также стало известно, что компания использовала активность собственных сотрудников и скриншоты, сделанные пользователями её смарт-очков, для той же цели. Похожие случаи задокументированы у Google и YouTube. Качественные обучающие данные становятся ещё одним стратегическим ресурсом, наравне с чипами, памятью и электроэнергией, которого не хватает ведущим разработчикам ИИ, пытающимся удержать темп инноваций, требуемый рынком.

Ключевые факты

  • Twitch добавил в настройках («Безопасность и конфиденциальность») переключатель «Обучение генеративного ИИ», позволяющий отказаться от использования контента для обучения ИИ-моделей Amazon
  • До появления переключателя опция была включена по умолчанию; когда именно Twitch начал использовать контент стримеров для обучения, неизвестно
  • Более 16 000 авторов на специальном форуме выразили несогласие с использованием их контента по умолчанию
  • Руководитель продукта Twitch Майк Минтон заявил, что default-включение было необходимо, иначе «никто бы не стал участвовать», и предположил, что почти весь публичный контент так или иначе используется для обучения моделей
  • Пользовательское соглашение Twitch с марта 2024 года давало права на использование контента, но не упоминало явно обучение генеративного ИИ; похожие практики уже отмечались у Meta, Google и YouTube

Почему это важно

История показывает типичный паттерн больших платформ: право использовать контент пользователей для обучения ИИ закладывается в пользовательское соглашение заранее и по умолчанию включено, а явная настройка для отказа появляется только после того, как практика становится известна и вызывает недовольство. Пользователи Twitch годами публиковали стримы, не зная, что материалы могут идти на обучение моделей Amazon.

Кому это важно

Стримерам и создателям контента на Twitch, их напрямую касается новая настройка. Также это важно для авторов на других крупных платформах (Meta/Facebook/Instagram, Google/YouTube), где, по данным материала, действуют похожие практики использования пользовательского контента для обучения ИИ.

Как это применить

Стримерам, которые не хотят, чтобы их контент шёл на обучение ИИ Amazon, нужно зайти в настройки аккаунта Twitch (веб или приложение) → аватар → Settings → раздел «Security and Privacy» → пункт «Generative AI Training», и отключить опцию. Важно учитывать: отключение не останавливает использование контента для других целей, перечисленных в политике конфиденциальности Twitch, например, для рекомендаций зрителям, помощи в спонсорских кампаниях и модерации через AutoMod.

Можно ли доверять

Материал Wired опирается на публичное заявление руководителей Twitch (Мэри Киш и Майка Минтона) на трансляции и на текст пользовательского соглашения платформы, поэтому фактическая база выглядит надёжной. При этом ключевые вопросы остаются открытыми: сама статья прямо признаёт, что неизвестно, с какого момента Twitch фактически использовал контент для обучения, и не отвечает, используют ли эти данные партнёры Amazon.

Риски и подводные камни

Настройка отказа не защищает контент полностью, Twitch прямо оговаривает, что материалы всё равно могут использоваться для других целей по политике конфиденциальности. Кроме того, по словам Минтона, публично доступный контент в принципе может собираться сторонними компаниями для обучения ИИ независимо от настроек самой платформы, то есть отказ на Twitch не гарантирует, что контент не попадёт в чужие обучающие датасеты.

«Я не знаю наверняка, но считаю вполне разумным предположить, что практически любой общедоступный контент так или иначе используется для обучения моделей, с разрешения или без. Так что нужно признать: многое здесь находится за пределами даже нашего прямого контроля.»

— Майк Минтон, руководитель отдела продукта Twitch

Компания Meta Platforms признана экстремистской организацией, её деятельность на территории РФ запрещена.