Представители Twitch объявили, что стримы на платформе потенциально могут стать материалом для тренировки моделей GenAI в рамках сотрудничества с Amazon. В обучении нейросетей может использоваться всё, начиная от самих трансляций и заканчивая сообщениями в чате. Также это распространяется на записи, хайлайты и текстовые материалы канала. Впервые внимание сообщества к этому нововведению привлекли 12 августа, через аккаунт поддержки "Твича" в социальной сети X.

В сообщении указано, что пользователи могут "отказаться от использования контента своего канала в тренировках ИИ моделей Amazon" через настройки профиля. Пользователи обратили внимание на следующие детали:
- Ни Twitch, ни Amazon не делали большого объявления о потенциальной кампании по тренировке ИИ через стримы, из-за чего многие впервые узнали об этой возможности только через сообщение поддержки;
- По умолчанию сбор данных для ИИ включён у всех пользователей — чтобы избежать использования своих материалов специалистами "Амазона", необходимо зайти в настройки и отказаться от этого;
- Как следует из обновлённой секции "Часто Задаваемых Вопросов" (FAQ) платформы Twitch, отказ от сбора данных не гарантирует исключения контента пользователя из программы тренировок — к примеру, если в чате есть хоть один человек, что не отказался от этой функции, то все сообщения в переписке могут быть использованы в обучении ИИ.
Обратив внимание на реакцию пользователей, представители Twitch провели специальный стрим, где постарались ответить на вопросы пользователей относительно нововведения. Трансляцию провели глава сообщества Мэри Киш и руководитель продуктового отдела Майк Минтон. Несмотря на надежды пользователей, стрим не стал площадкой для обсуждения корректности внедрения нового функционала — ведущие трансляции неоднократно подчеркивали, что "их руки связаны", и они могут лишь ответить на некоторые вопросы в рамках стрима.
Так, одним из главных запросов сообщества в начале разговора стала возможность отключить сбор данных ИИ для всех пользователей по умолчанию, позволив каждому осознанно принять решение о допуске специалистов к их данным для обучения нейросетевых моделей. Ответ Минтона был неожиданно прямолинеен:
Все в чате спамят "сделайте программу opt in, а не opt out". Я отвечу честно, и, полагаю, многие из вас оценят эту честность — если бы на эту функцию нужно было сознательно соглашаться, никто бы на это не пошёл
Руководитель продуктового отдела Twitch Майк Минтон
Он также добавил, что сбор данных для ИИ — стандарт для всей индустрии, и множество компаний ежедневно получают доступ к контенту пользователей без какого-либо уведомления. Минтон подчеркнул, что Twitch делает шаг навстречу пользователям тем, что по крайней мере даёт им опцию отказаться от доступа моделей к своим данным, так как представители площадки понимают, что подавляющее большинство рядовых пользователей не поддерживают массовое внедрение нейросетей в свою жизнь.
Также в рамках стрима прозвучал ряд других важных тезисов:
- Данное решение было принято сотрудниками Amazon, которые имеют полный контроль над Twitch. У руководителей стриминговой платформы нет никакой возможности отказаться от данной кампании;
- Ранее "Твич" не участвовал в целенаправленном сборе и/или продаже данных пользователей для обучения ИИ, а внедрение настройки является превентивной мерой для подобных действий в будущем, если они состоятся — решение пока не принято окончательно;
- При этом ведущие не могут однозначно ответить, использовал ли "Амазон" какие-либо материалы площадки для разработки моделей ранее без предупреждения пользователей;
- Twitch понимает беспокойство сообщества, и многие сотрудники платформы разделяют его. Мэри Киш заявила, что большое количество отказов от участия в сборе данных может стать аргументом в переговорах с Amazon об отказе от подобной практики;
- Часть положений относительного данного нововведения защищены соглашением о неразглашении — из-за чего ни ведущие трансляции, ни другие сотрудники "Твич" не могут раскрыть всех деталей и ответить на все вопросы относительно нововведений.
На момент публикации представители Amazon никак не прокомментировали ситуацию с обучением нейросетевых моделей на базе Twitch. Известно лишь, что подобные данные в будущем могут быть использованы для улучшения выдачи по запросам на генерацию текста, видео и изображений.