xAI обвинили в обучении Grok на материалах сексуального насилия над детьми — пострадавшая подала коллективный иск

Против компании xAI Илона Маска подан федеральный иск в Окружной суд Северного округа Калифорнии. Истец под псевдонимом Jane Doe утверждает, что разработчики включили известные материалы сексуального насилия над детьми (CSAM) в тренировочный датасет нейросети Grok, после чего сервис начал генерировать новые синтетические изображения с её внешностью. Дело может стать прецедентным: впервые ИИ-компанию обвиняют не просто в слабой фильтрации запросов, а в прямом использовании запрещённого контента для обучения модели.
Цифровые отпечатки и обход глобальных баз NCMEC
Пострадавшая стала жертвой преступления в дошкольном возрасте в начале 2000-х годов. Созданные тогда материалы десятилетиями циркулировали в сети, а их цифровые хэши были внесены в реестры правоохранительных органов и Национального центра пропавших и эксплуатируемых детей (NCMEC). Стандартные системы веб-фильтрации используют эти хэш-суммы для автоматической блокировки файлов без участия модераторов.
Как сообщает Ars Technica, о появлении новых изображений женщине сообщили специалисты Канадского центра защиты детей (Canadian Centre for Child Protection). По версии следствия, пользователи на открытых веб-форумах генерировали нелегальный контент с лицами реальных жертв.
В иске подчёркивается главная технологическая опасность генеративного ИИ: когда нейросеть берет за основу реальное лицо и синтезирует новый кадр, файл получает уникальный цифровой отпечаток. В результате традиционные базы хэшей NCMEC оказываются бессильны — они не способны автоматически обнаружить и заблокировать сгенерированный материал.
Обучается ли Grok на каждой генерации: юридические тонкости
В вирусных публикациях утверждалось, что Grok якобы отправляет абсолютно каждый результат генерации обратно в тренировочную базу. В юридических документах формулировка мягче, однако риски подтверждаются официальными правилами платформы.
Согласно справочному центру соцсети X и пользовательскому соглашению xAI, компания оставляет за собой право использовать:
- публичные посты и медиафайлы пользователей;
- текстовые промпты и загружаемые в чат изображения;
- сгенерированные моделью результаты,
если пользователь вручную не отключил сбор данных в настройках приватности или не активировал режим Private Chat. Адвокаты настаивают: если запрещённые изображения попадали в публичный доступ или чаты, они могли повторно оседать в обучающем конвейере нейросети. При этом публичных технических доказательств состава исходного датасета xAI сторона обвинения пока не предоставила.
Действующие фильтры xAI и претензии к чистоте датасета
Утверждения о том, что у xAI вовсе отсутствуют правила безопасности, не соответствуют действительности. В действующей политике допустимого использования xAI прямо прописан строгий запрет на любую сексуализацию и эксплуатацию несовершеннолетних, а система модерации предусматривает обязательную отправку отчётов в NCMEC.
Однако претензия юристов касается этапа первичного сбора данных (pre-training). В официальной документации стартапа указано, что компания очищает обучающие массивы от сцен насилия, но в открытых описаниях фильтрации тренировочных данных напрямую не детализированы механизмы отсева CSAM и несанкционированного интимного контента.
Проблема «машинного забывания» (Machine Unlearning)
Один из сложнейших технических аспектов дела связан с архитектурой нейросетей. Модель не хранит картинки в виде файлов на диске — информация преобразуется в миллиарды математических весов и связей.
Удалить исходный файл с сервера просто, однако полностью стереть влияние конкретного обучающего примера на готовую нейросеть требует сложнейших процедур machine unlearning или полного переобучения модели с нуля за десятки миллионов долларов. В иске утверждается, что xAI не предоставила доказательств проведения подобных процедур очистки весов Grok.
Масштаб проблемы: иски на тысячи изображений и реакция Маска
Это далеко не первое судебное разбирательство вокруг генератора xAI:
- В марте 2026 года иски против компании подали семьи трёх девушек, чьи подростковые снимки использовались для создания дипфейков;
- В августе жительница Вайоминга заявила в суде, что её детский снимок был использован для создания более 7000 порнографических генераций;
- По оценке исследовательской группы Center for Countering Digital Hate (CCDH), в пиковый период доступности функций редактирования Grok всего за 11 дней сгенерировал порядка 3 млн изображений сексуального характера, из которых около 23 тысяч могли изображать несовершеннолетних.
Сама xAI отрицает сознательное попустительство. В июле компания подала встречный иск против пользователя, создававшего запрещённый контент, заявив, что за год заблокировала свыше 52 тысяч аккаунтов, передала в NCMEC более 73 тысяч сигналов и помогла правоохранителям арестовать как минимум 244 злоумышленника.
Требования коллективного иска
В заявлении юридической фирмы Girard Sharp отмечается, что Jane Doe требует присвоить иску общенациональный коллективный статус в интересах тысяч потенциальных жертв.
Иск опирается на федеральный закон США Masha’s Law. Истица требует выплаты денежной компенсации, принудительного уничтожения всех созданных копий запрещённого контента на серверах xAI и внедрения строгих технологических барьеров, исключающих повторное попадание подобных данных в ИИ-пайплайны. Представители xAI на момент публикации официальных комментариев по новому иску не дали.