Newsday и seattle times подали в суд на openai и microsoft из-за обучения ИИ на статьях

4 минут чтения

Newsday и Seattle Times обратились в суд из-за использования материалов для обучения ИИ

Американские газеты Seattle Times и Newsday подали иск против OpenAI и Microsoft, обвинив компании в незаконном использовании журналистских материалов при разработке и обучении генеративных нейросетей. По мнению издателей, деятельность технологических корпораций создает серьезную угрозу для всей медиаиндустрии и способна подорвать экономическую основу профессиональной журналистики.

Документ был направлен в американский суд. В нем утверждается, что публикации газет могли использоваться в массивах данных для обучения систем искусственного интеллекта без получения разрешения и без выплаты компенсации правообладателям.

Газеты заявили об угрозе для журналистики

В иске генеративный искусственный интеллект сравнивается со "змеей, пожирающей собственный хвост". Авторы документа считают, что нейросети потребляют материалы, созданные журналистами, а затем используют их для генерации новых текстов, которые могут частично заменять оригинальные публикации и снижать спрос на работу редакций.

Представители изданий подчеркивают: продукты на базе ИИ позиционируются как инструменты для создания контента, однако фактически они способны выступать его агрессивными потребителями. Сначала алгоритмы анализируют статьи, репортажи и другие материалы, а затем формируют пересказы, имитации и ответы, основанные на переработанных фрагментах уже существующих произведений.

По версии истцов, такая модель ведет к неравному распределению выгоды. Технологические компании получают коммерческий доход от нейросетевых продуктов, тогда как редакции, создающие исходный контент, могут терять аудиторию, рекламные поступления и подписчиков.

Особое внимание к сотрудничеству Microsoft и Seattle Times

Иск Seattle Times выглядит особенно примечательным на фоне прежнего сотрудничества газеты с Microsoft и OpenAI. Технологические компании ранее финансировали отдельные журналистские проекты и стипендиальные программы издания.

Истцы фактически ставят вопрос о границах такого партнерства: поддержка отдельных инициатив, по их мнению, не означает автоматического согласия на масштабное использование всего архива публикаций для обучения коммерческих моделей искусственного интеллекта. Газета также может настаивать на том, что подобные отношения не отменяют необходимости получать отдельные лицензии на использование авторских материалов.

Спор выходит за рамки одного дела

Конфликт между СМИ и разработчиками нейросетей продолжается уже несколько лет. В 2023 году The New York Times также подала иск против OpenAI и Microsoft, заявив о предполагаемом нарушении авторских прав. Издание утверждало, что его публикации использовались при создании и обучении ИИ-систем, а ответы чат-ботов иногда содержали значительные фрагменты материалов газеты.

Кроме того, в конце прошлого года журналист и писатель Джон Каррейру вместе с группой авторов инициировал отдельное разбирательство против шести крупных компаний, работающих в сфере искусственного интеллекта. Эти процессы показывают, что претензии к разработчикам нейросетей выдвигают не только крупные медиахолдинги, но и отдельные создатели контента.

Почему авторские права стали главным предметом спора

Современные генеративные модели обучаются на огромных объемах информации. В такие наборы могут входить книги, новости, фотографии, научные публикации и материалы с сайтов. Главный юридический вопрос заключается в том, можно ли считать обучение нейросети самостоятельным видом использования произведения и требуется ли для этого согласие правообладателя.

Технологические компании могут утверждать, что анализ данных является преобразующей обработкой, а итоговые ответы не представляют собой прямое воспроизведение конкретной статьи. Издатели, напротив, считают, что без качественных оригинальных материалов нейросети не смогли бы выдавать содержательные результаты, а значит, создатели контента должны участвовать в распределении дохода.

Возможные последствия для рынка

Разбирательства способны повлиять на всю систему работы цифровых медиа. Если суды признают использование публикаций нарушением авторских прав, разработчикам придется заключать лицензионные соглашения с издателями, ограничивать доступ моделей к отдельным архивам или внедрять новые механизмы контроля данных.

Для редакций это может стать источником дополнительной выручки. Крупные газеты получат возможность продавать лицензии на архивы, устанавливать правила использования текстов и контролировать появление своих материалов в ответах чат-ботов.

Одновременно возможен и противоположный сценарий. Если суды встанут на сторону технологических компаний, СМИ придется искать другие способы защиты: усиливать технические ограничения, закрывать архивы от автоматизированного сканирования и активнее развивать платную подписку.

Риски для читателей и качества информации

Издатели обеспокоены не только финансовыми потерями. Массовое распространение автоматически созданных текстов может привести к снижению качества информационной среды. Нейросеть способна пересказывать публикации без понимания редакционного контекста, допускать фактические ошибки и смешивать проверенные сведения с недостоверными данными.

Если аудитория начнет получать новости преимущественно через чат-ботов, оригинальные редакции могут потерять прямой контакт с читателями. Это усложнит финансирование расследований, работу корреспондентов и подготовку материалов, требующих значительных временных и человеческих ресурсов.

Что может измениться в отношениях СМИ и ИИ-компаний

Одним из вероятных результатов судебных процессов станет формирование новых правил сотрудничества. Издатели могут потребовать прозрачного раскрытия наборов данных, уведомлений об использовании контента и регулярных выплат за доступ к архивам.

В перспективе рынок способен перейти к модели, при которой нейросети будут использовать журналистские материалы только на основании договоров. В таких соглашениях могут быть прописаны сроки лицензии, перечень разрешенных публикаций, порядок атрибуции и ограничения на воспроизведение оригинальных текстов.

Дела Newsday и Seattle Times становятся частью более широкого спора о том, кому принадлежат данные, на которых строится искусственный интеллект. Их итог может определить не только условия работы OpenAI и Microsoft, но и будущее цифровой журналистики, авторского права и всей экономики создания контента.

Прокрутить вверх