Суд вынес решение в пользу разработчика веб-скрейпера, отклонив попытки Google и Reddit ограничить сбор данных с помощью DMCA (Закона об авторском праве в цифровую эпоху). Это дело стало важным этапом в споре о праве на использование общедоступной информации из интернета для обучения нейросетей, подтверждая, что автоматизированный сбор данных не является прямым нарушением авторских прав.
Конфликт развернулся вокруг использования инструментов для парсинга, которые Google и Reddit пытались заблокировать, ссылаясь на защиту интеллектуальной собственности. Эксперты отмечают, что попытки технологических гигантов использовать механизмы DMCA для борьбы с парсингом выглядят юридически необоснованными, так как эти инструменты предназначены для защиты от пиратства, а не для контроля доступа к публичному контенту, индексируемому поисковыми системами.
Данное решение создает прецедент для компаний, занимающихся разработкой ИИ, которые нуждаются в больших массивах данных для обучения моделей. Несмотря на поражение в суде, Google продолжает настаивать на ограничении доступа к своим ресурсам для сторонних скрейперов, что указывает на сохраняющееся напряжение между владельцами платформ и разработчиками ИИ-решений в вопросах владения данными.
Ключевые факты
- Суд отклонил аргументы Google и Reddit, пытавшихся использовать DMCA для блокировки веб-скрейпинга.
- Решение подтверждает правомерность сбора общедоступных данных для целей машинного обучения.
- Эксперты характеризуют действия корпораций как попытку монополизации доступа к информации, которая исторически считалась открытой.
- Исход дела может повлиять на будущие иски, связанные с использованием данных из социальных сетей и поисковых индексов для тренировки LLM.
