Платформа для хостинга репозиториев Codeberg внесла изменения в свои Условия использования (ToU), официально запретив использование размещенного кода для обучения генеративных моделей без явного согласия владельцев. Это решение направлено на защиту авторских прав разработчиков и предотвращение несанкционированного сбора данных (скрейпинга) для тренировки нейросетей, что становится важным прецедентом для открытых сообществ.
Новые правила прямо классифицируют автоматизированный сбор данных для обучения ИИ как «нежелательное использование» ресурсов платформы. В отличие от многих других площадок, Codeberg делает акцент на праве авторов контролировать использование их интеллектуальной собственности в контексте машинного обучения. Это изменение отражает растущее беспокойство в open-source сообществе относительно того, как крупные технологические компании используют публично доступный код для создания коммерческих моделей.
Реализация запрета опирается на юридическое закрепление статуса контента, размещенного на платформе. Теперь пользователи, загружая свой код, могут быть уверены, что площадка официально выступает против его использования в целях обучения ИИ-систем без разрешения. Это создает дополнительный барьер для разработчиков моделей, которые ранее полагались на свободный доступ к репозиториям для формирования обучающих выборок.
Ключевые факты
- Codeberg добавил пункт в Условия использования, запрещающий «извлечение данных для обучения ИИ» (LLM-extrusions).
- Запрет распространяется на автоматизированный сбор кода с платформы без явного согласия правообладателей.
- Изменения направлены на защиту интеллектуальной собственности разработчиков, публикующих проекты в открытом доступе.
- Решение принято в ответ на обеспокоенность сообщества по поводу неконтролируемого использования кода для тренировки нейросетей.