Новый отчет SaferAI демонстрирует, что открытые модели, такие как GLM-5.2 от Z.ai, практически сравнялись по своим возможностям с передовыми проприетарными системами. Однако стремительный рост производительности сопровождается серьезным дефицитом встроенных механизмов безопасности, что создает разрыв между технологическим прогрессом и существующими методами контроля, вызывая опасения у экспертов по поводу неконтролируемого распространения мощных ИИ-инструментов.
Исследование подчеркивает, что текущие подходы к управлению рисками в открытых моделях не успевают за темпами их развития. В то время как разработчики закрытых систем внедряют многоуровневые фильтры и системы мониторинга на этапе обучения, открытые аналоги часто лишены подобных ограничений. Это позволяет пользователям запускать модели без внешнего надзора, что делает их потенциально уязвимыми для злоупотреблений в различных сферах.
Проблема усугубляется тем, что доступность весов моделей позволяет энтузиастам дообучать их под специфические задачи, зачастую обходя базовые этические настройки. Аналитики SaferAI отмечают, что текущая стратегия регулирования, ориентированная на ограничение доступа к вычислительным мощностям, становится менее эффективной по мере того, как модели становятся компактнее и производительнее, требуя меньших ресурсов для развертывания.
Ключевые факты
- Модель GLM-5.2 от Z.ai продемонстрировала производительность, сопоставимую с лидерами рынка в тестах на логическое мышление и кодинг.
- Отчет SaferAI указывает на отсутствие критических механизмов защиты от генерации вредоносного контента в открытых весах.
- Разрыв в безопасности между закрытыми и открытыми моделями увеличился на 30% за последний год из-за ускорения темпов выпуска новых версий.
- Эксперты призывают к разработке новых стандартов «безопасности по умолчанию» для моделей с открытыми весами, чтобы предотвратить риски неконтролируемого использования.
