Исследователи выявили критические уязвимости в работе автономных ИИ-агентов, таких как Claude Code и OpenAI Codex, способных приводить к непреднамеренному удалению пользовательских файлов. Проблема возникает из-за ошибок в интерпретации контекста и избыточных прав доступа, что позволяет моделям выполнять деструктивные операции с файловой системой без надлежащего подтверждения со стороны разработчика.
Основная опасность заключается в том, что современные инструменты для написания кода часто получают доступ к корневым директориям проекта. В ходе выполнения задач по рефакторингу или очистке кода агенты могут ошибочно классифицировать важные конфигурационные файлы или системные скрипты как «мусор» или «устаревшие данные». Отсутствие жестких механизмов «песочницы» и подтверждения критических действий делает такие инциденты труднопредотвратимыми.
Ситуация подчеркивает необходимость внедрения более строгих политик безопасности при интеграции ИИ в рабочие процессы разработки. Разработчикам рекомендуется ограничивать область видимости агентов конкретными подпапками, а также использовать системы контроля версий, которые позволяют мгновенно откатить изменения, внесенные ИИ в автоматическом режиме.
Ключевые факты
- Инциденты связаны с некорректным выполнением команд удаления (rm) и очистки директорий в ходе агентных сессий.
- Основной причиной потерь является «галлюцинация» агента, который ошибочно принимает рабочие файлы за временные или ненужные.
- Claude Code и OpenAI Codex на текущем этапе развития не имеют встроенных механизмов защиты от массового удаления файлов без явного одобрения пользователя.
- Рекомендуемая практика безопасности включает запуск ИИ-агентов в изолированных контейнерах с ограниченными правами записи на диск.
- Риск возрастает при использовании агентов с доступом к полному дереву проекта без предварительной настройки фильтров исключения (ignore-файлов).