Исследование, основанное на 7 020 экспериментах, показало, что выбор конкретного фреймворка для разработки ИИ-агентов практически не влияет на их устойчивость к атакам. Статистический анализ подтвердил, что вклад архитектурного каркаса в итоговый результат безопасности составляет лишь 0,06%. Это означает, что уязвимости агентов зависят от других факторов, а не от выбранного инструментария оркестрации.
Авторы работы провели контролируемое тестирование, используя верифицированные полезные нагрузки для проверки безопасности различных агентных систем. В ходе испытаний оценивалась способность агентов противостоять попыткам манипуляции и несанкционированного выполнения кода. Результаты опровергают распространенное мнение о том, что использование «более безопасных» фреймворков автоматически снижает риски эксплуатации ИИ-систем.
Полученные данные указывают на необходимость смещения фокуса в обеспечении безопасности с уровня инфраструктурных фреймворков на уровень самих моделей, систем промпт-инжиниринга и протоколов контроля доступа. Разработчикам следует уделять больше внимания методам фильтрации входных данных и мониторингу поведения агентов в реальном времени, так как архитектурная оболочка не обеспечивает существенной защиты от целенаправленных атак.
Ключевые факты
- Общий объем выборки составил 7 020 независимых испытаний агентов.
- Вклад выбора фреймворка в итоговую безопасность оценен в 0,06%.
- Исследование базируется на методологии контролируемой проверки полезной нагрузки (payload-verified evaluation).
- Работа подчеркивает, что безопасность агентов определяется не фреймворком, а другими системными факторами.