Разработчики формируют набор CVE-уязвимостей для тестирования безопасности ИИ-агентов, работающих на Python. Проект направлен на создание стандартизированного бенчмарка, который позволит оценивать устойчивость агентных систем к эксплуатации известных критических уязвимостей в коде и библиотеках. Это важный шаг для обеспечения безопасности автономных систем, взаимодействующих с внешними средами и исполняющих произвольный код.
Инициатива сфокусирована на выявлении векторов атак, специфичных для агентных архитектур, где модель имеет доступ к выполнению системных команд или управлению файловой системой. В отличие от классических проверок безопасности приложений, здесь акцент делается на способности агента распознавать и предотвращать попытки внедрения вредоносных инструкций через эксплуатацию уязвимых зависимостей.
Создаваемый инструментарий призван помочь разработчикам в автоматизированном тестировании безопасности на этапе интеграции агентов. Использование реальных CVE позволяет моделировать сценарии, с которыми системы сталкиваются в продакшене, обеспечивая более высокую точность оценки рисков по сравнению с синтетическими тестами.
Ключевые факты
- Проект базируется на анализе реальных CVE (Common Vulnerabilities and Exposures) для Python-экосистемы.
- Основная цель — создание воспроизводимого бенчмарка для оценки безопасности ИИ-агентов.
- Тестирование охватывает уязвимости, связанные с выполнением кода и доступом к системным ресурсам.
- Репозиторий открыт для сообщества с целью сбора наиболее актуальных и критических уязвимостей для включения в тестовый набор.