Разработчики формируют набор CVE-уязвимостей для тестирования безопасности ИИ-агентов, работающих на Python. Проект направлен на создание стандартизированного бенчмарка, который позволит оценивать устойчивость агентных систем к эксплуатации известных критических уязвимостей в коде и библиотеках. Это важный шаг для обеспечения безопасности автономных систем, взаимодействующих с внешними средами и исполняющих произвольный код.

Инициатива сфокусирована на выявлении векторов атак, специфичных для агентных архитектур, где модель имеет доступ к выполнению системных команд или управлению файловой системой. В отличие от классических проверок безопасности приложений, здесь акцент делается на способности агента распознавать и предотвращать попытки внедрения вредоносных инструкций через эксплуатацию уязвимых зависимостей.

Создаваемый инструментарий призван помочь разработчикам в автоматизированном тестировании безопасности на этапе интеграции агентов. Использование реальных CVE позволяет моделировать сценарии, с которыми системы сталкиваются в продакшене, обеспечивая более высокую точность оценки рисков по сравнению с синтетическими тестами.

Ключевые факты

  • Проект базируется на анализе реальных CVE (Common Vulnerabilities and Exposures) для Python-экосистемы.
  • Основная цель — создание воспроизводимого бенчмарка для оценки безопасности ИИ-агентов.
  • Тестирование охватывает уязвимости, связанные с выполнением кода и доступом к системным ресурсам.
  • Репозиторий открыт для сообщества с целью сбора наиболее актуальных и критических уязвимостей для включения в тестовый набор.