OpenAI вводит дополнительные меры безопасности для своей новой модели Astra, ограничивая возможности системы в ответ на выявленные риски кибербезопасности. Компания стремится предотвратить использование ИИ для автоматизации вредоносных действий, таких как создание эксплойтов или проведение фишинговых атак, внедряя более строгие протоколы фильтрации запросов и мониторинга поведения модели в режиме реального времени.
Решение принято после проведения серии стресс-тестов, которые показали, что модель способна генерировать сложный код, потенциально применимый для поиска уязвимостей в программном обеспечении. Разработчики интегрировали новые уровни защиты, которые анализируют контекст взаимодействия с пользователем и блокируют попытки эксплуатации специфических системных векторов атак. Эти изменения являются частью стратегии компании по обеспечению «безопасности по умолчанию» для своих наиболее мощных мультимодальных систем.
Помимо технических ограничений, OpenAI пересмотрела внутренние политики доступа для корпоративных клиентов, использующих Astra через API. Теперь для работы с моделью требуется прохождение расширенной верификации, а все подозрительные активности подвергаются автоматическому логированию для последующего аудита. Подобный подход отражает растущее внимание индустрии к предотвращению злоупотреблений генеративными технологиями на этапе их развертывания.
Ключевые факты
- OpenAI ограничила функциональность модели Astra для минимизации рисков кибербезопасности.
- Внедрены новые фильтры, блокирующие генерацию кода, направленного на поиск уязвимостей и проведение атак.
- Введены обязательные процедуры расширенной верификации для корпоративных пользователей API.
- Система мониторинга в реальном времени теперь автоматически логирует подозрительные запросы для последующего анализа.