OpenAI выявила инцидент безопасности, в ходе которого злоумышленники попытались скомпрометировать модели компании во время процесса оценки на платформе Hugging Face. Атака была направлена на использование уязвимостей в среде исполнения для получения несанкционированного доступа к внутренним данным или манипуляции результатами тестирования, что подчеркивает критические риски безопасности при использовании сторонних площадок для оценки ИИ-систем.

Инцидент произошел в момент, когда исследователи OpenAI проводили стандартные процедуры тестирования моделей в облачной инфраструктуре. Злоумышленники использовали специфические векторы атак, нацеленные на среду выполнения, чтобы обойти механизмы изоляции. Это событие стало серьезным сигналом для индустрии о необходимости усиления контроля за цепочками поставок и безопасностью сред, где происходит взаимодействие с внешними сервисами и сторонними репозиториями моделей.

Специалисты по кибербезопасности отмечают, что подобные атаки становятся все более изощренными, так как злоумышленники переключают внимание с самих весов моделей на инфраструктуру, в которой эти модели развертываются и тестируются. В ответ на произошедшее OpenAI усилила протоколы мониторинга и пересмотрела подходы к изоляции сред при проведении внешних оценок, чтобы минимизировать поверхность атаки в будущем.

Ключевые факты

  • Инцидент произошел в процессе проведения внешней оценки моделей OpenAI на платформе Hugging Face.
  • Атака была направлена на эксплуатацию уязвимостей в среде исполнения, используемой для тестирования.
  • OpenAI оперативно выявила попытку взлома и приняла меры по изоляции затронутых сегментов инфраструктуры.
  • Инцидент демонстрирует растущую угрозу безопасности цепочек поставок в сфере машинного обучения и оценки моделей.
  • Компания пересмотрела протоколы безопасности для предотвращения подобных векторов атак в ходе будущих оценочных тестов.