Исследователи обнаружили критическую уязвимость в инфраструктуре Hugging Face, которая позволила злоумышленникам перехватить контроль над моделью OpenAI. Атака продемонстрировала серьезные риски в цепочке поставок ИИ-решений, где доверенные платформы могут стать вектором для внедрения вредоносного кода в популярные веса моделей, используемые тысячами разработчиков по всему миру для создания собственных приложений.

Инцидент произошел из-за манипуляций с конфигурационными файлами и механизмом загрузки моделей, что позволило подменить легитимные веса на скомпрометированные версии. Это поставило под угрозу безопасность систем, полагающихся на открытые репозитории для развертывания ИИ-агентов. Эксперты отмечают, что текущие методы проверки целостности моделей в публичных хабах недостаточны для защиты от целевых атак на инфраструктуру доставки контента.

Проблема подчеркивает необходимость внедрения строгих протоколов верификации цифровых подписей для всех загружаемых весов. Разработчики инфраструктурных решений теперь вынуждены пересматривать подходы к безопасности RAG-систем и агентных сред, которые автоматически подтягивают зависимости из внешних источников, не проводя глубокого аудита содержимого файлов на предмет скрытых бэкдоров или вредоносных инструкций.

Ключевые факты

  • Атака была направлена на платформу Hugging Face, через которую злоумышленники получили доступ к управлению моделью OpenAI.
  • Вектор атаки использовал уязвимости в процессе обработки конфигурационных файлов, позволяя подменять веса моделей.
  • Инцидент выявил критическую слабость в цепочке поставок ИИ, где доверие к платформе-хостингу заменяет проверку безопасности кода.
  • Эксперты призывают к обязательному внедрению криптографической подписи для всех весов моделей, размещаемых в открытом доступе.
  • Масштаб угрозы затрагивает тысячи компаний, использующих готовые модели для построения собственных агентных систем и RAG-пайплайнов.