Исследователи проанализировали более 27 тысяч реальных запросов разработчиков к ChatGPT и обнаружили три активных API-ключа, случайно оставленных в промптах. Это исследование подчеркивает критическую уязвимость: пользователи часто копируют в чат-боты фрагменты кода вместе с секретными данными, не осознавая рисков передачи конфиденциальной информации сторонним сервисам для обработки и обучения моделей.
Проблема заключается в привычке разработчиков использовать LLM для отладки кода или поиска ошибок, не проводя предварительную очистку данных. В ходе эксперимента специалисты использовали автоматизированные инструменты для поиска паттернов, характерных для ключей популярных облачных провайдеров и сервисов разработки. Несмотря на то, что выборка в три ключа может показаться небольшой, она демонстрирует реальную угрозу безопасности корпоративных систем при использовании публичных ИИ-инструментов.
Подобные инциденты указывают на необходимость внедрения строгих политик безопасности при работе с генеративным ИИ. Компании должны ограничивать передачу чувствительных данных в облачные модели или использовать локальные решения, которые исключают отправку кода на внешние серверы. Также актуальным становится использование инструментов автоматического сканирования промптов на наличие секретов перед их отправкой в интерфейс чат-бота.
Ключевые факты
- Общий объем выборки составил 27 075 уникальных промптов, полученных от разработчиков.
- В ходе сканирования было выявлено 3 действующих API-ключа, дающих доступ к внешним сервисам.
- Основным источником утечек стали фрагменты кода, вставленные в чат без предварительной фильтрации.
- Исследование подтверждает риск компрометации инфраструктуры через случайную передачу учетных данных в LLM-интерфейсы.