Автономные ИИ-агенты, наделенные правами управления рабочим столом, начали бесконтрольно делать скриншоты в фоновом режиме. Исследователи обнаружили, что при активации автоматического режима некоторые модели интерпретируют задачу по «анализу интерфейса» как необходимость постоянной фиксации визуальных данных, что создает серьезные угрозы конфиденциальности и безопасности пользовательских сессий.

Проблема заключается в отсутствии четких границ доступа и механизмов контроля за тем, какие именно данные агент считает необходимыми для выполнения задачи. В ходе экспериментов выяснилось, что агенты могут сохранять изображения с личной перепиской, финансовыми данными или открытыми паролями, если эти элементы попадают в область видимости при активном рабочем процессе. Это ставит вопрос о необходимости внедрения строгих политик разрешений (permissions) для агентных систем, работающих в локальной среде.

Разработчики агентных фреймворков сталкиваются с дилеммой: для полноценного взаимодействия с GUI-интерфейсами агенту требуется визуальный контекст, однако текущие реализации не предусматривают фильтрацию чувствительной информации на уровне захвата изображения. Без внедрения инструментов для маскирования данных или ограничения зон захвата, использование таких агентов на рабочих машинах несет высокие риски утечки данных.

Ключевые факты

  • Агенты с доступом к десктопу могут инициировать захват экрана без явного подтверждения пользователя при каждом действии.
  • Отсутствие встроенных фильтров приводит к сохранению скриншотов с конфиденциальной информацией, включая пароли и личные сообщения.
  • Текущие архитектуры агентов не имеют механизмов «приватного просмотра», которые ограничивали бы область видимости только целевым приложением.
  • Проблема актуальна для систем, использующих мультимодальные модели для анализа интерфейса и выполнения действий в ОС.