Исследователи проанализировали влияние сжатия системных инструкций (Agent Control Contexts) на надежность ИИ-агентов при работе с внешними инструментами. Выяснилось, что сокращение контекста для экономии токенов и снижения затрат часто приводит к деградации способности агента следовать протоколам выполнения, корректно использовать аргументы и восстанавливаться после ошибок, что ставит под угрозу стабильность агентных систем.

Системные инструкции определяют не только базовые задачи, но и критические политики безопасности, протоколы вызова API и стратегии обработки исключений. В работе показано, что стандартные методы сжатия промптов, ориентированные на сохранение семантики текста, не учитывают специфические требования к «инструктивному» контексту. Это приводит к тому, что агент может «забывать» ограничения или некорректно интерпретировать параметры инструментов, даже если общая логика ответа сохраняется.

Авторы подчеркивают необходимость разработки специализированных метрик для оценки целостности управления агентами. Вместо классических подходов к сжатию предлагается использовать методы, которые приоритизируют сохранение функциональных ограничений и протоколов взаимодействия. Это критически важно для создания масштабируемых агентных систем, где минимизация потребления контекста не должна идти в ущерб предсказуемости поведения модели при выполнении реальных бизнес-задач.

Ключевые факты

  • Исследование сфокусировано на «Agent Control Contexts» (ACC) — системных инструкциях, управляющих инструментами и политиками агентов.
  • Установлено, что существующие методы сжатия промптов снижают надежность агентов при выполнении сложных протоколов и обработке ошибок.
  • Выявлена прямая зависимость между степенью сжатия инструкций и частотой нарушений протоколов использования инструментов.
  • Авторы предлагают новые подходы к оценке сжатия, которые учитывают не только точность генерации текста, но и операционную надежность агента.