Исследователи из Стэнфордского университета представили System Prompt Index — открытую базу данных, содержащую более 1000 системных инструкций для ведущих языковых моделей, включая ChatGPT, Claude и Gemini. Проект позволяет изучить, как разработчики настраивают поведение ИИ, задают ограничения и определяют стилистику общения, предоставляя прозрачный взгляд на «внутреннюю кухню» современных чат-ботов.

Системный промпт является фундаментом, на котором строится взаимодействие пользователя с моделью. Он определяет не только базовые правила безопасности и этики, но и специфические паттерны поведения, которые отличают одну модель от другой. Публикация такого объема данных дает возможность исследователям и разработчикам анализировать эволюцию инструкций и их влияние на качество ответов, а также выявлять закономерности в проектировании системных сообщений.

База данных охватывает широкий спектр моделей, от популярных коммерческих решений до специализированных версий. Доступ к этим данным помогает лучше понять, как именно разработчики пытаются минимизировать галлюцинации, предотвращать нежелательный контент и задавать тон общения. Это важный шаг к демистификации того, как именно «мыслят» и реагируют современные ИИ-системы на уровне их базовых конфигураций.

Ключевые факты

  • В базу System Prompt Index включено более 1000 уникальных системных инструкций.
  • Проект охватывает промпты для моделей от OpenAI, Anthropic, Google и других крупных разработчиков.
  • Ресурс позволяет отслеживать изменения в системных инструкциях с течением времени.
  • Данные доступны для анализа в открытом доступе на специализированном портале.
  • Проект направлен на повышение прозрачности в области разработки и настройки LLM.