Исследователь использовал модель Gemini 1.5 Pro для автоматизации расшифровки и анализа 300-летних португальских приходских записей. ИИ успешно справился с распознаванием рукописного текста и структурированием неразборчивых данных, что позволило перевести архивные документы в машиночитаемый формат. Этот кейс демонстрирует эффективность больших языковых моделей в задачах оцифровки и обработки сложных исторических архивов, требующих глубокого понимания контекста.

Основная сложность работы с подобными документами заключается в специфическом почерке XVIII века и использовании архаичного португальского языка. Традиционные методы OCR часто оказываются бессильны перед такими задачами, требуя ручного труда палеографов. Использование LLM с большим контекстным окном позволяет модели анализировать целые страницы записей целиком, сохраняя логическую связь между именами, датами и событиями, что значительно ускоряет процесс индексации генеалогических данных.

Результаты эксперимента показывают, что модель способна не только транскрибировать текст, но и извлекать структурированные сущности, такие как имена родителей, даты крещения и местоположения. Это открывает возможности для массовой автоматизации работы с историческими архивами, которые ранее считались труднодоступными для массового анализа из-за объема и сложности рукописного материала.

Ключевые факты

  • Модель Gemini 1.5 Pro использовалась для обработки рукописных приходских записей возрастом 300 лет.
  • ИИ продемонстрировал способность распознавать архаичный португальский язык и специфические стили письма XVIII века.
  • Автоматизация позволила перевести неструктурированные изображения документов в формат структурированной базы данных.
  • Метод значительно сокращает время, необходимое для индексации генеалогических архивов по сравнению с ручным вводом данных.