Google DeepMind анонсировала обновление своей специализированной модели Gemini Robotics 2, которая теперь способна управлять движениями всего тела гуманоидных роботов. В отличие от предыдущей версии, сфокусированной на манипуляциях верхней частью корпуса, новая разработка обеспечивает координацию конечностей от стоп до кончиков пальцев, позволяя роботам выполнять сложные перемещения и взаимодействия с окружающим пространством.

Технология базируется на мультимодальных возможностях архитектуры Gemini, адаптированной для обработки сенсорных данных в реальном времени. Модель переводит команды высокого уровня в последовательности моторных действий, что значительно упрощает программирование робототехники. Это позволяет гуманоидам быстрее адаптироваться к новым задачам, требующим баланса и точной моторики, без необходимости написания жестких алгоритмов для каждого отдельного сустава.

Интеграция Gemini Robotics 2 направлена на повышение автономности роботов в неструктурированных средах, таких как склады или производственные площадки. Модель способна интерпретировать визуальные сигналы и текстовые инструкции, преобразуя их в физические действия. Такой подход сокращает разрыв между абстрактным планированием ИИ и физическим исполнением, открывая путь к созданию более универсальных помощников для промышленности и сферы услуг.

Ключевые факты

  • Gemini Robotics 2 обеспечивает управление всеми частями тела гуманоида, включая ноги и руки.
  • Модель использует мультимодальные возможности Gemini для обработки визуальной и сенсорной информации.
  • Основной фокус разработки — переход от управления только манипуляторами к полноценной координации движений всего робота.
  • Технология предназначена для повышения автономности роботов в сложных и меняющихся условиях эксплуатации.