Google анонсировала второе поколение специализированной модели Gemini Robotics 2, предназначенной для повышения ловкости и автономности гуманоидных роботов. Технология позволяет машинам лучше интерпретировать физические задачи, быстрее обучаться сложным манипуляциям с объектами и эффективнее взаимодействовать с неструктурированной средой, что является критическим шагом для внедрения робототехники в промышленность и логистику.
Новая архитектура модели фокусируется на улучшении сенсомоторной координации. В отличие от предыдущих версий, ориентированных преимущественно на обработку текста и изображений, Gemini Robotics 2 интегрирует данные с датчиков робота в реальном времени. Это позволяет системе корректировать движения при возникновении непредвиденных препятствий или изменении формы предметов, с которыми работает манипулятор.
Разработка направлена на решение проблемы «неуклюжести» роботов при выполнении бытовых или производственных задач, требующих высокой точности. Интеграция модели в аппаратное обеспечение позволяет сократить время задержки между анализом визуальной сцены и физическим действием, что приближает поведение роботов к человеческим темпам работы в динамических условиях.
Ключевые факты
- Модель Gemini Robotics 2 специально оптимизирована для задач, требующих высокой мелкой моторики и манипуляции объектами разной формы.
- Технология направлена на устранение задержек при обработке сенсорных данных, что критично для безопасности и эффективности в реальном времени.
- Основной фокус применения — автоматизация складских операций и производственных процессов, где роботы сталкиваются с непредсказуемой средой.
- Разработка является частью стратегии Google по расширению присутствия ИИ-технологий в физическом мире через интеграцию мультимодальных моделей в робототехнические платформы.