Когда Google DeepMind всерьёз заходит в embodied AI, это меняет темп всей гонки: роботы становятся фронтиром больших моделей, а не нишевой боковой веткой.

В 2025 году большая языковая модель уже никого не удивляла сама по себе. Следующий вопрос звучал жёстче: сможет ли эта интеллектуальная мощность выйти из текстового интерфейса в физический мир и работать с предметами, пространством и телом машины?

Gemini Robotics стала одним из самых важных ответов на этот вопрос. Google DeepMind показала, что семейство Gemini можно адаптировать не только к разговору и поиску, но и к embodied задачам, где нужны восприятие, планирование и действия в реальной среде.

Статус технологии

Есть прототип и подтверждённая инженерная гипотеза, но до масштабной эксплуатации далеко.

5 фактов

  • Анонс Gemini Robotics и Gemini Robotics-ER состоялся 12 марта 2025.
  • Google DeepMind описала Gemini Robotics как наиболее продвинутую vision-language-action модель компании на тот момент.
  • Gemini Robotics-ER была представлена как embodied reasoning модель для робототехнических программ и планирования.
  • В апреле Google отдельно показала внутреннюю кухню построения семейства Gemini Robotics.

Кто стоит за этой историей

  • Люди: Carolina Parada
  • Организации: Google DeepMind
  • Технологии: vision-language-action models, robotics, embodied reasoning

Что это значит

Этот релиз важен для понимания всей отрасли. Когда big tech вкладывается в embodied AI, робототехника получает не только капитал и PR, но и новые вычислительные, дата- и модельные масштабы.

Для читателя Х.SPACE это одна из тех историй, где важнее смотреть не на вау-видео, а на скорость переноса моделей в устойчивые физические навыки.

Источники