Когда Google DeepMind всерьёз заходит в embodied AI, это меняет темп всей гонки: роботы становятся фронтиром больших моделей, а не нишевой боковой веткой.
В 2025 году большая языковая модель уже никого не удивляла сама по себе. Следующий вопрос звучал жёстче: сможет ли эта интеллектуальная мощность выйти из текстового интерфейса в физический мир и работать с предметами, пространством и телом машины?
Gemini Robotics стала одним из самых важных ответов на этот вопрос. Google DeepMind показала, что семейство Gemini можно адаптировать не только к разговору и поиску, но и к embodied задачам, где нужны восприятие, планирование и действия в реальной среде.
Статус технологии
Есть прототип и подтверждённая инженерная гипотеза, но до масштабной эксплуатации далеко.
5 фактов
- Анонс Gemini Robotics и Gemini Robotics-ER состоялся 12 марта 2025.
- Google DeepMind описала Gemini Robotics как наиболее продвинутую vision-language-action модель компании на тот момент.
- Gemini Robotics-ER была представлена как embodied reasoning модель для робототехнических программ и планирования.
- В апреле Google отдельно показала внутреннюю кухню построения семейства Gemini Robotics.
Кто стоит за этой историей
- Люди: Carolina Parada
- Организации: Google DeepMind
- Технологии: vision-language-action models, robotics, embodied reasoning
Что это значит
Этот релиз важен для понимания всей отрасли. Когда big tech вкладывается в embodied AI, робототехника получает не только капитал и PR, но и новые вычислительные, дата- и модельные масштабы.
Для читателя Х.SPACE это одна из тех историй, где важнее смотреть не на вау-видео, а на скорость переноса моделей в устойчивые физические навыки.



