Google DeepMind анонсувала платформу Gemini Robotics 2 — нову версію системи штучного інтелекту для керування роботами, які можуть виконувати побутові завдання. На відміну від попередньої моделі, новинка забезпечує «інтелектуальне керування всім тілом», що дозволяє роботам координувати рухи всього корпусу, а не лише маніпулювати руками, повідомляє Engadget.
Компанія опублікувала відео, на якому роботи виконують різні побутові справи: прибирають сміття, переносять лійку для поливу, вставляють аудіокасету в магнітофон, закручують лампочку та зав’язують пакет зі сміттям. Google наголошує, що це реальні кадри роботи «повністю автономних» роботів у режимі реального часу.
Попередня версія Gemini Robotics дозволяла роботам виконувати делікатні операції, як-от закривати пакети із застібкою чи складати орігамі, але система керувала лише руками. Gemini Robotics 2 працює комплексніше: у роботах одночасно функціонують кілька моделей штучного інтелекту, зокрема модель комп’ютерного зору та розуміння мови для аналізу навколишнього середовища, а також дві моделі «зір – мова – дія» для керування рухами тіла і маніпуляціями руками. Такий мультимодальний підхід покращує сприйняття обстановки та координацію дій.
У Google підкреслюють, що роботи не є універсальними помічниками. Кожна дія, показана у відео, проходила окреме навчання за допомогою дистанційного керування людьми, відеоприкладів і комп’ютерного моделювання. Робот не здатен автоматично виконувати нові завдання на основі загальних знань.
У компанії називають це кроком до створення «фізичного AGI» — універсального штучного інтелекту, який зможе виконувати будь-які фізичні дії на рівні людини. Керівниця напряму робототехніки Google DeepMind Кароліна Парада наголосила: «Питання безпеки стає ще важливішим, тому що роботи працюватимуть у значно більшій кількості різних ситуацій. Виникатиме багато невизначеності, тому ми хочемо набагато глибше зрозуміти всі аспекти безпеки».
Google реалізувала багаторівневу систему запобіжників, яка контролює роботу моделей штучного інтелекту. Також представлено тест ASIMOV-Agentic, що оцінює потенційні небезпечні наслідки команд ще до їх виконання. Компанія наголошує, що до появи споживчих роботів ще далеко, і Gemini Robotics 2 перебуває на ранньому етапі розвитку.
Цей підхід відрізняється від заяв Tesla, де Ілон Маск прогнозував масове виробництво роботів Optimus і їхнє широке застосування вже до 2025–2026 років. Проте ці прогнози поки не справдилися, а одна з демонстрацій Tesla викликала сумніви через дистанційне керування роботами операторами. Google робить акцент на автономності своїх систем і визнає, що до створення універсальних роботів, здатних виконувати будь-яку людську роботу, ще залишаються технічні виклики.

