Présentation de Gemini Robotics 2
Google DeepMind a annoncé la dernière version de son modèle d'intelligence artificielle Gemini Robotics, capable de contrôler l'ensemble d'un robot humanoïde. Alors que le modèle précédent se concentrait sur le contrôle du haut du corps, Gemini Robotics 2 prend en charge les « mouvements de tout le corps », allant des pieds aux doigts.
Fonctionnement de Gemini Robotics 2
Ce nouveau modèle permet aux robots humanoïdes d'effectuer une gamme plus large d'actions, telles que marcher, s'accroupir, s'étirer et manipuler des objets. Les vidéos partagées par Google montrent comment le robot Apollo 2 d'Apptronik peut se pencher pour ramasser un arrosoir ou trouver et prendre des articles spécifiques sur une étagère.
Améliorations et limites
Google DeepMind note que ses robots « ont encore à progresser en termes de vitesse de mouvement », mais que cette mise à jour est une étape importante vers les compétences nécessaires pour effectuer des tâches plus complexes et réelles qui nécessitent une coordination de tout le corps. De plus, Gemini Robotics 2 prend en charge une meilleure dextérité, car il peut maintenant contrôler des mains plus complexes à cinq doigts.
Implications et sécurité
Google DeepMind met également à jour Gemini Robotics ER, un modèle de raisonnement incarné qui aide les robots à analyser leur environnement, à traiter les instructions et à effectuer des tâches multétapes. Gemini Robotics ER 2 est meilleur pour terminer des tâches sur une période prolongée et « comprend maintenant quand les tâches commencent et se terminent ». Le modèle est également capable de détecter la présence d'humains à proximité et de déclencher des appels d'outils de sécurité pour arrêter le robot en cas d'approche trop rapprochée.
Les améliorations apportées à Gemini Robotics On-Device Model permettent désormais au modèle de s'adapter plus rapidement à de nouvelles formes, capteurs et degrés de liberté, même sans connexion internet.