Gemini Robotics 2 : l'IA de Google passe au physique
Google DeepMind a dévoilé Gemini Robotics 2, un système d'IA unifié contrôlant divers robots dont des humanoïdes. Il combine modèles de vision et d'action pour des tâches complexes comme ranger des étagères. Google mise sur l'IA physique comme prochaine étape clé.
« "It's another milestone in our path towards really getting towards what we call like physical AGI, which means we get a robot to do anything that a human can," » — Wired AI
Que faut-il retenir ?
- Gemini Robotics 2 combine un modèle de vision langage et deux modèles d'action visuelle
- Le système permet à des robots comme Apollo 2 d'effectuer des tâches complexes de manipulation
- Google utilise un mélange de téléopération humaine, vidéos et simulations pour l'entraînement
- Le benchmark ASIMOV-Agentic mesure la sécurité des systèmes d'IA contrôlant des robots
Pourquoi cette nouvelle compte-t-elle ?
Cette avancée marque une étape vers l'AGI physique avec des applications industrielles et domestiques concrètes. L'intégration de multiples modèles d'IA ouvre la voie à des robots polyvalents. Les questions de sécurité deviennent cruciales avec l'IA dans le monde physique, poussant Google à développer des garde-fous spécifiques.
💬 Carolina Parada, Responsable robotique chez Google DeepMind
Public concerné : entreprises
Quelles sont les innovations clés de Gemini Robotics 2 ?
Gemini Robotics 2 combine plusieurs modèles d'IA (vision langage et action) en un système unifié permettant à des robots d'accomplir des tâches complexes comme manipuler des objets. Google utilise un entraînement mixte (téléopération, vidéos, simulations) pour ces capacités physiques.
🔧 Outils mentionnés