Gemini Robotics On-Device

2025-06-24 · Éditeur : Google · Domaine : Intelligence Artificielle

Google DeepMind présente Gemini Robotics On-Device, son modèle vision-langage-action optimisé pour tourner sur le robot lui-même, adaptable à de nouvelles tâches avec 50 à 100 démonstrations.

Ce qui change

  • Modèle exécuté localement sur le robot, avec des besoins de calcul minimaux, conçu pour les robots à deux bras.
  • Premier modèle VLA de Google proposé au réglage fin.
  • Adaptation à de nouvelles tâches avec 50 à 100 démonstrations seulement.
  • Tâches très dextres exécutées sans connexion : ouvrir un sac, plier des vêtements.
  • SDK Gemini Robotics avec simulateur MuJoCo, accessible via un programme de testeurs de confiance.

Google DeepMind présente Gemini Robotics On-Device, son modèle vision-langage-action optimisé pour tourner sur le robot lui-même, adaptable à de nouvelles tâches avec 50 à 100 démonstrations. ### Ce qui change - Modèle exécuté localement sur le robot, avec des besoins de calcul minimaux, conçu pour les robots à deux bras. - Premier modèle VLA de Google proposé au réglage fin. - Adaptation à de nouvelles tâches avec 50 à 100 démonstrations seulement. - Tâches très dextres exécutées sans connexion : ouvrir un sac, plier des vêtements. - SDK Gemini Robotics avec simulateur MuJoCo, accessible via un programme de testeurs de confiance. ### Caractéristiques - Type : modèle vision-langage-action pour robots bi-bras, exécution embarquée. - Disponibilité : testeurs de confiance (SDK sur inscription). ### Tarifs Tarif non communiqué à l'annonce. ### Benchmarks Le billet présente des graphiques de généralisation visuelle, sémantique et comportementale face au modèle phare et au meilleur modèle embarqué précédent, sans chiffres dans le texte. ### À retenir Un pas vers des robots autonomes sans dépendance au cloud. Accès réservé à un cercle restreint en 2025.

Liens

Tags : LLM, Google, DeepMind, Robotique, Embarqué