Transparencia
Google DeepMind lanza Gemini Robotics ER 2, su modelo de razonamiento para robots más avanzado
Afirmaciones verificadas
El modelo es un vision-language model (VLM) que permite a los robots comunicarse con humanos, entender el mundo físico y planificar tareas de varios pasos que duran varios minutos.
Estado: Verificada (fuente primaria)
El modelo está disponible en Google AI Studio y en private preview en la Gemini Enterprise Agent Platform; los modelos VLA y on-device se ofrecen a early-access partners.
Estado: Verificada (fuente primaria)
Gemini Robotics ER 2 es descrito como el 'most capable embodied reasoning (ER) model' de Google para robots.
Estado: Declarada por la fuente · Requiere atribución
Gemini Robotics ER 2 se presenta junto con dos modelos de la misma familia: Gemini Robotics 2 y Gemini Robotics On-Device 2.
Estado: Verificada (fuente primaria)
Google DeepMind presentó Gemini Robotics ER 2 el 30 de julio de 2026.
Estado: Verificada (fuente primaria)
La versión anterior de la línea, Gemini Robotics-ER 1.6, tiene entrada de texto, imágenes, video y audio, y salida de texto, con documentación técnica actualizada en diciembre de 2025.
Estado: Verificada (fuente primaria)