AgregarSuscribite al canalWhatsApp AgregarAgreganos en GoogleGoogle

Él, robot

Google presentó Gemini Robotics 2, modelo de IA para robots con control de todo el cuerpo

El sistema extiende la inteligencia artificial a los movimientos completos de humanoides y permite que varios robots colaboren entre sí.

04.08.2026 07:21

Lectura: 4'

Compartir en

Google presentó Gemini Robotics 2, su nuevo modelo de visión, lenguaje y acción orientado a robótica, que incorpora control inteligente de movimientos en todo el cuerpo, mayor destreza en tareas manuales y capacidad de colaboración entre múltiples robots. La compañía lo describió como la base para una próxima generación de robots "verdaderamente adaptables", según informó en un comunicado publicado en su blog oficial.

El avance principal respecto a versiones anteriores es que el modelo ya no se limita a controlar la parte superior del cuerpo de un humanoide. "Por primera vez, el modelo puede controlar robots humanoides completos, traduciendo la intención en un control inteligente de todo el cuerpo", precisó Google. Esto permite que un robot reciba una instrucción como colocar una regadera en el contenedor verde del estante inferior, procese esa orden y ejecute la tarea desplazándose por el espacio y razonando sobre cada movimiento.

Datos clave
  • Gemini Robotics 2Google presentó su nuevo modelo de IA orientado a robótica, con control inteligente de movimientos en todo el cuerpo, mayor destreza manual y coordinación entre múltiples robots.
  • Control de cuerpo completoPor primera vez, el modelo puede controlar robots humanoides completos, desde los pies hasta los dedos de las manos, superando la limitación de versiones anteriores que solo abarcaban la parte superior.
  • Tres modelos diferenciadosEl sistema opera mediante tres componentes: el modelo VLA de visión y acción, Gemini Robotics ER 2 de razonamiento avanzado, y Gemini Robotics On-Device 2 para ejecución local en el dispositivo.
  • Coordinación entre robotsEl modelo permite que varios robots se coordinen entre sí para organizarse y completar tareas más rápido.
  • Adaptación en pocas horasEl sistema puede adaptarse a cuerpos robóticos completamente nuevos en solo unas horas tras su implementación.
  • Manos de 22 gradosEl modelo VLA puede controlar manos SharpaWave de cinco dedos y 22 grados de libertad para realizar acciones delicadas como atar nudos.
  • Seguridad multicapaGemini Robotics ER 2 incorpora un enfoque de seguridad multicapa y una nueva comparativa llamada ASIMOV-Agentic para navegación en entornos de incertidumbre.
  • Disponibilidad limitadaGemini Robotics ER 2 ya está disponible en Google AI Studio, mientras que los modelos VLA y On-Device solo están accesibles para socios con acceso anticipado.

El modelo también incorpora la capacidad de que varios robots se coordinen entre sí para organizarse y completar tareas más rápido, según detalló la empresa. Además, está diseñado para ejecutarse localmente en el dispositivo y puede adaptarse a distintos cuerpos robóticos completamente nuevos en solo unas horas, indicó Google.

Tres modelos con funciones diferenciadas

Gemini Robotics 2 opera mediante tres modelos. El primero es el modelo de visión, lenguaje y acción (VLA), que convierte información visual y lingüística en control motor y abarca desde los dedos de los pies hasta los de las manos. Este modelo permite un nuevo nivel de manipulación preciso tanto para robots con manos como para los que usan pinzas. Entre sus capacidades concretas, puede controlar manos SharpaWave de cinco dedos y 22 grados de libertad para realizar acciones delicadas como atar nudos, y también puede operar pinzas paralelas estándar de dos dedos para tareas complejas que requieren destreza.

El segundo es Gemini Robotics ER 2, definido como el modelo de razonamiento integrado más avanzado. Actúa como un agente de lenguaje visual que funciona como "el cerebro de alto nivel del robot": observa el entorno, razona sobre los pasos necesarios para completar una tarea, se coordina con el modelo VLA para ejecutar las acciones y realiza un seguimiento del progreso hasta que la tarea finaliza. Según Google, los robots ahora pueden entender cuándo comienzan y cuándo terminan las tareas. Este modelo fue desarrollado con un enfoque de seguridad multicapa que combina marcos de seguridad en IA e incorpora una nueva comparativa llamada ASIMOV-Agentic, orientada a la IA física agéntica y a la navegación en entornos de incertidumbre.

El tercero es Gemini Robotics On-Device 2, la versión del modelo VLA optimizada para ejecutarse localmente en los dispositivos robóticos, con mayor eficiencia operativa.

Disponibilidad

Google informó que Gemini Robotics ER 2 ya está disponible en Google AI Studio y en versión preliminar privada en Gemini Enterprise Agent Platform. Los modelos VLA y On-Device, en cambio, solo están disponibles para socios con acceso anticipado, según precisó la compañía.