La robótica está entrando en una nueva etapa. Durante décadas, la mayoría de los robots industriales han destacado por su precisión al realizar tareas repetitivas, pero han tenido una gran limitación: su incapacidad para adaptarse a situaciones inesperadas. Ahora, Google DeepMind busca cambiar ese paradigma con el lanzamiento de Gemini Robotics 2, una nueva generación de modelos de inteligencia artificial diseñada para dotar a los robots de capacidades avanzadas de razonamiento, planificación y adaptación al mundo físico.
La compañía presentó una plataforma compuesta por tres modelos de IA que trabajan de manera complementaria para convertir a los robots humanoides en asistentes mucho más inteligentes, capaces de comprender instrucciones habladas, tomar decisiones, colaborar entre sí e incluso seguir funcionando sin conexión a Internet.
Un nuevo cerebro para los robots
El principal objetivo de Gemini Robotics 2 es actuar como el “cerebro” de un robot.
En lugar de limitarse a ejecutar instrucciones previamente programadas, el sistema permite que el robot comprenda lo que ocurre a su alrededor, interprete órdenes dadas por personas y planifique los pasos necesarios para completar una tarea compleja.
Según Google, esta nueva capa de inteligencia hace que la interacción entre humanos y robots sea mucho más natural.
En una publicación oficial, la empresa explicó que Gemini Robotics ER 2 funciona como un cerebro de alto nivel para los robots, permitiéndoles conversar con personas, comprender el entorno físico y planificar tareas de múltiples pasos antes de delegar la ejecución de los movimientos a modelos especializados en control físico.
El gran problema de la robótica actual
Actualmente, la mayoría de los robots funcionan de dos maneras:
- Siguiendo instrucciones programadas previamente.
- Siendo controlados remotamente por un operador.
Este enfoque funciona correctamente en ambientes totalmente controlados, como líneas de producción o almacenes, donde prácticamente todo ocurre de manera predecible.
Sin embargo, cuando aparece un objeto fuera de lugar, cambia la posición de un elemento o surge una situación inesperada, muchos robots dejan de funcionar correctamente o necesitan ser reprogramados.
Google considera que esta rigidez ha sido uno de los principales obstáculos para la expansión de la robótica en entornos cotidianos.
Robots capaces de adaptarse
Gemini Robotics 2 busca resolver precisamente este problema.
La nueva inteligencia artificial no solo aprende movimientos específicos, sino que también razona sobre ellos.
Esto significa que un robot podrá analizar diferentes escenarios y decidir cómo actuar sin necesidad de que un ingeniero programe manualmente cada posible situación.
Además, Google señala que el sistema ha sido diseñado para funcionar con distintos tipos de robots, independientemente de su forma física.
Esto facilita transferir conocimientos entre diferentes plataformas robóticas, algo que históricamente ha sido una tarea muy complicada.
Control completo del cuerpo
Una de las novedades más importantes de Gemini Robotics 2 es que ahora puede controlar completamente un robot humanoide.
La versión anterior estaba centrada principalmente en la parte superior del cuerpo.
Con esta nueva generación, el sistema puede coordinar simultáneamente:
- Caminar.
- Agacharse.
- Mantener el equilibrio.
- Inclinarse.
- Ponerse en cuclillas.
- Manipular objetos mientras se desplaza.
Este control integral permite ejecutar tareas mucho más complejas y naturales.
Manos robóticas mucho más precisas
Google también ha mejorado considerablemente la capacidad de manipulación de objetos.
Los nuevos robots incorporan manos robóticas de cinco dedos capaces de realizar tareas extremadamente delicadas, entre ellas:
- Atar nudos.
- Cerrar bolsas con cierre hermético (zip-lock).
- Recoger objetos muy pequeños.
- Manipular elementos frágiles con mayor precisión.
Para aplicaciones industriales, la plataforma también es compatible con pinzas robóticas de dos dedos utilizadas en almacenes y centros logísticos.
Estas pueden realizar tareas como:
- Empacar cajas.
- Organizar mercancías.
- Manipular paquetes pesados.
- Clasificar productos.
Gemini Robotics ER 2: planificación inteligente
Junto con Gemini Robotics 2, Google presentó Gemini Robotics ER 2, un modelo especializado en planificación y toma de decisiones.
A diferencia del modelo encargado del movimiento, este sistema no controla directamente cada articulación del robot.
Su función consiste en:
- Comprender instrucciones habladas.
- Dividir tareas complejas en pequeñas acciones.
- Recordar qué pasos ya fueron completados.
- Adaptar el plan cuando ocurre un imprevisto.
Por ejemplo, si un robot recibe la orden de preparar una estación de trabajo, el sistema puede organizar automáticamente cientos de pequeñas decisiones necesarias para completar la tarea.
Robots que colaboran entre sí
Otra característica destacada es la capacidad para coordinar varios robots trabajando en el mismo espacio.
Gemini Robotics ER 2 permite que diferentes robots compartan información sobre su progreso y coordinen acciones para evitar interferencias.
Esto podría resultar especialmente útil en:
- Centros logísticos.
- Plantas industriales.
- Hospitales.
- Grandes almacenes.
- Centros de distribución.
En estos escenarios, varios robots podrán colaborar simultáneamente para completar procesos complejos con mayor eficiencia.
Gemini Robotics On-Device 2: inteligencia sin Internet
Google también anunció Gemini Robotics On-Device 2, una versión que funciona directamente dentro del robot.
A diferencia de muchos sistemas actuales que dependen de servidores en la nube para procesar información, este modelo puede operar completamente de forma local.
Esto ofrece varias ventajas importantes:
- El robot continúa funcionando aunque no tenga conexión a Internet.
- Se reducen los tiempos de respuesta.
- Mejora la privacidad de los datos.
- Disminuye la dependencia de infraestructuras externas.
Además, Google afirma que los desarrolladores pueden adaptar este modelo a nuevos robots utilizando menos de 200 ejemplos de entrenamiento y en apenas unas horas, reduciendo significativamente el tiempo necesario para desplegar nuevas aplicaciones.
Un paso hacia robots más versátiles
La combinación de Gemini Robotics 2, Gemini Robotics ER 2 y Gemini Robotics On-Device 2 busca crear robots capaces de afrontar tareas mucho más variadas que las generaciones anteriores.
En conjunto, estos modelos permiten:
- Comprender el entorno.
- Planificar acciones complejas.
- Controlar todo el cuerpo del robot.
- Manipular objetos con precisión.
- Trabajar junto a otros robots.
- Adaptarse a diferentes plataformas.
- Funcionar sin conexión a Internet.
Todo ello representa un avance importante hacia robots que puedan desempeñar funciones en fábricas, almacenes, hospitales e incluso hogares.
La seguridad como prioridad
Google asegura que la seguridad ha sido uno de los pilares fundamentales durante el desarrollo de esta plataforma.
Además de incorporar sistemas tradicionales de seguridad física, la empresa ha integrado mecanismos basados en inteligencia artificial que ayudan al robot a tomar decisiones más seguras.
Entre las funciones implementadas destacan:
- Detectar cuando una persona se acerca demasiado.
- Detener automáticamente su actividad para evitar accidentes.
- Reanudar el trabajo únicamente cuando el área vuelve a ser segura.
- Rechazar instrucciones potencialmente peligrosas.
- Solicitar ayuda humana cuando la situación lo requiera.
ASIMOV-Agentic: el nuevo estándar para evaluar robots
Como parte de esta iniciativa, Google presentó un nuevo benchmark denominado ASIMOV-Agentic, diseñado para evaluar el comportamiento de los robots en situaciones donde la seguridad es crítica.
Este sistema pone a prueba aspectos como:
- La capacidad de rechazar órdenes inseguras.
- El reconocimiento de escenarios donde se necesita intervención humana.
- La prevención de acciones que puedan causar daños.
- La toma de decisiones responsables ante situaciones inesperadas.
El objetivo es garantizar que los futuros robots equipados con inteligencia artificial actúen de forma segura tanto para las personas como para su entorno.
¿Qué significa este avance para el futuro?
La llegada de Gemini Robotics 2 representa uno de los pasos más ambiciosos de Google en el ámbito de la robótica basada en inteligencia artificial.
Más que mejorar la precisión de los movimientos, la compañía busca crear robots capaces de comprender, razonar y adaptarse de manera similar a como lo hacen las personas al enfrentarse a nuevas situaciones.
Si estas tecnologías cumplen las expectativas, podrían acelerar la adopción de robots humanoides en sectores como la manufactura, la logística, la atención sanitaria y los servicios, donde la capacidad de adaptarse a entornos dinámicos es tan importante como la fuerza o la precisión mecánica.
Aunque todavía queda camino por recorrer antes de que estos sistemas lleguen de forma masiva al mercado, Gemini Robotics 2 marca un importante avance hacia una nueva generación de robots más autónomos, colaborativos e inteligentes, preparados para desenvolverse en escenarios reales con un nivel de flexibilidad nunca antes visto.
