Gemini ya es un ser con cuerpo gracias a Robotics 2 para robots humanoides

service
Compartir

Comparte este artículo

o copie el enlace

Google DeepMind acaba de lanzar una nueva versión de su modelo de IA Gemini, capaz de controlar una amplia gama de robots diferentes, incluidos humanoides capaces de realizar tareas que requieren destreza, como atornillar bombillas y atar bolsas de basura.

Gemini Robotics 2 combina varios modelos de IA diferentes en un único sistema. En conjunto, permiten que un robot interprete su entorno y sepa cómo actuar en él. Un modelo de visión y lenguaje (VLM), que entiende imágenes y videos, puede comunicarse con los humanos y razonar cómo realizar diferentes tareas. Dos modelos de visión, lenguaje y acción (VLA), entrenados para comprender cómo moverse en el espacio físico, controlan los movimientos de todo el cuerpo del robot, así como los de las pinzas o las manos.

En las demostraciones en video compartidas antes del lanzamiento, la empresa mostró varios robots diferentes realizando tareas complejas de forma autónoma utilizando el modelo combinado. En una de las demostraciones, el robot Apollo 2 de Apptronik utilizó unas manos de una empresa llamada Sharpa para ordenar estanterías. Google DeepMind entrenó el modelo para realizar estas tareas mediante una combinación de teleoperación humana, ejemplos en video y simulaciones; todavía no es posible que los modelos de IA realicen una amplia gama de tareas complejas sin un entrenamiento específico.

Collage de un cerebro y bebés gateando.

Los bebés son máquinas de aprendizaje extraordinarias, y es posible que pronto se encuentren avances clave para la IA en la arquitectura de sus pequeños cerebros.

«Hacer que un robot haga todo lo que un humano ya hace»

Aunque Anthropic y OpenAI han tomado la delantera con los chatbots y las herramientas de programación de IA, Google cuenta con una trayectoria más sólida en investigación robótica y ha publicado trabajos importantes sobre el uso de la IA para entrenar a los robots a realizar tareas útiles. Este lanzamiento es otra señal de que la gigante de las búsquedas apuesta por que la IA tendrá que liberarse del ámbito digital para alcanzar todo su potencial. Anteriormente se asoció con Boston Dynamics, líder en robots con patas, para proporcionar el «cerebro» a esas máquinas.

«Es otro hito en nuestro camino hacia lo que llamamos IA física, lo que significa que lograremos que un robot haga todo lo que un humano puede hacer», explica Carolina Parada, directora de robótica de Google DeepMind, a WIRED.

Sin embargo, permitir que los modelos de IA de vanguardia accedan a robots para que puedan deambular por lugares de trabajo u hogares y manipular objetos conlleva riesgos. Investigaciones previas han demostrado que el uso de IA de vanguardia para controlar robots puede generar comportamientos inesperados y, en ocasiones, peligrosos. La posibilidad de que estos modelos realicen acciones repentinas o no deseadas en el ámbito digital se hizo evidente recientemente, cuando un agente de IA aún no lanzado, desarrollado por OpenAI, hackeó varios sistemas.

«La cuestión de la seguridad es aún más urgente porque los estás exponiendo a muchas otras situaciones. Surgirán muchas incertidumbres, por lo que es importante poder comprender la cuestión de la seguridad con mayor profundidad», indica Parada.

Parada afirma que Google adopta un enfoque de seguridad multicapa, con medidas de protección aplicadas a cada nivel del modelo. Además, está presentando ASIMOV-Agentic, un nuevo referente para medir la seguridad de diversos sistemas de IA que colaboran para controlar un robot. Este referente detecta si una orden tendrá un resultado perjudicial o incierto.

El CEO de la compañía, Demis Hassabis, declaró anteriormente a WIRED que espera desarrollar un sistema operativo de IA para muchos robots diferentes, similar al sistema operativo Android para smartphone.

Artículo originalmente publicado en WIRED. Adaptado por Alondra Flores.

Gemini ya es un ser con cuerpo gracias a Robotics 2 para robots humanoides