Google revela el cerebro robótico Gemini Robotics ER 2

Google ha presentado un nuevo modelo de inteligencia artificial denominado Gemini Robotics ER 2, diseñado para actuar como el “cerebro” de los robots. Su propósito es que estas máquinas comprendan lo que sucede a su alrededor y puedan asistir a los seres humanos en diversas tareas.

Este sistema conversa con las personas, analiza el contexto y decide, paso a paso, cuál es la siguiente acción a ejecutar. La herramienta ya se encuentra a disposición de los desarrolladores mediante la API de Gemini y Google AI Studio.

Gemini Robotics ER 2 procesa en tiempo real lo que la cámara del robot capta, identificando en qué etapa de la tarea se encuentra. Ante cualquier inconveniente —por ejemplo, la caída de un objeto o un movimiento fallido—, el sistema reacciona al instante y corrige la trayectoria sin necesidad de reiniciar todo el proceso.

Además, es capaz de dirigir a varios robots de forma simultánea: mientras uno se desplaza por superficies planas, otro enfrenta terrenos irregulares, y ambos se comunican para lograr un objetivo común que ninguno podría alcanzar por sí solo.

Gemini Robotics ER 2 es el sistema que le dice al robot qué hacer y cuándo hacerlo. (Google)

Google demostró esta capacidad con Spot, el reconocido robot de Boston Dynamics. Bastó una orden en lenguaje natural para que el dispositivo fuera en busca de un objeto y lo entregara.

Gemini Robotics ER 2 está disponible para los desarrolladores a través de la API de Gemini, Google AI Studio y en versión preliminar privada dentro de la plataforma Gemini Enterprise Agent Platform. En otras palabras, cualquier especialista en robótica con acceso a estas plataformas puede emplear este nuevo modelo de IA sin restricciones.

Los desarrolladores ya pueden acceder al modelo desde la API de Gemini y Google AI Studio. (Google)

¿Por qué esta IA revoluciona el campo de la robótica?

Hasta hoy, los robots enfrentaban un desafío fundamental: no sabían determinar con certeza cuándo una tarea había concluido.

Gemini Robotics ER 2 resuelve este problema desde dos frentes. Primero, divide cada tarea en cinco niveles de progreso y monitorea en cuál de ellos se halla el robot en todo momento, con un 57% de precisión en las evaluaciones.

Segundo, es capaz de identificar el momento exacto en que ocurre un evento crítico, como dejar de verter café en una taza, con un 91% de exactitud y en menos de un segundo.

Se suma una capa de seguridad: cuando el robot percibe que una persona se aproxima, se detiene por completo. Solo reanuda sus labores cuando el área vuelve a estar despejada.

Los robots siempre tuvieron dificultades para saber si una tarea quedó completa. Gemini Robotics ER 2 resuelve eso de dos maneras. REUTERS/Dado Ruvic/Illustration

En las pruebas de seguridad, el modelo superó tanto a su versión anterior como a otros sistemas presentes en el mercado.

¿Qué funciones desempeña Gemini Robotics ER 2 dentro de un robot?

Gemini Robotics ER 2 opera como el cerebro de alto nivel del robot. Estas son sus principales capacidades:

Piensa y planifica

  • Interpreta órdenes en lenguaje natural, por ejemplo: “búscame el control remoto”, y las descompone en pasos específicos.
  • Decide la siguiente acción mientras el robot ejecuta la anterior, sin pausas.

Observa y comprende

  • Analiza el video en tiempo real proveniente de la cámara del robot.
  • Reconoce en qué fase de la tarea se encuentra, dividida en cinco niveles de avance.
  • Detecta fallos en el mismo instante en que ocurren: un artículo que cae, un derrame, un movimiento incorrecto.

Gemini Robotics ER 2 es la parte del sistema que piensa, no la que mueve al robot. REUTERS/Steve Marcus/File Photo

Corrige sin reiniciar

  • Si algo sale mal, ajusta la estrategia sobre la marcha, evitando comenzar desde cero.

Conversa con humanos

  • Mantiene diálogos con las personas y responde preguntas mientras trabaja.
  • Puede consultar Google Search si precisa información externa.

FILE PHOTO: The Google logo is seen on the Google house at CES 2024, an annual consumer electronics trade show, in Las Vegas, Nevada, U.S. January 10, 2024. REUTERS/Steve Marcus/File Photo

Coordina múltiples robots

  • Asigna a cada robot la parte de la tarea según sus capacidades.
  • Los robots se comunican entre sí para completar acciones que de forma individual serían imposibles.

Garantiza la seguridad

  • Detecta la cercanía de una persona y detiene el robot automáticamente.
  • Reanuda la actividad solo cuando el espacio queda libre.

Fuente: Infobae

COMPARTIR ESTA NOTICIA

Facebook
Twitter

FACEBOOK