Gemini Robotics 2 permite que un mismo modelo controle humanoides y brazos industriales

Gemini Robotics 2 permite que un mismo modelo controle humanoides y brazos industriales

Google DeepMind presentó Gemini Robotics 2 , una nueva familia de modelos de inteligencia artificial diseñada para controlar robots humanoides desde los pies hasta las manos. El sistema puede convertir instrucciones y señales visuales en movimientos, permitiendo que una máquina camine, se agache, alcance objetos y los manipule mientras mantiene el equilibrio. No se trata de un nuevo robot fabricado por Google, sino de una capa de inteligencia adaptable a diferentes plataformas. La compañía dividió el sistema en tres modelos: Gemini Robotics 2, encargado del movimiento; Gemini Robotics ER 2, orientado al razonamiento; y Gemini Robotics On-Device 2, preparado para funcionar localmente en el dispositivo.

Del movimiento de brazos al control corporal La primera generación de Gemini Robotics se concentraba principalmente en tareas realizadas sobre una mesa y en el control de la parte superior del cuerpo. La nueva versión amplía ese alcance hacia movimientos completos, necesarios para trabajar en habitaciones, fábricas y otros espacios diseñados para personas. En una de las demostraciones, el modelo controló el humanoide Apollo 2, de Apptronik. Tras recibir la orden de guardar una regadera, el robot caminó hasta una mesa, tomó el objeto, se desplazó hacia una estantería y lo colocó en un compartimento inferior.

Google reconoce, no obstante, que todavía debe mejorar la velocidad de sus movimientos. El mismo modelo fue utilizado con distintas configuraciones del Apollo 2 y con Franka Duo, una plataforma robótica de dos brazos. Esto muestra que parte de lo aprendido puede transferirse entre máquinas con cuerpos y herramientas diferentes sin comenzar todo el entrenamiento desde cero. © Google DeepMind Youtube. Manos robóticas para tareas más delicadas Uno de los mayores desafíos de la robótica es conseguir que una máquina manipule objetos con la precisión de una persona.

Gemini Robotics 2 puede controlar manos de cinco dedos y pinzas industriales para realizar acciones como cerrar bolsas herméticas, hacer nudos, utilizar herramientas o insertar piezas. Sin embargo, estas habilidades todavía están lejos de ser infalibles. En las pruebas de Google, el robot logró desenroscar una bombilla en el 92% de los intentos, pero su rendimiento bajó al 44% al atar una bolsa de basura y al 40% al cerrar una bolsa con sello. La propia compañía admite que la manipulación con varios dedos continúa siendo especialmente difícil.

Un modelo piensa y otro mueve el cuerpo Gemini Robotics ER 2 actúa como el cerebro de alto nivel. Interpreta las instrucciones humanas, analiza el entorno, divide una tarea en pasos y decide qué herramienta o sistema de movimiento debe utilizar el robot. Mientras la máquina trabaja, el modelo analiza continuamente el video de sus cámaras para comprobar cuánto ha avanzado, detectar errores y decidir cuándo terminó cada acción. Según Google, puede gestionar tareas de varios minutos que requieren cientos de decisiones y corregir un paso sin reiniciar todo el proceso.

La actualización también permite que diferentes robots colaboren. Un humanoide podría encargarse de alcanzar objetos en espacios adaptados para personas, mientras una plataforma con ruedas transporta materiales o una máquina industrial realiza una operación de precisión. Todos compartirían información para dividir el trabajo y completar una tarea conjunta. Robots que funcionan sin conexión Para situaciones con mala conectividad o en las que la latencia puede resultar peligrosa, Google desarrolló Gemini Robotics On-Device 2.

Esta versión ejecuta el modelo directamente en el hardware del robot , sin enviar constantemente sus datos a la nube. La empresa asegura que puede adaptarlo a nuevos robots de dos brazos utilizando normalmente menos de 200 ejemplos recopilados durante unas pocas horas. Esta capacidad podría facilitar su incorporación a máquinas con formas, sensores y movimientos muy diferentes. Google también presentó ASIMOV-Agentic, una prueba destinada a comprobar si los modelos rechazan órdenes peligrosas, reconocen tareas imposibles y piden ayuda cuando existe incertidumbre.

Gemini Robotics ER 2 puede detectar la proximidad de una persona, detener al humanoide y retomar la actividad cuando el área vuelve a estar despejada. Por ahora, Gemini Robotics ER 2 está disponible en versión preliminar mediante Gemini API y Google AI Studio. El modelo de movimiento y su edición local permanecen limitados a socios seleccionados, por lo que el anuncio representa más un avance experimental que la llegada inmediata de humanoides autónomos a hogares y fábricas. Fuente: Infobae.