Google DeepMind presenta Gemini Robotics 2

Google DeepMind presenta Gemini Robotics 2

⏱ Tiempo de lectura: 3 min

Google DeepMind lanzó Gemini Robotics 2, su capa de inteligencia para la próxima generación de robots. El anuncio incluye tres modelos: un modelo visión-lenguaje-acción para control de cuerpo completo en humanoides, Gemini Robotics ER 2 para razonamiento encarnado y orquestación de tareas, y un VLA ejecutable en dispositivo que se adapta a nuevos cuerpos robóticos en horas. Solo ER 2 está disponible públicamente.

Tres modelos de inteligencia física para robótica

Google DeepMind desplegó tres componentes distintos bajo la marca Gemini Robotics 2. El primero es un modelo visión-lenguaje-acción diseñado para control de cuerpo completo en robots humanoides, capaz de coordinar movimiento, percepción visual e instrucciones de alto nivel. El segundo, Gemini Robotics ER 2, está orientado a razonamiento encarnado y orquestación de tareas complejas. El tercero es un VLA (Vision-Language-Action) que funciona en dispositivo y reduce el tiempo de adaptación a nuevos cuerpos robóticos de semanas a horas. Un punto de control único ya impulsa al robot Apptronik Apollo 2 y a Franka Duo. La robótica con inteligencia artificial avanza hacia sistemas más generalistas y versátiles.

Disponibilidad y acceso público

De los tres modelos lanzados, solo Gemini Robotics ER 2 está disponible públicamente en este momento. Los otros dos componentes —el modelo visión-lenguaje-acción y el VLA en dispositivo— permanecen bajo control de Google DeepMind, enfocados en demostración mediante puntos de control que ya operan en Apptronik Apollo 2 y Franka Duo. La fuente no especifica fechas de lanzamiento público para estos modelos ni detalles sobre planes de acceso futuro. Más información en MarkTechPost.

Modelo Función principal Estado de acceso
Gemini Robotics VLA Control de cuerpo completo en humanoides Demostración con punto de control
Gemini Robotics ER 2 Razonamiento encarnado y orquestación Disponible públicamente
VLA en dispositivo Adaptación rápida a nuevos cuerpos Demostración con punto de control
Robots demostrados Apptronik Apollo 2, Franka Duo Operativos con un punto de control

El contexto detrás del anuncio

Este lanzamiento refleja el enfoque de Google DeepMind en crear capas de inteligencia reutilizables para múltiples plataformas robóticas. La capacidad de adaptar un VLA a nuevos cuerpos en horas, en lugar de semanas o meses, representa un cambio significativo en la velocidad de iteración. Sin embargo, solo ER 2 está disponible públicamente; los otros modelos permanecen bajo control de la empresa, limitando el acceso inmediato para investigadores y desarrolladores externos.

Preguntas frecuentes sobre Gemini Robotics 2

¿Cuál es la diferencia entre los tres modelos?

El modelo visión-lenguaje-acción maneja control físico de cuerpo completo. ER 2 se enfoca en razonamiento de alto nivel y orquestación. El VLA en dispositivo facilita adaptación rápida a nuevas morfologías robóticas.

¿Cuándo estarán disponibles públicamente los otros modelos?

No se especifica en el texto fuente recibido. Solo Gemini Robotics ER 2 está disponible públicamente en la actualidad.

¿Qué robots ya usan estos modelos?

Apptronik Apollo 2 y Franka Duo operan con un punto de control único de Gemini Robotics 2.

Nuestra lectura editorial

Google DeepMind avanza hacia sistemas de inteligencia física más generalistas. El desafío inmediato es la apertura: mantener dos de tres modelos cerrados limita la validación externa y el feedback de comunidad investigadora. La adaptación rápida a nuevos cuerpos es valiosa; el acceso público lo sería más.

En Inteligencia Artificial creemos que la robótica se acelera cuando los componentes inteligentes son reutilizables. ¿Cuánto tiempo pasará antes de que DeepMind abra estos modelos a investigadores fuera de su ecosistema?

Fuente: www.marktechpost.com

Deja una respuesta

Subir