
Google anunció el lanzamiento de Gemini Robotics 2, un modelo de inteligencia artificial capaz de controlar por completo robots humanoides, lo que les permite caminar, agacharse, mantener el equilibrio y manipular objetos mientras ejecutan tareas complejas. La empresa aseguró que el sistema puede coordinar varios robots y adaptarse a diferentes plataformas robóticas tras solo unas horas de entrenamiento.
La presentación de Gemini Robotics 2 amplió las capacidades del modelo original, conocido como Gemini Robotics, que se introdujo a principios de año. Mientras la versión inicial se centraba en la manipulación sobre mesas, la nueva edición extendió el dominio hacia el movimiento completo del cuerpo.
PUBLICIDAD
Google también dio a conocer dos modelos complementarios: Gemini Robotics ER 2, orientado a razonamiento avanzado, y Gemini Robotics On-Device 2, que permite operar robots fuera de línea sin requerir conexión a la nube.
La compañía explicó que, a diferencia de los robots convencionales diseñados para tareas repetitivas, estos nuevos modelos pueden razonar acciones, adaptarse a entornos desconocidos y completar trabajos de varios pasos con un reentrenamiento mínimo.
PUBLICIDAD

El modelo denominado visión-lenguaje-acción puede controlar tanto robots humanoides como sistemas robóticos de doble brazo, lo que habilita tareas domésticas e industriales mediante el uso de manos robóticas o pinzas especializadas.
De la manipulación parcial al dominio corporal
Uno de los cambios más importantes se centró en el control integral del cuerpo. Mientras las versiones anteriores limitaban el movimiento principalmente a la parte superior, Gemini Robotics 2 permite a los humanoides desplazarse por habitaciones, agacharse, estirarse e interactuar con distintos objetos.
PUBLICIDAD
Durante las demostraciones, el modelo de Google operó el robot humanoide Apollo 2 de la empresa Apptronik, y le indicó que recogiera una regadera, cruzara un cuarto y la depositara en un estante bajo. Con el mismo punto de control, el sistema también interactuó con otras plataformas, como Franka Duo, y mostró flexibilidad para adaptarse a diferentes formas robóticas.
La destreza constituyó otra mejora relevante. El sistema puede manipular manos robóticas de cinco dedos para realizar tareas como atar bolsas de basura, cerrar bolsas con sello hermético y desenroscar bombillas. En plataformas industriales que usan pinzas de dos dedos, el modelo logra ejecutar inserciones precisas, manejo de herramientas y colocación de objetos.
PUBLICIDAD

Inteligencia colaborativa y funcionamiento sin conexión
Gemini Robotics ER 2 funciona como el motor de razonamiento avanzado del robot, capaz de comprender instrucciones verbales, dividirlas en pasos concretos y supervisar su progreso hasta terminar la tarea. El modelo actualizado puede ejecutar secuencias de acciones durante varios minutos y tomar cientos de decisiones, además de recuperarse ante fallos y adaptarse a cambios en el entorno.
Otra novedad es la colaboración entre múltiples robots. Ahora, diversos tipos de robots pueden comunicarse y dividir el trabajo para completar tareas que resultarían imposibles para una sola máquina.
PUBLICIDAD
Para situaciones en las que no hay acceso a internet, Google desarrolló Gemini Robotics On-Device 2, un modelo que se ejecuta directamente en el hardware robótico y adapta su funcionamiento a nuevos diseños de robots de doble brazo tras menos de 200 ejemplos de entrenamiento recogidos en pocas horas.

En paralelo, la compañía presentó ASIMOV-Agentic, un nuevo estándar para medir la seguridad robótica, que evalúa si los robots rechazan acciones peligrosas, reconocen situaciones inciertas y solicitan ayuda humana cuando corresponde. Gemini Robotics ER 2 también mejora la detección de proximidad humana, lo que permite que los robots detengan su operación cuando una persona se acerca demasiado.
PUBLICIDAD
Implementación y acceso temprano
Google informó que Gemini Robotics ER 2 estará disponible mediante Google AI Studio y en versión preliminar privada a través de la plataforma Gemini Enterprise Agent. Tanto el modelo visión-lenguaje-acción como el modelo local ya se encuentran accesibles para socios de acceso temprano.
Con esta actualización, la compañía pone a disposición de desarrolladores y empresas herramientas que amplían las posibilidades de la robótica autónoma y colaborativa, con aplicaciones en el hogar y la industria.
PUBLICIDAD
PUBLICIDAD
PUBLICIDAD
Últimas Noticias
Qué riesgos de seguridad enfrentas al comprar un dispositivo usado y cómo protegerte
El malware en teléfonos de segunda mano puede robar datos personales o financieros

Ahora puedes añadir notas a tus canciones favoritas en Spotify
La función ‘Notas de usuario’ permite escribir mensajes personales en cada canción de una playlist
Usuarios de LinkedIn ahora podrán denunciar contenido inútil generado por IA
La nueva herramienta busca reducir la presencia de contenido artificial en la red social profesional

Google Fotos da marcha atrás y te permite apagar una función al abrir imágenes
La nueva versión de la app incorpora una opción para quienes prefieren revisar sus imágenes sin el destello blanco que aparece al abrir cada archivo

Ciberataques en El Salvador: Sistema de IA evita pérdidas de US $12.5 millones
Un informe de ESET indica que el ransomware subió más de 30% en el país y el sector financiero fue el principal blanco; también detectó que uno de cada 35 mensajes maliciosos correspondió a intentos de phishing, una combinación que elevó la presión sobre bancos, organismos estatales y entidades de enseñanza



