IA | Innovación

Google Gemini 1.5 Pro revoluciona la navegación robótica autónoma

DeepMind de Google presenta un nuevo avance en la navegación robótica

El equipo de robótica de DeepMind de Google ha dado un paso más en el campo de la inteligencia artificial generativa al demostrar cómo un robot puede responder a comandos y navegar por una oficina. En un nuevo estudio titulado "Movilidad VLA: Navegación de Instrucciones Multimodales con VLMs de Largo Contexto y Gráficos Topológicos", el equipo ha implementado Google Gemini 1.5 Pro para enseñar a un robot a moverse de manera autónoma en un entorno complejo.

Interacciones multimodales y navegación autónoma

En una serie de videos presentados junto al proyecto, los empleados de DeepMind comienzan con un "OK, Robot" al estilo de un asistente inteligente, antes de pedir al sistema que realice diferentes tareas en un espacio de oficina de 9,000 pies cuadrados. Desde llevar a una persona a un tablero blanco hasta seguir instrucciones escritas en dicho tablero, el robot demuestra su capacidad para comprender y ejecutar comandos de manera autónoma.

Entrenamiento y aprendizaje

Antes de los videos, los robots fueron familiarizados con el espacio utilizando lo que el equipo llama "Navegación de Instrucciones Multimodales con Tours de Demostración (MINT)". Esto implica guiar al robot por la oficina mientras se señalan diferentes puntos de referencia con explicaciones verbales. Luego, el equipo utiliza la Visión-Lenguaje-Acción jerárquica (VLA) para combinar la comprensión del entorno y el razonamiento de sentido común. Una vez que se combinan estos procesos, el robot puede responder a comandos escritos, dibujados y gestuales.

Éxito en las interacciones

Google informa que el robot ha tenido una tasa de éxito del 90% en más de 50 interacciones con empleados. Este avance en la navegación robótica muestra el potencial de la inteligencia artificial generativa para mejorar la autonomía y la interacción de los robots en entornos complejos como oficinas o almacenes.

Con este nuevo enfoque en la navegación robótica, DeepMind de Google continúa demostrando cómo la inteligencia artificial puede revolucionar la forma en que interactuamos con la tecnología y cómo los robots pueden desempeñar un papel cada vez más importante en nuestra vida diaria.


Podcast El Desván de las Paradojas
Publicidad


Otras noticias • IA

Adquisición estratégica

Adobe adquiere Topaz Labs para transformar la edición creativa

Adobe ha adquirido Topaz Labs, conocida por sus innovadoras herramientas de inteligencia artificial para la edición de imágenes y videos. Esta fusión promete revolucionar el...

Inversión tecnológica

Amazon invierte 13.000 millones en India para potenciar tecnología

Amazon ha invertido 13.000 millones de dólares en India, reforzando su infraestructura de AWS y su red de comercio electrónico. Esta inversión, parte de un...

Racionalización tecnológica

Empresas racionan inteligencia artificial por costos y eficiencia

La inteligencia artificial en las empresas está experimentando un cambio significativo. Tras un periodo de gasto desmedido, muchas organizaciones, como Accenture, están racionando su uso...

Automatización tecnológica

Hang Ten Systems revoluciona TI con inteligencia artificial y automatización

La startup Hang Ten Systems, fundada por Vishal Sikka, busca revolucionar los servicios de TI mediante la inteligencia artificial, prometiendo automatización en el desarrollo de...

Impacto laboral

La IA redefine el futuro laboral y demanda nuevas habilidades

La rápida evolución de la inteligencia artificial (IA) ha generado debates sobre su impacto laboral. A pesar de los despidos en tecnología, la demanda de...

Aplicación independiente

Meta presenta app para creadores con inteligencia artificial integrada

Meta lanza una nueva aplicación independiente para creadores en Facebook, incorporando inteligencia artificial para optimizar la creación de contenido y la interacción con la audiencia....

Innovaciones colaborativas

Figma revoluciona diseño con capas de código y animaciones AI

La última actualización de Figma introduce capas de código, soporte para animaciones y la creación de plugins personalizados mediante inteligencia artificial, mejorando la colaboración entre...

Chip optimizado

OpenAI lanza chip Jalapeño para optimizar inteligencia artificial

OpenAI ha presentado su nuevo chip Jalapeño, diseñado en colaboración con Broadcom, para optimizar la inferencia en inteligencia artificial. Este procesador busca reducir costes operativos...