IA | Innovación

Google Gemini 1.5 Pro revoluciona la navegación robótica autónoma

DeepMind de Google presenta un nuevo avance en la navegación robótica

El equipo de robótica de DeepMind de Google ha dado un paso más en el campo de la inteligencia artificial generativa al demostrar cómo un robot puede responder a comandos y navegar por una oficina. En un nuevo estudio titulado "Movilidad VLA: Navegación de Instrucciones Multimodales con VLMs de Largo Contexto y Gráficos Topológicos", el equipo ha implementado Google Gemini 1.5 Pro para enseñar a un robot a moverse de manera autónoma en un entorno complejo.

Interacciones multimodales y navegación autónoma

En una serie de videos presentados junto al proyecto, los empleados de DeepMind comienzan con un "OK, Robot" al estilo de un asistente inteligente, antes de pedir al sistema que realice diferentes tareas en un espacio de oficina de 9,000 pies cuadrados. Desde llevar a una persona a un tablero blanco hasta seguir instrucciones escritas en dicho tablero, el robot demuestra su capacidad para comprender y ejecutar comandos de manera autónoma.

Entrenamiento y aprendizaje

Antes de los videos, los robots fueron familiarizados con el espacio utilizando lo que el equipo llama "Navegación de Instrucciones Multimodales con Tours de Demostración (MINT)". Esto implica guiar al robot por la oficina mientras se señalan diferentes puntos de referencia con explicaciones verbales. Luego, el equipo utiliza la Visión-Lenguaje-Acción jerárquica (VLA) para combinar la comprensión del entorno y el razonamiento de sentido común. Una vez que se combinan estos procesos, el robot puede responder a comandos escritos, dibujados y gestuales.

Éxito en las interacciones

Google informa que el robot ha tenido una tasa de éxito del 90% en más de 50 interacciones con empleados. Este avance en la navegación robótica muestra el potencial de la inteligencia artificial generativa para mejorar la autonomía y la interacción de los robots en entornos complejos como oficinas o almacenes.

Con este nuevo enfoque en la navegación robótica, DeepMind de Google continúa demostrando cómo la inteligencia artificial puede revolucionar la forma en que interactuamos con la tecnología y cómo los robots pueden desempeñar un papel cada vez más importante en nuestra vida diaria.


Crear Canciones Personalizadas
Publicidad


Otras noticias • IA

Innovaciones colaborativas

Google Maps mejora participación con nuevas herramientas y funciones

Google ha introducido innovaciones en Google Maps para fomentar la participación de los usuarios, como Gemini, un asistente para crear subtítulos, y un acceso simplificado...

Acuerdo estratégico

Anthropic se une a Google y Broadcom para potenciar IA

Anthropic ha firmado un acuerdo estratégico con Google y Broadcom para aumentar su capacidad de computación, utilizando TPUs y expandiendo su infraestructura. Con una inversión...

Innovación integral

Rocket revoluciona el desarrollo de productos para startups en India

Rocket, una startup india, transforma la estrategia de producto al combinar investigación, desarrollo y análisis competitivo en una plataforma accesible. Su enfoque integral permite a...

Fondo inversión

Zero Shot lanza fondo de 100 millones para startups de IA

Zero Shot, un nuevo fondo de capital riesgo con un objetivo de 100 millones de dólares, ha sido cofundado por exmiembros de OpenAI. Su experiencia...

Dictado innovador

Google lanza aplicación de dictado sin conexión para iOS

Google ha lanzado "Google AI Edge Eloquent", una innovadora aplicación de dictado que funciona sin conexión. Ofrece transcripción en tiempo real, personalización del texto y...

Conflicto intensificado

Irán amenaza centros de datos en creciente conflicto Medio Oriente

El conflicto en el Medio Oriente se intensifica con las amenazas de Irán a centros de datos, reflejando una estrategia de retaliación contra Estados Unidos....

Precios ajustados

Anthropic modifica precios de Claude Code generando reacciones mixtas

Anthropic ha cambiado su política de precios para Claude Code, limitando el uso de herramientas de terceros y adoptando un sistema de "pago por uso"....

Energía artificial

Empresas tecnológicas invierten en gas ante demanda de energía creciente

La creciente demanda de energía por parte de los centros de datos impulsados por la inteligencia artificial ha llevado a las empresas tecnológicas a invertir...