IA | Innovación

Google Gemini 1.5 Pro revoluciona la navegación robótica autónoma

DeepMind de Google presenta un nuevo avance en la navegación robótica

El equipo de robótica de DeepMind de Google ha dado un paso más en el campo de la inteligencia artificial generativa al demostrar cómo un robot puede responder a comandos y navegar por una oficina. En un nuevo estudio titulado "Movilidad VLA: Navegación de Instrucciones Multimodales con VLMs de Largo Contexto y Gráficos Topológicos", el equipo ha implementado Google Gemini 1.5 Pro para enseñar a un robot a moverse de manera autónoma en un entorno complejo.

Interacciones multimodales y navegación autónoma

En una serie de videos presentados junto al proyecto, los empleados de DeepMind comienzan con un "OK, Robot" al estilo de un asistente inteligente, antes de pedir al sistema que realice diferentes tareas en un espacio de oficina de 9,000 pies cuadrados. Desde llevar a una persona a un tablero blanco hasta seguir instrucciones escritas en dicho tablero, el robot demuestra su capacidad para comprender y ejecutar comandos de manera autónoma.

Entrenamiento y aprendizaje

Antes de los videos, los robots fueron familiarizados con el espacio utilizando lo que el equipo llama "Navegación de Instrucciones Multimodales con Tours de Demostración (MINT)". Esto implica guiar al robot por la oficina mientras se señalan diferentes puntos de referencia con explicaciones verbales. Luego, el equipo utiliza la Visión-Lenguaje-Acción jerárquica (VLA) para combinar la comprensión del entorno y el razonamiento de sentido común. Una vez que se combinan estos procesos, el robot puede responder a comandos escritos, dibujados y gestuales.

Éxito en las interacciones

Google informa que el robot ha tenido una tasa de éxito del 90% en más de 50 interacciones con empleados. Este avance en la navegación robótica muestra el potencial de la inteligencia artificial generativa para mejorar la autonomía y la interacción de los robots en entornos complejos como oficinas o almacenes.

Con este nuevo enfoque en la navegación robótica, DeepMind de Google continúa demostrando cómo la inteligencia artificial puede revolucionar la forma en que interactuamos con la tecnología y cómo los robots pueden desempeñar un papel cada vez más importante en nuestra vida diaria.


Podcast El Desván de las Paradojas
Publicidad


Otras noticias • IA

Podcasting democratizado

Spotify lanza herramienta de podcasts con inteligencia artificial para usuarios

Spotify introduce una herramienta de creación de podcasts basada en inteligencia artificial, permitiendo a los usuarios personalizar contenido y convertirse en creadores. Con funciones de...

Creación simplificada

Spotify lanza Studio para crear podcasts con inteligencia artificial

Spotify ha lanzado Studio, una aplicación de escritorio en fase de vista previa para crear podcasts personalizados utilizando inteligencia artificial. La herramienta busca simplificar la...

Reciclaje eficiente

Conflicto en Irán impulsa reciclaje de aluminio y oportunidades económicas

El conflicto en Irán ha elevado los precios del aluminio, impulsando la demanda de reciclaje. Startups como Sortera y Amp utilizan tecnologías avanzadas para mejorar...

Asistente universal

Hark recauda 700 millones para revolucionar asistentes de IA

Hark ha recaudado 700 millones de dólares para desarrollar un asistente personal de IA que busca ser una interfaz universal con el mundo digital. Enfrenta...

Revolución IA

Nvidia lanza procesador Vera para revolucionar la inteligencia artificial

Nvidia, liderada por Jensen Huang, lanza su procesador Vera, diseñado para la inteligencia artificial, buscando revolucionar el mercado de CPUs. A pesar de la competencia,...

Marketing audiovisual

Clouted revoluciona el marketing con clips de contenido inteligente

El clipado de contenido se ha convertido en una herramienta clave para las marcas en marketing, aprovechando vídeos cortos para captar la atención del consumidor....

Innovación sostenible

xAI de Elon Musk enfrenta críticas por impacto ambiental negativo

La controversia de xAI, fundada por Elon Musk, destaca el conflicto entre innovación tecnológica y sostenibilidad ambiental. Su uso de generadores contaminantes ha generado críticas...

Ingresos récord

Nvidia alcanza ingresos récord impulsados por arquitectura Blackwell

Nvidia ha reportado ingresos récord de 81.6 mil millones de dólares, impulsados por su arquitectura Blackwell en centros de datos. A pesar de la proyección...