DeepMind de Google presenta un nuevo avance en la navegación robótica
El equipo de robótica de DeepMind de Google ha dado un paso más en el campo de la inteligencia artificial generativa al demostrar cómo un robot puede responder a comandos y navegar por una oficina. En un nuevo estudio titulado "Movilidad VLA: Navegación de Instrucciones Multimodales con VLMs de Largo Contexto y Gráficos Topológicos", el equipo ha implementado Google Gemini 1.5 Pro para enseñar a un robot a moverse de manera autónoma en un entorno complejo.
Interacciones multimodales y navegación autónoma
En una serie de videos presentados junto al proyecto, los empleados de DeepMind comienzan con un "OK, Robot" al estilo de un asistente inteligente, antes de pedir al sistema que realice diferentes tareas en un espacio de oficina de 9,000 pies cuadrados. Desde llevar a una persona a un tablero blanco hasta seguir instrucciones escritas en dicho tablero, el robot demuestra su capacidad para comprender y ejecutar comandos de manera autónoma.
Entrenamiento y aprendizaje
Antes de los videos, los robots fueron familiarizados con el espacio utilizando lo que el equipo llama "Navegación de Instrucciones Multimodales con Tours de Demostración (MINT)". Esto implica guiar al robot por la oficina mientras se señalan diferentes puntos de referencia con explicaciones verbales. Luego, el equipo utiliza la Visión-Lenguaje-Acción jerárquica (VLA) para combinar la comprensión del entorno y el razonamiento de sentido común. Una vez que se combinan estos procesos, el robot puede responder a comandos escritos, dibujados y gestuales.
Éxito en las interacciones
Google informa que el robot ha tenido una tasa de éxito del 90% en más de 50 interacciones con empleados. Este avance en la navegación robótica muestra el potencial de la inteligencia artificial generativa para mejorar la autonomía y la interacción de los robots en entornos complejos como oficinas o almacenes.
Con este nuevo enfoque en la navegación robótica, DeepMind de Google continúa demostrando cómo la inteligencia artificial puede revolucionar la forma en que interactuamos con la tecnología y cómo los robots pueden desempeñar un papel cada vez más importante en nuestra vida diaria.
Otras noticias • IA
Pensilvania demanda a Character.AI por engaños en salud digital
La demanda de Pensilvania contra Character.AI destaca la necesidad de regular la inteligencia artificial en salud, tras acusaciones de engañar a usuarios haciéndose pasar por...
OpenAI lanza GPT-5.5 Instant con mejoras en precisión y contexto
OpenAI ha lanzado GPT-5.5 Instant, mejorando la precisión y gestión del contexto en interacciones. Con avances significativos en rendimiento y personalización, el modelo promete transformar...
ElevenLabs recauda $500 millones y alcanza valoración de $11 mil millones
ElevenLabs, respaldada por inversores de renombre, ha recaudado $500 millones y ha visto crecer su valoración a $11 mil millones. La empresa se centra en...
Etsy lanza app en ChatGPT para compras conversacionales únicas
Etsy ha lanzado una aplicación nativa en ChatGPT, permitiendo búsquedas conversacionales para facilitar la compra de productos únicos. Esta integración, junto con un asistente de...
PayPal se reinventa con IA tras recortes de personal
PayPal está reinventándose al centrarse en la innovación y la inteligencia artificial, a pesar de recortes de personal del 20%. La compañía busca recuperar su...
ElevenLabs recauda 500 millones para revolucionar la inteligencia artificial
ElevenLabs ha recaudado 500 millones de dólares en su ronda de financiación Serie D, destacándose en la inteligencia artificial de voz. Con un crecimiento notable...
Meta utiliza IA para proteger a menores en sus plataformas
Meta ha implementado inteligencia artificial para identificar a usuarios menores de 13 años en sus plataformas, mejorando la seguridad. Aunque se aplauden estas medidas, surgen...
La inteligencia artificial impulsa empleo y creatividad según Nvidia
La inteligencia artificial, según Jensen Huang de Nvidia, puede ser un motor de creación de empleo, permitiendo a los trabajadores enfocarse en tareas creativas. Aunque...
Lo más reciente
- 1
Nuro recibe permiso para probar robotaxis autónomos en California
- 2
Lucid Motors navega incertidumbre en producción y ventas de EVs
- 3
Altara revoluciona la gestión de datos con inteligencia artificial
- 4
Bumble prioriza calidad y tecnología tras caída en usuarios pagos
- 5
a16zcrypto lanza fondo de 2.200 millones en mercado cripto
- 6
Volkswagen aumenta inversión en Rivian y se convierte en líder
- 7
Threads lanza mensajería web para chats individuales y grupales

