Google presenta Gemma, una nueva familia de modelos ligeros
Google ha anunciado hoy el lanzamiento de Gemma, una nueva familia de modelos ligeros de código abierto. Estos nuevos modelos, comenzando con Gemma 2B y Gemma 7B, han sido "inspirados por Gemini" y están disponibles para uso comercial e investigativo.
Google no nos ha proporcionado un documento detallado sobre cómo estos modelos se desempeñan en comparación con modelos similares de Meta y Mistral, por ejemplo, y solo señaló que son "de última generación". La empresa sí mencionó que estos son modelos densos de solo decodificador, que es la misma arquitectura que utilizó para sus modelos Gemini (y sus modelos anteriores de PaLM) y que veremos las comparativas más tarde hoy en el ranking de Hugging Face.
Acceso a Gemma y herramientas de desarrollo
Para empezar con Gemma, los desarrolladores pueden acceder a cuadernos Colab y Kaggle listos para usar, así como integraciones con Hugging Face, MaxText y NeMo de Nvidia. Una vez pre-entrenados y ajustados, estos modelos pueden ejecutarse en cualquier lugar.
Si bien Google destaca que estos son modelos abiertos, cabe destacar que no son de código abierto. De hecho, en una reunión informativa antes del anuncio de hoy, Janine Banks de Google destacó el compromiso de la empresa con el código abierto, pero también señaló que Google es muy intencional en la forma en que se refiere a los modelos de Gemma.
"Los modelos abiertos se han vuelto bastante generalizados en la industria", dijo Banks. "Y a menudo se refiere a modelos de pesos abiertos, donde hay un amplio acceso para que los desarrolladores e investigadores personalicen y ajusten los modelos, pero, al mismo tiempo, los términos de uso, como la redistribución, así como la propiedad de las variantes desarrolladas, varían según los términos de uso específicos del modelo. Y así vemos alguna diferencia entre lo que tradicionalmente llamaríamos de código abierto y decidimos que tenía más sentido referirnos a nuestros modelos de Gemma como modelos abiertos".
Potencial de desarrollo de aplicaciones de IA
Los tamaños de estos modelos son adecuados para muchos casos de uso y, según el director de gestión de productos de Google DeepMind, Tris Warkentin, "la calidad de generación ha aumentado significativamente en el último año". Esto desbloquea nuevas formas de desarrollar aplicaciones de IA, incluida la capacidad de ejecutar inferencias y ajustes en tu escritorio o portátil de desarrollo local con tu GPU RTX o en un único host en GCP con Cloud TPUs, por ejemplo.
Esto también es cierto para los modelos abiertos de los competidores de Google en este espacio, por lo que tendremos que ver cómo se desempeñan los modelos de Gemma en escenarios del mundo real. Además de los nuevos modelos, Google también está lanzando un nuevo kit de herramientas de IA generativa responsable para proporcionar "orientación y herramientas esenciales para crear aplicaciones de IA más seguras con Gemma", así como una herramienta de depuración.
Otras noticias • IA
Google presenta Nano Banana 2, revolucionando la generación de imágenes
Google ha lanzado Nano Banana 2, un modelo de generación de imágenes que mejora la calidad y velocidad, permitiendo crear imágenes coherentes y detalladas. Integrado...
Codex en Figma transforma colaboración entre diseñadores y desarrolladores
La integración de Codex en Figma une diseño y programación, facilitando la colaboración entre equipos creativos. Esta sinergia permite a diseñadores y desarrolladores trabajar juntos...
Salesforce reporta 10.700 millones y se reinventa ante desafíos
Salesforce, enfrentando la "SaaSpocalipsis", reportó ingresos de 10.700 millones de dólares, un aumento del 13%. Introdujo métricas innovadoras como "unidades de trabajo agente" y presentó...
Anthropic compra Vercept para impulsar innovación en inteligencia artificial
Anthropic ha adquirido Vercept, una startup innovadora en inteligencia artificial, destacando la competencia en el sector. La fusión busca potenciar el desarrollo de soluciones avanzadas,...
Nvidia alcanza ingresos récord impulsados por inteligencia artificial y datos
Nvidia ha reportado ingresos récord de 68 mil millones de dólares, impulsados por la demanda de inteligencia artificial y su negocio de centros de datos....
Preocupación por aumento eléctrico por centros de datos de IA
El aumento del coste de la electricidad en EE. UU., impulsado por centros de datos de inteligencia artificial, genera preocupación. Las grandes tecnológicas, como Microsoft...
CUDIS presenta anillos inteligentes para promover salud y bienestar
CUDIS lanza anillos inteligentes que combinan métricas de salud con un sistema de puntos para incentivar comportamientos saludables. Incluyen un coach AI personalizado y rastrean...
OpenAI introduce anuncios en ChatGPT generando reacciones encontradas
OpenAI ha comenzado a implementar anuncios en ChatGPT, generando reacciones mixtas. La estrategia busca monetizar el servicio mientras se mantiene la confianza del usuario. Sin...
Lo más reciente
- 1
Ada, el asistente digital que optimiza tu productividad laboral
- 2
Threads facilita mensajes directos con nuevo atajo en prueba
- 3
Einride asegura 113 millones para liderar transporte eléctrico autónomo
- 4
Walmart pagará 100 millones por prácticas engañosas en Spark Driver
- 5
Inteligencia artificial en citas: mejora la experiencia y preocupa privacidad
- 6
Ada revoluciona la gestión de tareas y correos electrónicos
- 7
X optimiza anuncios reutilizando creativos de otras redes sociales

