Startup de IA lanza modelo para generar sonidos y canciones de forma gratuita
La startup Stability AI, conocida por su generador de arte impulsado por IA llamado Stable Diffusion, ha lanzado un modelo de IA abierto para generar sonidos y canciones que afirma fue entrenado exclusivamente con grabaciones libres de regalías.
Llamado Stable Audio Open, el modelo generativo toma una descripción de texto (por ejemplo, "ritmo de rock tocado en un estudio tratado, batería de sesión en un kit acústico") y produce una grabación de hasta 47 segundos de duración. El modelo fue entrenado utilizando alrededor de 486,000 muestras de las bibliotecas de música gratuita FreeSound y Free Music Archive.
Creación de sonidos y elementos de producción
Stability AI asegura que el modelo se puede utilizar para crear ritmos de batería, riffs de instrumentos, ruidos ambientales y "elementos de producción" para videos, películas y programas de televisión, así como para "editar" canciones existentes o aplicar el estilo de una canción (por ejemplo, smooth jazz) a otra.
“Un beneficio clave de esta versión de código abierto es que los usuarios pueden ajustar el modelo con sus propios datos de audio personalizados”, escribió Stability AI en una publicación en su blog corporativo. “Por ejemplo, un batería podría ajustarlo con muestras de sus propias grabaciones de batería para generar nuevos ritmos”.
Limitaciones y controversia
Sin embargo, Stable Audio Open tiene sus limitaciones. No puede producir canciones completas, melodías o voces, al menos no buenas. Stability AI dice que no está optimizado para esto y sugiere que los usuarios que buscan esas capacidades opten por el servicio premium de Stable Audio de la compañía.
Stable Audio Open tampoco se puede utilizar comercialmente; sus términos de servicio lo prohíben. Y no se desempeña igual de bien en todos los estilos musicales y culturas o con descripciones en idiomas distintos al inglés, sesgos que Stability AI atribuye a los datos de entrenamiento.
Controversia en la compañía
Stability AI, que ha tenido dificultades para sacar adelante su negocio en declive, se convirtió recientemente en objeto de controversia después de que su vicepresidente de audio generativo, Ed Newton-Rex, renunciara por desacuerdo con la postura de la compañía de que entrenar modelos de IA generativos en obras con derechos de autor constituye "uso justo". Stable Audio Open parece ser un intento de cambiar esa narrativa, al mismo tiempo que publicita no tan sutilmente los productos pagados de Stability AI.
A medida que los generadores de música, incluido el de Stability, ganan popularidad, los derechos de autor y las formas en que algunos creadores de generadores podrían estar abusando de ellos se están convirtiendo en un punto central de atención.
En mayo, Sony Music, que representa a artistas como Billy Joel, Doja Cat y Lil Nas X, envió una carta a 700 compañías de IA advirtiendo contra el "uso no autorizado" de su contenido para entrenar generadores de audio. Y en marzo, se firmó en Tennessee la primera ley de Estados Unidos destinada a frenar los abusos de la IA en la música.
Otras noticias • IA
Claude Science transforma la investigación científica con asistentes virtuales
Claude Science de Anthropic revoluciona la investigación científica al integrar más de 60 bases de datos y ofrecer asistentes virtuales personalizados. Su enfoque en la...
Integración de IA en empresas exige estrategia y cultura adecuadas
La integración de la inteligencia artificial en las empresas requiere un enfoque estratégico y cultural. Iniciativas como la de Amazon Web Services, que despliega ingenieros...
Riverside lanza herramienta para convertir grabaciones en newsletters
Riverside ha lanzado una funcionalidad que permite a los creadores transformar grabaciones de audio y video en newsletters, facilitando la conexión con su audiencia. Además,...
X lanza servidor MCP para integrar aplicaciones de IA fácilmente
X ha lanzado un servidor de Model Context Protocol (MCP) que facilita la integración de aplicaciones de IA, simplificando el acceso a su API. Esta...
Lumo 2.0: el chatbot innovador y ético de Proton
Proton ha lanzado Lumo 2.0, un chatbot que combina innovación y privacidad. Con capacidades avanzadas como reconocimiento de imágenes, velocidad de respuesta mejorada y un...
La IA revoluciona el empleo y exige adaptación continua
La inteligencia artificial (IA) transforma el mercado laboral, generando crecimiento en empresas que la adoptan, aunque también plantea preocupaciones sobre la pérdida de empleos. La...
Wix adquiere Base44 para potenciar su IA en el mercado
La adquisición de Base44 por Wix destaca la importancia de desarrollar modelos de IA propios en un mercado competitivo. Con su modelo Base1, la empresa...
Google democratiza la creación de imágenes personalizadas con Gemini
Gemini de Google ha democratizado la creación de imágenes mediante IA, permitiendo a todos los usuarios con cuenta de Google generar imágenes personalizadas de forma...
Lo más reciente
- 1
EquiLibre Technologies revoluciona el trading con IA innovadora
- 2
Clicks Communicator: el regreso del teclado físico reinventado
- 3
Google presenta Nano Banana 2 Lite, revolucionando la creación visual
- 4
Fusión nuclear avanza hacia un futuro energético sostenible
- 5
Acti lanza teclado inteligente con IA para iOS y Android
- 6
Claude Sonnet 5 transforma la IA con accesibilidad y ética
- 7
Etched recauda 800 millones y revoluciona la IA con eficiencia

