Startup de IA lanza modelo para generar sonidos y canciones de forma gratuita
La startup Stability AI, conocida por su generador de arte impulsado por IA llamado Stable Diffusion, ha lanzado un modelo de IA abierto para generar sonidos y canciones que afirma fue entrenado exclusivamente con grabaciones libres de regalías.
Llamado Stable Audio Open, el modelo generativo toma una descripción de texto (por ejemplo, "ritmo de rock tocado en un estudio tratado, batería de sesión en un kit acústico") y produce una grabación de hasta 47 segundos de duración. El modelo fue entrenado utilizando alrededor de 486,000 muestras de las bibliotecas de música gratuita FreeSound y Free Music Archive.
Creación de sonidos y elementos de producción
Stability AI asegura que el modelo se puede utilizar para crear ritmos de batería, riffs de instrumentos, ruidos ambientales y "elementos de producción" para videos, películas y programas de televisión, así como para "editar" canciones existentes o aplicar el estilo de una canción (por ejemplo, smooth jazz) a otra.
“Un beneficio clave de esta versión de código abierto es que los usuarios pueden ajustar el modelo con sus propios datos de audio personalizados”, escribió Stability AI en una publicación en su blog corporativo. “Por ejemplo, un batería podría ajustarlo con muestras de sus propias grabaciones de batería para generar nuevos ritmos”.
Limitaciones y controversia
Sin embargo, Stable Audio Open tiene sus limitaciones. No puede producir canciones completas, melodías o voces, al menos no buenas. Stability AI dice que no está optimizado para esto y sugiere que los usuarios que buscan esas capacidades opten por el servicio premium de Stable Audio de la compañía.
Stable Audio Open tampoco se puede utilizar comercialmente; sus términos de servicio lo prohíben. Y no se desempeña igual de bien en todos los estilos musicales y culturas o con descripciones en idiomas distintos al inglés, sesgos que Stability AI atribuye a los datos de entrenamiento.
Controversia en la compañía
Stability AI, que ha tenido dificultades para sacar adelante su negocio en declive, se convirtió recientemente en objeto de controversia después de que su vicepresidente de audio generativo, Ed Newton-Rex, renunciara por desacuerdo con la postura de la compañía de que entrenar modelos de IA generativos en obras con derechos de autor constituye "uso justo". Stable Audio Open parece ser un intento de cambiar esa narrativa, al mismo tiempo que publicita no tan sutilmente los productos pagados de Stability AI.
A medida que los generadores de música, incluido el de Stability, ganan popularidad, los derechos de autor y las formas en que algunos creadores de generadores podrían estar abusando de ellos se están convirtiendo en un punto central de atención.
En mayo, Sony Music, que representa a artistas como Billy Joel, Doja Cat y Lil Nas X, envió una carta a 700 compañías de IA advirtiendo contra el "uso no autorizado" de su contenido para entrenar generadores de audio. Y en marzo, se firmó en Tennessee la primera ley de Estados Unidos destinada a frenar los abusos de la IA en la música.
Otras noticias • IA
Prentis revoluciona la automatización de oficinas con IA innovadora
Prentis, un laboratorio de IA cofundado por Ritankar Das, busca automatizar tareas de oficina para optimizar flujos de trabajo. Con contratos por 50 millones de...
OpenAI lanza teclado Micro para ChatGPT en medio de críticas
OpenAI ha lanzado el Micro, un teclado diseñado para trabajar con ChatGPT, en un contexto de controversia legal y críticas mixtas. Aunque presenta características interesantes,...
Prentis revoluciona la automatización laboral con IA personalizada
Prentis, cofundada por Ritankar Das y figuras como Reid Hoffman, busca revolucionar la automatización de tareas laborales mediante IA personalizada. Con una valoración de $1.000...
Cognition adquiere Poke para humanizar asistentes de IA
La adquisición de Poke por Cognition destaca la evolución de asistentes de IA hacia interacciones más humanas y cercanas. Poke, conocido por su enfoque amigable,...
Anthropic presenta Opus 5, la IA más accesible y flexible
Anthropic ha lanzado Opus 5, un modelo de inteligencia artificial más asequible y flexible que sus predecesores. Destaca por su capacidad de iteración y adaptabilidad,...
Empresas de IA piden evitar restricciones para fomentar innovación
Un grupo de empresas de IA ha solicitado a los responsables políticos evitar restricciones prematuras sobre modelos de pesos abiertos, argumentando que son esenciales para...
Bluesky lanza Attie, asistente de IA para personalizar feeds
Bluesky ha lanzado Attie, un asistente de IA que permite a los usuarios personalizar sus feeds sociales y realizar preguntas abiertas mediante la funcionalidad Quests....
ChatGPT ahora permite interacción por voz para mayor eficiencia
OpenAI ha lanzado una actualización de ChatGPT que permite la interacción por voz, mejorando la eficiencia y naturalidad en el uso de la inteligencia artificial....
Lo más reciente
- 1
La inteligencia artificial transforma la búsqueda en línea y medios
- 2
Alianza entre SSI y Nvidia impulsa inteligencia artificial segura
- 3
Autonomous Key combate la adicción digital con tecnología accesible
- 4
Enigma revoluciona interacción humano-robot con 100 robots globalmente
- 5
Snapchat presenta "Now Playing" para compartir música en tiempo real
- 6
Kalshi y Netflix en disputa por representación de mercados
- 7
Bibliotecas de EE. UU. enseñan a desactivar la inteligencia artificial

