Transparencia
Stability AI lanza Stable Audio 3.0 con tres modelos open weights y uno exclusivo API
Afirmaciones verificadas
El modelo Large queda reservado para acceso vía API/enterprise.
Estado: Atribuida a una sola fuente · Requiere atribución
El sistema fue entrenado con 1,278,902 grabaciones de audio en total, de las cuales 806,284 proceden de AudioSparx y 472,618 de Freesound.
Estado: Verificada (fuente primaria)
Los tiempos de inferencia en hardware H200 son de 1.31 segundos para Medium y 1.80 segundos para Large.
Estado: Atribuida a una sola fuente · Requiere atribución
Medium tiene 1.4 mil millones de parámetros y Large tiene 2.7 mil millones de parámetros; ambos generan composiciones de hasta 6 minutos y 20 segundos.
Estado: Verificada (fuente primaria)
Small SFX y Small tienen 459 millones de parámetros y generan hasta 2 minutos de audio.
Estado: Verificada (fuente primaria)
Stability AI lanzó el 20 de mayo de 2026 Stable Audio 3.0, una familia de cuatro modelos de generación de música y efectos sonoros: Small SFX, Small, Medium y Large.
Estado: Verificada (fuente primaria)
Tres de los cuatro modelos (Small SFX, Small y Medium) se publican como open weights.
Estado: Verificada (fuente primaria)