Dos personas conversan en un stand promocional de Databricks con material corporativo
Dos personas conversan en un stand promocional de Databricks con material corporativo — imagen de archivo de El Forum, ajena al asunto de esta pieza; pendiente de sustituciónEl Forum · Fototeca de El Forum · OWN_WORK

Un modelo ligero para ejecución en dispositivos móviles

Stable Audio Open Small es una versión reducida del modelo original Stable Audio Open, con 341 millones de parámetros frente a los 1.100 millones de la versión anterior.

Esto permite que el modelo sea suficientemente compacto para correr en CPUs Arm, que son habituales en dispositivos móviles y edge computing.

El modelo está diseñado para generar muestras cortas de audio, facilitando su uso en aplicaciones prácticas donde la latencia y el consumo energético son críticos.

El foco en la optimización para CPUs Arm apunta a expandir la IA generativa más allá de los centros de datos tradicionales hacia aparatos con recursos limitados.

Generación de audio en tiempo real y sin conexión a la nube

El modelo puede crear hasta 11 segundos de audio en menos de 8 segundos en un smartphone, lo que implica capacidad para respuesta rápida en el dispositivo.

Al eliminar la necesidad de enviar datos a la nube, se reducen los riesgos asociados a la privacidad y se evita la dependencia de conectividad permanente.

Estas ventajas son cruciales para aplicaciones en móvil, asistentes de voz o dispositivos portátiles donde la conexión estable no es garantizada.

La generación on-device también puede dar lugar a nuevas experiencias de usuario más inmediatas y personalizadas.

Colaboración estratégica entre Stability AI y Arm

La alianza entre Stability AI y Arm combina experiencia en modelos de IA generativa con el diseño de arquitecturas de procesador optimizadas.

Este lanzamiento conjunto muestra un modelo de cooperación para llevar la innovación tecnológica desde laboratorios hasta dispositivos de uso final.

Marcar un hito en audio generativo on-device sitúa a ambas compañías en un nicho con alto potencial comercial y tecnológico.

La iniciativa puede presagiar próximos desarrollos que amplíen el rango de IA generativa en edge computing.

Implicaciones para el futuro de la IA generativa en dispositivos edge

Esta capacidad abre la puerta a aplicaciones que pueden operar con independencia de la nube, mejorando la experiencia y seguridad del usuario.

También plantea retos futuros en cuanto a eficiencia energética y capacidad de cómputo en dispositivos cada vez más compactos.

Habrá que vigilar la evolución del modelo para soportar audios más largos o formatos más complejos manteniendo la autonomía.

El desarrollo contribuye a descentralizar la IA generativa, acercándola al usuario final sin infraestructura pesada.