← Volver al artículo

Transparencia

Liquid AI lanza LFM2.5-DSpark, acelera inferencia hasta 3,2 veces en GPU

Afirmaciones verificadas

  • La mejora en throughput en dispositivos on-device llega hasta 2.87x, con un ejemplo en un modelo LFM2.5-1.2B-Instruct en HumanEval, pasando de 136 a 389 tokens/s en MacBook Pro M4 Max.

    Estado: Verificada (fuente primaria)

  • La mejora en throughput en GPU alcanza hasta 3.18x, con un ejemplo en un modelo LFM2.5-8B-A1B en MATH500, pasando de 428 a 1,362 tokens/s en H100.

    Estado: Verificada (fuente primaria)

  • La publicación del contenido fue el 20 de agosto de 2026, en el blog de Hugging Face.

    Estado: Verificada (fuente primaria)

  • Las mediciones se realizaron con batch size 1 y temperatura 0, en cinco datasets diferentes.

    Estado: Verificada (fuente primaria)

  • Liquid AI ha lanzado LFM2.5-DSpark, una actualización de su familia LFM2.5 que incorpora speculate decoding para acelerar la inferencia.

    Estado: Verificada (fuente primaria)

Transparencia — Liquid AI lanza LFM2.5-DSpark, acelera inferencia hasta 3,2 veces en GPU · El Forum