Kog AI publica motor de inferencia que alcanza 3,000 tokens/seg en GPUs AMD y Nvidia
Kog AI anunció el 25 de junio de 2026 un motor de inferencia que mejora el rendimiento en GPUs, con planes de acelerar aún más y captar inversión en septiembre.
Tarjeta gráfica GPU con disipador de calor negro y conectores de vídeo visiblesWilliam Hook · flickr · CC-BY-SA
Kog publica un motor de inferencia para IA más rápido
El 25 de junio de 2026, Kog AI lanzó oficialmente su motor de inferencia que logra hasta 3,000 tokens por segundo en una demo con 8× AMD MI300X, y 2.100 en Nvidia H200. La empresa afirma que este rendimiento supera en hasta 3,5 veces a otras soluciones. La demo utilizó el modelo Laneformer, de 2B parámetros, y evidenció una aceleración significativa en comparación con tecnologías previas.
Planes de aceleración y inversión en 2026
Kog planea implementar un modelo 10 veces más rápido en septiembre, lo que podría reducir aún más los tiempos de inferencia. Además, está en proceso de captar fondos para su Serie A, buscando ampliar su tecnología y cobertura de mercado. La compañía también lanzó una tech preview de su motor en mayo, preparando el camino para la comercialización y la competencia en el sector de hardware y software para IA.