Tarjeta gráfica GPU con disipador de calor negro y conectores de vídeo visibles
Tarjeta gráfica GPU con disipador de calor negro y conectores de vídeo visiblesWilliam Hook · flickr · CC-BY-SA

Kog publica un motor de inferencia para IA más rápido

El 25 de junio de 2026, Kog AI lanzó oficialmente su motor de inferencia que logra hasta 3,000 tokens por segundo en una demo con 8× AMD MI300X, y 2.100 en Nvidia H200. La empresa afirma que este rendimiento supera en hasta 3,5 veces a otras soluciones. La demo utilizó el modelo Laneformer, de 2B parámetros, y evidenció una aceleración significativa en comparación con tecnologías previas.

Planes de aceleración y inversión en 2026

Kog planea implementar un modelo 10 veces más rápido en septiembre, lo que podría reducir aún más los tiempos de inferencia. Además, está en proceso de captar fondos para su Serie A, buscando ampliar su tecnología y cobertura de mercado. La compañía también lanzó una tech preview de su motor en mayo, preparando el camino para la comercialización y la competencia en el sector de hardware y software para IA.