Jalapeño, el chip de OpenAI: 85.448 tokens/kW frente a los 44.960 de la GB200 de Nvidia
Los datos de OpenAI muestran a Jalapeño con mejor eficiencia energética y menor latencia que Nvidia GB200 y GB300 en varios modelos, aunque no en todos los escenarios posibles.
Prueba de encendido de un motor cohete con llamas y humo intenso — imagen de archivo de El Forum, ajena al asunto de esta pieza; pendiente de sustituciónEl Forum · Fototeca de El Forum · OWN_WORK
Los datos que OpenAI puso sobre la mesa
OpenAI difundió el 25 de agosto de 2026 un documento con resultados de rendimiento de Jalapeño frente a los sistemas Nvidia GB200 y GB300. En GPT-OSS 120B, un modelo de código abierto, Jalapeño alcanzó 85.448 tokens mixtos por segundo y kilovatio, frente a 44.960 de la GB200: casi el doble de tokens generados por cada unidad de energía consumida.
La latencia end-to-end, el tiempo que tarda una petición en obtener respuesta completa, también favoreció a Jalapeño: 1,03 segundos frente a 1,80 en GB200 para GPT-OSS 120B, y 1,65 frente a 5,99 en DeepSeek R1 670B comparado con GB300. En Kimi K2.5 1T la diferencia fue de 1,56 frente a 5,31 segundos.
El tiempo mínimo entre tokens, que mide la fluidez con la que un modelo genera texto palabra a palabra, se redujo también en Jalapeño: de 1,87 a 0,69 milisegundos en GPT-OSS 120B, y de 5,48 a 1,44 milisegundos en Kimi K2.5 1T frente a GB300.
Un chip que consume menos de lo que promete
Jalapeño está diseñado para un consumo máximo de 700 vatios, pero en las pruebas de OpenAI el uso registrado en carga fue de 550 vatios, por debajo de su tope teórico. Ese margen es parte de la explicación de las cifras de eficiencia por kilovatio que la compañía presenta frente a Nvidia.
El chip se anunció oficialmente el 24 de junio de 2026 junto con Broadcom, el socio que lo fabrica. OpenAI no afirma que Jalapeño sea superior en todos los casos: los resultados se limitan a comparaciones puntuales con GB200 y GB300 en modelos concretos, sin extenderlos a una conclusión general sobre el conjunto del hardware de Nvidia.