
Regional Endpoints y nuevos modelos abiertos en la plataforma de Mistral
Mistral anunció Regional Endpoints, un servicio ya disponible con carácter general que permite a los clientes elegir si sus cargas de inferencia -es decir, el procesamiento que ejecuta un modelo ya entrenado para responder a una consulta- se ejecutan en Europa o en Estados Unidos. La compañía lo presenta junto a un Priority Tier en fase de vista previa pública, con niveles de servicio comprometidos, límites de tasa personalizados y un acuerdo de disponibilidad (SLA) pensado para cargas críticas.
En paralelo, Mistral empezará a alojar en su plataforma modelos abiertos de terceros, comenzando por GLM-5.2 de la firma china Z.ai. Es un giro relevante para una compañía que basa parte de su discurso en la soberanía tecnológica europea: pasa de ofrecer solo modelos propios a convertirse también en distribuidor de modelos ajenos, sin que el comunicado explique los criterios de selección de esos terceros.
La carrera europea por infraestructura de inferencia soberana
Mistral sostiene que los compromisos de cómputo de varios clientes sostendrán 200 megavatios de infraestructura en Europa antes de finales de 2027, un paso hacia el objetivo declarado de alcanzar 1 gigavatio de cómputo propio en el continente para 2030. Según Reuters, Microsoft ha acordado gastar "miles de millones de dólares" en esa infraestructura europea de Mistral, sin que se haya revelado el importe exacto; Microsoft, por su parte, ha comunicado que Mistral desplegará "miles de GPUs NVIDIA Vera Rubin" para ampliar la capacidad disponible para clientes.
El movimiento se suma a otras iniciativas de inferencia soberana en marcha: Infercom y SambaNova presentaron lo que Chronicle.lu describió como la primera plataforma de inferencia como servicio soberana de Europa, domiciliada en Luxemburgo y alojada en Alemania con despliegue previsto para noviembre de 2025; Scaleway ya ofrece inferencia gestionada desde la región FR-PAR con precios públicos desde 0,93 €/hora. La Comisión Europea, por su lado, financia 19 AI Factories a través de EuroHPC para dar acceso gratuito a capacidad de GPU a proyectos europeos, incluidos los modelos de peso abierto; solo la AI Factory italiana IT4LIA cuenta con un presupuesto de 290.000.000 € financiado al 50% por el Digital Europe Programme.