Transparencia
Vercel integra Kimi K3 con ZDR y proveedores en EE. UU. en su AI Gateway
Afirmaciones verificadas
AI Gateway enruta entre múltiples proveedores para failover, mayor disponibilidad y más capacidad que un solo proveedor
Estado: Verificada (fuente primaria)
El modelo Kimi K3 tiene un contexto máximo de 1M tokens y una salida máxima de 131K tokens
Estado: Verificada (fuente primaria)
Kimi K3 Fast implica un coste por token aproximadamente un 50% superior al modelo base, a cambio de menor latencia
Estado: Verificada (fuente primaria)
Kimi K3 y Kimi K3 Fast están disponibles en AI Gateway a través de proveedores con sede en EE. UU. (Baseten y Fireworks)
Estado: Verificada (fuente primaria)
La ficha del modelo Kimi K3 muestra 4.8s de latencia y 38 tps de throughput para el proveedor listado en esa vista
Estado: Verificada (fuente primaria)
La ficha oficial de Kimi K3 en AI Gateway muestra precios de $3/M tokens de entrada, $15/M de salida y $0.3/M para lectura de caché (sin precio de escritura de caché)
Estado: Verificada (fuente primaria)
La tarifa de la variante regional para EE. UU. es aproximadamente un 10% superior a la variante regular
Estado: Verificada (fuente primaria)
Para forzar la inferencia solo en centros de datos de EE. UU. se puede configurar inferenceRegion con geoRegion: 'us'
Estado: Verificada (fuente primaria)
Si se usa la opción 'speed' sobre el modelo base moonshotai/kimi-k3, el sistema permanece en ese modelo y cae a velocidad estándar si el nivel rápido no está disponible
Estado: Verificada (fuente primaria)
Zero Data Retention (ZDR) está soportado para ambos modelos, activable desde el panel de AI Gateway o mediante el parámetro zeroDataRetention: true
Estado: Verificada (fuente primaria)