← Volver al artículo

Transparencia

Vercel integra Kimi K3 con ZDR y proveedores en EE. UU. en su AI Gateway

Afirmaciones verificadas

  • AI Gateway enruta entre múltiples proveedores para failover, mayor disponibilidad y más capacidad que un solo proveedor

    Estado: Verificada (fuente primaria)

  • El modelo Kimi K3 tiene un contexto máximo de 1M tokens y una salida máxima de 131K tokens

    Estado: Verificada (fuente primaria)

  • Kimi K3 Fast implica un coste por token aproximadamente un 50% superior al modelo base, a cambio de menor latencia

    Estado: Verificada (fuente primaria)

  • Kimi K3 y Kimi K3 Fast están disponibles en AI Gateway a través de proveedores con sede en EE. UU. (Baseten y Fireworks)

    Estado: Verificada (fuente primaria)

  • La ficha del modelo Kimi K3 muestra 4.8s de latencia y 38 tps de throughput para el proveedor listado en esa vista

    Estado: Verificada (fuente primaria)

  • La ficha oficial de Kimi K3 en AI Gateway muestra precios de $3/M tokens de entrada, $15/M de salida y $0.3/M para lectura de caché (sin precio de escritura de caché)

    Estado: Verificada (fuente primaria)

  • La tarifa de la variante regional para EE. UU. es aproximadamente un 10% superior a la variante regular

    Estado: Verificada (fuente primaria)

  • Para forzar la inferencia solo en centros de datos de EE. UU. se puede configurar inferenceRegion con geoRegion: 'us'

    Estado: Verificada (fuente primaria)

  • Si se usa la opción 'speed' sobre el modelo base moonshotai/kimi-k3, el sistema permanece en ese modelo y cae a velocidad estándar si el nivel rápido no está disponible

    Estado: Verificada (fuente primaria)

  • Zero Data Retention (ZDR) está soportado para ambos modelos, activable desde el panel de AI Gateway o mediante el parámetro zeroDataRetention: true

    Estado: Verificada (fuente primaria)