← Volver al artículo

Transparencia

Guidelight evalúa planes de control de IA: OpenAI mejor puntuado y Meta el peor, sin planes públicos

Afirmaciones verificadas

  • El análisis de Guidelight fue actualizado al 18 de agosto de 2026.

    Estado: Verificada (fuente primaria)

  • El estudio evaluó a cinco laboratorios de IA: Anthropic, Google, OpenAI, Meta y xAI.

    Estado: Verificada (fuente primaria)

  • En una evaluación sobre un plan público de contención, Anthropic obtuvo 0 puntos, OpenAI 3, y Meta 0.

    Estado: Verificada (fuente primaria)

  • Guidelight define un 'containment plan' como un plan pre-especificado que se activa cuando la IA es detectada intentando subvertir el control humano, especificando qué permisos revocar, quién puede seguir operando el sistema, bajo qué restricciones y cuándo desconectarlo por completo.

    Estado: Declarada por la fuente · Requiere atribución

  • La definición de Guidelight sobre un 'plan de contención' es un protocolo predefinido que se activa cuando una IA intenta eludir el control, especificando permisos, restricciones y condiciones para su desconexión.

    Estado: Verificada (fuente primaria)

  • La evaluación midió cuatro criterios: registro/monitorización interna, detención de sistemas tras aumento de conductas anómalas, revisión por auditores externos independientes con publicación de hallazgos, y existencia de un plan exacto de contención.

    Estado: Atribuida a una sola fuente · Requiere atribución

  • Las calificaciones globales fueron: Anthropic C+ (2,50), OpenAI C+ (2,50), Google D+ (1,50), xAI D− (0,83) y Meta F (0,67).

    Estado: Verificada (fuente primaria)

  • Nadie de los cinco laboratorios evaluados alcanzó la puntuación máxima de 5 en ninguna de las prácticas evaluadas; la puntuación máxima en una práctica individual fue 3 sobre 5.

    Estado: Verificada (fuente primaria)

  • Ninguna de las cinco empresas evaluadas ha hecho pública información suficiente sobre planes concretos de contención de un modelo descontrolado.

    Estado: Atribuida a una sola fuente · Requiere atribución

  • OpenAI obtuvo la mejor puntuación en la evaluación, mientras que Anthropic y Meta obtuvieron las puntuaciones más bajas.

    Estado: Atribuida a una sola fuente · Requiere atribución

  • Se examinaron seis prácticas clave relacionadas con el control y la contención de modelos de IA.

    Estado: Verificada (fuente primaria)

  • Un estudio de Guidelight evaluó los planes públicos de Anthropic, Google, OpenAI, Meta y xAI sobre monitorización, detención de sistemas y contención de modelos de IA.

    Estado: Atribuida a una sola fuente · Requiere atribución