Transparencia
Guidelight evalúa planes de control de IA: OpenAI mejor puntuado y Meta el peor, sin planes públicos
Afirmaciones verificadas
El análisis de Guidelight fue actualizado al 18 de agosto de 2026.
Estado: Verificada (fuente primaria)
El estudio evaluó a cinco laboratorios de IA: Anthropic, Google, OpenAI, Meta y xAI.
Estado: Verificada (fuente primaria)
En una evaluación sobre un plan público de contención, Anthropic obtuvo 0 puntos, OpenAI 3, y Meta 0.
Estado: Verificada (fuente primaria)
Guidelight define un 'containment plan' como un plan pre-especificado que se activa cuando la IA es detectada intentando subvertir el control humano, especificando qué permisos revocar, quién puede seguir operando el sistema, bajo qué restricciones y cuándo desconectarlo por completo.
Estado: Declarada por la fuente · Requiere atribución
La definición de Guidelight sobre un 'plan de contención' es un protocolo predefinido que se activa cuando una IA intenta eludir el control, especificando permisos, restricciones y condiciones para su desconexión.
Estado: Verificada (fuente primaria)
La evaluación midió cuatro criterios: registro/monitorización interna, detención de sistemas tras aumento de conductas anómalas, revisión por auditores externos independientes con publicación de hallazgos, y existencia de un plan exacto de contención.
Estado: Atribuida a una sola fuente · Requiere atribución
Las calificaciones globales fueron: Anthropic C+ (2,50), OpenAI C+ (2,50), Google D+ (1,50), xAI D− (0,83) y Meta F (0,67).
Estado: Verificada (fuente primaria)
Nadie de los cinco laboratorios evaluados alcanzó la puntuación máxima de 5 en ninguna de las prácticas evaluadas; la puntuación máxima en una práctica individual fue 3 sobre 5.
Estado: Verificada (fuente primaria)
Ninguna de las cinco empresas evaluadas ha hecho pública información suficiente sobre planes concretos de contención de un modelo descontrolado.
Estado: Atribuida a una sola fuente · Requiere atribución
OpenAI obtuvo la mejor puntuación en la evaluación, mientras que Anthropic y Meta obtuvieron las puntuaciones más bajas.
Estado: Atribuida a una sola fuente · Requiere atribución
Se examinaron seis prácticas clave relacionadas con el control y la contención de modelos de IA.
Estado: Verificada (fuente primaria)
Un estudio de Guidelight evaluó los planes públicos de Anthropic, Google, OpenAI, Meta y xAI sobre monitorización, detención de sistemas y contención de modelos de IA.
Estado: Atribuida a una sola fuente · Requiere atribución