Transparencia
Un investigador jefe de Anthropic avisa: más de 10% de riesgo de que la IA "mate a todos los humanos"
Afirmaciones verificadas
Asia Plus resumió que Hubinger dijo que sistemas futuros "surpass human intelligence" y serían "capable of hacking anything, revolutionizing any field overnight, and gaining real power and resources."
Estado: Atribuida a una sola fuente · Requiere atribución
BBC informó sobre la declaración de Hubinger, citando su post en X y la preocupación de la comunidad sobre los riesgos de la superinteligencia.
Estado: Atribuida a una sola fuente · Requiere atribución
Evan Hubinger, Alignment Science Lead en Anthropic, escribió en X: "We really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade."
Estado: Verificada (fuente primaria)
Hubinger añadió: "I believe Anthropic is trying its best, but we do not yet have a plan to solve alignment for superintelligence and are not clearly on track to."
Estado: Verificada (fuente primaria)
Hubinger explicó que el riesgo proviene de la superinteligencia derivada del auto-mejoramiento recursivo: "The danger is from superintelligence arising from recursive self-improvement."
Estado: Verificada (fuente primaria)
Indian Express reportó la estimación del 10 % del riesgo y la falta de planes concretos de Anthropic para la alineación.
Estado: Atribuida a una sola fuente · Requiere atribución