Steve Jurvetson, de Draper Fisher Jurvetson, habla en un escenario durante una conferencia
Steve Jurvetson, de Draper Fisher Jurvetson, habla en un escenario durante una conferencia — imagen de archivo de El Forum, ajena al asunto de esta pieza; pendiente de sustituciónEl Forum · Fototeca de El Forum · OWN_WORK

Las advertencias públicas de exintegrantes de Anthropic

Jacob Coxon y Evan Hubinger, exinvestigadores de Anthropic, emplearon la plataforma X el 9 de septiembre de 2026 para alertar sobre la posibilidad de que la IA alcance una superinteligencia capaz de matar a todos los humanos.

Coxon denunció que los laboratorios están acelerando hacia una IA auto-mejorable sin control demostrable y que esto implica un riesgo directo sobre la vida humana.

Hubinger reforzó estas afirmaciones señalando que él y otros colegas creen de forma seria que la IA podría causar la extinción humana y concretando su estimación de riesgo en más del 10 % en la próxima década.

Ambos subrayaron que, aunque Anthropic intenta mitigar estos riesgos, aún no hay un plan claro de alineación para ese escenario extremo.

El respaldo documental en el prospecto de IPO de Anthropic

El propio prospecto de IPO de Anthropic, presentado en 2026 para su registro ante la SEC, dedica 80 páginas a describir los peligros que conlleva el desarrollo de IA avanzada.

Este documento reconoce explícitamente los riesgos que los exinvestigadores han referido en sus publicaciones públicas.

La inclusión tan detallada en un trámite financiero refleja que Anthropic es consciente del carácter de riesgo existencial que puede presentar su tecnología.

No obstante, el prospecto no detalla una solución concreta para asegurar un control efectivo frente a una posible superinteligencia.

La carrera hacia la superinteligencia y sus consecuencias

Los exintegrantes de Anthropic denuncian una carrera acelerada hacia IA superinteligente auto-mejorable, sin criterios claros ni garantía de seguridad.

Esta dinámica genera una situación en la cual la búsqueda por adelantarse a otros competidores puede dejar de lado aspectos críticos de seguridad y control.

El riesgo valorado en más del 10 % en una década indica que esta amenaza no es un problema lejanísimo sino plausible en un horizonte temporal inmediato.

La ausencia de un plan de alineación suscita dudas sobre si los avances tecnológicos actuales serán capaces de evitar consecuencias catastróficas.

Implicaciones para el sector tecnológico y la regulación

Estas declaraciones ponen presión sobre reguladores para considerar medidas más estrictas en el desarrollo de IA avanzada, reconociendo explícitamente todo riesgo existencial.

Los laboratorios que trabajan en superinteligencia están obligados a fortalecer la comunicación transparente sobre sus progresos y riesgos detectados.

Este episodio subraya la necesidad de avanzar en protocolos sólidos de alineación e integración ética en todos los modelos futuros.

La comunidad de usuarios y desarrolladores debe mantenerse informada y preparada ante eventuales cambios regulatorios o técnicos, dados estos avisos serios de expertos internos.

El debate sobre la alineación y el control de la IA

La falta de una solución clara para alinear IA superinteligente es el núcleo de la preocupación expresada por Hubinger y Coxon.

La alineación es el proceso que busca asegurar que las acciones de una IA avanzada sean compatibles con valores humanos y controlables.

Actualmente no existe consenso ni método probado para garantizar que una superinteligencia actúe en beneficio de la humanidad, y Anthropic reconoce esta incertidumbre.

Esta discusión reafirma que la seguridad y el control de IA no son solo problemas técnicos, sino también éticos y estratégicos que requieren atención inmediata.