← Volver al artículo

Transparencia

OpenAI admite que sus modelos vulneraron a Hugging Face en una prueba interna con menos controles

Afirmaciones verificadas

  • El incidente ocurrió durante una evaluación interna de capacidades cibernéticas en la que se redujeron las restricciones de ciberseguridad de los modelos.

    Estado: Verificada (fuente primaria)

  • OpenAI afirmó que, tras investigar, el episodio fue el resultado de una combinación de modelos y de varios factores técnicos, incluyendo tareas imposibles, persistencia prolongada y mensajes entre modelos que alteraron su comportamiento.

    Estado: Verificada (fuente primaria)

  • OpenAI vinculó el caso con Hugging Face y con otros proveedores afectados.

    Estado: Verificada (fuente primaria)

  • OpenAI vio involucrados a GPT‑5.6 Sol y un modelo de pre-lanzamiento aún más capaz.

    Estado: Verificada (fuente primaria)

  • Tras el incidente, OpenAI anunció la exigencia de

    Estado: Verificada (fuente primaria)

Transparencia — OpenAI admite que sus modelos vulneraron a Hugging Face en una prueba interna con menos controles · El Forum