Muñeco de crochet con la figura de la mascota de Android al aire libre
Muñeco de crochet con la figura de la mascota de Android al aire libre — imagen de archivo de El Forum, ajena al asunto de esta pieza; pendiente de sustituciónEl Forum · Fototeca de El Forum · OWN_WORK

Cómo funciona el sistema de investigación automatizada

Anthropic publicó un paper titulado "Automated Researchers Can Reliably Mitigate Alignment Failures", según recogió TechCrunch el 28 de agosto de 2026. El trabajo, liderado por el fellow de la compañía Chen Yueh-Han, describe un sistema que busca literatura disponible, propone métodos y entrena el modelo con ellos de forma iterativa, sin que un equipo humano diseñe cada paso del proceso.

El paper sostiene que el sistema mejoró el rendimiento en los 10 benchmarks de comportamientos desalineados que evaluó, y que lo hizo sin sacrificar el rendimiento general del modelo. Cada iteración de entrenamiento tomó 30 minutos por método probado, una cifra que Anthropic destaca como indicio de viabilidad práctica a corto plazo, aunque se trata de una conclusión propia recogida por TechCrunch y no de una verificación independiente.

Un tema que Anthropic también aborda fuera del paper técnico

Anthropic mantiene, además, una página institucional titulada "When AI builds itself", dedicada a la autosuperación recursiva de la IA. La propia compañía aclara que las opiniones vertidas allí, a mayo de 2026, son individuales y no constituyen una posición oficial de la empresa, una distinción que separa el debate especulativo del resultado técnico concreto de este paper.