Logotipo iluminado de Microsoft en la fachada de una tienda de la empresa
Logotipo iluminado de Microsoft en la fachada de una tienda de la empresaJeepersMedia · flickr · CC-BY

El memorándum que desató la polémica en Microsoft

En enero de 2023, Brent Hecht, director de Applied Science en Microsoft, escribió en un memorándum interno que el scraping de contenido para entrenar modelos de IA representa "el mayor robo de trabajo en la historia humana". Además, calificó esta práctica como "un robo asombroso e inédito en proporciones". Estos documentos surgieron como parte de la demanda que The New York Times inició contra OpenAI y Microsoft, y fueron presentados como argumentos legales.

Este material interno revela tensiones dentro de Microsoft sobre la ética y las prácticas aplicadas en el entrenamiento de inteligencia artificial que utiliza grandes cantidades de datos recogidos sin consentimiento explícito de los creadores originales.

A pesar del fuerte lenguaje empleado por Hecht, Microsoft declaró en medios que estas ideas son opiniones personales y no representan la posición oficial de la empresa ni sus políticas.

La divulgación del memorándum ha servido para avivar el debate público y jurídico sobre hasta qué punto la recolección y uso irrestricto de contenido para entrenar IA es justo o legal, especialmente en sectores como el editorial y el creativo.

La amenaza a los editores según el jefe de ChatGPT

Nick Turley, responsable del equipo de ChatGPT, también escribió internamente que los editores enfrentan una "amenaza existencial" como resultado del avance de productos de IA como ChatGPT, los cuales calificó de "mayormente sustitutivos" y que se irán haciendo aún más así.

Estas declaraciones evidencian que dentro de Microsoft hay plena conciencia sobre el impacto disruptivo que la IA genera en industrias tradicionales, especialmente en la producción y distribución de contenido original.

Identificar productos de IA como sustitutos directos plantea cuestiones regulatorias y éticas sobre la competencia, la remuneración y el futuro laboral de miles de profesionales relacionados con la edición y creación de contenidos.

El reconocimiento de esta amenaza internaliza el conflicto legal pero también la responsabilidad que tienen las grandes empresas tecnológicas en los cambios estructurales que la IA está provocando.

El memorándum y las declaraciones internas forman parte de los documentos aportados en la demanda legal iniciada por The New York Times contra OpenAI y Microsoft, centrada en cómo las grandes IA entrenan sus modelos usando material protegido sin permiso.

La ley de derechos de autor y su aplicación en el contexto de la IA generativa es un terreno aún en desarrollo donde convergen intereses contrapuestos: creadores que exigen reconocimiento y compensación frente a laboratorios que defienden su innovación y viabilidad técnica.

Este caso se ha convertido en un punto de referencia para futuras acciones legales y políticas regulatorias que definirán el grado de libertad que tendrán los modelos de IA para procesar datos protegidos, y bajo qué condiciones.

La existencia de opiniones tan fuertes dentro de Microsoft indica que el debate sobre la ética del scraping y el respeto al trabajo humano es interno y conmueve incluso a las altas esferas corporativas.

Hombre habla en un escenario junto a atril con el logo de Microsoft
Hombre habla en un escenario junto a atril con el logo de MicrosoftChoubistar · flickr · CC-BY-SA

Las posiciones oficiales y el futuro del debate

Microsoft ha aclarado que las opiniones expresadas por Brent Hecht no representan la postura oficial de la empresa, intentando matizar el impacto público del memorándum filtrado.

Sin embargo, estas declaraciones han reforzado la presión sobre Microsoft y OpenAI para buscar soluciones que respeten más a los creadores y se adapten a los requisitos legales.

El debate sobre la ética del entrenamiento de modelos de IA y el scraping masivo seguirá siendo central ante el avance global de la inteligencia artificial generativa y sus aplicaciones en múltiples sectores.

Es probable que futuras regulaciones y acuerdos influirán en cómo los modelos acceden y procesan los datos, y en qué compensación reciben los titulares de derechos, redefiniendo la relación entre IA, empresas tecnológicas y creadores de contenido.