Brent Hecht, director de Ciencia Aplicada en Microsoft y profesor en la Northwestern University, describió en documentos internos de la compañía la recopilación de contenidos para entrenar modelos de inteligencia artificial como «un robo asombroso de proporciones sin precedentes» y, posiblemente, «el mayor robo de trabajo en la historia de la humanidad». Los escritos judiciales desvelan que OpenAI y Microsoft copiaron millones de artículos, emplearon el índice de Bing y bases derivadas de Common Crawl, y construyeron enormes repositorios con obras de los demandantes.
La compañía sostiene que se trata de la opinión personal de un empleado y no de la empresa, y aún no existe una constatación judicial. Sin embargo, la evidencia apunta a que las compañías que desarrollaron la inteligencia artificial generativa tenían plena consciencia de la naturaleza de lo que estaban haciendo.
Métodos para saltarse los muros de pago
Los documentos incluyen correos en los que se informa a directivos sobre técnicas para eludir el paywall de los medios y recopilar más noticias, saludadas internamente como buenas ideas. Además, no solo se limitaron a copiar: construyeron productos que ellos mismos reconocieron como crecientemente sustitutivos de las fuentes originales, lo que provocó fuertes caídas en las tasas de clics hacia las páginas afectadas y una auténtica amenaza existencial para los medios.
La publicación en la web no convierte el contenido en dominio público ni autoriza a copiarlo, almacenarlo, eliminar sus avisos de derechos de autor y reutilizarlo industrialmente. Si los tribunales declaran legal esa conducta, no será porque la copia no existiera, sino porque habrán decidido que el interés industrial o supuestamente transformador de la IA justifica una excepción de dimensiones inéditas.
Los argumentos de la defensa
Microsoft alega que, de entre 8,2 millones de conversaciones de Copilot seleccionadas por su posible relación con los medios demandantes, menos del 1% compartía ni dieciséis palabras con los textos originales y pocas tenían solapamientos significativos. En otros casos se invoca un uso muy transformador para justificar el tratamiento, pero la Oficina del Copyright afirma que explotar comercialmente millones de obras protegidas para producir contenidos que además compiten con ellas rebasa todas las nociones del fair use.
La cuestión de fondo es por qué los accionistas de estas compañías deberían conservar íntegramente unas rentas construidas mediante una apropiación masiva y, como evidencian estas declaraciones, deliberada. Las posibles respuestas oscilan entre indemnizaciones retroactivas a los titulares de derechos, la destrucción o el reentrenamiento de modelos infractores, licencias colectivas obligatorias o la transferencia de una participación significativa a un fondo ciudadano.
Más allá de que la apropiación fuera profundamente cuestionable, lo revelado ahora es que quienes la llevaban a cabo también lo tenían perfectamente claro.
