Microsoft: casi nadie copia artículos del NYT con Copilot

Microsoft revela en tribunales que menos del 1% de las respuestas de Copilot reproducen enteros textos del NYT. Un dato clave en la batalla por derechos de autor.

Microsoft: casi nadie copia artículos del NYT con Copilot

El conflicto entre Microsoft, OpenAI y gigantes editoriales como The New York Times ha salido a la luz con datos contundentes. En los últimos emplazamientos legales, la compañía tecnológica ha argumentado que su chatbot, Copilot, escasamente reproduce oraciones completas de periódicos o libros, y mucho menos fragmentos sustanciales que pudieran sustituir al texto original.

Para demostrarlo, Microsoft suminisó 8,2 millones de registros de chat de Copilot a un experto contratado por las editoriales. Estos registros no fueron aleatorios; la empresa asegura que fueron seleccionados específicamente porque contenían palabras clave vinculadas al uso de los sitios web de los demandantes, siendo por tanto los más propensos a contener obras protegidas por derechos de autor.

Lectura de datos y defensa del uso justo

El análisis resultante muestra una cifra reveladora: solo 59.545 interacciones mostraron algún tipo de correspondencia directa. En el contexto de millones de consultas,これは un porcentaje ínfimo. Microsoft utiliza estos datos para reforzar su defensa de que la generación de respuestas mediante inteligencia artificial no constituye una violación masiva de derechos de autor, sino un uso transformativo y limitado del contenido.

Esta postura es crucial en un momento en que la industria tecnológica enfrenta un escrutinio sin precedentes sobre cómo se alimenta a los grandes modelos de lenguaje (LLM). La editorialidad teme la sustitución de su contenido; Microsoft demuestra que la sustitución directa es rara.

💡 Opinión iaPasión

Estos números tranquilizan ligeramente a los creadores, pero no resuelven el dilema estructural. El hecho de que Copilot no copie y pegue enteros fragmentos del New York Times no invalida la preocupación fundamental: la IA ha aprendido de ese trabajo sin compensación inicial. ¿Es suficiente afirmar que "no hay copia sustancial" cuando el modelo fue entrenado con propiedad intelectual ajena? Creemos que sí es un punto fuerte para Microsoft, pero la batalla por la remuneración justa por el entrenamiento seguirá siendo el gran battleground legal de los próximos años. La transparencia de datos, como la mostrada aquí, es el primer paso necesario.