Microsoft refuta las acusaciones de infracción: Copilot rara vez reproduce contenido del New York Times y las obras de los autores

📅 2026-09-05

Resumen:

En respuesta a una demanda conjunta por infracción de derechos de autor iniciada por editores de noticias y autores de libros, Microsoft presentó los últimos materiales de defensa al tribunal, insistiendo en que su chatbot de inteligencia artificial Copilot casi nunca copia palabra por palabra ni reproduce sustancialmente informes de medios como The New York Times y obras literarias protegidas por derechos de autor. Esta postura tiene como objetivo construir una sólida defensa legal de "uso justo" para Microsoft y OpenAI, y presionar al tribunal para que ponga fin a los casos relacionados mediante un juicio sumario lo antes posible.

Como parte del proceso de descubrimiento de la demanda, Microsoft publicó una base de datos de 8,2 millones de transcripciones de conversaciones reales de Copilot con expertos contratados por las organizaciones de noticias demandantes. Microsoft señaló que el conjunto de datos no fue seleccionado al azar, sino que fue seleccionado específicamente en función de palabras clave relacionadas con el sitio web de noticias del demandante. En teoría, es un conjunto de muestra que "es más probable que contenga contenido supuestamente infractor".

Sin embargo, los resultados del análisis de datos revelaron frecuencias de repetición extremadamente bajas. Entre estos 8,2 millones de registros filtrados, sólo 59.545 registros contenían al menos 16 palabras consecutivas que se superponían con el contenido de noticias utilizado para la capacitación del modelo, lo que representa menos del 1% del total de registros. Además, en la demanda que involucra a la organización de reportajes de investigación sin fines de lucro "Center for Investigative Reporting" (Centro de Reportajes de Investigación), el experto original sólo identificó 51 casos en una muestra masiva que constituía una "superposición sustancial" con el material de la organización.

En otro caso consolidado presentado por un grupo de escritores sobre derechos de autor de libros, los datos de las pruebas mostraron una tendencia similar. Expertos independientes contratados por los escritores del demandante realizaron una revisión de los 212 libros involucrados en el caso y finalmente encontraron registros generados con al menos 30 palabras superpuestas en solo 10 libros, con un total de solo 24 muestras coincidentes.

Microsoft argumentó ante el tribunal que estos datos detallados simplemente confirmaban su defensa legal central, es decir, usar materiales protegidos por derechos de autor para entrenar modelos de lenguaje de gran tamaño es "uso legítimo" según el marco de la ley de derechos de autor de EE. UU. Microsoft enfatizó que el propósito de utilizar materiales protegidos por derechos de autor de Copilot y el sistema de inteligencia artificial generativa detrás de él es fundamentalmente diferente al de la publicación original. Su mecanismo fundamental es absorber y reorganizar patrones lingüísticos para generar contenido nuevo, en lugar de circular como sustituto de la obra original. Incluso si ocasionalmente reaparecen fragmentos de texto esporádicos, no pueden borrar las características de "uso transformador" del proceso de capacitación del modelo de lenguaje grande.

Anteriormente, varias organizaciones de medios y grupos de creadores, incluidos el New York Times, el Center for Investigative Reporting y el Authors Guild, presentaron conjuntamente una demanda acusando a Microsoft y OpenAI de apropiarse ilegalmente de millones de artículos y libros originales sin autorización para entrenar sus plataformas comerciales de inteligencia artificial, y de competir directamente con los autores originales generando contenido altamente superpuesto, lo que impactó gravemente el ecosistema empresarial del periodismo independiente y la creación literaria. Para mejorar la eficiencia de los procedimientos judiciales, las demandas relacionadas que involucran a editores y escritores de noticias se han consolidado y entregado al mismo juez federal.

En la actualidad, Microsoft ha solicitado oficialmente al tribunal un juicio sumario, con la esperanza de utilizar los datos anteriores para demostrar que la acusación de infracción sustantiva del demandante carece de una base fáctica universal, resolviendo así esta demanda clave de la industria en una etapa temprana con respecto a la legalidad del entrenamiento subyacente de inteligencia artificial generativa. Hasta el momento, el New York Times, el Center for Investigative Reporting y el Writers Guild of America no han comentado públicamente las últimas estadísticas y declaraciones judiciales presentadas por Microsoft.

Etiquetas relacionadas

Artículos relacionados

Comentarios

0/500
Captcha (click to refresh)
Sin comentarios