Microsoft: Copilot reproduce libros en menos del 0,001% de casos

Microsoft: Copilot reproduce libros en menos del 0,001% de casos

⏱ Tiempo de lectura: 3 min

Microsoft presentó argumentos ante un tribunal federal en Nueva York el 4 de septiembre de 2026 en el litigio de derechos de autor consolidado contra desarrolladores de modelos de lenguaje grandes. Según el análisis de 8,2 millones de conversaciones de Copilot, solo 24 respuestas contenían al menos 30 palabras coincidentes con obras de autores demandantes, una tasa de 0,00029%, según la moción de sentencia sumaria de Microsoft.

Copilot y la reproducción de contenido protegido

El experto del demandante, Dr. Shawn Shan, utilizó un protocolo de extracción adversarial con aproximadamente 5,3 millones de intentos que alimentaron fragmentos literales de libros al modelo GPT. Menos del 1% de esos intentos produjeron coincidencias de 30 palabras. En un entorno de laboratorio controlado, cuando el experto seleccionaba un pasaje objetivo e instaba repetidamente al modelo a emitir el texto deseado, ocasionalmente ocurría. Fuera de ese contexto, en 202 de 212 libros analizados, no se detectó reproducción alguna en los registros de Copilot. Microsoft argumenta que el entrenamiento de modelos de lenguaje constituye un uso justo.

Argumentos de uso justo y daño de mercado

Microsoft sostiene que el entrenamiento en libros protegidos es transformativo: los libros se crean para ser leídos, pero OpenAI utilizó textos como "The Street Lawyer" de John Grisham y "Cleopatra" de Stacy Schiff con propósito tecnológico: construir un modelo que genere respuestas en lenguaje natural. Sobre la descarga de Library Genesis, Microsoft afirma que no participó en la adquisición de esos datos. Respecto del daño de mercado, Microsoft cita evidencia de que los consumidores rechazarían comprar libros generados por IA incluso a precios drasticamente más bajos, y que las ventas de autores no han disminuido desde el lanzamiento de ChatGPT en noviembre de 2022. Fuente: www.unite.ai

Procedimiento en el litigio multidistrial

El caso In re: OpenAI, Inc. Copyright Infringement Litigation, ante el Juez Sidney H. Stein en la Corte de Distrito de Estados Unidos para el Distrito Sur de Nueva York, reúne demandas de autores y editores. The New York Times Company, OpenAI e Microsoft presentaron mociones de sentencia sumaria el 4 de septiembre de 2026. Los escritos de oposición vencen el 5 de octubre de 2026, con nueva presentación pública requerida el 15 de octubre de 2026. La orden de sellado estipulada establece calendarios para redacciones y revelación pública de los argumentos.

Dato Detalle
Tasa de reproducción detectada 24 de 8,2 millones de conversaciones (0,00029%)
Análisis adversarial 5,3 millones de intentos con pasajes literales; menos del 1% produjo coincidencias
Libros sin reproducción detectada 202 de 212 obras analizadas
Argumento central Uso transformativo de material protegido; entrenamiento vs. lectura pública
Tribunal Corte de Distrito Sur de Nueva York, Juez Sidney H. Stein
Fecha de mociones 4 de septiembre de 2026
Vencimiento de oposiciones 5 de octubre de 2026

Preguntas frecuentes sobre el litigio Copilot

¿Qué prueba Microsoft con el análisis de 8,2 millones de conversaciones?

Que en uso real de Copilot, la reproducción exacta de fragmentos de 30+ palabras de libros protegidos ocurre en menos del 0,001% de los casos, según los registros de la empresa. Esto difiere del entorno de laboratorio donde expertos forzaban intencionalmente la reproducción.

¿Cuál es la próxima fecha importante en este caso?

El 5 de octubre de 2026 vencen los escritos de oposición de los demandantes. La nueva presentación pública de todos los argumentos sin redacciones está programada para el 15 de octubre de 2026.

¿Aplica el argumento de "uso justo" a todos los modelos de IA?

No se especifica en el texto fuente recibido si tribunales establecerán precedente que cubra todos los modelos. Microsoft cita fallos en casos contra Meta y Anthropic que también describieron el entrenamiento de modelos de lenguaje como altamente transformativo.

Qué falta por confirmar

La decisión del Juez Stein sobre si el entrenamiento constituye uso justo de conformidad con la ley de derechos de autor estadounidense. También está pendiente el resultado de la moción de sentencia sumaria separada de Microsoft en el caso de demandantes editores de noticias (The New York Times, The Seattle Times, Newsday), presentada el mismo día.

En Inteligencia Artificial, este caso marca un momento crítico: los tribunales estadounidenses definen si el entrenamiento masivo de modelos en obras protegidas es legal o requiere negociación de licencias. La decisión afectará directamente cómo empresas como OpenAI y Microsoft desarrollan futuros modelos en toda industria. ¿Debería el derecho de autor adaptarse a modelos de IA, o los modelos deben adecuarse a la ley vigente?

Deja una respuesta

Subir