OpenAI ocultó capacidad de búsqueda en registros durante litigio

OpenAI ocultó capacidad de búsqueda en registros durante litigio

⏱ Tiempo de lectura: 4 min

OpenAI enfrenta demandas de "sanciones serias" tras revelarse que ocultó durante dos años su capacidad técnica de buscar en millones de registros de ChatGPT, según un escrito judicial del New York Times. El ingeniero de privacidad Vincent Monaco testificó que la empresa mintió sobre la viabilidad de estas búsquedas, pese a haberlas realizado ya antes del litigio.

Qué ocultó OpenAI en el proceso judicial

Según el escrito de sanciones presentado el jueves, OpenAI ocultó la existencia de dos muestras grandes de registros durante más de dos años: una de 10 millones de registros y otra de 78 millones, ambas ya anonimizadas. La empresa había realizado búsquedas en esas muestras para crear un filtro contra la regurgitación de contenido protegido por derechos de autor. Sin embargo, negó públicamente que tal capacidad existiera, argumentando que sería costoso, gravoso e invasivo para la privacidad de los usuarios.

Números, cronología y evidencia suprimida

Monaco reveló en su deposición de abril que OpenAI había buscado intencionalmente en esos 78 millones de registros con contenido del New York Times como parte de su investigación interna. En cambio, los demandantes —encabezados por el Times y Daily News— fueron obligados a pasar ocho meses trabajando en un "sandbox" restringido con solo 20 millones de registros redactados. OpenAI aplicó 19 mil millones de redacciones automáticas a esa muestra, dejándola "inutilizable" según el tribunal. Además, la empresa eliminó o comprimió miles de millones de registros que debían preservarse según orden judicial, argumentando simplemente que cumplir era "difícil". El reporte completo detalla cada alegación.

Dato Detalle
Muestras ocultas 10 millones y 78 millones de registros, ambas anonimizadas
Período de ocultamiento Más de dos años sin revelar existencia
Muestra entregada a demandantes 20 millones de registros con 19 mil millones de redacciones
Testigo clave Vincent Monaco, ingeniero de privacidad de OpenAI
Acusación central OpenAI mintió sobre capacidad técnica de búsqueda durante dos años
Búsquedas realizadas por OpenAI Contenido del New York Times en muestras para crear filtro interno
Datos eliminados Miles de millones de registros comprimidos o borrados sin cumplir orden de preservación

Qué cambia con esta información

Este escrito de sanciones representa un punto crítico en el litigio sobre derechos de autor. Los registros ocultos constituyen evidencia central: podrían probar si OpenAI permitió que ChatGPT reproduzca artículos completos del Times, debilitando su defensa de uso justo transformativo. OpenAI responde que el Times busca solo invadir privacidad de usuarios y que su caso se debilita tras descartar algunas demandas.

Preguntas frecuentes sobre el caso OpenAI vs. New York Times

¿Qué intentaban demostrar con los registros ocultos?

Los demandantes buscaban documentar si ChatGPT regurgitaba artículos del Times completos o sustancialmente similares, lo que violaría derechos de autor y cuestionaría la defensa de uso justo transformativo de OpenAI.

¿Cuándo se resuelve este litigio?

No se especifica en el texto fuente recibido. La fase actual trata sobre sanciones por conducta procesal antes de llegar a mérito.

¿Qué pasa si el tribunal sanciona a OpenAI?

Las sanciones podrían incluir multas, costos procesales, adverse inference (conclusión desfavorable sobre hechos no probados) o restricciones probatorias que debiliten la posición de OpenAI en el litigio.

La lectura para quienes usan IA a diario

Este caso muestra tensiones sin resolver entre privacidad de usuarios, capacidades técnicas reales versus públicas, y derechos de autor en modelos entrenados con contenido editorial. Las acusaciones de ocultamiento sistemático elevan preguntas sobre transparencia en desarrollo de sistemas de IA generativa.

En Inteligencia Artificial, los litigios sobre derechos de autor enfrentarán cada vez más pruebas sobre qué contenido específico ingresó a modelos y cómo se usa. ¿Debería regularse por ley qué datos pueden ser ocultos en procesos judiciales sobre IA?

Fuente: arstechnica.com

Deja una respuesta

Subir