OpenAI ocultó capacidad de búsqueda en registros durante litigio

⏱ Tiempo de lectura: 4 min
OpenAI enfrenta demandas de "sanciones serias" tras revelarse que ocultó durante dos años su capacidad técnica de buscar en millones de registros de ChatGPT, según un escrito judicial del New York Times. El ingeniero de privacidad Vincent Monaco testificó que la empresa mintió sobre la viabilidad de estas búsquedas, pese a haberlas realizado ya antes del litigio.
Qué ocultó OpenAI en el proceso judicial
Según el escrito de sanciones presentado el jueves, OpenAI ocultó la existencia de dos muestras grandes de registros durante más de dos años: una de 10 millones de registros y otra de 78 millones, ambas ya anonimizadas. La empresa había realizado búsquedas en esas muestras para crear un filtro contra la regurgitación de contenido protegido por derechos de autor. Sin embargo, negó públicamente que tal capacidad existiera, argumentando que sería costoso, gravoso e invasivo para la privacidad de los usuarios.
Números, cronología y evidencia suprimida
Monaco reveló en su deposición de abril que OpenAI había buscado intencionalmente en esos 78 millones de registros con contenido del New York Times como parte de su investigación interna. En cambio, los demandantes —encabezados por el Times y Daily News— fueron obligados a pasar ocho meses trabajando en un "sandbox" restringido con solo 20 millones de registros redactados. OpenAI aplicó 19 mil millones de redacciones automáticas a esa muestra, dejándola "inutilizable" según el tribunal. Además, la empresa eliminó o comprimió miles de millones de registros que debían preservarse según orden judicial, argumentando simplemente que cumplir era "difícil". El reporte completo detalla cada alegación.
| Dato | Detalle |
|---|---|
| Muestras ocultas | 10 millones y 78 millones de registros, ambas anonimizadas |
| Período de ocultamiento | Más de dos años sin revelar existencia |
| Muestra entregada a demandantes | 20 millones de registros con 19 mil millones de redacciones |
| Testigo clave | Vincent Monaco, ingeniero de privacidad de OpenAI |
| Acusación central | OpenAI mintió sobre capacidad técnica de búsqueda durante dos años |
| Búsquedas realizadas por OpenAI | Contenido del New York Times en muestras para crear filtro interno |
| Datos eliminados | Miles de millones de registros comprimidos o borrados sin cumplir orden de preservación |
Qué cambia con esta información
Este escrito de sanciones representa un punto crítico en el litigio sobre derechos de autor. Los registros ocultos constituyen evidencia central: podrían probar si OpenAI permitió que ChatGPT reproduzca artículos completos del Times, debilitando su defensa de uso justo transformativo. OpenAI responde que el Times busca solo invadir privacidad de usuarios y que su caso se debilita tras descartar algunas demandas.
Preguntas frecuentes sobre el caso OpenAI vs. New York Times
¿Qué intentaban demostrar con los registros ocultos?
Los demandantes buscaban documentar si ChatGPT regurgitaba artículos del Times completos o sustancialmente similares, lo que violaría derechos de autor y cuestionaría la defensa de uso justo transformativo de OpenAI.
¿Cuándo se resuelve este litigio?
No se especifica en el texto fuente recibido. La fase actual trata sobre sanciones por conducta procesal antes de llegar a mérito.
¿Qué pasa si el tribunal sanciona a OpenAI?
Las sanciones podrían incluir multas, costos procesales, adverse inference (conclusión desfavorable sobre hechos no probados) o restricciones probatorias que debiliten la posición de OpenAI en el litigio.
La lectura para quienes usan IA a diario
Este caso muestra tensiones sin resolver entre privacidad de usuarios, capacidades técnicas reales versus públicas, y derechos de autor en modelos entrenados con contenido editorial. Las acusaciones de ocultamiento sistemático elevan preguntas sobre transparencia en desarrollo de sistemas de IA generativa.
En Inteligencia Artificial, los litigios sobre derechos de autor enfrentarán cada vez más pruebas sobre qué contenido específico ingresó a modelos y cómo se usa. ¿Debería regularse por ley qué datos pueden ser ocultos en procesos judiciales sobre IA?
Fuente: arstechnica.com

Deja una respuesta
Lo siento, debes estar conectado para publicar un comentario.