Cómo usan realmente la IA: datos independientes revelan usos ocultos

⏱ Tiempo de lectura: 4 min
Las empresas de IA como Anthropic y OpenAI publican reportes sobre cómo se usan Claude y ChatGPT, pero solo comparten los datos que les favorecen, según investigadores independientes. Un nuevo proyecto llamado AI Observatory busca llenar ese vacío analizando conversaciones reales de usuarios con modelos populares para revelar patrones que los reportes corporativos omiten deliberadamente.
El problema de los datos corporativos sesgados
Anka Reuel, investigadora del Stanford Trustworthy AI Research Lab, explica que no existe una fuente independiente que corrobore los números que publican las grandes empresas. El AI Observatory es un proyecto de código abierto que agregó y analizó 24.521 conversaciones reales (85.633 turnos conversacionales) de usuarios interactuando con 52 modelos diferentes entre 2023 y 2025. Los datos provienen de siete conjuntos de datos existentes recopilados con consentimiento de usuarios, permitiendo a investigadores y legisladores evaluar el uso real de IA generativa sin depender de narrativas corporativas.
Qué revelan los datos reales sobre el uso de IA
Cuando los investigadores aplicaron los mismos criterios de filtrado de Anthropic a su conjunto de datos, descubrieron que el 48% de las conversaciones habrían sido excluidas de su Anthropic Economic Index porque no se enfocaban en productividad laboral. Esas conversaciones filtradas mostraban mucho más contenido sensible: salud y relaciones (44,2% versus 31,2%), temas adultos o ilícitos (7,9% versus 2,1%), acoso y odio (27,5% versus 5,66%), y contenido sexual (16,7% versus 2,4%). El patrón también aparece en OpenAI, cuyo reporte de 2025 encontró que solo el 30% del uso de consumidor estaba relacionado con trabajo. Investigadores independientes advierten que decisiones de política pública sobre riesgos y beneficios de IA se toman con datos incompletos.
Diferencias de uso según modelo y evolución temporal
El AI Observatory encontró variaciones significativas en cómo las personas usan distintos modelos. Grok y Gemini se usan más para búsqueda de información, con Grok concentrando especialmente temas de política pero también proliferación de desinformación. Claude destaca en tareas de programación, Gemini en usos sociales y roleplaying, y ChatGPT en asistencia con tareas escolares. Con GPT-4o las conversaciones son más largas e iterativas que con GPT-3.5. Entre 2023 y 2025, el pequeño talk aumentó, sugiriendo mayor adopción de IA como compañera, mientras que el contenido sensible disminuyó, indicando mejores salvaguardas en las plataformas.
| Dato | Detalle |
|---|---|
| Conversaciones analizadas | 24.521 conversaciones, 85.633 turnos de 5.000 usuarios |
| Modelos cubiertos | 52 modelos incluyendo ChatGPT, Gemini, Claude y Grok |
| Período de recopilación | 2023 a 2025 |
| Conversaciones no-trabajo filtradas Anthropic | 48% excluidas por no ser productividad laboral |
| Salud y relaciones en datos filtrados | 44,2% vs 31,2% en reporte Anthropic |
| Contenido sexual en datos filtrados | 16,7% vs 2,4% en reporte Anthropic |
| Acoso y discurso de odio en datos filtrados | 27,5% vs 5,66% en reporte Anthropic |
| Conversaciones analizadas por Anthropic | 1 millón en su Economic Index |
| Conversaciones analizadas por OpenAI | 1,5 millones en reporte 2025 |
| Uso de trabajo en ChatGPT (consumo) | Solo 30% según reporte OpenAI 2025 |
| Institutos colaboradores | MIT, Stanford, Data Provenance Initiative y otros |
Por qué este dato es relevante
El AI Observatory expone un problema crítico: los responsables de políticas públicas toman decisiones sobre riesgos y beneficios de IA basándose en datos corporativos incompletos e intencionalemente filtrados. Los reportes de empresas minimizan contenido sensible y subrayan productividad, ocultando usos reales como compañía, soporte emocional o búsqueda de información política. Acceso a datos independientes permite a investigadores evaluar si los sistemas de IA se usan mayormente para bien o para mal, una pregunta fundamental que hoy permanece sin respuesta verificable.
Preguntas frecuentes sobre uso real de IA
¿Qué es el AI Observatory?
Un proyecto de código abierto que agrega conversaciones reales de usuarios con IA generativa para análisis independiente, evitando depender únicamente de reportes corporativos de Anthropic, OpenAI y otros.
¿Por qué Anthropic filtra datos?
Anthropic enfoca su Economic Index en productividad laboral porque eso es su pregunta de investigación principal. El AI Observatory muestra que eso deja fuera el 48% de conversaciones reales, incluyendo usos de salud, relaciones y contenido sensible que las políticas públicas también deberían evaluar.
¿Cuál es el riesgo de datos sesgados?
Decisiones sobre regulación, seguridad y riesgos de IA se toman sin conocer cómo la población realmente usa estos sistemas. Legisladores operan con narrativas corporativas incompletas en lugar de evidencia independiente verificable.
Nuestra lectura editorial
El AI Observatory llena un vacío crítico en transparencia de IA. Aunque sus datos son menores a los que tienen las empresas (24.521 vs 1-1,5 millones de conversaciones), logran mostrar patrones radicalmente diferentes simplemente al no filtrar datos para favorecer una narrativa. Esto señala que la privacidad de usuarios no es el único obstáculo: también existe un problema de incentivos corporativos en qué datos se publican.
En Inteligencia Artificial consideramos que este tipo de investigación independiente es esencial para que legisladores y la sociedad entiendan realmente cómo la IA impacta nuestras vidas más allá de productividad. ¿Deberían las empresas estar obligadas a compartir datos de uso con investigadores independientes bajo protecciones de privacidad?
Fuente: www.technologyreview.com

Deja una respuesta
Lo siento, debes estar conectado para publicar un comentario.