Cómo usan realmente la IA: datos independientes revelan usos ocultos

Cómo usan realmente la IA: datos independientes revelan usos ocultos

⏱ Tiempo de lectura: 4 min

Las empresas de IA como Anthropic y OpenAI publican reportes sobre cómo se usan Claude y ChatGPT, pero solo comparten los datos que les favorecen, según investigadores independientes. Un nuevo proyecto llamado AI Observatory busca llenar ese vacío analizando conversaciones reales de usuarios con modelos populares para revelar patrones que los reportes corporativos omiten deliberadamente.

El problema de los datos corporativos sesgados

Anka Reuel, investigadora del Stanford Trustworthy AI Research Lab, explica que no existe una fuente independiente que corrobore los números que publican las grandes empresas. El AI Observatory es un proyecto de código abierto que agregó y analizó 24.521 conversaciones reales (85.633 turnos conversacionales) de usuarios interactuando con 52 modelos diferentes entre 2023 y 2025. Los datos provienen de siete conjuntos de datos existentes recopilados con consentimiento de usuarios, permitiendo a investigadores y legisladores evaluar el uso real de IA generativa sin depender de narrativas corporativas.

Qué revelan los datos reales sobre el uso de IA

Cuando los investigadores aplicaron los mismos criterios de filtrado de Anthropic a su conjunto de datos, descubrieron que el 48% de las conversaciones habrían sido excluidas de su Anthropic Economic Index porque no se enfocaban en productividad laboral. Esas conversaciones filtradas mostraban mucho más contenido sensible: salud y relaciones (44,2% versus 31,2%), temas adultos o ilícitos (7,9% versus 2,1%), acoso y odio (27,5% versus 5,66%), y contenido sexual (16,7% versus 2,4%). El patrón también aparece en OpenAI, cuyo reporte de 2025 encontró que solo el 30% del uso de consumidor estaba relacionado con trabajo. Investigadores independientes advierten que decisiones de política pública sobre riesgos y beneficios de IA se toman con datos incompletos.

Diferencias de uso según modelo y evolución temporal

El AI Observatory encontró variaciones significativas en cómo las personas usan distintos modelos. Grok y Gemini se usan más para búsqueda de información, con Grok concentrando especialmente temas de política pero también proliferación de desinformación. Claude destaca en tareas de programación, Gemini en usos sociales y roleplaying, y ChatGPT en asistencia con tareas escolares. Con GPT-4o las conversaciones son más largas e iterativas que con GPT-3.5. Entre 2023 y 2025, el pequeño talk aumentó, sugiriendo mayor adopción de IA como compañera, mientras que el contenido sensible disminuyó, indicando mejores salvaguardas en las plataformas.

Dato Detalle
Conversaciones analizadas 24.521 conversaciones, 85.633 turnos de 5.000 usuarios
Modelos cubiertos 52 modelos incluyendo ChatGPT, Gemini, Claude y Grok
Período de recopilación 2023 a 2025
Conversaciones no-trabajo filtradas Anthropic 48% excluidas por no ser productividad laboral
Salud y relaciones en datos filtrados 44,2% vs 31,2% en reporte Anthropic
Contenido sexual en datos filtrados 16,7% vs 2,4% en reporte Anthropic
Acoso y discurso de odio en datos filtrados 27,5% vs 5,66% en reporte Anthropic
Conversaciones analizadas por Anthropic 1 millón en su Economic Index
Conversaciones analizadas por OpenAI 1,5 millones en reporte 2025
Uso de trabajo en ChatGPT (consumo) Solo 30% según reporte OpenAI 2025
Institutos colaboradores MIT, Stanford, Data Provenance Initiative y otros

Por qué este dato es relevante

El AI Observatory expone un problema crítico: los responsables de políticas públicas toman decisiones sobre riesgos y beneficios de IA basándose en datos corporativos incompletos e intencionalemente filtrados. Los reportes de empresas minimizan contenido sensible y subrayan productividad, ocultando usos reales como compañía, soporte emocional o búsqueda de información política. Acceso a datos independientes permite a investigadores evaluar si los sistemas de IA se usan mayormente para bien o para mal, una pregunta fundamental que hoy permanece sin respuesta verificable.

Preguntas frecuentes sobre uso real de IA

¿Qué es el AI Observatory?

Un proyecto de código abierto que agrega conversaciones reales de usuarios con IA generativa para análisis independiente, evitando depender únicamente de reportes corporativos de Anthropic, OpenAI y otros.

¿Por qué Anthropic filtra datos?

Anthropic enfoca su Economic Index en productividad laboral porque eso es su pregunta de investigación principal. El AI Observatory muestra que eso deja fuera el 48% de conversaciones reales, incluyendo usos de salud, relaciones y contenido sensible que las políticas públicas también deberían evaluar.

¿Cuál es el riesgo de datos sesgados?

Decisiones sobre regulación, seguridad y riesgos de IA se toman sin conocer cómo la población realmente usa estos sistemas. Legisladores operan con narrativas corporativas incompletas en lugar de evidencia independiente verificable.

Nuestra lectura editorial

El AI Observatory llena un vacío crítico en transparencia de IA. Aunque sus datos son menores a los que tienen las empresas (24.521 vs 1-1,5 millones de conversaciones), logran mostrar patrones radicalmente diferentes simplemente al no filtrar datos para favorecer una narrativa. Esto señala que la privacidad de usuarios no es el único obstáculo: también existe un problema de incentivos corporativos en qué datos se publican.

En Inteligencia Artificial consideramos que este tipo de investigación independiente es esencial para que legisladores y la sociedad entiendan realmente cómo la IA impacta nuestras vidas más allá de productividad. ¿Deberían las empresas estar obligadas a compartir datos de uso con investigadores independientes bajo protecciones de privacidad?

Fuente: www.technologyreview.com

Deja una respuesta

Subir