We still don’t know how people are really using AI
Las empresas de inteligencia artificial como Anthropic y OpenAI publican regularmente informes sobre cómo las personas utilizan productos como Claude y ChatGPT. Sin embargo, investigadores de IA señalan que solo se divulga la información que estas compañías desean mostrar. «No existe una fuente independiente para corroborar estos datos», afirma Anka Reuel, candidata a doctorado en ciencias de la computación en el Laboratorio de Investigación de IA Confiable de Stanford (STAIR).
Reuel es co-líder de un nuevo proyecto de investigación, llamado el Observatorio de IA, que busca llenar este vacío. Esta plataforma pública agrega y analiza conversaciones reales con modelos populares como Claude y Gemini, recopiladas con el consentimiento de los usuarios a través de siete conjuntos de datos existentes. El objetivo es proporcionar fuentes independientes de información que ayuden a investigadores y legisladores a evaluar cómo se está utilizando la IA generativa.
El Observatorio de IA ha descubierto que el uso de la IA varía significativamente entre modelos y ha cambiado con el tiempo. Su investigación revela comportamientos más sensibles que los capturados en los informes de las principales empresas de IA, que tienden a centrarse más en el uso laboral que en el personal.
El Índice Económico de Anthropic es una de las fuentes más conocidas y citadas de datos sobre el uso de la IA, pero presenta puntos ciegos. Como su nombre sugiere, se centra en usos relacionados con el trabajo y la productividad de Claude AI, filtrando conversaciones no relacionadas con estos usos. Cuando los investigadores del Observatorio de IA aplicaron los métodos de Anthropic a su conjunto de datos, encontraron que casi la mitad de las conversaciones—48%—habrían sido filtradas. Esas conversaciones no relacionadas con el trabajo eran más propensas a involucrar temas de salud y relaciones, temas adultos o ilícitos, acoso y odio, y contenido sexual.
Los conjuntos de datos que el Observatorio de IA examinó incluyen conversaciones que tuvieron lugar entre 2023 y 2025, y encontraron diferencias tanto en cómo las personas estaban utilizando la IA como en cómo respondían las diversas plataformas de IA. Las conversaciones dentro de WildChat, uno de los conjuntos de datos más grandes y detallados incluidos en el estudio del Observatorio de IA, se volvieron más largas y elaboradas con el tiempo, lo que sugiere un aumento en el uso de la IA como compañía.
El Observatorio de IA también encontró que los temas, estilos de interacción, estructuras de conversación, y la probabilidad y tipo de casos de uso sensibles diferían de un modelo a otro. Por ejemplo, las personas usaban Grok y Gemini con más frecuencia para la recuperación de información, mientras que Anthropic se utilizaba más para codificación, Gemini para usos sociales y de rol, y ChatGPT para asistencia en tareas.
Las diferencias incluso se observaron entre diferentes versiones del mismo modelo. Los investigadores encontraron que las conversaciones con ChatGPT eran más cortas cuando estaba impulsado por GPT-3.5, y más largas e iterativas con GPT-4o.
Para crear el Observatorio de IA, Reuel y los investigadores de MIT, Stanford, la Iniciativa de Procedencia de Datos, y otras instituciones agregaron 85,633 turnos conversacionales a través de 24,521 conversaciones de siete conjuntos de datos del mundo real recopilados en investigaciones previas. Sin embargo, estas conversaciones son solo una pequeña muestra comparadas con los datos a los que tienen acceso los grandes laboratorios.
Fuente: https://www.technologyreview.com/2026/08/18/1142226/how-people-use-ai/