AI isn’t enough to protect social media communities from AI
En un mundo donde la inteligencia artificial (IA) está cada vez más presente, las plataformas de redes sociales enfrentan un dilema: ¿cómo proteger a sus comunidades de los efectos negativos de la propia IA? Aunque la tecnología promete mejorar la moderación de contenido, su implementación sin supervisión humana puede llevar a errores significativos que afectan a los usuarios.
Un ejemplo claro de esto ocurrió en abril en el subreddit r/AskHistorians de Reddit. Moderadores de la comunidad notaron que decenas de comentarios y publicaciones, algunos con más de 10 años de antigüedad, fueron eliminados automáticamente. Dr. Sarah Gilbert, una de las moderadoras, explicó que no había nada que ellos o los expertos pudieran hacer al respecto. La eliminación de contenido valioso, que había tomado horas o incluso días en ser creado, fue atribuida a las herramientas de moderación de IA recientemente renovadas de Reddit.
Reddit ha afirmado que, gracias a la IA, ha incrementado las acciones de cumplimiento contra contenido de odio y violencia en más de un 200%, y que la IA ha ayudado a reducir la exposición a contenido potencialmente dañino en más de un 40%. Sin embargo, como ilustra el caso de AskHistorians, más acciones de cumplimiento no significan necesariamente un mejor cumplimiento.
El crecimiento de la IA generativa ha creado nuevos obstáculos para la moderación en redes sociales. Gilbert señaló que los modelos de lenguaje grandes han dificultado la detección de spam, ya que buscan imitar voces humanas reales. «En los últimos dos o tres meses, hemos sido absolutamente inundados por spambots impulsados por LLM», dijo.
Algunas empresas de redes sociales han comenzado a explorar nuevas técnicas de moderación basadas en IA. Sin embargo, la dependencia excesiva de estas herramientas puede llevar a penalizaciones injustas. Discord, por ejemplo, admitió que su sistema de moderación de IA prohibió erróneamente unas 8,400 cuentas entre mayo y principios de julio. La IA etiquetó incorrectamente imágenes que contenían cuadrículas, como tableros de ajedrez o hojas de cálculo, como contenido inapropiado, lo que resultó en prohibiciones permanentes para los usuarios afectados.
Este incidente subraya la importancia de mantener supervisión humana en la moderación de contenido. Sin una supervisión significativa, un sistema de moderación basado en IA puede cometer miles de errores en cuestión de semanas, con consecuencias duraderas. Desde 2025, muchos usuarios de Facebook e Instagram han reportado prohibiciones masivas que atribuyen a la moderación de IA, lo que ha generado frustración debido a la falta de interacción humana para resolver estos problemas.
Fuente: https://arstechnica.com/gadgets/2026/08/ai-isnt-enough-to-protect-social-media-communities-from-ai/