Apps y consumo
Reddit reporta una caída del 20% en la exposición al spam mediante LLM
Reddit está utilizando modelos de lenguaje extensos (LLM) para combatir el spam, reportando una reducción del 20% en la exposición de los usuarios al spam entre enero y marzo.
Reddit está utilizando modelos de lenguaje extensos (LLM) para reducir el spam en todo internet, desplegando inteligencia artificial para combatir el contenido automatizado. A medida que los modelos de lenguaje potentes se vuelven fácilmente accesibles, los actores malintencionados pueden distribuir spam y contenido de bots de manera más eficiente, lo que representa un desafío creciente para las plataformas en línea. En respuesta, Reddit ha desarrollado herramientas que utilizan LLM para reducir el spam, gran parte del cual es generado por los propios LLM. Según la empresa, la plataforma bloquea ahora 23 millones de vistas de spam al día. Además, Reddit reporta que detecta alrededor de 25,000 nuevas publicaciones y comentarios de spam cada día. Aunque las plataformas sociales han construido herramientas automatizadas de reducción de spam durante años, Reddit afirma que estos sistemas actualizados están detectando spam a una tasa mayor.
La empresa atribuye esta mayor eficiencia a las capacidades de reconocimiento de patrones de los modelos de IA modernos. En una publicación de blog de la empresa, Reddit declaró: “Aprovechamos los LLM para detectar los patrones altamente sutiles y coordinados de comportamiento falso y exageración artificial que los sistemas antiguos pasaban por alto”. Al identificar estos patrones complejos, la plataforma ha logrado limitar el alcance del spam automatizado. Específicamente, Reddit afirma que redujo la exposición de los usuarios al spam en un 20% de enero a marzo en comparación con los tres meses anteriores, lo que demuestra el impacto inmediato de integrar los LLM en su infraestructura de moderación. Esta reducción se mide frente a los tres meses anteriores, lo que destaca un cambio medible en la calidad del contenido.
Este despliegue ocurre junto a cambios más amplios en la industria, a medida que otras plataformas sociales establecen políticas distintas para gestionar el contenido generado por IA. Plataformas como YouTube, Meta e Instagram permiten actualmente a los usuarios publicar contenido generado por IA siempre que lo revelen, mientras que TikTok ha introducido funciones que permiten a los usuarios alternar la cantidad de contenido generado por IA que ven. Sin embargo, a medida que las plataformas buscan detectar contenido generado por IA más rápido, los expertos señalan que las herramientas automatizadas por sí solas son insuficientes. Los expertos en plataformas enfatizan que la moderación de contenido por IA debe combinarse con la moderación humana para lograr los resultados más efectivos. Este enfoque híbrido sigue siendo fundamental para identificar y marcar con precisión el contenido infractor, como el discurso de odio, que a menudo requiere contexto humano para ser evaluado.
Por qué importa
A medida que la accesibilidad de los modelos de lenguaje extensos facilita la generación de spam en todo internet, las plataformas se ven cada vez más obligadas a adoptar herramientas de moderación impulsadas por IA para mantener la calidad del contenido. Sin embargo, mantener la seguridad de la plataforma e identificar con precisión las violaciones complejas seguirá requiriendo un equilibrio entre los sistemas automatizados y la supervisión humana.