IA & GenAI

¿Pueden los foros sobrevivir a la IA? Por qué Reddit gana y Stack Overflow colapsa

The Economist preguntó si Reddit puede sobrevivir en la era de la IA. La respuesta corta, con datos duros de por medio, es que ya está sobreviviendo mejor que casi cualquier otro foro de internet —mientras Stack Overflow, la comunidad que enseñó a programar a una generación entera, se desploma de 200,000 preguntas mensuales a menos de 50,000.

The Economist tituló recientemente uno de sus análisis con una pregunta directa: ¿puede Reddit sobrevivir en la era de la IA? Es una pregunta razonable para cualquier plataforma cuyo modelo de negocio dependía, hasta hace apenas tres años, de que millones de personas llegaran a ella a través de una búsqueda en Google. Pero la pregunta correcta, la que realmente separa a los ganadores de los perdedores de esta transición, no es si un foro puede sobrevivir a la IA en abstracto, sino qué tipo de contenido hace que un sistema de IA necesite citar a ese foro como fuente en lugar de simplemente absorber su conocimiento y volverlo invisible. Reddit y Stack Overflow, dos de los foros más influyentes de la historia reciente de internet, están respondiendo esa pregunta con trayectorias casi opuestas, y esa divergencia es la lección de fondo detrás del titular de The Economist.

El negocio: Reddit factura más que nunca, sin traficar menos

Los resultados del segundo trimestre de 2026 de Reddit desmienten, con cifras, la premisa de que la IA generativa necesariamente le quita tráfico y relevancia a las comunidades de contenido generado por usuarios: la compañía reportó ingresos totales de 805 millones de dólares, con su negocio publicitario creciendo 64% interanual hasta 762 millones. Más revelador todavía: mientras el resto de la web experimenta lo que los analistas de tráfico llaman la era del "zero-click" —Gartner proyecta que el volumen de búsquedas tradicionales caerá 25% para 2026, y a inicios de este año el 68.01% de las búsquedas en Google en Estados Unidos terminaron sin que el usuario diera clic a ningún sitio externo, frente a 60.45% en 2024—, Reddit reportó un crecimiento de 68.2% en tráfico total del sitio y de 12.3% específicamente proveniente de Google. La plataforma no solo no está siendo asfixiada por la IA generativa: está siendo, en un sentido medible, favorecida por ella, precisamente en el momento en que casi todo el resto del ecosistema de contenido está perdiendo la batalla contra el mismo fenómeno.

La explicación reside en un segundo negocio que Reddit construyó en paralelo a su negocio publicitario tradicional: el licenciamiento directo de sus datos a las empresas que entrenan modelos de lenguaje. La compañía firmó un acuerdo con Google en 2024 por 60 millones de dólares anuales que le permite a la empresa de Mountain View entrenar sus modelos con contenido de Reddit, y un acuerdo similar con OpenAI valuado en aproximadamente 70 millones. Ese negocio de licenciamiento de datos generó 43 millones de dólares en el trimestre más reciente, un crecimiento de 24% interanual, con OpenAI y Google como los dos clientes más grandes. Y el modelo de cobro está evolucionando hacia algo todavía más favorable para Reddit: en 2026 la compañía empezó a migrar de tarifas anuales fijas hacia un esquema de precios dinámico basado en uso, donde la compensación escala según qué tan frecuentemente se rastrea su contenido y qué tan central resulta ese contenido en las respuestas generadas por el modelo —es decir, entre más útil resulta Reddit para que una IA responda bien, más cobra Reddit por ello.

Por qué Reddit específicamente, y no cualquier sitio con opiniones de usuarios

La pregunta que The Economist deja abierta merece una respuesta más precisa: ¿por qué Reddit, de entre todos los repositorios de contenido generado por usuarios en internet, se volvió desproporcionadamente valioso para los sistemas de IA? La evidencia apunta a una característica estructural específica: Reddit y Quora son citados de forma desproporcionada por los sistemas de IA como fuente, precisamente porque contienen algo que la propia IA no puede generar de forma creíble por sí misma —testimonios de primera mano, experiencia vivida, opiniones humanas verificables con fecha y usuario asociados, en lugar de conocimiento sintetizado y genérico—. Cuando un usuario le pregunta a un asistente de IA "cuál es la mejor aspiradora para pelo de mascota" o "qué se siente realmente hacer un doctorado en biología", el sistema tiene un incentivo estructural para citar un hilo real de Reddit con testimonios humanos verificables, en lugar de generar una respuesta que suene genérica y sin respaldo. Ese mismo mecanismo, sin embargo, no protege a Quora de la misma manera: pese a ser también citada desproporcionadamente por sistemas de IA, la plataforma perdió 28.1% de sus visitantes en el último año, con apenas 38.6 millones de visitas únicas —evidencia de que ser citado como fuente por una IA y retener tráfico humano directo son, cada vez más, dos negocios distintos que no necesariamente se refuerzan entre sí, y que Reddit ha logrado sostener ambos mientras Quora solo sostiene el primero.

El litigio como estrategia, no como anomalía

La contraparte de ese éxito comercial es una batalla legal activa: Reddit demandó a Perplexity AI en octubre de 2025 en una corte federal de Nueva York, acusando a la empresa —junto con la firma lituana de scraping de datos Oxylabs, la operación identificada como un "antiguo botnet ruso" AWMProxy, y la startup texana SerpApi— de competencia desleal, enriquecimiento injusto e infracción de derechos de autor por extraer contenido de Reddit a escala industrial sin licencia. Es la segunda demanda de este tipo que Reddit presenta: en junio de 2025 ya había demandado a Anthropic bajo argumentos similares, con una audiencia programada para enero de 2026. La lógica de negocio detrás de ambas demandas es directa y coherente con la estrategia de licenciamiento que ya describimos: si el contenido de Reddit es lo suficientemente valioso como para que Google y OpenAI paguen decenas de millones de dólares anuales por acceder a él de forma legal, entonces cualquier competidor que lo obtenga gratis mediante scraping no autorizado no es solo una violación de términos de servicio, es una amenaza directa al valor del activo que sostiene la parte de más rápido crecimiento del negocio de la compañía.

El otro lado del espejo: por qué Stack Overflow no tuvo la misma suerte

Stack Overflow ofrece el contraste más nítido posible con la trayectoria de Reddit, y la razón de fondo no es un fallo de estrategia comercial sino una diferencia en la naturaleza misma del contenido: el volumen mensual de preguntas nuevas en la plataforma se desplomó de picos superiores a 200,000 en 2014 a menos de 50,000 hacia finales de 2025. La causa no es misteriosa —es la contraparte exacta del mecanismo que favorece a Reddit—: una pregunta típica de Stack Overflow ("¿cómo soluciono este error de sintaxis en Python?") es, precisamente, el tipo de consulta que un asistente de IA como GitHub Copilot o ChatGPT puede resolver de forma completa y verificable sin necesidad de citar ninguna fuente externa, porque la respuesta correcta es objetivamente verificable con solo ejecutar el código. A diferencia del testimonio humano subjetivo que hace valiosos los hilos de Reddit, el conocimiento técnico codificable de Stack Overflow es exactamente el tipo de información que un modelo de lenguaje entrenado con suficientes ejemplos puede reproducir y mejorar sin depender de la fuente original —lo cual significa que la plataforma que durante más de una década fue el repositorio de conocimiento técnico más valioso de internet se convirtió, sin proponérselo, en el material de entrenamiento perfecto para construir la herramienta que terminaría por hacerla innecesaria para sus propios usuarios.

Mi lectura

La lección que emerge de comparar estas dos trayectorias no es que "el contenido generado por usuarios sobrevive a la IA" ni que "los foros están condenados": es que la variable que determina la supervivencia es específicamente si el valor del contenido reside en la experiencia humana subjetiva y verificable con nombre y fecha (que una IA no puede fabricar de forma creíble y por lo tanto tiene incentivo para citar), o si reside en la resolución de un problema técnico objetivamente verificable (que una IA puede replicar y por lo tanto no necesita citar). Reddit ganó esta transición no por una decisión de producto brillante, sino porque la naturaleza misma de su contenido —opiniones, experiencias, testimonios en primera persona sobre absolutamente cualquier tema humano— resultó ser estructuralmente la materia prima que los sistemas de IA necesitan seguir citando para no sonar genéricos, mientras que Stack Overflow perdió esta transición porque su contenido, por más valioso que fuera, era exactamente el tipo de conocimiento codificable que la IA existe para automatizar.

Esto deja una pregunta abierta para cualquier plataforma de contenido generado por usuarios que todavía no ha enfrentado esta prueba: ¿su valor reside en la experiencia humana irremplazable, o en la resolución de un problema que, tarde o temprano, un modelo lo suficientemente entrenado resolverá mejor y sin necesidad de citar a nadie?

Fuentes

Sigue leyendo 01 / 05

← Volver al blog