Thin content: qué es y cómo eliminarlo

Pila de páginas donde la mayoría son finas y sin sustancia

El thin content es contenido que no aporta valor suficiente al usuario, y no tiene que ver con la longitud. Una página de 200 palabras puede ser excelente y una de 2.000 puede ser thin. Importa porque no afecta solo a esa página: en volumen, arrastra la percepción de calidad de todo el sitio.

Qué es el thin content

Thin content es contenido de escaso valor. La definición de Google es deliberadamente amplia porque el criterio es el usuario: ¿esta página resuelve algo que la persona que la abrió necesitaba resolver?

Si la respuesta es no, es thin, tenga la extensión que tenga.

Thin no es corto: la diferencia entre extensión y valor

Este es el malentendido que más daño hace, porque lleva a la solución equivocada.

Una página de contacto con la dirección, el teléfono y un mapa tiene 50 palabras y es perfecta: resuelve exactamente lo que buscaba quien entró. Un artículo de 2.500 palabras que da diez vueltas para decir tres cosas obvias que están en otras cincuenta webs es thin, aunque el contador diga lo contrario.

La consecuencia práctica: alargar una página delgada no la arregla. Añadir 800 palabras de relleno a una ficha de producto vacía la convierte en una ficha de producto vacía y larga. Lo que la arregla es añadir información que no estaba.

Qué dice Google exactamente (y desde cuándo)

El concepto entró en el vocabulario del sector con Panda (2011), cuyo objetivo explícito era degradar sitios con contenido de baja calidad y granjas de contenido.

Desde entonces, dejó de ser un filtro puntual: se integró en el sistema de evaluación de calidad y hoy funciona de forma continua. Las directrices de calidad de Google siguen listando expresamente varias formas de thin content, y las actualizaciones de contenido útil de los últimos años han reforzado el criterio de «contenido hecho para personas» frente a «contenido hecho para posicionar».

Los seis tipos de thin content

Clasificarlo importa porque cada tipo se arregla de forma distinta.

Contenido autogenerado y traducciones automáticas

Texto producido en masa sin supervisión: generación programática desde plantillas, hilado de sinónimos, o traducción automática publicada sin revisar.

Nota importante y actual: el problema no es la herramienta, es la falta de valor. Google ha dicho explícitamente que no penaliza el contenido por estar generado con IA; penaliza el contenido sin valor, se haya escrito como se haya escrito. Un texto con IA revisado, verificado y enriquecido con criterio propio no es thin. El mismo texto publicado tal cual sale, sí.

Páginas puerta y landings por ciudad clonadas

Páginas creadas para captar variantes de búsqueda que llevan al mismo sitio. El caso más común en España: veinte landings de servicio donde lo único que cambia es el nombre de la ciudad.

El filtro para saber si las tuyas lo son: si puedes hacer buscar y reemplazar del topónimo y la página sigue teniendo sentido, es una plantilla repetida veinte veces. Cómo hacerlas bien está en la guía de SEO local.

Contenido duplicado o copiado del fabricante

El caso masivo del ecommerce: miles de fichas con la descripción que da el proveedor, idéntica a la de otras cincuenta tiendas.

Técnicamente es duplicado, pero el efecto es de thin: tu página no aporta nada que no esté ya en cincuenta sitios. Lo tratamos también en la guía de contenido duplicado.

Páginas de archivo, tag y paginación vacías

El clásico de WordPress. Se crean solas y casi nunca se revisan:

  • Tags con un solo artículo, o tags que duplican la categoría.
  • Archivos por fecha y por autor que nadie busca.
  • Páginas de adjunto: una URL por cada imagen subida, con la imagen y nada más.
  • Paginación profunda de listados.

Es el tipo más fácil de arreglar porque se resuelve con configuración, no escribiendo.

Fichas de producto sin contenido propio

Producto con foto, precio, un atributo y nada más. En catálogos grandes es la mayoría del sitio.

No hace falta reescribir 5.000 fichas: se prioriza. Las que venden llevan contenido propio; la cola larga se enriquece con atributos reales y contenido de usuario. El desarrollo está en SEO para ecommerce.

Contenido afiliado sin valor añadido

Reseñas de producto copiadas de la web del fabricante o de otras reseñas, con el enlace de afiliado encima. Google lo dice expresamente en sus directrices: la afiliación no es el problema, la falta de valor propio sí.

Los seis tipos de thin content en una rejilla de iconos

¿Penaliza el thin content?

Sí, pero conviene entender de qué forma, porque el mecanismo cambia lo que hay que hacer.

Acción manual frente a ajuste algorítmico

La acción manual existe y se llama literalmente «contenido escaso con poco o ningún valor añadido». Te llega un aviso a Search Console, sabes exactamente qué ha pasado y hay proceso de reconsideración. Es poco frecuente y se reserva para casos graves.

El ajuste algorítmico es lo habitual y lo silencioso. No hay aviso, no hay mensaje, no hay proceso. Simplemente el sitio rinde por debajo de lo que debería, y es indistinguible de «tengo mala suerte» hasta que alguien lo audita.

Si tienes dudas sobre si lo tuyo es una penalización, el diagnóstico está en la guía de penalizaciones de Google.

El efecto sitewide: cómo lo malo arrastra a lo bueno

Esta es la parte que más gente subestima, y es la que justifica el trabajo.

El thin content no afecta solo a la página que lo padece. Cuando una proporción alta de tu sitio es contenido de bajo valor, la evaluación de calidad global baja, y con ella el rendimiento de las páginas que sí son buenas.

Dicho de otra forma: puedes tener el mejor artículo del sector rindiendo por debajo de lo que merece porque comparte dominio con 4.000 páginas de tag vacías. Por eso limpiar suele producir subidas en páginas que no se han tocado, y por eso es de las intervenciones con mejor relación esfuerzo-resultado.

Cómo detectarlo a escala

Aquí está el hueco real frente a los resultados que hoy están por delante en la SERP: todos explican qué es, ninguno explica cómo encontrarlo cuando tienes 20.000 URLs. Este es nuestro procedimiento.

Inventario: crawl + GSC + analítica en una sola tabla

Una sola tabla, una fila por URL, con estas columnas:

Columna

De dónde sale

URL, código, indexable

Crawl

Número de palabras del contenido principal

Crawl

Similitud con otras URLs del sitio

Crawl

Profundidad de clic y enlaces internos entrantes

Crawl

Impresiones, clics y posición media (12 meses)

Search Console

Sesiones y conversiones

Analítica

Enlaces externos entrantes

Herramienta de backlinks

El cruce es lo que da el diagnóstico. Ninguna columna sola sirve: la de palabras da falsos positivos y la de tráfico da falsos negativos.

Los umbrales que usamos y por qué

No son leyes, son puntos de partida que luego se ajustan al proyecto:

  • Menos de 300 palabras de contenido principal (sin menús, pies ni barras laterales): candidata a revisar, no a eliminar.
  • Cero impresiones en 12 meses: señal fuerte. Google la conoce y no la considera relevante para nada.
  • Impresiones pero cero clics con posición por debajo de 20: existe pero no compite.
  • Cero enlaces internos entrantes: página huérfana. Nadie del propio sitio la considera importante.
  • Similitud interna por encima del 70 %: casi-duplicado.

La regla de oro: ninguna página se toca por un solo criterio. Se actúa cuando se cruzan dos o más. Una página de 150 palabras con 4.000 impresiones y conversiones no es thin, es eficiente.

Detectar plantillas repetidas y similitud interna

La función de casi-duplicado de un crawler (habitualmente con un umbral del 80-90 %) es la que destapa las landings clonadas y las fichas con texto de fabricante.

Un truco barato que funciona: coge una frase del segundo párrafo de una landing, búscala entre comillas con site:tudominio.com y cuenta cuántas devuelve. Si salen dieciocho, ya tienes el diagnóstico sin herramienta.

Páginas con impresiones y cero clics

Es la lista más rentable del inventario, porque separa dos problemas que se confunden:

  • Posición buena y cero clics: no es thin, es un problema de title y meta. Se arregla en diez minutos.
  • Posición mala y cero clics: sí puede ser thin. Google la conoce, la muestra a veces y nadie la elige.

Confundir estos dos casos lleva a reescribir páginas que solo necesitaban un title nuevo.

Inventario cruzado para detectar thin content a escala

Qué hacer con cada página: consolidar, mejorar o eliminar

El árbol de decisión

Con el inventario delante, cada URL pasa por estas preguntas en este orden:

  1. ¿Tiene tráfico, conversiones o enlaces externos? Si sí, no se elimina bajo ningún concepto. Se mejora o se consolida conservando su URL.
  2. ¿Existe otra página del sitio que cubra lo mismo? Si sí, consolidar.
  3. ¿Hay demanda de búsqueda real para su tema? Si sí, mejorar.
  4. ¿Cumple una función aunque no traiga tráfico? (aviso legal, contacto, política de cookies). Si sí, se queda. noindex si procede, pero se queda.
  5. Si no cumple ninguna, eliminar.

Consolidar: cómo se fusiona sin perder señales

Consolidar es coger dos o más páginas que compiten y hacer una buena.

El procedimiento: elige la URL que se queda (normalmente la que tiene más histórico, no la que más te gusta), lleva a ella lo mejor de las otras, redirige las demás y actualiza los enlaces internos que apuntaban a las viejas.

Ese último paso se olvida siempre. Dejar los enlaces internos apuntando a URLs redirigidas crea cadenas y desperdicia crawl budget.

301 1:1, nunca al hub

Cuando consolidas, la 301 va de cada página a su equivalente concreto, nunca a la home ni a la categoría por comodidad.

Google trata una redirección a un destino no equivalente como un soft 404: no transfiere señales y, en la práctica, tiras a la basura lo que esa URL había acumulado. Si no hay equivalente, es mejor un 410 honesto que una 301 a cualquier sitio.

Mejorar: qué se le añade a una página delgada

No palabras: información. En este orden de rentabilidad:

  1. Responder lo que la página promete y hoy no responde.
  2. Datos, ejemplos o casos propios. Es lo único que no puede copiarte nadie.
  3. Elementos que aportan de verdad: tablas comparativas, capturas, plantillas descargables.
  4. Las preguntas reales que la gente hace sobre el tema.
  5. Enlaces internos a lo relacionado, en los dos sentidos.

Eliminar: 410, 404 o noindex

  • 410 (Gone): la opción por defecto cuando la página no vuelve y no tenía nada. Google lo procesa más rápido que el 404.
  • 404: equivalente en efecto, más lento de procesar.
  • noindex: para páginas que tienen que existir para el usuario pero no aportan en búsqueda (filtros, resultados internos, algunas legales). Ojo: sigue consumiendo rastreo.

Nunca borres en masa sin haber cruzado el inventario. Hemos visto proyectos eliminar cientos de URLs por tener pocas palabras y llevarse por delante páginas con enlaces externos.

Un ejemplo real de cómo sale el reparto

Para que se vea cómo funciona el árbol en la práctica, este es el tipo de reparto que nos encontramos en una web de contenido de unas 2.000 URLs:

Grupo

Volumen típico

Decisión

Páginas de adjunto de imagen

600-800

Eliminar de raíz (desactivar en el plugin)

Tags con uno o dos artículos

150-300

noindex o fusionar en categoría

Artículos sobre el mismo tema publicados en años distintos

40-80 en grupos de 2-4

Consolidar con 301 1:1

Artículos con demanda y contenido flojo

100-200

Mejorar

Artículos sin demanda y sin tráfico

80-150

Eliminar con 410

Páginas funcionales (legal, contacto)

10-20

Se quedan, noindex si procede

Lo llamativo del reparto no es la limpieza en sí: es que el grupo más numeroso casi siempre es el que se genera solo y no lo escribió nadie. Antes de plantearte reescribir doscientos artículos, desactiva lo que tu CMS está creando a tus espaldas. Es el trabajo de una tarde y suele ser la mitad del problema.

El orden en que se ejecuta

Importa, porque hacerlo al revés genera trabajo doble:

  1. Primero lo automático: desactivar adjuntos, archivos y tags descontrolados. Barato y masivo.
  2. Después las consolidaciones: son las que devuelven tráfico más rápido, porque juntan señales que ya existen.
  3. Luego las eliminaciones de lo que no tiene nada.
  4. Al final, mejorar lo que merece la pena. Es lo más caro en horas y lo último que toca.

Mucha gente empieza por el punto 4 porque es el más agradecido de contar, y acaba mejorando artículos que compiten con otro artículo suyo que no había visto.

Árbol de decisión para consolidar, mejorar o eliminar una página

Thin content en la era de la IA

Contenido generado con IA: cuándo es thin y cuándo no

La postura de Google es clara y conviene repetirla porque el sector la deforma: no importa cómo se produjo el contenido, importa si aporta valor.

Un artículo generado con IA, verificado, corregido, enriquecido con datos propios y con criterio de alguien que sabe del tema no es thin. Un artículo generado con IA publicado sin leer es thin, exactamente igual que lo sería escrito a mano sin pensar.

Lo que sí ha cambiado es la escala: producir 500 páginas mediocres cuesta hoy una tarde. Por eso el problema se ha multiplicado y por eso los sistemas de calidad se han endurecido.

Por qué un LLM no cita una página delgada

Hay una razón adicional para limpiar, y es nueva.

Cuando un asistente de IA construye una respuesta, recupera páginas y extrae de ellas la información. Una página delgada no tiene nada que extraer: no hay dato, no hay respuesta concreta, no hay estructura.

Y aquí aplica el marco de siempre: los modelos con búsqueda se apoyan en los resultados de Google, así que quien no rankea difícilmente es citado. El thin content te deja fuera de las dos cosas a la vez, y por el mismo motivo.

Cómo evitar que vuelva

Limpiar sin cambiar el proceso garantiza volver a la misma situación en dos años. Lo que funciona:

  • Un estándar mínimo de publicación escrito, no sobreentendido: qué tiene que llevar una pieza para publicarse.
  • Desactivar de raíz lo que se genera solo: páginas de adjunto, archivos por fecha y autor, tags sin control.
  • Gobernanza de tags: quién puede crearlos y con qué criterio.
  • Revisión periódica: dos veces al año, el mismo inventario.
  • Regla para el catálogo: qué producto nuevo entra indexable y cuál no.

¿Cuánto thin content tiene tu web?

Casi nadie lo sabe hasta que lo mide, y la cifra suele sorprender. El inventario cruzado de este artículo es exactamente lo que hacemos en una consultoría SEO, con el plan de consolidar, mejorar o eliminar URL por URL y priorizado por impacto.

Preguntas frecuentes

¿Qué es el thin content?

Contenido que no aporta valor suficiente al usuario. No depende de la extensión: depende de si resuelve lo que buscaba quien entró.

¿Cuántas palabras necesita una página para no ser thin?

No hay número. Una página de 100 palabras que responde exactamente lo que se le pide no es thin; una de 2.000 que no dice nada, sí. Usamos las 300 palabras como umbral para revisar, nunca para decidir.

¿El thin content penaliza toda la web?

Puede. Si la proporción de páginas de bajo valor es alta, la evaluación de calidad del sitio baja y arrastra a las páginas buenas. Por eso limpiar suele mejorar el rendimiento de contenidos que no se han tocado.

¿Google penaliza el contenido escrito con IA?

No por estar escrito con IA. Penaliza el contenido sin valor, se haya producido como se haya producido. Un texto con IA revisado y enriquecido con criterio propio no es thin.

¿Borro las páginas con poco tráfico?

No sin cruzarlo antes con enlaces externos, conversiones y función en el sitio. Una página sin tráfico pero con enlaces externos es un activo. Borrarla es tirar autoridad.

¿Las páginas de tag son thin content?

Suelen serlo cuando se crean sin control: tags con un solo artículo o que duplican una categoría. Un tag con veinte artículos coherentes y demanda de búsqueda propia es una página legítima.

¿Cuánto tarda en recuperarse una web tras limpiar thin content?

Con desindexación y consolidación, entre uno y tres meses. Si había acción manual, hasta que se resuelva la reconsideración. En sitios grandes, la recuperación es progresiva a medida que Google reevalúa.