Por qué sus páginas están atascadas en el rastreo (actualmente no indexadas) y qué hacer al respecto

- Advertisement -spot_img

Últimamente, varios propietarios de sitios se han acercado para pedir ayuda con problemas de indexación. En la mayoría de los casos, encuentro que Google ha clasificado sus páginas como “rastreadas-no indexadas actualmente” en el informe de indexación de páginas de Google Search Console.

Crédito de la imagen: Marie Haynes

En casi En todos los casos que he examinado estas páginas tienen problemas de calidad. Por lo general, son “contenidos básicos”: esencialmente repiten lo que muchos otros ya han escrito sobre un tema sin ofrecer nada nuevo o más útil que lo que existe actualmente en línea.

En este artículo, compartiré cómo veo el informe rastreado (actualmente no indexado) en GSC. Le daré una herramienta para ayudarle a encontrar las páginas de este informe que debería analizar más a fondo. Y te daré algunos consejos para mejorar y que puedas recuperarte. Sin embargo, debo dar una advertencia justa. Para la mayoría de los sitios, si tiene una gran cantidad de páginas que desea indexar, pero están atascadas en el rastreo (actualmente no indexadas), la recuperación será difícil.

Lo que dijo Google sobre el rastreo actualmente no indexado en el evento central de búsqueda de Google en Toronto

Asistí al evento de Google Search Central en abril de 2026. Los organizadores nos pidieron que no atribuyéramos citas directamente a ningún empleado de Google, pero nos dieron permiso para compartir lo que se dijo.

Un presentador habló sobre cómo funciona la Búsqueda. Dijo que cuando Google rastrea una página, esencialmente significa que la descarga. Entonces, “Si creemos que es útil podríamos ponerlo en una base de datos”, o en otras palabras, en el índice de Google.

Luego habló sobre qué tipo de cosas quiere Google incluir en el índice. Dijo que la IA ha reducido el umbral para crear cosas. Si cualquiera puede crear contenido sobre cualquier cosa, entonces el tipo de contenido que Google quiere agregar a su índice es contenido que ofrece dos cosas: experiencia personal y conocimiento que nadie más tiene.

Dijo que si Google ha rastreado su página y ha decidido no indexarla, podría haber dos razones:

1. Podría haber un problema técnico

He descubierto que esto es raro. Sin embargo, la semana pasada revisé un sitio que había pasado por una migración y todas sus páginas estaban atascadas en el rastreo (actualmente no indexadas). Nota: Esto no es lo mismo que “Descubierto-no indexado actualmente”, lo que significa que Google conoce las páginas, pero aún no las ha rastreado.

Mi primer paso fue analizar si Google podía ver el contenido de las páginas. Utilicé la herramienta de inspección de páginas en GSC haciendo clic en la lupa al lado de la URL en la lista rastreada actualmente no indexada y hice clic en “Probar URL en vivo”. Sorprendentemente, cuando vi la página probada en vivo, todo lo que mostró fue un encabezado, algunas palabras repetitivas y ningún contenido.

En este caso, el propietario del sitio efectivamente tuvo un problema técnico. Su archivo robots.txt tenía esta línea, Disallow: /*?*. La idea era bloquear el rastreo de URL con parámetros como ?replytocom o ?utm_source. Pero su nuevo tema dependía de estos parámetros para sus archivos CSS y javascript, por lo que básicamente estaban bloqueando que Google y todos los demás motores de búsqueda vieran la mayor parte de su contenido.

Desde entonces, eliminamos este bloqueo y, muy lentamente, las páginas comienzan a aparecer nuevamente en el índice.

Si su prueba en vivo muestra que Google realmente puede ver el contenido de sus páginas, es muy poco probable que se trate de un problema técnico que esté causando problemas de rastreo (actualmente no indexados).

También debo mencionar que algunas páginas debería estar en su lista rastreada y actualmente no indexada si no son la versión canónica. Si ve /feed/ páginas o paginación o páginas con parámetros de URL, esto es normal.

2. Calidad

El empleado de Google en Toronto continuó explicando otra causa por la que Google rastrea una página y no la indexa. Dijo que podría deberse a que “lo miramos y descubrimos que no era bueno”. Dijo que si miles de personas han cubierto exactamente el mismo tema, podrían decidir que es poco probable que su página sea útil en la Búsqueda. Puede ser que existan otras opciones más populares o de mejor calidad.

También dijo que a veces Google experimenta permitiendo que su página sea indexada por un tiempo para ver si a los usuarios les gusta: “Estamos experimentando para ver cuál produce usuarios más felices”. ¡Esa es una declaración bastante descabellada!

Mi apuesta es que si tiene páginas que desea indexar, pero Google las tiene en el grupo rastreado y no indexado actualmente, entonces su principal problema está relacionado con el contenido básico.

Leer  La industria de SEO está enseñando las habilidades incorrectas

El contenido de los productos básicos es la causa más probable

Google habló mucho sobre contenido básico en este evento.

Crédito de la imagen: Marie Haynes
Crédito de la imagen: Marie Haynes

El contenido básico es contenido que casi cualquiera podría escribir sobre un tema. Generalmente se trata de repetir lo que ya existe online en otros sitios. El contenido no básico aporta un punto de vista único o tiene contenido del que otros carecen o no pueden replicar fácilmente. Suele demostrar conocimiento o experiencia de primera mano.

Toma este artículo que estás leyendo ahora mismo. Cualquiera podría utilizar la IA para escribir un artículo útil que defina las páginas rastreadas que actualmente no están indexadas. Mi artículo, sin embargo, habla de mi experiencia como profesional a quien se le paga por dar mi opinión sobre este tema. Compartí el ejemplo técnico del mundo real anterior, compartí información de primera mano que aprendí al asistir a un evento de Google y estoy a punto de compartir mis observaciones sobre páginas que se consideraron no dignas de indexación.

Mis observaciones de páginas atascadas rastreadas: actualmente no indexadas

Estas páginas no suelen ser basura. Son artículos buenos y decentes, tan buenos como las páginas que clasifica Google. Y ese es justamente el punto. Las páginas no son especiales ni más valiosas que las que existen actualmente.

Este es el proceso que utilizo para analizar estas páginas.

Para encontrar la lista, haga clic en “Páginas” en Indexación en GSC. Luego haga clic en rastreado, actualmente no indexado:

Crédito de la imagen: Marie Haynes

Debajo de esto, verá una lista de URL para investigar. (A continuación, compartiré más sobre una herramienta que creé para ayudarte a filtrar esta lista para ver las URL que realmente importan).

Encontraré una URL en esta lista que realmente queremos indexar.

Primero, buscaré algunas consultas para las que esperaría que se clasificara la página. En las SERP suele haber una respuesta de IA que resulta muy útil. A menudo, un usuario encontrará allí la respuesta a su pregunta. Si este es el caso, ¿por qué querrían hacer clic en su sitio web para leer exactamente lo mismo?

Ampliaré la descripción general de la IA y luego abriré Gemini en la barra lateral de Chrome. Luego mantengo presionado CTRL/Cmd y hago clic en los principales sitios web vinculados desde AIO. Si haces esto cuando tienes abierto Gemini en la barra lateral de Chrome, verás que estas pestañas se agregan a tu conversación de Gemini.

Crédito de la imagen: Marie Haynes

Luego escribo “/”, lo que abre las habilidades que he guardado en chrome://skills/ y elijo mi verificación No básico. (Si eres miembro de mi comunidad paga, puedes encontrar esta habilidad completa aquí).

Esta habilidad es un mensaje muy largo que analiza algunas de las cosas que Google nos dice que sus algoritmos pretenden recompensar en su documentación sobre la creación de contenido útil, que incluyen, entre otras:

  • ¿El contenido proporciona información, informes, investigaciones o análisis originales?
  • ¿El contenido proporciona un análisis profundo o información interesante que va más allá de lo obvio?
  • Si el contenido se basa en otras fuentes, ¿evita simplemente copiar o reescribir esas fuentes y, en cambio, proporciona originalidad y valor adicional sustancial?
  • ¿El contenido proporciona un valor sustancial en comparación con otras páginas en los resultados de búsqueda?

Y Géminis me da algunas de las razones por las que las páginas enlazadas ofrecen valor al lector. Nota: A veces las páginas se clasifican no por su valor no comercial sino porque son una fuente autorizada. Cuando eres una autoridad conocida, puedes salirte con la tuya con un poco más de “comercialidad”.

Crédito de la imagen: Marie Haynes

Ahora bien, debemos reconocer que Gemini no tiene información privilegiada sobre los sistemas de clasificación de Google. no lo hace saber por qué ciertas páginas están clasificadas. Lo que estamos tratando de aprender aquí es qué tipos de cosas podrían ayudar a que una página sea digna de ser presentada a los buscadores.

Luego, abro la página de mi cliente y le digo esto: “Ahora analice esta página según el mismo criterio. Esta página no está bien clasificada. Es nuestro cliente. Por favor comparte dónde crees que falta. No es necesario sugerir mejoras en este momento”.

Aquí está el resultado de una página rastreada y actualmente no indexada en la que utilicé este mensaje.

Crédito de la imagen: Marie Haynes

John Mueller y Martin Splitt discutieron sobre rastreo (actualmente no indexado) en un podcast reciente

Cuando estaba a punto de publicar esto, Google publicó un podcast de búsqueda extraoficial sobre “Cómo leer el informe de indexación”. Hay mucho aquí, así que puse en negrita las partes que pensé que eran importantes.

Esta discusión comienza a las 20:32 en el video.

Capítulo 9: Descubierto versus rastreado No indexado: ¿Es un problema técnico o de calidad del sitio?

“Y también, si agrega o cambia su sitio o si su sitio es muy nuevo, entonces también puede usar este informe para ver un poco cómo su sitio pasa por las diferentes etapas, porque en algún momento, verá páginas en Descubiertos actualmente no indexadas. Lo que le indica que sabemos que existen, pero en realidad no las hemos visitado. Y si no las hemos visitado, no podemos ponerlas en el índice. Rastreados: actualmente no indexados, lo que significa que los visitamos y no los incluimos en el índice. Y eso puede tener todo tipo de razones diferentes. ¿Diría que esto es a menudo o sólo a veces una señal de un problema de calidad?

Leer  La mayoría de los usuarios de las redes sociales admiten que estarían más felices si no existiera

Entonces, Definitivamente, si nuestros sistemas están seriamente preocupados por la calidad de un sitio web, reducirán el número de páginas que indexan. Porque si nos preocupa mucho la calidad general, entonces no tiene mucho sentido que nuestros sistemas pasen mucho tiempo en el sitio web.

Entonces, probablemente rastrearemos mucho menos, indexaremos mucho menos y luego Verá cosas como rastreado, no indexado o descubierto, no indexado, que desde nuestro punto de vista es básicamente nuestro sistema diciendo, sabemos sobre esto, lo miramos, y una vez que estemos satisfechos, echaremos otro vistazo y veremos si podemos indexarlo. No es tanto que yo diga que debas tomar estas situaciones y tratar de solucionarlas. Desde un punto de vista técnico, no es que necesites solucionar este problema técnico porque Google no está indexando esta página en este momento, sino más bien Casi necesitas hacerlo cuando reconoces un patrón más grande como este, que Google no está indexando muchas de tus páginas y que no hay ninguna razón técnica; casi necesitas dar un paso atrás y pensar en la calidad general.

Y pensar en la calidad es realmente un desafío porque muchas veces es su sitio web y es su bebé. Y por supuesto, es el mejor bebé de todos los tiempos. Pero dar un paso atrás e intentar mirarlo con los ojos de alguien que no está directamente involucrado con su sitio web. A veces, eso abre algunas ideas sobre áreas en las que se puede mejorar, donde tal vez si la mayor parte de su sitio web está generado por IA y funcionó durante un tiempo, es posible que las personas vean este sitio generado por IA y digan, bueno, puedo decir que esto está generado por IA. No hay nada único o valioso disponible aquí para mí. Eso no quiere decir que todo el contenido generado por IA sea malo, pero a veces simplemente te encuentras con sitios web en los que piensas, cualquiera podría haber escrito esto. Esto no me dice nada. Sí, eso es verdad. Y creo que lo que hace esto difícil no es sólo el hecho de que obviamente la forma en que lo escribiste es la que pensaste que era mejor, y por eso piensas que es de alta calidad, por supuesto. Así que es muy, muy difícil salirse de tu propia perspectiva. Pero a veces también hay muchas otras cosas que son igual de buenas.. Entonces, ¿por qué lo agregaríamos al índice?

Y luego eso puede decirte que tal vez este contenido no sea tan valioso como pensaba porque otras personas están cubriendo lo mismo. ¿Y entonces cuál es el valor de que esta versión esté en el índice? Sí, eso es cierto. Siento que podríamos tener un podcast completo sobre calidad. creo que tal vez Otra cosa que vale la pena mencionar con respecto a la calidad es que no se trata sólo del texto.. Así que muchas veces la gente dirá, bueno, mi texto es único, o mis artículos son buenos, y están empaquetados en una página a la que es terrible acceder, donde cualquiera que intenta cargarlo como si el ventilador de su computadora girara y dijera: “Dios mío, tengo que salir corriendo para asegurarme de que mi computadora no explote”. Quizás sea un caso extremo, pero Todos han visto estas páginas donde básicamente el texto está ahí, pero está casi escondido, escondido detrás de anuncios, escondido detrás de intersticiales, escondido detrás de otras cosas que se mueven y van y vienen, tal vez escondido debajo de un montón de contenido de relleno, que a veces vemos, por ejemplo, con recetas donde hay una historia realmente larga encima que tal vez a la mayoría de las personas realmente no les importe. Y luego viene la receta. Estos son todo tipo de cosas donde la calidad general es mucho más que solo ese texto que dices, este es mi contenido principal. Esto es lo que Google debería contar para mi sitio. Y desde nuestro punto de vista, casi tenemos que tener en cuenta la experiencia completa en una página, porque eso es lo que ven los usuarios. No es que los usuarios vayan a una página web y activen algún modo mágico que simplemente extraiga el texto, sino que tienen la experiencia completa de este sitio web con todas las animaciones 3D, 4D y todo. Estoy muy de acuerdo. De acuerdo, oh Dios mío”.

Leer  Pichai dice que la IA podría "romper prácticamente todo el software"

¿Cómo se puede solucionar este problema?

Vaya, esta es la parte difícil de este artículo, porque en muchos casos, siento que es extremadamente difícil sacar páginas rastreadas (actualmente no indexadas). Quiero decir, si los culpables son los anuncios excesivos y el relleno, hay cosas obvias que mejorar allí. Si hay un problema técnico, solucionelo y solicite la reindexación a través de GSC, o simplemente tenga paciencia y espere hasta que Google intente rastrear sus páginas nuevamente.

Sin embargo, si se trata de un problema de calidad, es probable que tengas que esforzarte mucho para mejorar estas páginas.

Para muchos sitios que analizo, su superpoder en el pasado era la capacidad de cubrir un tema en profundidad. Últimamente, existe una tendencia no solo a cubrir un tema, sino a anticipar todas las consultas en abanico y cubrirlas también. Esto se mencionó varias veces en el evento de Google Search Central. Si está creando una gran cantidad de contenido basándose en este método, corre el riesgo de enfrentar una penalización de contenido escalada. No puedo probar esto todavía, pero sospecho que la actualización de spam de junio de 2026 afectó a varios sitios que estaban creando contenido básico a escala. Si esto es cierto, no verá una acción manual en GSC. Simplemente verás una caída en el tráfico orgánico sin explicación.

Temo por muchas agencias de SEO porque, para muchas, la herramienta número uno en su caja de herramientas es la creación de contenido. La IA ha hecho que sea mucho más fácil cubrir contenido sobre cualquier tema. No estoy en contra del uso de la IA para ayudar con la creación de contenido. Pero, si su empresa de SEO puede utilizar la IA para crear contenido sobre sus temas, entonces probablemente no sea original, revelador y sustancialmente más útil que lo que existe actualmente. Hay excepciones. Conozco algunas agencias que utilizan canales de inteligencia artificial inteligentes para entrevistar a una empresa, extraer su experiencia relevante y convertirla en contenido bueno y original.

Aunque no recomiendo usar IA para escribir contenido sin la participación humana, sí creo que puedes hacer una lluvia de ideas con IA para ayudar a mejorarlo. El problema, sin embargo, es que las soluciones requerirán esfuerzo. La palabra “esfuerzo” se utiliza 120 veces en las Directrices para evaluadores de calidad de Google. Querrá encontrar formas de aprovechar su experiencia para crear contenido que se sume al conjunto de conocimientos que existe actualmente sobre sus temas.

Pruebe este sencillo mensaje. Entregue su contenido a un LLM o abra Gemini en la barra lateral y pregunte esto: “¿Es probable que este contenido se considere contenido básico?”

Acabo de abrir Gemini en Google Docs y pregunté sobre este mismo artículo que estás leyendo ahora:

Crédito de la imagen: Marie Haynes

A continuación, prueba esto para obtener algunas ideas.

“Dame 20 ideas que me ayuden a aprovechar mi experiencia de primera mano para hacer que este artículo sea aún más útil y sustancialmente mejor que cualquier otra cosa que exista sobre este tema en la web”.

Maldita sea, hay algunas buenas ideas aquí.

Crédito de la imagen: Marie Haynes

Algunas herramientas para ayudarle a evaluar las páginas rastreadas que no están indexadas actualmente

Creé un par de herramientas usando Antigravity de Google. Puede encontrarlos en tools.mariehaynes.com.

Hay dos nuevas herramientas:

1. Filtre sus URL rastreadas y no indexadas actualmente. Exporte sus URL rastreadas y no indexadas actualmente desde GSC. Si exporta como CSV, abra el archivo zip y busque el archivo table.csv. Puede cargarlo en esta herramienta y eliminará las páginas /feed/ y otras para que pueda ver y hacer clic en las URL que desea investigar.

Crédito de la imagen: Marie Haynes

2. Comprobador de índice GSC. Deberá iniciar sesión en su cuenta de Google para utilizar esta herramienta, pero sepa que no veo ninguno de sus datos. Verificará una lista de URL para ver cuál es su estado de indexación. Puede elegir entre las páginas más recientes en su mapa del sitio, pegar una lista de URL manualmente o hacer que la herramienta tome las páginas con mayor tráfico de GSC.

Lo que está buscando aquí es si estas páginas que le importan están realmente indexadas o si están atascadas en el rastreo (actualmente no indexadas).

Crédito de la imagen: Marie Haynes

¡Espero que este artículo ayude! Google parece estar volviéndose más estricto con respecto a lo que indexa estos días.

Más recursos:


Lea el boletín de Marie, Noticias de IA que puedes utilizar. Suscríbete ahora.


Imagen de portada: Tetiana Yurchenko/Shutterstock

spot_img
spot_img

Artículos relacionados

LEAVE A REPLY

Please enter your comment!
Please enter your name here

Artículos populares