Lo esencial en 30 segundos
- Publicar no es indexar. Entre ambas cosas hay una cola de rastreo que puedes acortar, pero no saltarte.
- El registro de visitas de bots convierte la indexacion de fe ciega en dato observable.
- OpenAIBot y los rastreadores de IA ya son una tercera categoría de tráfico que conviene medir aparte.
- Si una URL no se indexa, el 80% de las veces el problema es de calidad o de arquitectura, no de envio.
- Semalt incluye 100 URLs gratuitas al mes, suficiente para el ritmo de publicación de casi cualquier negocio local.
Hay una escena que se repite en todos los proyectos. El cliente publica la página que llevaba tres semanas esperando —el nuevo servicio, la landing de campaña, la guía que iba a traer tráfico— y al dia siguiente escribe: «no aparece en Google». Y tiene razón: no aparece. Lo que casi nunca se explica bien es por que, ni cuanto es razonable esperar, ni que se puede hacer al respecto sin caer en supersticiones.
Publicar y estar indexado son dos sucesos separados por un proceso que no controlas del todo: Google tiene que descubrir la URL, decidir que merece la pena rastrearla, rastrearla, procesarla, evaluarla y decidir si la incluye. Cada uno de esos pasos puede fallar o retrasarse, y por defecto no ves ninguno. El modulo de indexacion de Semalt ataca dos partes concretas de ese problema: acelerar el descubrimiento y, sobre todo, hacer visible lo que hasta ahora era invisible.
por qué tu web tarda: el presupuesto de rastreo, explicado sin misticismo
Google asigna a cada dominio una cantidad de atención limitada. No es un número publicado ni una cuota fija: es el resultado practico de cuanta autoridad tienes, con que frecuencia publicas cosas que resultan útiles, y como responde tu servidor. Un medio nacional tiene rastreo casi continuo. Una web de veinte páginas de un negocio de Sevilla puede recibir visitas cada varios días.
Eso tiene tres consecuencias prácticas que conviene interiorizar antes de tocar nada:
El rastreo se gasta
Si el bot dedica sus visitas a páginas de filtros, parámetros y paginaciones infinitas, no le queda atención para tu contenido nuevo.
La lentitud se paga
Un servidor que responde despacio reduce el ritmo de rastreo: Google modera su presión para no tumbarte.
La confianza se acumula
Dominios que publican con regularidad material que resulta útil reciben más rastreo. Es lento de construir y rápido de perder.
Por eso las «técnicas de indexacion rápida» que circulan por foros funcionan tan mal: atacan el síntoma final ignorando que el cuello de botella suele estar mucho antes.
El registro de bots: el dato que casi nadie mira
Esta es, en nuestra opinión, la parte más valiosa del modulo y la menos vendida. Poder ver en un registro en vivo que bots han pasado, por que URLs y con que código de respuesta convierte una discusión de opiniones en una revisión de hechos.
Lo que se aprende mirando ese registro durante un mes:
| Lo que observas | Interpretación | Acción |
|---|---|---|
| El bot no ha visitado la URL nueva | Problema de descubrimiento: no está enlazada ni en el sitemap | Enlazado interno desde una página con tráfico + envio |
| La ha visitado y no está indexada | Problema de calidad o de duplicidad, no de rastreo | Revisar contenido, canonical y valor diferencial |
| Visitas concentradas en páginas irrelevantes | Presupuesto de rastreo mal repartido | Limpiar parámetros, paginaciones y facetas |
| Respuestas 5xx o tiempos altos en el log | El servidor limita el ritmo de rastreo | Rendimiento y estabilidad antes que contenido |
| Solo pasa GoogleBot, nunca los demás | Dependencia de un único canal de descubrimiento | Sitemaps y enlazado accesibles a todos los rastreadores |
«¿No me indexa porque no me ha visto, o porque me ha visto y no le ha parecido suficiente?» Son dos problemas completamente distintos con soluciones opuestas, y sin el log de bots solo se puede adivinar.
OpenAIBot: la tercera columna del registro
Que en el mismo log aparezcan GoogleBot, BingBot y OpenAIBot no es un detalle cosmético. Refleja un cambio real en como se descubre tu contenido.
Bing dejo de ser una nota al pie el dia que sus resultados empezaron a alimentar asistentes conversacionales. Y los rastreadores de sistemas de IA determinan si tu contenido puede formar parte del corpus con el que se responden preguntas sobre tu sector. Si publicas una guía excelente y ningún rastreador de IA pasa por ahi durante dos meses, esa guía no puede ser citada aunque este perfectamente indexada en Google.
Lo que vemos en dominios pequeños: los tres bots tienen ritmos y prioridades distintos, y no siempre coinciden en que consideran importante. Un patrón habitual es que GoogleBot visite la home y las categorías con frecuencia mientras los rastreadores de IA se concentran en páginas con estructura clara y respuestas concretas. Eso, por si solo, ya es una señal editorial útil.
Muchas webs bloquean rastreadores de IA en robots.txt sin saberlo, por una plantilla heredada o una recomendación antigua copiada de un foro. Antes de invertir en contenido pensado para ser citado, verifica que no le estas cerrando la puerta al bot que tendría que leerlo.
Un protocolo de publicación que si funciona
Este es el procedimiento que aplicamos a cada página nueva. No es magia: es reducir a cero los motivos por los que una URL tarda.
- Antes de publicar: comprueba lo obvioLa URL debe devolver 200, no llevar noindex, tener un canonical que apunte a si misma y estar en el sitemap. Parece elemental y es la causa de la mitad de los casos que nos llegan como «Google no me indexa».
- En el momento de publicar: enlazala desde dentroUna página huérfana depende exclusivamente del sitemap. Un enlace desde una página que ya recibe rastreo frecuente —la home, una categoría viva, un artículo con tráfico— es la señal de descubrimiento más fuerte y más barata que existe.
- Inmediatamente después: envía la URLEnvio directo de la URL nueva y, si has tocado la estructura, también del sitemap. Esto acorta el descubrimiento; no fuerza la indexacion, y conviene decirlo claro.
- Dias 1 a 7: observa el registro de bots¿Ha pasado alguien? Si a los siete días ningún bot ha visitado la URL, el problema es de descubrimiento y hay que reforzar enlazado interno. Si han pasado y no aparece, el problema es otro y no se arregla enviando otra vez.
- Dias 7 a 30: comprueba impresionesUna URL indexada empieza a recoger impresiones, aunque sea en posiciones bajas. Cero impresiones a los treinta días con rastreo confirmado apunta a contenido que no compite en ninguna consulta: el problema es editorial.
Cuando el problema no es la indexacion (que es casi siempre)
Conviene decirlo sin rodeos porque ahorra dinero: en la mayoría de los casos que nos llegan etiquetados como «problema de indexacion», la indexacion no es el problema. Estas son las causas reales, por frecuencia.
Contenido sin valor diferencial. Páginas de servicio de trescientas palabras que repiten lo que dicen otras cincuenta webs de la ciudad. Google las rastrea, las evalúa y decide que no aportan nada nuevo al índice. No hay envio que arregle eso.
Duplicación interna. Especialmente en páginas por zonas o barrios generadas con plantilla. Veinte páginas idénticas salvo el nombre del barrio son, para efectos prácticos, una página. Se indexa una y las demás quedan como duplicados.
Arquitectura profunda. Contenido a cinco clics de la home, sin enlaces entrantes internos relevantes. Existe, pero nada en la estructura sugiere que importe.
Canibalizacion. Ya tienes otra página cubriendo esa intención. Google elige una y la nueva queda a la sombra.
Problemas de renderizado. Contenido inyectado por JavaScript que el rastreador no ve en el primer pase. Cada vez menos frecuente, pero devastador cuando ocurre.
Si has enviado una URL dos veces y sigue sin indexarse, deja de enviarla. Enviar por tercera vez no cambia nada. El trabajo esta en la página, en su enlazado o en su razón de existir.
Casos en los que la velocidad de indexacion si es decisiva
Para una web corporativa que publica dos veces al mes, la indexacion rápida es una comodidad. Hay contextos donde es directamente una ventaja competitiva.
| Escenario | Por que importa |
|---|---|
| Contenido de actualidad local | Un evento en Sevilla, un cambio normativo, una noticia sectorial: la ventana de interés dura días y llegar el séptimo es no llegar. |
| Ecommerce con rotación | Productos de temporada que deben estar visibles desde el primer dia de campaña, no cuando termine. |
| Migraciones y rediseños | Miles de URLs nuevas que necesitan rastreo rápido para que las redirecciones se procesen y la caída de tráfico sea corta. |
| Correcciones urgentes | Un precio erróneo o un dato legal desactualizado que sigue apareciendo en resultados: quieres que se reprocese hoy, no en dos semanas. |
| Contenido pensado para ser citado | Si tu objetivo es entrar en respuestas generativas, cuanto antes lo lean los rastreadores de IA, antes puede formar parte de una respuesta. |
Higiene de sitemap: que enviar y que no
El sitemap no es una lista de todo lo que existe en tu web: es una declaración de lo que consideras digno de indexarse. Cuando se trata como un volcado automático, pierde exactamente el valor que debería aportar.
Tres reglas que aplicamos en todos los proyectos. Solo URLs indexables. Si una URL lleva noindex, devuelve 301 o tiene un canonical apuntando a otra, no debe estar en el sitemap. Un sitemap con un 30% de URLs contradictorias reduce la confianza en todo el archivo, no solo en esas entradas. Fechas de modificación honestas. Poner la fecha de hoy en todas las URLs cada noche, algo que hacen muchos CMS por defecto, es la forma más rápida de que ese campo se ignore por completo. Separado por tipo. Un sitemap para páginas, otro para artículos, otro para productos. Cuando algo deja de indexarse, saber en que archivo estaba acorta el diagnóstico de horas a minutos.
Y una recomendación menos obvia: revisa la relación entre URLs enviadas y URLs indexadas cada trimestre. Un dominio sano de negocio local debería estar por encima del 85%. Si estas en el 50%, tienes contenido que Google ha visto y ha descartado, y eso no es un problema de indexacion sino de que la mitad de tu web no justifica su existencia. Es una conversación incomoda y casi siempre la más rentable del trimestre.
Como se conecta con el resto del sistema
La indexacion aislada mide un evento técnico. Lo interesante empieza cuando se enlaza con el resto del ciclo, que es lo que permite tener la analítica en la misma cuenta.
La secuencia completa de una publicación queda asi: envías la URL, ves en el registro que los bots pasan, ves en la analítica de Search Console como entran las primeras impresiones, sigues en Google SERP como se estabiliza la posición y compruebas en AI Analytics si la página empieza a alimentar respuestas generativas.
Ese encadenamiento es el que permite responder con precisión a la pregunta que de verdad importa: ¿esta página ha funcionado? Y sobre todo, si no ha funcionado, ¿en qué eslabón se rompió? Sin esa cadena, la respuesta habitual es «habrá que darle tiempo», que no es una respuesta.
Envía tu próxima página y observa que pasa
100 URLs al mes gratis, registro de bots en vivo y la analítica en la misma cuenta. Es el experimento más barato que puedes hacer con tu próxima publicación.
Entrar en Semalt Ver Fast IndexingPreguntas frecuentes
¿Enviar una URL garantiza que se indexe?
No. Acorta el descubrimiento, que es la primera fase. La decisión de indexar depende de la evaluación de calidad y de si la página aporta algo distinto a lo que ya esta en el índice.
¿Cuántas veces conviene reenviar una URL?
Una vez, y como mucho una segunda tras cambios sustanciales. Si tras dos envíos y rastreo confirmado no se indexa, el problema esta en la página.
¿Cuánto es normal que tarde en un dominio pequeño?
Solemos ver primeras impresiones entre el dia 3 y el 12, y posición estable entre la semana 6 y la 12. Mide tu propia curva: depende de tu autoridad y tu frecuencia de publicación.
¿Merece la pena bloquear los rastreadores de IA?
Es una decisión de negocio, no técnica. Si tu modelo depende de tráfico a la web, bloquearlos protege contenido; si dependes de ser recomendado, bloquearlos te deja fuera del corpus. Decidelo a conciencia, no por herencia de una plantilla.
¿Sirve para páginas que ya estaban indexadas y se han actualizado?
Si, y es uno de los usos más rentables: acelerar el reprocesado de contenido corregido o ampliado, especialmente precios y datos que aparecen en el snippet.
Conclusion
La indexacion rápida no es una palanca de crecimiento por si misma. Es una condición previa: elimina la incertidumbre de la primera fase para que puedas concentrarte en las que si deciden resultados, que son la calidad del contenido y su encaje con lo que la gente busca.
Su valor real, en nuestra experiencia, esta menos en la velocidad y más en la visibilidad del proceso. Saber si un bot ha pasado por una URL convierte una conversación de fe —«dale tiempo, ya entrara»— en un diagnóstico con dos ramas claras y dos planes de trabajo distintos. Eso ahorra semanas y bastante dinero.
Si quieres probarlo, la forma barata es empezar por tu próxima publicación: abre el panel, envía la URL y mira el registro durante una semana. Y si prefieres que revisemos por qué hay páginas tuyas que llevan meses sin entrar, escríbenos: esa revisión forma parte de la auditoría inicial que entregamos en 24 horas.