Google actualizó el 22 de julio de 2026 su guía oficial para optimizar el crawl budget. El cambio aparece como una mejora de claridad, terminología y flujo, no como una actualización de ranking. Aun así, para un ecommerce con miles de fichas, filtros, variantes, parámetros, páginas agotadas o muchos productos en Merchant Center, la guía deja una decisión práctica: antes de pedir más rastreo, hay que enseñar a Google qué URLs merecen ser rastreadas y cuáles solo consumen recursos.
Qué ha aclarado Google
El hecho oficial es concreto: el changelog de la documentación de crawling registra el 22 de julio una revisión de la guía de crawl budget para mejorar claridad, consistencia de términos y estructura. Google no lo presenta como un cambio de algoritmo ni como una señal nueva de ranking.
La guía aclara que el crawl budget se compone de dos piezas: el límite de capacidad de rastreo, que busca no sobrecargar el servidor, y la demanda de rastreo, que depende de tamaño, frecuencia de actualización, calidad, relevancia y otros factores. También indica que no toda URL rastreada acaba indexada.
Para ecommerce hay una frase especialmente importante: aunque cada crawler tenga su propia demanda, el límite de capacidad se comparte entre todos los crawlers. La propia guía cita que Google Shopping puede tener más demanda sobre productos incluidos en feeds de comerciantes. Eso no significa que Merchant Center quite SEO de forma automática; significa que una tienda con catálogo grande debe cuidar servidor, URLs y señales de inventario.
La noticia no es 'Google cambia rankings'; la noticia útil es que Google explica mejor cómo decide qué puede y quiere rastrear en sitios grandes.Por qué afecta a categorías, fichas y filtros
La mayoría de tiendas pequeñas no tiene un problema real de crawl budget. Google dice que si las páginas se rastrean el mismo día que se publican, mantener el sitemap al día y revisar el informe de indexación suele bastar. El riesgo aparece cuando el catálogo crece, cambia a diario o genera demasiadas URLs parecidas.
En ecommerce, ese exceso suele salir de filtros indexables sin intención clara, combinaciones de parámetros, ordenaciones, paginaciones vacías, variantes casi idénticas, productos retirados que devuelven páginas blandas y URLs de tracking o búsqueda interna. Google llama a esto inventario percibido: si Google conoce muchas URLs que no aportan valor, puede gastar tiempo en comprobarlas antes de llegar a fichas o categorías importantes.
La documentación de faceted navigation encaja con esta lectura. Google avisa de que los filtros basados en parámetros pueden crear espacios de URL casi infinitos y ralentizar el descubrimiento de URLs útiles. Para una tienda, eso puede retrasar fichas nuevas, cambios de precio, categorías de temporada o contenido editorial que sí debería competir en orgánico.
- Categorías: decide qué filtros tienen intención SEO real y cuáles solo deben ayudar a navegar.
- Fichas: evita duplicar variantes si no aportan una URL útil, enlazada y diferenciada.
- Sitemaps: incluye URLs canónicas importantes y usa `lastmod` cuando el contenido cambie de verdad.
- Merchant Center: alinea feed, stock, precio y disponibilidad con la web para no multiplicar rastreos sobre datos incoherentes.
Qué revisaría esta semana
No empezaría por tocar `robots.txt`. Empezaría por Search Console y logs, si existen. El objetivo es separar tres grupos: URLs importantes que Google tarda en descubrir, URLs conocidas pero no indexadas, y URLs que Google no debería estar visitando tanto.
El informe de Page Indexing ayuda a detectar síntomas como `Discovered - currently not indexed`, soft 404, páginas duplicadas o canonicals elegidos por Google. Los logs del servidor o de CDN permiten ver si Googlebot consume tiempo en filtros, parámetros, búsquedas internas, páginas sin stock o redirecciones encadenadas.
Con esa foto, la acción más rentable suele ser de inventario: consolidar duplicados, bloquear filtros sin valor de búsqueda, devolver `404` o `410` en URLs retiradas de verdad, arreglar soft 404, acortar redirecciones y limpiar el sitemap. En tiendas grandes, también revisaría Time to First Byte y errores `5xx`, porque Google indica que latencia, respuestas lentas, errores de servidor y `429` reducen la capacidad de rastreo.
| Zona | Qué mirar | Decisión práctica |
|---|---|---|
| Filtros | Color, talla, precio, orden, disponibilidad y combinaciones sin demanda | Indexar solo filtros con intención clara; bloquear o no enlazar el resto. |
| Fichas | Variantes, productos agotados, retirados y duplicados por parámetros | Canónica consistente, contenido diferenciable o `404/410` si ya no existe. |
| Sitemap | URLs canónicas, `lastmod`, categorías prioritarias y fichas activas | No meter búsquedas internas, filtros pobres ni URLs no canónicas. |
| Servidor | TTFB, `5xx`, `429`, cadenas de redirección y soft 404 | Corregir errores antes de esperar más rastreo. |
| Search Console | `Discovered - currently not indexed`, duplicadas y soft 404 | Cruzar patrones por plantilla, categoría y tipo de URL. |
Fuente: Síntesis NewsEcom a partir de la guía de crawl budget de Google
Qué no conviene tocar todavía
No conviene convertir la aclaración de Google en una limpieza agresiva sin datos. Bloquear filtros que ya captan búsquedas, borrar categorías que consolidan autoridad o devolver `404` a productos que tienen alternativa puede empeorar tráfico y conversión.
Tampoco usaría `noindex` como herramienta principal para ahorrar rastreo. Google lo dice de forma clara en la guía: una página con `noindex` todavía debe rastrearse para que Google vea esa señal, por lo que puede seguir consumiendo tiempo. Si una URL no debe rastrearse en absoluto, el caso suele resolverse mejor con arquitectura, enlaces, robots.txt o eliminación real, según el objetivo.
La tercera cautela es no confundir crawl budget con ranking. Si una categoría importante ya se rastrea rápido pero no posiciona, el problema puede estar en intención, contenido, enlaces internos, autoridad, competencia o datos de producto. Mejorar rastreo ayuda a descubrir y refrescar URLs; no convierte una ficha pobre en la mejor respuesta.
- No bloquees filtros con tráfico o ventas sin comprobar consultas, enlaces internos y canibalización.
- No cambies canonicals masivamente si no puedes probar plantillas y páginas afectadas.
- No metas en el sitemap todo el catálogo si incluye duplicados, agotados permanentes o URLs no canónicas.
- No interpretes una caída orgánica como crawl budget si no hay retrasos de rastreo o problemas de indexación.
Cómo medir si te afecta
La medición útil cruza cuatro fuentes: Page Indexing en Search Console, sitemap, logs de rastreo y rendimiento orgánico por plantilla. Una tienda que solo mira clics puede reaccionar tarde; una tienda que solo mira logs puede optimizar URLs sin valor comercial.
Haría una muestra de 100 URLs: 30 categorías, 40 fichas prioritarias, 20 filtros con intención posible y 10 productos retirados. Para cada URL anotaría estado en Search Console, fecha de último rastreo si está disponible, canonical elegido, inclusión en sitemap, respuesta HTTP y tráfico orgánico de los últimos 28 días.
La decisión sale de los patrones. Si Google visita miles de URLs de filtros sin clics mientras fichas nuevas quedan descubiertas pero no indexadas, toca recortar inventario rastreable. Si las URLs importantes reciben `5xx`, `429` o tardan demasiado, la prioridad es infraestructura. Si todo se rastrea bien pero no convierte, el problema está fuera del crawl budget.
La métrica clave no es rastrear más URLs; es que Google llegue antes a las URLs que de verdad sostienen demanda, margen y disponibilidad.Preguntas frecuentes
Qué es crawl budget en ecommerce?
Es la combinación de lo que Google puede rastrear sin sobrecargar tu servidor y lo que quiere rastrear según demanda. En ecommerce importa cuando hay muchas URLs de productos, filtros, variantes, parámetros o cambios frecuentes.
Todas las tiendas online tienen que optimizar crawl budget?
No. Google indica que esta guía es avanzada y pensada sobre todo para sitios grandes, sitios con cambios muy rápidos o sitios con muchas URLs descubiertas pero no indexadas. Una tienda pequeña suele empezar por sitemap y Page Indexing.
Los filtros de productos deben bloquearse siempre?
No. Algunos filtros pueden responder búsquedas reales, por ejemplo una categoría por material, talla, uso o compatibilidad. El bloqueo tiene sentido para combinaciones sin demanda, duplicadas, infinitas o meramente operativas.
Usar noindex ahorra crawl budget?
No como primera herramienta. Google debe rastrear la página para ver el `noindex`, así que puede seguir gastando rastreo. Si una URL no debe rastrearse, conviene revisar enlaces, arquitectura, robots.txt o eliminación según el caso.
Merchant Center afecta al rastreo orgánico?
Google explica que Google Shopping puede tener más demanda de rastreo sobre productos presentes en feeds y que la capacidad se comparte entre crawlers. No significa pérdida automática de SEO, pero sí exige datos de producto coherentes y servidor sano.
Fuentes
- Google Crawling Infrastructure: Changelog, 22 de julio de 2026
- Google Crawling Infrastructure: Optimize your crawl budget
- Google Crawling Infrastructure: Managing crawling of faceted navigation URLs
- Google Search Central: Learn about sitemaps
- Google Crawling Infrastructure: How HTTP status codes affect Google's crawlers
- Google Search Status Dashboard: Ranking history




