Bots de IA en PrestaShop: cuáles bloquear y cuáles te dan ventas

SEO y rendimiento · 6 min de lectura

Bots de IA en PrestaShop: cuáles bloquear y cuáles te dan ventas

Una tienda de ropa con ochocientos modelos empieza a caerse cada tarde. El servidor no ha cambiado, las visitas tampoco, y en el registro aparecen nombres nuevos: Bytespider, GPTBot, ClaudeBot. La primera reacción es bloquearlos todos. Es la reacción cara, y no arregla lo que se está rompiendo.

Qué bots de IA entran en tu tienda y qué hace cada uno

No son todos lo mismo, y esa es la parte que casi nadie mira. Las empresas de IA usan tres robots distintos, con tres nombres distintos, precisamente para que puedas decidir por separado:

  • Entrenamiento. Recogen páginas para futuras versiones del modelo: GPTBot (OpenAI), ClaudeBot (Anthropic), Google-Extended (Google), Bytespider (ByteDance, los de TikTok), CCBot. Bloquearlos no te quita ni una visita.
  • Buscador. Indexan tu tienda para poder citarla cuando alguien pregunta: OAI-SearchBot, Claude-SearchBot, PerplexityBot. Si los bloqueas, dejas de aparecer en las respuestas.
  • Petición de una persona. Van a por tu página porque alguien acaba de preguntar por ti: ChatGPT-User, Claude-User. No están rastreando: están atendiendo a un cliente potencial. OpenAI avisa además de que, al ser una acción iniciada por un usuario, su robots.txt puede no aplicarse.

La lista de bloqueo que circula por los foros mete los tres grupos en el mismo saco. Cierra el entrenamiento —que quizá querías cerrar— y de paso te saca del buscador y le da con la puerta en las narices al cliente que preguntaba por tus zapatillas.

Bloquearlos a todos te cuesta ventas, y está medido

Adobe sigue más de un billón de visitas a tiendas de Estados Unidos, y lleva once meses seguidos midiendo lo mismo: el visitante que llega desde una IA convierte alrededor de un 60 % mejor que el que llega por otro canal. Deja un 37 % más de ingreso por visita, añade al carrito un 28 % más y se queda casi la mitad de tiempo más en la ficha.

Tiene todo el sentido: cuando ese cliente pincha ya ha hecho la comparativa dentro del chat. No viene a mirar, viene decidido.

Y no es residual: el tráfico que la IA manda al comercio creció un 62 % en un año, y se ha multiplicado por doce desde finales de 2024.

Bloquear un rastreador de entrenamiento te ahorra ancho de banda. Bloquear el del buscador te borra de la respuesta que iba a citarte.

Google-Extended: el único que puedes cerrar sin pagar nada

Hay uno que es todo ventaja y casi nadie lo sabe. Google-Extended decide si Google puede usar tus textos para entrenar Gemini, y es un permiso separado de Googlebot, que es quien indexa tu tienda para el buscador de toda la vida.

Lo importante viene ahora: los resúmenes de IA que salen arriba en Google no beben de Google-Extended, beben del índice normal de Googlebot. Puedes decirle a Google que no entrene con tus fichas y seguir apareciendo exactamente igual en el buscador y en esos resúmenes.

Bytespider ignora tu robots.txt

Aquí se cae la mitad de los consejos que vas a leer. El robots.txt es una petición, no una puerta. Funciona con quien decide respetarlo.

El caso más citado es Bytespider, el rastreador de ByteDance —la empresa de TikTok— que alimenta su asistente Doubao. ByteDance sostiene que respeta el robots.txt; lo que reportan los administradores es otra cosa: hay quien ha registrado hasta 1,4 millones de peticiones diarias de ese único bot, un ritmo del orden de veinticinco veces el de GPTBot. Para Bytespider, el robots.txt no basta: hay que cerrarle en el servidor.

Y no es el único. En 2025 Cloudflare acusó públicamente a Perplexity de rastrear con identidades encubiertas cuando se le bloqueaba el agente declarado: cambiaba de user-agent, se hacía pasar por un Chrome normal en macOS y rotaba direcciones fuera de sus rangos publicados. Cloudflare lo retiró de su lista de bots verificados. Perplexity lo negó.

Conclusión práctica: el robots.txt vale para OpenAI, Anthropic y Google, que lo respetan y documentan sus agentes. Para el resto hace falta bloqueo real —regla de servidor por user-agent, o el interruptor de bloqueo de rastreadores de IA que tu CDN ya te ofrece si estás detrás de una.

La cuenta que explica por qué se cae tu tienda

Volvamos a la tienda de ropa. Ochocientos modelos no son ochocientas direcciones. Con la búsqueda por facetas encendida —6 tallas, 12 colores, 20 marcas, 4 rangos de precio— cada categoría genera 5.760 combinaciones de un solo valor por filtro. Con cuarenta categorías, 230.000 URLs. Y eso contando una sola opción por filtro: en cuanto el cliente puede marcar dos tallas a la vez, la cifra se va a los millones.

Ninguna de esas páginas existe de verdad. Todas ejecutan una consulta pesada que la caché no puede guardar, porque cada combinación es distinta.

Ese agujero no lo abrió la IA. Llevaba años ahí y lo pagabas en presupuesto de rastreo desperdiciado con Google, como ya contamos al hablar de facetas y CPU. Lo que ha hecho la IA es multiplicar el número de robots que se meten por él —los bots ya son más de la mitad del tráfico web—, y ahí es donde una tienda con pocos recursos se rompe: no por una visita cara, sino por cincuenta a la vez.

Por eso bloquear robots es tratar el síntoma. Los que lleguen el mes que viene tendrán otro nombre.

Qué hacer, por orden

  1. Cierra las URLs que no deberían existir para nadie. Combinaciones de filtros, resultados de la búsqueda interna, ordenaciones, la página 47 de un listado, carrito y cuenta de cliente. Ni para la IA ni para Google. Esto es lo que baja la CPU.
  2. Deja abiertos los buscadores de IA. OAI-SearchBot, Claude-SearchBot, PerplexityBot, ChatGPT-User y Claude-User son los que te traen al cliente que convierte un 60 % mejor.
  3. Decide sobre el entrenamiento. GPTBot, ClaudeBot y CCBot son opcionales. Google-Extended es gratis cerrarlo.
  4. Bloquea Bytespider en el servidor, no en el robots.txt: no lo va a leer.
  5. Mira los registros una semana antes y después. Es lo único que te dice si has acertado.

Y si el servidor no da más de sí

Todo lo anterior asume que tienes margen. Si estás en alojamiento compartido y la tienda se cae cada tarde, primero se apaga el incendio: se cierran los rastreadores de entrenamiento y se deja entrar solo a los buscadores.

Pero que sea una decisión con fecha, no el estado definitivo. Una tienda que ha cerrado la puerta a los buscadores de IA no aparece cuando preguntan por ella, y eso no se nota en ninguna gráfica: simplemente no pasa.

Si no sabes por dónde empezar a cortar, cuéntanos qué catálogo tienes, cuántas facetas hay encendidas y en qué servidor está montado, y te decimos qué se cierra, qué se deja abierto y qué hay que arreglar antes de tocar el robots.txt.

Cuéntanos cómo va tu servidor

Cómo te podemos ayudar

Ver todos los servicios →

Seguir leyendo

¿Te echamos una mano con tu proyecto? Hablemos

Convierta su comercio electrónico en su mejor comercial

¿Está preparado para impulsar su tienda PrestaShop? Hablemos de su proyecto y creemos juntos algo increíble.

Contacte con nosotros