TechCrunch publicó ayer un reportaje de Sarah Perez sobre los agentes personales de inteligencia artificial, esos asistentes que reservan una mesa o hacen la compra por ti. Cuenta que quienes los usan se topan una y otra vez con webs que no les dejan terminar el recado.
Esa historia tiene un segundo plano que le toca más de cerca a un negocio pequeño. Para decidir si esos programas entran en tu web hay unos ajustes, y a mediados de septiembre cambiaron de significado. Elegir mal uno de ellos, desde esa fecha, te quita de Google.
Lo que les está pasando a los agentes que compran
Según TechCrunch, Amazon empezó a bloquear a propósito al agente Muse de Meta en su tienda, un dato que la pieza atribuye a Bloomberg. Yelp le dijo que no admite tráfico que no sea humano, salvo que el agente haya pagado su programa de licencia de datos. En eBay el matiz es otro, y lo dieron ellos: no prohíben a todos los agentes de compra de terceros, sino a los no autorizados.
Delta respondió por boca de Heena Chavda, responsable de su área de Comunicación Global. Hoy no tiene ningún acuerdo ni integración que permita a un agente externo buscar o reservar vuelos por un cliente en sus plataformas digitales. Añade que sigue evaluando si esa tecnología mejora la relación con el cliente. La compañía le dijo además a TechCrunch que abrirse a los agentes tendría que hacerse cuidando la seguridad y la experiencia de cliente.
Hay otros bloqueos que nadie decidió. Walmart está asociado con Muse y aun así TechCrunch recogió unas cuantas quejas en redes de compras que no se completaban. Un portavoz le dijo que esos cortes no eran intencionados. Lo que sus clientes parecen encontrarse, según la misma pieza, es el botón que hay que pulsar para demostrar que eres una persona. Si ese paso se interrumpe, la comprobación podría fallar y el agente se queda fuera.
Vale la pena quedarse con ese detalle, porque ese botón lo tienes probablemente en tu propia web, en el formulario de contacto o en el paso de pago.
Las tres cosas que se deciden por separado
Muchas webs no reciben las visitas directamente: pasan antes por una empresa que filtra el tráfico y acelera las páginas. Cloudflare es una de ellas. Si no sabes si la tuya pasa por ahí, esa es la primera pregunta de la lista del final.
En un anuncio del 15 de septiembre, firmado por Bryan Becker, Cloudflare clasifica el tráfico automático por lo que viene a hacer, y ofrece un control para cada comportamiento:
- Búsqueda: rastrear para construir un índice de búsqueda.
- Entrenamiento: rastrear para entrenar o afinar un modelo de inteligencia artificial.
- Agente: programas dirigidos por una persona que visitan una página en su nombre, como los que buscan contenido para un chat o los que manejan un navegador.
La empresa da sus propias cifras de qué eligen sus clientes. Menos del 1 % de los sitios bloquea los robots de búsqueda, y el 17 % activa algún mecanismo para bloquear el entrenamiento. Casi nadie quiere dejar de aparecer en los buscadores; bastantes no quieren alimentar modelos.
El cambio que puede costarte el buscador
Aquí está el motivo para mirar qué tienes puesto. Hay rastreadores que hacen dos cosas en la misma visita: recogen para el buscador y recogen para entrenar. Applebot, de Apple, Bingbot, de Microsoft, y Googlebot, de Google, son de esos.
Hasta ahora, las opciones de bloquear no se les aplicaban, precisamente para no estropear la presencia en los buscadores. Desde el 15 de septiembre sí se les aplican. Y el anuncio lo dice de las dos opciones: tanto «bloquear» como «bloquear en las páginas con anuncios» afectan ya a la búsqueda además del entrenamiento. Si alguien bloquea para que ningún modelo le toque el contenido, deja fuera a esos tres rastreadores, y con ellos el buscador. Para una pyme que recibe clientes por Google, eso cuesta bastante más que un agente que se va sin comprar.
Para rechazar solo el entrenamiento y seguir apareciendo en el buscador hay un ajuste distinto, que funciona publicando una instrucción en el robots.txt de tu web. Es el archivo de texto donde se pide a los programas automáticos que no entren en ciertas páginas.
Ese ajuste no funciona igual con los tres. Cloudflare explica que Apple y Google permiten rechazar el entrenamiento mediante una regla en ese archivo, y que han declarado que hacerlo no afecta a la posición en sus buscadores. Con Microsoft, el mecanismo equivalente está en construcción y lo sitúa a principios de 2027. Hasta que llegue, elegir ese ajuste no le transmite a Bing ninguna preferencia por esa vía. Quien quiera rechazar el entrenamiento en Bing hoy tiene que hacerlo con las herramientas de Microsoft.
Lo que le pasó a quien no tocó nada
Cloudflare publica cómo se trasladaron los ajustes viejos. Mira el caso de los dominios que nunca habían configurado estos tres controles y tenían activada la vieja opción de bloquear los robots de inteligencia artificial. El resultado para ellos es este: búsqueda permitida, entrenamiento rechazado y agentes bloqueados en las páginas donde se detecta publicidad.
TechCrunch recoge esa última parte y la relaciona con las quejas de estos días, aunque lo presenta como sospecha de terceros. A la propia Cloudflare le preguntó qué estaba pasando con Muse, y respondió que no tenía datos que compartir.
Ese bloqueo de agentes actúa solo donde se detecta un anuncio. Si tu web no sirve publicidad, que es el caso de casi cualquier taller, tienda o gestoría, hoy no te está cerrando ninguna página.
Todo eso es lo que le pasó a quien nunca tocó los tres controles. Para los dominios que sí los tenían configurados, Cloudflare dice que conserva el efecto práctico de lo que estuviera elegido, leído con las definiciones nuevas. La empresa nombra además un traslado concreto: un «bloquear» puesto en el control de entrenamiento pasa al ajuste que rechaza solo el entrenamiento. Es justo el que no estropea la búsqueda.
Sobre qué hay que hacer, el anuncio responde en dos tiempos, y conviene leer los dos. Primero dice que nada, en casi todos los casos, porque los ajustes anteriores se trasladan solos. Y en el mismo bloque añade que quien quiera fuera del todo a esos rastreadores de doble uso ahora tiene que decirlo expresamente. Para los dominios nuevos, desde el 15 de septiembre ofrece dos configuraciones recomendadas según si el sitio gana dinero con anuncios. La de los que no viven de la publicidad deja pasar los tres comportamientos.
Para decirle «no» a un agente todavía no hay forma estándar
Cloudflare no incluye por ahora, para los agentes, una opción de rechazo equivalente a la del entrenamiento. Da la razón: internet todavía no tiene una instrucción bien establecida para expresarles esa preferencia, y dice que revisará el enfoque cuando maduren estándares como ai-prefs.
Eso es justo lo que el sector intenta tapar. Según TechCrunch, Meta anunció que trabaja con Walmart, Stripe y otras empresas en un estándar abierto. Está centrado en la comunicación entre agentes para el comercio electrónico, y busca separar los programas que actúan de buena fe de los que no. El argumento de Meta que recoge la pieza es comercial: dejar fuera a un agente personal es dejar fuera al cliente que hay detrás. Como todo estándar recién anunciado, hoy es un plan y no algo que funcione en tu web.
Cuatro preguntas para quien te lleva la web
- ¿Pasa mi web por una empresa de estas antes de llegar al servidor? Si no lo sabes, pregúntalo a quien te lleva la web o a tu alojamiento. Va primera porque, si la respuesta es que no, las otras tres sobran.
- Si pasa, ¿qué hay puesto hoy en cada uno de los tres controles, búsqueda, entrenamiento y agentes?
- Si en alguno dice «bloquear» a secas, ¿me está quitando de los buscadores? Es la pregunta que puede costar dinero.
- ¿Hay un paso de «demuestra que eres una persona» en el camino de comprar o de pedir cita? Es el del primer apartado: si se interrumpe, la comprobación puede fallar y el agente se queda fuera.
Dónde encaja esto si tu web la llevamos nosotros
Si tienes un plan con nosotros, la web, su gestor y los módulos Galianet que incluya tu plan son software que hemos programado nosotros. Un fallo ahí lo arreglamos sin coste. Conviene decir también lo contrario, que es lo publicado: los programas y servicios de otros proveedores que hayas contratado tú quedan fuera de tu plan. Una empresa de las que filtran el tráfico puede ser uno de ellos.
Lo que no vas a encontrar en ningún panel es si te conviene dejar entrar a estos agentes. Eso depende de si tus clientes los usan para comprar lo que tú vendes, y hoy nadie tiene esa medida de tu negocio, nosotros tampoco. Lo que sí podemos hacer es mirar qué tienes puesto y explicarte qué efecto tiene, si nos das acceso al panel donde está. Pídenos presupuesto y te decimos antes de empezar si eso lleva coste.
Fuentes
- Sarah Perez, «The next hurdle for AI agents: getting websites to let them in», TechCrunch, 6 de octubre de 2026: https://techcrunch.com/2026/10/06/the-next-hurdle-for-ai-agents-getting-websites-to-let-them-in/
- Bryan Becker, «Have it both ways: stay discoverable in search while disallowing AI training», blog de Cloudflare, 15 de septiembre de 2026: https://blog.cloudflare.com/accountable-mixed-use-ai-crawlers/
- El anuncio de Meta sobre el estándar llega recogido en el reportaje de TechCrunch, que lo enlaza en https://www.facebook.com/business/news/a-new-way-for-businesses-and-personal-agents-to-work-together.