Las webs empiezan a cobrar a los robots de IA: qué es el pago por rastreo
Internet

Las webs empiezan a cobrar a los robots de IA: qué es el pago por rastreo

Cloudflare bloqueará por defecto a los rastreadores de IA y les responderá con un 402. Qué es el pago por rastreo y cómo puede cambiar la web abierta.

Durante treinta años el trato en internet fue tácito y funcionó razonablemente: tú dejas que un buscador rastree tu web y el buscador te devuelve visitas. Nadie firmó nada, pero el intercambio estaba equilibrado. Ese equilibrio se ha roto, y Cloudflare acaba de decidir que va a intervenir.

A partir del 15 de septiembre, la compañía bloqueará por defecto a los rastreadores de IA de uso mixto en webs que muestran publicidad, y les responderá con un código HTTP 402 - Payment Required. Un código que llevaba en el estándar desde los años noventa prácticamente sin usarse y que ahora encuentra por fin su función.

De dónde sale el problema

La cifra que ha convertido esto en un asunto urgente es la del desequilibrio entre rastreos y visitas devueltas. Según los datos que ha compartido el propio CEO de Cloudflare, Matthew Prince, se han medido ratios que van de 250 accesos de bot por cada visita real hasta cifras de 1.500 a 1, según la plataforma.

Traducido: tu web paga ancho de banda y servidores para servir contenido a un rastreador que, a diferencia del buscador clásico, casi nunca te manda un lector a cambio. La respuesta del asistente de IA se lo queda todo: el usuario pregunta, recibe la respuesta sintetizada y no llega a pisar tu página.

📌 Relacionado: Qué es una VPN, para qué sirve y cuándo merece la pena usarla

Para una web pequeña esto no es una discusión filosófica, es la factura de hosting subiendo mientras el tráfico baja.

Qué es exactamente el pago por rastreo

La idea es sencilla y elegante:

  1. El rastreador de una empresa de IA pide una página.
  2. El servidor, en vez de servirla, responde con un 402 y una indicación del precio.
  3. Si el rastreador acepta y paga, recibe el contenido. Si no, se queda fuera.

El editor fija el precio. El pago se liquida mediante un protocolo específico de micropagos, pensado para transacciones de importe minúsculo que serían inviables con pasarelas tradicionales por comisiones.

👉 Te puede interesar: Cómo eliminar tu información personal de Google (guía paso a paso 2026)

Cloudflare ya ha adelantado que el sistema evoluciona hacia un modelo de pago por uso: cobrar no solo cuando el bot descarga la página, sino cuando ese contenido genera valor en la respuesta al usuario final. Es más justo conceptualmente y bastante más difícil de medir.

La distinción clave: no todos los bots son iguales

Aquí está el matiz que más se pierde en los titulares. Cloudflare no está bloqueando “la IA” en bloque: está presionando para que las empresas separen sus rastreadores por finalidad. Hay al menos tres tipos con implicaciones muy distintas:

  • Rastreo para entrenamiento: recopilar texto para entrenar un modelo. No devuelve ni una visita, nunca. Es el caso más discutido.
  • Rastreo para búsqueda: indexar para poder citar y enlazar la fuente. Se parece al buscador clásico y sí puede devolver tráfico.
  • Agentes actuando en nombre de un usuario: alguien pide a su asistente que le busque algo concreto y el agente entra a esa web. Es tráfico real con un intermediario.

Los llamados rastreadores “de uso mixto” son los que hacen las tres cosas con el mismo identificador, de forma que el editor no puede decir “sí a la búsqueda, no al entrenamiento”. Eso es justo lo que Cloudflare quiere forzar a que se rompa.

🔗 Sigue leyendo: Navegadores con IA integrada: qué son Comet, Atlas y Dia y si merece la pena cambiarse

Qué significa esto si tienes una web

Si eres editor, blogger o llevas una tienda online, esto te toca:

  • Tendrás control real por primera vez. El archivo robots.txt siempre ha sido una petición educada que cualquiera puede ignorar, y muchos la ignoran. Un bloqueo a nivel de red no se ignora.
  • Puede que ganes algo de dinero, aunque no te hagas ilusiones: para una web pequeña las cantidades serán simbólicas. El impacto grande es para medios con volumen.
  • Piensa qué quieres bloquear. Bloquear el rastreo de búsqueda puede quitarte visibilidad en los asistentes que sí citan fuentes, que empiezan a ser una vía de tráfico. No es automáticamente bueno decir que no a todo.

Y el riesgo, que también existe

No quiero vender esto como una victoria limpia, porque tiene una cara incómoda.

🔎 Más de Internet

Un internet donde el acceso automatizado se cobra es un internet con peajes. Y los peajes los pagan mejor los grandes. Un laboratorio de IA con miles de millones puede permitirse rastrear pagando; un proyecto de investigación universitario, un archivo digital o una startup pequeña, no. Existe el riesgo real de consolidar todavía más a los que ya están arriba.

También está el precedente: si un intermediario que gestiona una parte enorme del tráfico mundial decide por defecto quién pasa y quién no, ese poder de decisión es en sí mismo un asunto delicado, por muy razonable que sea la política concreta.

Preguntas frecuentes

¿Esto afecta a Google y a la búsqueda normal? La medida apunta a rastreadores de IA, no al indexado clásico de buscadores. El punto conflictivo son precisamente los rastreadores que hacen ambas cosas sin distinguirlas, que es lo que el cambio pretende separar.

¿Puedo aplicar algo así en mi web sin usar Cloudflare? Puedes bloquear por identificador de agente o por rango de direcciones en tu servidor, aunque es más frágil y hay que mantenerlo a mano. Lo que no puedes montar tú fácilmente es la parte del cobro.

¿Van a dejar los modelos de aprender de internet? No. Habrá acuerdos comerciales, contenido que siga siendo libre y datos ya recopilados. Lo que cambia es que el acceso masivo y gratuito por defecto deja de darse por hecho.

Me parece un momento importante, y no exactamente feliz. La web abierta funcionó porque el acceso era barato y el intercambio, más o menos justo. Que haya que poner cajas registradoras en la puerta significa que el intercambio dejó de serlo. Prefiero un internet con peajes negociados a uno donde quien produce el contenido acaba cerrando por no poder pagar los servidores, pero no voy a fingir que sea la mejor de las opciones posibles.

📊 Encuesta rápida

¿Deberían las webs cobrar a las empresas de IA por rastrear su contenido?

💻🎮 Pon a prueba lo que sabes¿Cuánto sabes de tecnología? El test definitivoHacer test →
Lucía Navarro
Lucía Navarro

Divulgadora científica. Le interesan el espacio, la investigación y cómo la tecnología cambia nuestra vida online. Fan de explicar lo complejo sin jerga.

3 comentarios

  • MS
    María S.hace 2 horas

    Muy buen artículo, no tenía ni idea de esto. Gracias por la info 👏

    ♥ 0
  • IG
    Iván G.ayer

    Justo lo que estaba buscando, gracias por explicarlo tan claro.

    ♥ 17
  • LG
    Laura G.hace 3 días

    Lo comparto ahora mismo con mi grupo, esto interesa a todos.

    ♥ 10