AI Visibility Software
← Blog
Publicado

Tráfico de rastreadores de IA vs. tráfico de referencia de IA: dos métricas que tu stack de analítica sigue confundiendo

El tráfico de rastreadores de IA y el tráfico de referencia de IA se mezclan en una sola cifra de "tráfico de IA". Descubre dónde se cuenta cada uno, qué demuestra y qué se le escapa a los dos.

En resumen

El tráfico de rastreadores de IA ocurre del lado del servidor: bots como GPTBot y PerplexityBot recorren tus páginas y nunca tocan un navegador, así que solo aparecen en los logs de servidor. El tráfico de referencia de IA es humano: clics desde una respuesta de IA que llegan en parte al canal AI Assistant de GA4, pero se le escapa Perplexity y el 70,6 % de las sesiones de IA que llegan sin referente.

Última actualización: octubre de 2026

En marketing se sigue hablando de “tráfico de IA” para referirse a dos cosas distintas. Para unos son los bots que leen tus páginas para construir una respuesta. Para otros son las personas que hacen clic después de leer esa respuesta. Mezcla las dos en un informe, y terminas exagerando tu alcance o perdiéndote la mayor parte de él.

Un equipo de contenido ve que GPTBot golpeó el servidor unos cuantos miles de veces la semana pasada y declara la campaña un éxito. Un equipo de growth revisa GA4, ve un canal AI Assistant plano, y concluye que la IA no vale la pena perseguir como canal. Los dos equipos leen una cifra real. Ninguno de los dos ve el panorama completo.

¿Qué es el tráfico de rastreadores de IA?

Cada motor importante opera más de un bot, y cada uno cumple una función distinta.

OpenAI envía GPTBot para reunir datos de entrenamiento y OAI-SearchBot para alimentar los resultados de búsqueda en vivo y las citaciones de ChatGPT. Perplexity opera dos agentes distintos: PerplexityBot construye su índice de búsqueda y por lo general respeta robots.txt, mientras que Perplexity-User recorre una página en el momento en que una persona hace una pregunta en vivo, y por lo general ignora robots.txt porque quien dispara la solicitud es un usuario, no un calendario. Los rastreadores de Google alimentan tanto su índice orgánico como Google AI Overviews, y Google-Extended es el control independiente que te permite excluir tu contenido del entrenamiento de IA específicamente. Microsoft Copilot se apoya en Bingbot, el mismo rastreador que alimenta Bing Search.

Ninguno de estos bots carga un navegador. Cada uno envía una solicitud HTTP, lee el HTML en bruto y se desconecta. El análisis de logs de rastreadores de Vercel de 2026 encontró que GPTBot solicita archivos JavaScript en aproximadamente el 11,5 % de sus peticiones, pero nunca ejecuta ni uno solo de ellos.

Tu etiqueta de GA4 vive dentro de ese JavaScript. Si el script nunca se ejecuta, ningún evento de página vista se dispara jamás, sin importar lo bien que hayas configurado la propiedad.

Ese es el mecanismo que vale la pena recordar: el tráfico de rastreadores de IA es invisible para GA4 por diseño, no por accidente. La solución no es un snippet de seguimiento. Es un log de servidor.

¿Qué es el tráfico de referencia de IA?

El 13 de mayo de 2026, Google le dio a GA4 un canal nativo AI Assistant. Las sesiones de referentes de chatbots reconocidos se clasifican en él de forma automática, sin necesidad de configuración personalizada. Reconoce ChatGPT, Gemini y Microsoft Copilot.

Ese canal tiene dos huecos, y un tercero queda justo fuera de él.

Primero, Perplexity no está en la lista. Sus clics siguen cayendo en el canal Referencia normal, indistinguibles de un blog cualquiera que enlace hacia ti, a menos que construyas tú mismo un grupo de canales personalizado.

Segundo, los clics de Google AI Overviews tampoco caen en AI Assistant ni en Referencia. GA4 los archiva bajo Búsqueda orgánica, el mismo cubo que cualquier otro clic de Google, así que la parte impulsada por IA se esconde dentro de una cifra que a nadie se le ocurre desglosar.

Tercero, y el más grande: la mayoría de las sesiones de IA no llevan ninguna cabecera de referente. Un análisis de 446.405 visitas encontró que el 70,6 % del tráfico impulsado por IA llega sin referente y cae en Directo, el mismo cubo que alguien que escribe tu URL de memoria (Loamly, State of AI Traffic 2026, actualizado en febrero de 2026). Un grupo de canales solo puede clasificar el tráfico que puede ver.

El primer hueco lo puedes cerrar tú mismo. Construye un grupo de canales personalizado en GA4, añade una regla de fuente para perplexity.ai, y coloca esa regla por encima de Referencia para que las sesiones de Perplexity se reclamen antes de que el cubo genérico las atrape. Nada de lo que configures en GA4 recupera el tercer hueco. El tráfico sin referente no tiene ninguna cabecera que emparejar, así que ninguna regla, personalizada o nativa, puede clasificarlo.

La ruta del bot y la ruta humana

Imagina las dos rutas lado a lado.

RUTA DE RASTREO DE IA  (bot, lado del servidor)
Bot de IA (GPTBot, OAI-SearchBot, PerplexityBot, Google-Extended, Bingbot)
  -> solicitud HTTP de HTML en bruto, sin navegador, sin JavaScript
  -> tu servidor web o CDN
  -> registrado solo en los logs de acceso de servidor o CDN
  -> GA4: nada se dispara, nunca

RUTA DE REFERENCIA DE IA  (humano, lado del navegador)
Una persona hace clic en una cita dentro de una respuesta de IA
  -> un navegador real abre tu página
  -> el JavaScript se ejecuta, la etiqueta de GA4 dispara una página vista
  -> canal de GA4: AI Assistant (ChatGPT, Gemini, Microsoft Copilot)
                    o Referencia (Perplexity)
                    o Búsqueda orgánica (Google AI Overviews)
                    o Directo (cerca del 70,6 % de las sesiones de IA: sin ningún referente)

Las dos rutas nunca se cruzan. La visita de un bot nunca se convierte en una sesión de GA4, y una sesión de GA4 nunca viene de un bot. Trátalas como dos instrumentos, no como uno.

Dónde se cuenta cada métrica y qué se le escapa

Alinea las dos, y el hueco en la mayoría de los stacks de reporting salta a la vista.

Tráfico de rastreadores de IATráfico de referencia de IA
Dónde se cuentaLogs de acceso de servidor o CDN, leídos con una herramienta de análisis de logsCanal AI Assistant de GA4, más Referencia y Búsqueda orgánica para las sesiones que clasifica mal
Qué demuestraEl bot de un motor de IA recorrió activamente una página concretaUna persona real hizo clic desde una respuesta de IA y llegó a tu sitio
Qué se le escapaSi algún humano llegó a ver ese contenido, o si produjo alguna citaciónLos clics de Perplexity (archivados como Referencia), los clics de Google AI Overviews (archivados como Búsqueda orgánica), y el 70,6 % de las sesiones de IA sin referente (archivadas como Directo)
Capa de herramientas que necesitasAnálisis de logs de servidor o una plataforma de analítica de agentesAnalítica web más una herramienta de SEO centrada en referencia, o un grupo de canales personalizado en GA4

Por qué la confusión te sale cara

Confundir las dos produce dos errores opuestos.

Un pico en las solicitudes de GPTBot no significa que la gente te esté descubriendo a través de la IA. Significa que un motor leyó tu página. Eso es un indicador adelantado, no un resultado. El valor solo aparece después, si el motor de verdad te cita y una persona hace clic.

Un número plano en tu canal AI Assistant de GA4 tampoco significa que los motores de IA te estén ignorando. Puede significar que la gente está leyendo tu marca en una respuesta de Perplexity, en un AI Overview o en una sesión sin referente, y ninguna de esas tres aparece donde estás mirando.

Reporta las dos cifras por separado y nombra lo que se le escapa a cada una. Una sola línea de “tráfico de IA” que mezcla logs de servidor con sesiones de GA4 no es una métrica. Son dos mediciones distintas usando la misma etiqueta.

Cómo rastrear los dos lados

Ni los archivos de log ni GA4 responden la pregunta que de verdad le importa a un equipo de marca: ¿estás ganando share of voice frente a tus rivales dentro de la respuesta misma, mención o citación, produzca o no un clic?

Para el lado del bot, las plataformas de analítica de agentes como Profound superponen datos de CDN y de logs de servidor con contexto de citación, para que puedas ver qué páginas recorrió un motor concreto y con qué frecuencia eso se correlaciona con una citación real. Para el lado de la referencia, una vez que un grupo de canales personalizado en GA4 está haciendo su trabajo, herramientas como el AI Toolkit de Semrush añaden benchmarking competitivo de referencia de IA sobre tus propias cifras de primera parte.

Si prefieres una sola suscripción que rastree menciones y citaciones de marca en los principales motores de IA y convierta esos huecos en una lista de correcciones priorizada, Temso cubre ese terreno desde 89 €/mes, con proyectos y recomendaciones ilimitados en todos los planes.

Empieza por las dos cifras que ya tienes. Extrae tus logs de servidor para la actividad de GPTBot y PerplexityBot de esta semana y ponlos junto a tu canal AI Assistant de GA4. El tamaño de ese hueco es exactamente lo que tu stack actual todavía no puede ver, y el ranking de herramientas de visibilidad en IA desglosa qué herramientas lo cierran.

FAQ

¿Cuál es la diferencia entre el tráfico de rastreadores de IA y el tráfico de referencia de IA?

El tráfico de rastreadores de IA ocurre del lado del servidor: cada solicitud que un bot de IA, como GPTBot o PerplexityBot, envía para recorrer tus páginas, registrada solo en los logs de servidor o CDN. El tráfico de referencia de IA es humano: una persona hace clic en un enlace de cita dentro de una respuesta de IA y llega a tu sitio en un navegador real, algo que GA4 puede rastrear en parte a través de su canal AI Assistant.

¿Por qué el tráfico de rastreadores de IA nunca aparece en GA4?

Los bots de IA, como GPTBot, OAI-SearchBot y PerplexityBot, envían una solicitud HTTP simple y leen el HTML en bruto. Nunca cargan un navegador ni ejecutan JavaScript, así que el script que dispara el evento de página vista de GA4 nunca se ejecuta. El único registro de esa visita vive en tus logs de acceso de servidor o CDN.

¿El canal AI Assistant de GA4 rastrea los referidos de Perplexity?

No. El canal AI Assistant de GA4, lanzado el 13 de mayo de 2026, reconoce referentes como ChatGPT, Gemini y Microsoft Copilot, pero Perplexity no está en esa lista. Los clics de Perplexity siguen cayendo en el canal genérico Referencia, indistinguibles de cualquier otro enlace entrante, a menos que construyas un grupo de canales personalizado en GA4 para capturarlos.

¿Qué porcentaje del tráfico de referencia de IA es invisible para GA4?

Un análisis de 446.405 visitas encontró que el 70,6 % del tráfico impulsado por IA llega sin ninguna cabecera de referente y cae en el canal Directo de GA4, el mismo cubo que se usa cuando alguien escribe tu URL de memoria (Loamly, State of AI Traffic 2026, actualizado en febrero de 2026). Un grupo de canales solo puede clasificar el tráfico que realmente puede ver.

¿Qué herramienta debo usar para rastrear la actividad de los rastreadores de IA?

Empieza por tus propios logs de acceso de servidor o CDN y una herramienta de análisis de logs, ya que es el único lugar donde se registran las solicitudes de rastreo. Las plataformas de analítica de agentes, como Profound, superponen contexto de citación sobre esos datos de logs, mostrando qué páginas recorrió de verdad un motor de IA concreto y cómo se correlaciona eso con conseguir una citación.

¿Puede una sola herramienta rastrear tanto el tráfico de rastreadores de IA como el tráfico de referencia de IA?

No directamente. Los archivos de log y GA4 siguen siendo la fuente de verdad para las solicitudes de rastreo y las sesiones con clic. Lo que añade una plataforma como Temso es la capa por encima de las dos: si tu marca llega o no a ser mencionada o citada en los motores de IA, desde 89 €/mes, con proyectos y recomendaciones ilimitados en todos los planes.