← Volver al Blog

Primera semana de GA4 en dominio nuevo: kaoriq

A los cuatro días de registrar un dominio nuevo abrí GA4 y vi 65 páginas vistas / 34 usuarios / 9 países.

Por un instante de emoción de proyecto recién lanzado, casi lo celebré. Después miré el desglose por país. Estados Unidos tenía 17 sesiones con un promedio de 4.9 segundos de duración. Francia, Polonia, Corea del Sur, India, Singapur: todos entre 0 y 1.4 segundos. Japón solo, en cambio, marcaba 751 segundos, más de 12 minutos. Un valor tan atípico que debería estar prohibido.

El dominio es kaoriq.com, registrado el 2 de mayo de 2026: un e-commerce de fragancias con quiz de personalidad que estoy construyendo. Al día de hoy tiene menos de 20 artículos. Hechos los cálculos de servilleta, esa distribución de páginas vistas es físicamente imposible que venga de humanos reales.

Este post explica cómo leer la primera semana de datos de GA4 en un dominio nuevo como “yo + un ejército de crawlers”, con los números crudos expuestos. Es para quien esté corriendo GA4 en un proyecto nuevo, o para quien haya registrado un dominio este fin de semana.

Los datos crudos: últimos 14 días (4 días de actividad real)

Primero los números, sin adornos.

Total

MétricaValor
Sesiones37
Páginas vistas65
Usuarios totales34
Usuarios nuevos34
Duración promedio de sesión104.1 s
Tasa de rebote80%

Por país

PaísSesionesVistasDuración prom. (s)
Japón533751.0
Estados Unidos17174.9
Canadá441.3
Francia441.4
Polonia220.0
Corea del Sur220.0
(no definido)110.1
India110.0
Singapur110.0

Por día

FechaSesionesVistasUsuarios
2026-05-02 (día de registro)174014
2026-05-036116
2026-05-04121212
2026-05-05222

A primera vista, “no está mal para la primera semana” es una lectura tentadora. Pero este dataset contiene un lector japonés de 751 segundos viviendo al lado de 9 países con promedios de cero segundos. Falta el medio. Esa brecha es la pista más importante.

5 señales, cruzadas en paralelo

Nunca declaro tráfico de bot con una sola señal. Para evitar falsos positivos, siempre cruzo cinco ejes al mismo tiempo.

5 señales para separar humano de crawler en un dominio nuevo

SeñalPatrón botPatrón humanokaoriq realVeredicto
Duración de sesión0-5 s30 s a varios minUS 4.9s, FR 1.4s, KR 0sBot
Tasa de rebote90-100%40-70%80%Bot
Vistas / sesión1.0 (una página, se va)1.5-3.0US: 17/17 = 1.0Bot
Anomalía geográficaPaíses aleatorios sin relación al contenidoConcentrado en la geografía objetivoSolo EN/JA, pero PL/IN/SGBot
Pico temporalEnorme el día uno del dominio nuevoRampa gradual40 vistas el día del registroBot

Por qué una sola señal miente

“80% de rebote, tienen que ser todos bots, ¿no?” No tan rápido.

  • Solo duración: una lectora que abre tu post en una pestaña y se va a almorzar acumula 30+ minutos. Indistinguible de “muy involucrada” o “pestaña abandonada”.
  • Solo tasa de rebote: una página que responde perfectamente la pregunta recibe 100% de rebote de humanos satisfechos. Excelencia y bots dan el mismo número.
  • Solo geografía: un tweet viral fuera del país legítimamente produce tráfico multi-país. Débil por sí sola.

Solo tienes derecho a decir “bot” con confianza cuando las cinco señales apuntan al mismo lado a la vez.

La distribución bimodal fue la evidencia definitiva

La razón real por la que en kaoriq el veredicto se sostuvo es la forma de la distribución de duración.

  • Japón: 5 sesiones / 751 s promedio
  • Todo lo demás: 0-5 s

Si el tráfico fuera genuinamente humano, la duración de sesión debería distribuirse más uniformemente en la banda de 20 a 120 segundos: “rebotó tras el título (10s)”, “leyó la introducción (40s)”, “llegó hasta el final (180s)” formando un gradiente.

Pero la distribución de kaoriq es bimodal, con el medio vacío. La lectura honesta es que solo existen “yo (sesiones largas, probando el sitio)” y “crawlers (salidas instantáneas)”. Nada entre medio.

Al contrario, una distribución sana se vería como “Japón 100 sesiones / 60s, Estados Unidos 50 sesiones / 45s, Canadá 20 sesiones / 30s”: las duraciones se distribuyen normalmente. Esa sería una firma de tráfico humano real.

Entonces, ¿cuántos humanos reales había?

Después de todo el cruce de señales, mi estimación se desglosa así:

CategoríaSesiones estimadasNotas
Yo, probando el sitio4-5La mayoría de las 5 sesiones de Japón, fuente del promedio de 751s
Crawlers (Googlebot / Bingbot / GPTBot / ClaudeBot / AhrefsBot, etc.)27-30Las 17 de US, más las filas de Europa y Asia con cero segundos
Tráfico humano orgánico real2-5El resto de Japón y un par de sesiones de US

De 37 sesiones, como máximo 5 eran humanos reales. Esa es la realidad de la primera semana de un dominio nuevo.

Por qué GA4 no filtra esto por ti

GA4 tiene una exclusión automática de “bots y arañas conocidos” basada en la lista IAB/ABC Spiders & Bots. Atrapa los crawlers clásicos, pero se le escapan:

  • Crawlers que ejecutan JavaScript: GPTBot, ClaudeBot, PerplexityBot. Estos crawlers de IA generativa nuevos ejecutan JS, así que la etiqueta de GA4 se dispara.
  • Crawlers de herramientas SEO: AhrefsBot, SemrushBot, MozBot. Alta frecuencia, y aparecen en enjambre sobre dominios nuevos apenas los descubren.
  • Scrapers con navegador headless: bots hechos a medida con Puppeteer o Playwright son indistinguibles de una sesión de Chrome real.

La semana siguiente al registro de un dominio nuevo es cuando este ejército de crawlers descubre la nueva IP. Se calma en 7-10 días conforme se propaga el DNS. Pero si tomas los datos de la primera semana al pie de la letra, terminarás tomando malas decisiones.

3 anotaciones que todo dashboard de proyecto nuevo necesita

  1. Usa “Sesiones con interacción” como tu métrica principal. GA4 define una sesión con interacción como: ≥10s de duración, o ≥2 páginas vistas, o un evento de conversión. La mayoría del ejército de bots queda filtrada aquí.
  2. Siempre mira la duración de sesión segmentada por país. Mirar cualquier métrica única (sesiones, vistas) sin el filtro geográfico le permite al ejército de crawlers hacerse pasar por éxito.
  3. Trata los primeros 30 días como una “fase de ruido”. Los números reales aparecen recién cuando los canales sociales, el SEO y la profundidad de contenido se alinean.

Cierre: mira tu propio GA4 con este lente

El GA4 de un dominio nuevo miente durante la primera o segunda semana. Si tu desglose por país está lleno de sesiones de cero segundos desde Estados Unidos, Europa del Este y el sudeste asiático, ese es el desfile de crawlers, no humanos enamorándose de tu contenido.

El procedimiento es simple: cruza con cinco señales, sospecha de distribuciones bimodales, cambia la métrica principal a Sesiones con interacción. Hacer esto te salva de que los datos tempranos te lleven a decisiones equivocadas.

Dudar de GA4 es, al final, una disciplina para no cometer errores caros. Cruza los datos antes de que los datos te crucen a ti.


Este post está basado en datos reales

  • Sitio: kaoriq.com (dominio registrado el 2026-05-02, construido con Astro v6 + Tailwind v4)
  • Período analizado: 2026-04-22 → 2026-05-05 (4 días de actividad real)
  • Fuente de datos: GA4 Data API v1beta vía Service Account
  • Herramienta: mi propio harness-ops/tools/ga4/analyze.py

ken imoto · WebRTC & Voice AI engineer · kenimoto.dev