Usamos cookies y tecnologías similares para entender cómo se usa nuestro sitio web y para mostrar el calendario de reservas en la página de contacto. Las preferencias se pueden cambiar en cualquier momento.
Guarda únicamente la elección hecha en este aviso, para no volver a preguntar en cada página.
Detalles
scaile-consent — la elección, el momento en que se dio y la versión de este aviso. Se guarda en el almacenamiento local del navegador, no en una cookie. Se conserva 180 días y después se vuelve a preguntar. No contiene ningún identificador.
Analítica
Nos ayuda a entender qué páginas se leen y de dónde vienen las visitas.
Detalles
Google Analytics 4 — Google Ireland Limited. Cookies _ga y _ga_6X7LPM6SQ8, hasta 24 meses. Los datos se procesan en Estados Unidos. Las direcciones IP se truncan antes de almacenarse; Google Signals y las funciones publicitarias están desactivadas, así que no se construyen perfiles publicitarios.
Rybbit — medición de alcance que operamos nosotros mismos en servidores en Alemania. Sin cookies, pero con un identificador generado al azar (rybbit-visitor-id) en el almacenamiento local del navegador, que permanece hasta que se borre. Sin grabación de sesión y sin captura de formularios.
Medios externos
Carga el calendario de reservas en nuestra página de contacto.
Detalles
Cal.com — Cal.com, Inc., Estados Unidos. Al cargar el calendario se transmiten a Cal.com la dirección IP y datos del navegador y del dispositivo, y se le permite guardar identificadores en el dispositivo. Sin esto, la página de contacto muestra un marcador con un enlace directo, y siempre queda la opción de escribirnos por correo.
El Sitemap Visualiser de scaile lee el robots.txt de un sitio web y todos los sitemaps que hay detrás, hasta 25 000 URLs, y dibuja su estructura como un mapa de clusters en unos segundos. Gratis, sin cuenta y sin dirección de correo.
Leyendo el sitemap de …
Unos segundos. Estamos leyendo tu robots.txt y todos los sitemaps que hay detrás.
Así ve la IA tu sitio web
Secciones
Qué puede descargar cada rastreador de IA
Iniciando el rastreo completo de …
Un momento. Estamos arrancando el rastreo que hay detrás de tu informe.
Estamos rastreando tu sitio web
El informe llega a tu correo en unos minutos: estos clusters, qué puede descargar cada rastreador de IA, cada sección con su cobertura y las URLs que necesitan atención. ¿Repasamos juntos los hallazgos?
Un rastreo contrastado con el sitemap publicado, y no una lectura del archivo que ya existe.
Tu estructura dibujada, dos veces
Tus clusters de contenido en esta página en segundos, y la misma imagen como página dos del informe, con cada sección del tamaño que le dan sus URLs, sombreada según cuántas se pudieron leer, y un perfil de a qué distancia quedan tus páginas de la página de inicio.
A qué llega cada rastreador de IA
Las reglas de tu robots.txt aplicadas ruta por ruta a GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, Google-Extended y CCBot. Bloquear a uno de estos es la forma más silenciosa de desaparecer de las respuestas de IA.
Dónde no coinciden el sitemap y el sitio web
Páginas listadas que ya no existen, páginas enlazadas que nunca se listan y páginas sin ninguna ruta de entrada desde lo que rastreamos. Cada una con el número de URLs a las que afecta.
Cómo funciona el Sitemap Visualiser
Leemos tu robots.txt y todos los sitemaps que hay detrás, siguiendo un índice hasta sus hijos, incluidos los comprimidos, hasta 25 000 URLs, y dibujamos tu estructura en esta página. Sin cuenta, sin correo y sin esperar.
Desde tu página de inicio hacia afuera siguiendo enlaces reales, hasta 400 páginas y cinco niveles de profundidad, respetando por el camino las reglas de tu propio robots.txt.
Las reglas de tu robots.txt aplicadas ruta por ruta y rastreador por rastreador, con la regla de coincidencia más larga que siguen los rastreadores reales, de modo que un allow dentro de una carpeta bloqueada se lea como ellos lo leen.
Ese es el único momento en que hace falta un correo, y el único momento en que se rastrea algo. La puntuación, el mapa, el acceso de cada rastreador y las URLs que necesitan atención, en un PDF que llega a tu correo unos minutos después.
Qué lee el mapa y qué no puede leer
El dibujo de esta página sale de archivos que descargamos, no de un rastreo. Nada sobre tus páginas se infiere hasta que se pide el informe.
01
Lo que se ejecuta en esta página
Tu robots.txt y todos los sitemaps a los que apunta, incluidos los índices de sitemap y los archivos comprimidos.
Hasta 25 000 URLs, agrupadas en las secciones que tu empresa publica de verdad.
A cuáles de los seis rastreadores de IA les da acceso cada regla del robots.txt, ruta por ruta.
Ningún rastreo. En esta fase no se pide nada a tus páginas.
02
Lo que aquí no alcanza a ver
Las páginas que no aparecen en ningún sitemap. Si el sitemap es parcial, el dibujo también lo es.
Si una URL listada todavía responde.
Cómo se enlazan las páginas entre sí, que es una estructura distinta de la que declara un sitemap.
Cualquier cosa alojada en un entorno de staging o protegido con contraseña.
03
Lo que añade el informe completo
Un rastreo real desde tu página de inicio hacia afuera, hasta 400 páginas y cinco niveles de profundidad.
Páginas listadas que ya no existen, y páginas enlazadas que nunca se listan.
Páginas sin ninguna ruta de entrada desde lo que rastreamos.
Una puntuación con sus cuatro partes impresas, para que se pueda recalcular a mano.
La estructura de un sitio web y los rastreadores de IA, en términos simples
Qué muestra el mapa, y por qué la forma de un sitio web decide cuánto de él se llega a leer.
¿Qué es un visualizador de sitemap?
Un visualizador de sitemap convierte el archivo XML que un sitio web publica para los buscadores en una imagen que una persona puede leer. El XML enumera las URLs en una lista plana: útil para una máquina, inútil para quien intenta ver cómo está organizado el sitio web. Dibujarlo agrupa las URLs por segmento de ruta, así que las secciones que de verdad existen (productos, blog, soporte) aparecen como clusters cuyo tamaño depende de cuántas páginas contienen. La imagen sirve para detectar la diferencia entre el sitio web que se cree tener y el que se publica.
¿Por qué importa la estructura del sitio web para la búsqueda con IA?
Un asistente que responde una pregunta no lee el sitio web entero. Lee las páginas a las que llega y juzga cada una casi por separado. La estructura decide cuáles son: una página a cinco clics de la página de inicio, en una sección sin página de entrada por encima, se alcanza tarde o no se alcanza. La profundidad y la cobertura por sección son las dos cosas que este mapa hace visibles, y son las dos que más veces explican por qué una página bien escrita nunca se cita.
¿Qué rastreadores de IA leen sitemaps y qué cuesta bloquear a uno?
Importan seis rastreadores. GPTBot y ClaudeBot recogen datos de entrenamiento: bloquearlos es una decisión editorial real, que tiene un precio real, pero defendible. OAI-SearchBot y PerplexityBot descargan páginas para poder citarlas en una respuesta que alguien lee ahora mismo; bloquear a esos dos borra a tu empresa de las respuestas en vivo, que es otra decisión y casi nunca la buscada. Google-Extended decide si tu contenido alimenta a Gemini y a los AI Overviews. CCBot alimenta Common Crawl. El mapa muestra los seis con lo que cada uno puede descargar de tu sitio web.
¿Qué es un índice de sitemap y por qué los sitios web grandes tienen varios archivos?
El protocolo de sitemaps limita cada archivo a 50 000 URLs y 50 MB sin comprimir. Los sitios web más grandes reparten sus URLs entre varios archivos y publican un índice de sitemap (un sitemap de sitemaps), que es lo que señala el robots.txt. Esta herramienta sigue el índice hasta sus hijos, incluidos los comprimidos, y cuenta los archivos que leyó, un dato que vale la pena mirar: un sitio web que publica seis archivos de sitemap pero solo lista tres en su índice está escondiendo la mitad de sí mismo.
¿Un sitemap visual es lo mismo que un generador de sitemaps?
No, y la diferencia importa a la hora de elegir herramienta. Un generador crea el archivo XML que se publica, normalmente para un sitio web que todavía no lo tiene. Un visualizador lee el archivo que ya está publicado y lo dibuja. Esta herramienta es del segundo tipo: nunca escribe nada en tu sitio web y nunca pide acceso a él. Si no hay ningún sitemap, el dibujo queda vacío, y esa ausencia ya es el hallazgo.
Método revisado por última vez el ·Revisión a cargo de Simon Wilhelm, cofundador y CEO de scaile.
No. La herramienta es gratuita y no requiere registro.
¿Cuánto tarda?
Unos minutos. El rastreo en sí suele terminar en menos de un minuto; el informe llega como PDF en cuanto queda renderizado.
¿Cuánto de mi sitio web leen realmente?
Tus sitemaps completos, hasta 25 000 URLs, más un rastreo de hasta 400 páginas. En un sitio web más grande que eso el rastreo es una muestra, y el informe lo dice en lugar de dar a entender que lo leyó todo: lo que no se pudo medir bien queda fuera de la puntuación en vez de estimarse.
¿Qué es la puntuación?
Cuatro partes, ponderadas e impresas en el informe para que se puedan recalcular: cuántas de las páginas solicitadas respondieron y se pudieron leer (40 %), a qué distancia queda de la página de inicio la página mediana (20 %), cuánto de lo rastreado aparece listado en tu sitemap (20 %) y cuánto de tu sitio web pueden descargar los rastreadores de IA (20 %). Ningún modelo valora nada, así que el mismo sitio web obtiene siempre la misma puntuación.
¿Se puede mapear a un competidor?
Sí. La herramienta funciona sobre cualquier sitio web accesible públicamente, y respeta el robots.txt de ese sitio web exactamente igual que el de tu empresa.
¿Funciona sobre un entorno de staging?
No. Los entornos protegidos con contraseña y los de staging no se pueden rastrear.
¿Es lo mismo que el Health Check?
No. El Health Check puntúa si tus páginas están construidas para ser citadas. Esta hace la pregunta que hay debajo: si un rastreador puede siquiera llegar a ellas, y qué encuentra cuando llega.