Mapa del sitio gratuito

Sitemap Visualiser

El Sitemap Visualiser de scaile lee el robots.txt de un sitio web y todos los sitemaps que hay detrás, hasta 25 000 URLs, y dibuja su estructura como un mapa de clusters en unos segundos. Gratis, sin cuenta y sin dirección de correo.

  • Se ve en segundos
  • Sin cuenta
  • Gratis

40+ empresas nos eligen

Axel Springer
BILD Reisen
beurer
Impossible Cloud
Parto
Lyceum
TUM Venture Labs
Hey Honey
Building Radar
LipoCheck
Braun & Kollegen
ROPEX

Qué incluye el informe

Un rastreo contrastado con el sitemap publicado, y no una lectura del archivo que ya existe.

El informe del Sitemap Visualiser: una portada que mapea 4182 URLs de nextsure.de, delante de una página con lo que cada rastreador de IA puede descargar.

Tu estructura dibujada, dos veces

Tus clusters de contenido en esta página en segundos, y la misma imagen como página dos del informe, con cada sección del tamaño que le dan sus URLs, sombreada según cuántas se pudieron leer, y un perfil de a qué distancia quedan tus páginas de la página de inicio.

A qué llega cada rastreador de IA

Las reglas de tu robots.txt aplicadas ruta por ruta a GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, Google-Extended y CCBot. Bloquear a uno de estos es la forma más silenciosa de desaparecer de las respuestas de IA.

Dónde no coinciden el sitemap y el sitio web

Páginas listadas que ya no existen, páginas enlazadas que nunca se listan y páginas sin ninguna ruta de entrada desde lo que rastreamos. Cada una con el número de URLs a las que afecta.

Cómo funciona el Sitemap Visualiser

Leemos tu robots.txt y todos los sitemaps que hay detrás, siguiendo un índice hasta sus hijos, incluidos los comprimidos, hasta 25 000 URLs, y dibujamos tu estructura en esta página. Sin cuenta, sin correo y sin esperar.

Desde tu página de inicio hacia afuera siguiendo enlaces reales, hasta 400 páginas y cinco niveles de profundidad, respetando por el camino las reglas de tu propio robots.txt.

Las reglas de tu robots.txt aplicadas ruta por ruta y rastreador por rastreador, con la regla de coincidencia más larga que siguen los rastreadores reales, de modo que un allow dentro de una carpeta bloqueada se lea como ellos lo leen.

Ese es el único momento en que hace falta un correo, y el único momento en que se rastrea algo. La puntuación, el mapa, el acceso de cada rastreador y las URLs que necesitan atención, en un PDF que llega a tu correo unos minutos después.

Qué lee el mapa y qué no puede leer

El dibujo de esta página sale de archivos que descargamos, no de un rastreo. Nada sobre tus páginas se infiere hasta que se pide el informe.

Lo que se ejecuta en esta página

  • Tu robots.txt y todos los sitemaps a los que apunta, incluidos los índices de sitemap y los archivos comprimidos.
  • Hasta 25 000 URLs, agrupadas en las secciones que tu empresa publica de verdad.
  • A cuáles de los seis rastreadores de IA les da acceso cada regla del robots.txt, ruta por ruta.
  • Ningún rastreo. En esta fase no se pide nada a tus páginas.

Lo que aquí no alcanza a ver

  • Las páginas que no aparecen en ningún sitemap. Si el sitemap es parcial, el dibujo también lo es.
  • Si una URL listada todavía responde.
  • Cómo se enlazan las páginas entre sí, que es una estructura distinta de la que declara un sitemap.
  • Cualquier cosa alojada en un entorno de staging o protegido con contraseña.

Lo que añade el informe completo

  • Un rastreo real desde tu página de inicio hacia afuera, hasta 400 páginas y cinco niveles de profundidad.
  • Páginas listadas que ya no existen, y páginas enlazadas que nunca se listan.
  • Páginas sin ninguna ruta de entrada desde lo que rastreamos.
  • Una puntuación con sus cuatro partes impresas, para que se pueda recalcular a mano.

La estructura de un sitio web y los rastreadores de IA, en términos simples

Qué muestra el mapa, y por qué la forma de un sitio web decide cuánto de él se llega a leer.

¿Qué es un visualizador de sitemap?

Un visualizador de sitemap convierte el archivo XML que un sitio web publica para los buscadores en una imagen que una persona puede leer. El XML enumera las URLs en una lista plana: útil para una máquina, inútil para quien intenta ver cómo está organizado el sitio web. Dibujarlo agrupa las URLs por segmento de ruta, así que las secciones que de verdad existen (productos, blog, soporte) aparecen como clusters cuyo tamaño depende de cuántas páginas contienen. La imagen sirve para detectar la diferencia entre el sitio web que se cree tener y el que se publica.

¿Por qué importa la estructura del sitio web para la búsqueda con IA?

Un asistente que responde una pregunta no lee el sitio web entero. Lee las páginas a las que llega y juzga cada una casi por separado. La estructura decide cuáles son: una página a cinco clics de la página de inicio, en una sección sin página de entrada por encima, se alcanza tarde o no se alcanza. La profundidad y la cobertura por sección son las dos cosas que este mapa hace visibles, y son las dos que más veces explican por qué una página bien escrita nunca se cita.

¿Qué rastreadores de IA leen sitemaps y qué cuesta bloquear a uno?

Importan seis rastreadores. GPTBot y ClaudeBot recogen datos de entrenamiento: bloquearlos es una decisión editorial real, que tiene un precio real, pero defendible. OAI-SearchBot y PerplexityBot descargan páginas para poder citarlas en una respuesta que alguien lee ahora mismo; bloquear a esos dos borra a tu empresa de las respuestas en vivo, que es otra decisión y casi nunca la buscada. Google-Extended decide si tu contenido alimenta a Gemini y a los AI Overviews. CCBot alimenta Common Crawl. El mapa muestra los seis con lo que cada uno puede descargar de tu sitio web.

¿Qué es un índice de sitemap y por qué los sitios web grandes tienen varios archivos?

El protocolo de sitemaps limita cada archivo a 50 000 URLs y 50 MB sin comprimir. Los sitios web más grandes reparten sus URLs entre varios archivos y publican un índice de sitemap (un sitemap de sitemaps), que es lo que señala el robots.txt. Esta herramienta sigue el índice hasta sus hijos, incluidos los comprimidos, y cuenta los archivos que leyó, un dato que vale la pena mirar: un sitio web que publica seis archivos de sitemap pero solo lista tres en su índice está escondiendo la mitad de sí mismo.

¿Un sitemap visual es lo mismo que un generador de sitemaps?

No, y la diferencia importa a la hora de elegir herramienta. Un generador crea el archivo XML que se publica, normalmente para un sitio web que todavía no lo tiene. Un visualizador lee el archivo que ya está publicado y lo dibuja. Esta herramienta es del segundo tipo: nunca escribe nada en tu sitio web y nunca pide acceso a él. Si no hay ningún sitemap, el dibujo queda vacío, y esa ausencia ya es el hallazgo.

Método revisado por última vez el Revisión a cargo de Simon Wilhelm, cofundador y CEO de scaile.

Alan Zettelmann, Partner oficial
Alan ZettelmannPartner oficial

Otras herramientas gratuitas

Las demás también funcionan por su cuenta. Sin registro, sin tarjeta de crédito y sin necesidad de una llamada.

Preguntas frecuentes

¿Hace falta más detalle? Reservar una llamada

¿Hace falta una cuenta?

No. La herramienta es gratuita y no requiere registro.

¿Cuánto tarda?

Unos minutos. El rastreo en sí suele terminar en menos de un minuto; el informe llega como PDF en cuanto queda renderizado.

¿Cuánto de mi sitio web leen realmente?

Tus sitemaps completos, hasta 25 000 URLs, más un rastreo de hasta 400 páginas. En un sitio web más grande que eso el rastreo es una muestra, y el informe lo dice en lugar de dar a entender que lo leyó todo: lo que no se pudo medir bien queda fuera de la puntuación en vez de estimarse.

¿Qué es la puntuación?

Cuatro partes, ponderadas e impresas en el informe para que se puedan recalcular: cuántas de las páginas solicitadas respondieron y se pudieron leer (40 %), a qué distancia queda de la página de inicio la página mediana (20 %), cuánto de lo rastreado aparece listado en tu sitemap (20 %) y cuánto de tu sitio web pueden descargar los rastreadores de IA (20 %). Ningún modelo valora nada, así que el mismo sitio web obtiene siempre la misma puntuación.

¿Se puede mapear a un competidor?

Sí. La herramienta funciona sobre cualquier sitio web accesible públicamente, y respeta el robots.txt de ese sitio web exactamente igual que el de tu empresa.

¿Funciona sobre un entorno de staging?

No. Los entornos protegidos con contraseña y los de staging no se pueden rastrear.

¿Es lo mismo que el Health Check?

No. El Health Check puntúa si tus páginas están construidas para ser citadas. Esta hace la pregunta que hay debajo: si un rastreador puede siquiera llegar a ellas, y qué encuentra cuando llega.