Usamos cookies e tecnologias semelhantes para entender como nosso site é usado e para mostrar a agenda de reuniões na página de contato. Você pode mudar suas preferências quando quiser.
Guarda apenas a sua escolha neste aviso, para não perguntar de novo a cada página.
Detalhes
scaile-consent — sua escolha, o momento em que ela foi feita e a versão deste aviso. Fica no armazenamento local do navegador, não em um cookie. É mantido por 180 dias e depois perguntamos de novo. Não contém nenhum identificador.
Análise
Ajuda a entender quais páginas são lidas e de onde vêm as visitas.
Detalhes
Google Analytics 4 — Google Ireland Limited. Cookies _ga e _ga_6X7LPM6SQ8, por até 24 meses. Os dados são processados nos Estados Unidos. Os endereços IP são truncados antes de serem armazenados; o Google Signals e os recursos de publicidade estão desligados, então nenhum perfil publicitário é criado.
Rybbit — medição de alcance que operamos nós mesmos, em servidores na Alemanha. Sem cookies, mas com um identificador gerado aleatoriamente (rybbit-visitor-id) no armazenamento local do navegador, que fica até você apagá-lo. Sem gravação de sessão e sem captura de formulários.
Mídia externa
Carrega a agenda de reuniões na nossa página de contato.
Detalhes
Cal.com — Cal.com, Inc., Estados Unidos. Ao carregar a agenda, seu endereço IP e dados do navegador e do dispositivo são transmitidos à Cal.com, que também pode guardar identificadores no seu dispositivo. Sem isso, a página de contato mostra um espaço reservado com um link direto, e você sempre pode falar com a gente por e-mail.
O Sitemap Visualiser da scaile lê o robots.txt de um site e todos os sitemaps por trás dele, até 25.000 URLs, e desenha a estrutura do site como um mapa de clusters em poucos segundos. Gratuito, sem cadastro, sem endereço de e-mail.
Lendo o sitemap de …
Alguns segundos. Estamos lendo seu robots.txt e todos os sitemaps por trás dele.
É assim que a IA enxerga seu site
Seções
O que cada rastreador de IA pode acessar
Iniciando o rastreamento completo de …
Um momento. Estamos começando o rastreamento por trás do seu relatório.
Estamos rastreando seu site
O relatório chega ao seu e-mail em alguns minutos: estes clusters, o que cada rastreador de IA pode acessar, cada seção com sua cobertura e as URLs que precisam de atenção. Quer que a gente percorra os achados com você?
Um rastreamento confrontado com o sitemap que você publica, e não uma leitura do arquivo que já existe.
Sua estrutura desenhada, duas vezes
Seus clusters de conteúdo nesta página em segundos, e a mesma imagem como página dois do relatório, com cada seção dimensionada pelo número de URLs, sombreada conforme quantas voltaram legíveis, e um perfil de quão longe suas páginas ficam da página inicial.
O que cada rastreador de IA alcança
As regras do seu robots.txt aplicadas caminho por caminho a GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, Google-Extended e CCBot. Bloquear um deles é o jeito mais silencioso de sumir das respostas de IA.
Onde o sitemap e o site discordam
Páginas listadas que não existem mais, páginas linkadas que nunca são listadas e páginas sem nenhuma rota de entrada a partir do que rastreamos. Cada uma com o número de URLs afetadas.
Como funciona o Sitemap Visualiser
Lemos seu robots.txt e todos os sitemaps por trás dele, seguindo um índice até seus filhos, inclusive os compactados, até 25.000 URLs, e desenhamos sua estrutura nesta página. Sem cadastro, sem e-mail e sem espera.
Da sua página inicial para fora seguindo links reais, até 400 páginas e cinco níveis de profundidade, respeitando no caminho as regras do seu próprio robots.txt.
As regras do seu robots.txt aplicadas caminho por caminho e rastreador por rastreador, com a regra de correspondência mais longa que os rastreadores reais seguem, de modo que um Allow dentro de uma pasta bloqueada seja lido do jeito que eles leem.
É o único momento em que um e-mail é necessário, e o único momento em que algo é rastreado. A pontuação, o mapa, o acesso de cada rastreador e as URLs que precisam de atenção, em um PDF no seu e-mail alguns minutos depois.
O que o mapa lê, e o que ele não alcança
O desenho desta página vem de arquivos que buscamos, não de um rastreamento. Nada sobre suas páginas é deduzido antes de você pedir o relatório.
01
O que roda nesta página
Seu robots.txt e todos os sitemaps para os quais ele aponta, inclusive índices de sitemap e arquivos compactados.
Até 25.000 URLs, agrupadas nas seções que você de fato publica.
Quais dos seis rastreadores de IA cada regra do robots.txt libera, caminho por caminho.
Nenhum rastreamento. Nada é pedido às suas páginas nesta etapa.
02
O que não dá para ver aqui
Páginas que não estão em nenhum sitemap. Se o seu é parcial, o desenho também é.
Se uma URL listada ainda responde.
Como as páginas se ligam entre si, que é uma estrutura diferente da que um sitemap declara.
Qualquer coisa em ambiente de staging ou protegido por senha.
03
O que o relatório completo acrescenta
Um rastreamento de verdade, da sua página inicial para fora, até 400 páginas e cinco níveis de profundidade.
Páginas listadas que não existem mais, e páginas linkadas que nunca são listadas.
Páginas sem nenhuma rota de entrada a partir do que rastreamos.
Uma pontuação com as quatro partes impressas, para você mesmo refazer a conta.
Estrutura de site e rastreadores de IA, em termos simples
O que o mapa mostra, e por que o formato de um site decide quanto dele é lido.
O que é um visualizador de sitemap?
Um visualizador de sitemap transforma o arquivo XML que um site publica para os buscadores em uma imagem que uma pessoa consegue ler. O XML traz cada URL numa lista plana, o que serve a uma máquina e não serve a ninguém que queira enxergar como o site está organizado. Desenhar esse arquivo agrupa as URLs por segmento de caminho, então as seções que você realmente mantém (produtos, blog, suporte) aparecem como clusters dimensionados pelo número de páginas em cada uma. A imagem serve para achar o descompasso entre o site que você acha que tem e o site que você publica.
Por que a estrutura do site importa para a busca com IA?
Um assistente que responde a uma pergunta não lê seu site inteiro. Ele lê as páginas que consegue alcançar e julga cada uma quase isoladamente. A estrutura decide quais são essas páginas: uma que fica a cinco cliques da inicial, numa seção sem página de entrada acima dela, é alcançada tarde ou nunca. Profundidade e cobertura por seção são as duas coisas que este mapa torna visíveis, e são as duas que mais explicam por que um texto bem escrito nunca é citado.
Quais rastreadores de IA leem sitemaps, e quanto custa bloquear um deles?
Seis user agents importam. GPTBot e ClaudeBot coletam dados de treinamento; bloqueá-los é uma escolha editorial de verdade, com custo real, mas defensável. OAI-SearchBot e PerplexityBot buscam páginas para que elas possam ser citadas numa resposta que alguém está lendo agora; bloquear esses tira você dessas respostas, o que é outra decisão e quase nunca a pretendida. Google-Extended decide sobre o Gemini e as AI Overviews. CCBot alimenta o Common Crawl. O mapa mostra os seis, com o que cada um pode acessar no seu site.
O que é um índice de sitemap, e por que sites grandes têm vários arquivos?
O protocolo de sitemap limita um único arquivo a 50.000 URLs e 50 MB sem compactação. Sites maiores dividem suas URLs em vários arquivos e publicam um índice de sitemap (um sitemap de sitemaps), que é para onde o robots.txt aponta. Esta ferramenta segue o índice até seus filhos, inclusive os compactados, e conta quantos arquivos leu, o que vale conferir: quem publica seis arquivos de sitemap mas lista só três no índice está escondendo metade de si mesmo em silêncio.
Um sitemap visual é a mesma coisa que um gerador de sitemap?
Não, e a diferença importa na hora de escolher uma ferramenta. Um gerador cria o arquivo XML que você publica, normalmente para um site que ainda não tem nenhum. Um visualizador lê o arquivo já publicado e o desenha. Esta ferramenta é do segundo tipo: nunca escreve nada no seu site e nunca pede acesso a ele. Se não houver sitemap algum, o desenho vem vazio, e essa ausência já é o achado.
Método revisado pela última vez em ·Revisado por Simon Wilhelm, cofundador e CEO da scaile.
Não. A ferramenta é gratuita e não exige cadastro.
Quanto tempo leva?
Alguns minutos. O rastreamento em si costuma terminar em menos de um minuto; o relatório chega como PDF assim que fica pronto.
Quanto do meu site vocês leem de fato?
Seus sitemaps inteiros, até 25.000 URLs, mais um rastreamento de até 400 páginas. Em um site maior que isso o rastreamento é uma amostra, e o relatório diz isso em vez de dar a entender que leu tudo: o que não deu para medir direito fica fora da pontuação em vez de ser estimado.
O que é a pontuação?
Quatro partes, ponderadas e impressas no relatório para você refazer a conta: quantas das páginas solicitadas voltaram legíveis (40%), quão longe da página inicial fica a página mediana (20%), quanto do que foi rastreado aparece listado no seu sitemap (20%) e quanto do seu site os rastreadores de IA podem acessar (20%). Nenhum modelo avalia nada, então o mesmo site recebe sempre a mesma pontuação.
Dá para mapear um concorrente?
Dá. A ferramenta funciona em qualquer site acessível publicamente, e respeita o robots.txt daquele site exatamente como respeita o seu.
Funciona em um ambiente de staging?
Não. Ambientes protegidos por senha e de staging não podem ser rastreados.
É a mesma coisa que o Health Check?
Não. O Health Check pontua se suas páginas foram construídas para serem citadas. Esta faz a pergunta que vem antes: um rastreador consegue chegar até elas, e o que encontra quando chega.