Kostenlose Sitemap-Karte

Sitemap Visualiser

Der scaile Sitemap Visualiser liest die robots.txt einer Website und jede Sitemap dahinter, bis zu 25.000 URLs, und zeichnet die Struktur der Website in wenigen Sekunden als Cluster-Karte. Kostenlos, ohne Konto, ohne E-Mail-Adresse.

  • In Sekunden sichtbar
  • Ohne Anmeldung
  • Kostenlos

40+ Unternehmen vertrauen scaile

Axel Springer
BILD Reisen
beurer
Impossible Cloud
Parto
Lyceum
TUM Venture Labs
Hey Honey
Building Radar
LipoCheck
Braun & Kollegen
ROPEX

Das erhalten Sie

Ein Crawl, abgeglichen mit der Sitemap, die Sie veröffentlichen. Keine Wiedergabe der Datei, die Sie ohnehin haben.

Der Report des Sitemap Visualiser: eine Titelseite mit 4.182 erfassten URLs für nextsure.de, davor eine Seite mit den Zugriffsrechten jedes KI-Crawlers.

Ihre Struktur, zweimal gezeichnet

Ihre Content-Cluster in Sekunden auf dieser Seite und dasselbe Bild als Seite zwei des Reports. Dazu jeder Bereich in der Größe seiner URL-Anzahl, eingefärbt danach, wie viele lesbar zurückkamen, und ein Profil, wie weit Ihre Seiten von der Startseite entfernt liegen.

Was jeder KI-Crawler erreicht

Ihre robots.txt-Regeln, Pfad für Pfad angewandt auf GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, Google-Extended und CCBot. Einen davon zu blockieren ist der unauffälligste Weg, aus KI-Antworten zu verschwinden.

Wo Sitemap und Website auseinandergehen

Seiten, die Sie listen und die es nicht mehr gibt, Seiten, die Sie verlinken und nie listen, und Seiten, zu denen aus unserem Crawl kein Weg führt. Jeweils mit der Zahl der betroffenen URLs.

So funktioniert der Sitemap Visualiser

Wir lesen Ihre robots.txt und jede Sitemap dahinter. Einem Sitemap-Index folgen wir bis zu den darin verlinkten Dateien, auch zu gzip-komprimierten, bis zu 25.000 URLs. Ihre Struktur zeichnen wir direkt auf dieser Seite, ohne Anmeldung, ohne E-Mail, ohne Wartezeit.

Von Ihrer Startseite aus über echte Links, bis zu 400 Seiten und fünf Ebenen tief, unter Beachtung Ihrer eigenen robots.txt-Regeln.

Ihre robots.txt-Regeln, Pfad für Pfad und pro Crawler angewandt, nach der Longest-Match-Regel, der die echten Crawler folgen. Ein Allow innerhalb eines gesperrten Ordners wird also so gelesen, wie sie es lesen.

Erst dann wird eine E-Mail gebraucht, und erst dann wird überhaupt gecrawlt. Der Score, die Karte, der Zugriff jedes Crawlers und die URLs, die Aufmerksamkeit brauchen, als PDF in Ihrem Postfach, wenige Minuten später.

Was die Karte liest, und was nicht

Die Zeichnung auf dieser Seite stammt aus Dateien, die wir abgerufen haben, nicht aus einem Crawl. Über Ihre Seiten selbst wird nichts hergeleitet, solange Sie den Report nicht anfordern.

Was auf dieser Seite läuft

  • Ihre robots.txt und jede Sitemap, auf die sie zeigt, einschließlich Sitemap-Indizes und gzip-komprimierter Dateien.
  • Bis zu 25.000 URLs, gruppiert nach den Bereichen, die Sie tatsächlich veröffentlichen.
  • Welchen der sechs KI-Crawler jede robots.txt-Regel zulässt, Pfad für Pfad.
  • Kein Crawl. Von Ihren Seiten selbst wird in diesem Schritt nichts abgerufen.

Was hier nicht sichtbar ist

  • Seiten, die in keiner Sitemap stehen. Ist Ihre Sitemap unvollständig, ist es diese Zeichnung auch.
  • Ob eine gelistete URL noch erreichbar ist.
  • Wie die Seiten untereinander verlinkt sind, denn das ist eine andere Struktur als die, die eine Sitemap behauptet.
  • Alles auf einer Staging-Umgebung oder hinter einem Passwortschutz.

Was der vollständige Report ergänzt

  • Einen echten Crawl von Ihrer Startseite aus, bis zu 400 Seiten und fünf Ebenen tief.
  • Seiten, die Sie listen und die es nicht mehr gibt, und Seiten, die Sie verlinken und nie listen.
  • Seiten, zu denen aus unserem Crawl kein Weg führt.
  • Einen Score mit allen vier Bestandteilen, sodass Sie ihn selbst nachrechnen können.

Website-Struktur und KI-Crawler, in klaren Worten

Was die Karte zeigt, und warum die Form einer Website darüber entscheidet, wie viel davon gelesen wird.

Was ist ein Sitemap Visualiser?

Ein Sitemap Visualiser macht aus der XML-Sitemap, die eine Website für Suchmaschinen veröffentlicht, ein Bild, das ein Mensch lesen kann. Das XML listet jede URL flach untereinander, was für eine Maschine nützlich und für jeden nutzlos ist, der sehen will, wie eine Website aufgebaut ist. Beim Zeichnen werden die URLs nach Pfadsegment gruppiert, sodass die Bereiche, die Sie wirklich betreiben, also Produkte, Blog, Support, als Cluster in der Größe ihrer Seitenzahl erscheinen. Der Zweck des Bildes ist der Abgleich: die Website, die Sie zu haben glauben, gegen die, die Sie veröffentlichen.

Warum ist die Website-Struktur für die KI-Suche wichtig?

Ein Assistent, der eine Frage beantwortet, liest nicht Ihre ganze Website. Er liest die Seiten, die er erreicht, und beurteilt jede weitgehend für sich. Die Struktur entscheidet, welche Seiten das sind: Eine Seite, die fünf Klicks von der Startseite entfernt in einem Bereich ohne eigene Übersichtsseite liegt, wird spät erreicht oder gar nicht. Tiefe und Bereichsabdeckung sind die beiden Dinge, die diese Karte sichtbar macht, und sie erklären am häufigsten, warum eine gut geschriebene Seite nie zitiert wird.

Welche KI-Crawler lesen Sitemaps, und was kostet es, einen zu sperren?

Sechs User-Agents sind relevant. GPTBot und ClaudeBot sammeln Trainingsdaten; sie zu sperren, ist eine echte redaktionelle Entscheidung mit echten Kosten, aber sie ist vertretbar. OAI-SearchBot und PerplexityBot holen Seiten, damit sie in einer Antwort zitiert werden können, die gerade jemand liest; wer diese sperrt, verschwindet aus laufenden Antworten, und das ist eine andere Entscheidung, die fast nie so gemeint war. Google-Extended steuert Gemini und die AI Overviews. CCBot speist Common Crawl. Die Karte zeigt alle sechs mit dem, was jeder einzelne auf Ihrer Website abrufen darf.

Was ist ein Sitemap-Index, und warum haben große Websites mehrere Dateien?

Das Sitemap-Protokoll begrenzt eine einzelne Datei auf 50.000 URLs und 50 MB unkomprimiert. Größere Websites verteilen ihre URLs auf mehrere Sitemap-Dateien und veröffentlichen einen Sitemap-Index, also eine Sitemap der Sitemaps, auf die dann die robots.txt zeigt. Dieses Tool folgt einem Index bis zu den untergeordneten Dateien, auch gzip-komprimierten, und zählt die gelesenen Dateien mit. Das lohnt einen Blick: Eine Website, die sechs Sitemap-Dateien veröffentlicht, im Index aber nur drei nennt, versteckt stillschweigend die Hälfte von sich.

Ist eine visuelle Sitemap dasselbe wie ein Sitemap-Generator?

Nein, und der Unterschied entscheidet die Wahl des Tools. Ein Sitemap-Generator erzeugt die XML-Datei, die Sie veröffentlichen, meist für eine Website, die noch keine hat. Ein Visualiser liest die Datei, die Sie bereits veröffentlichen, und zeichnet sie. Dieses Tool ist das Zweite: Es schreibt nichts auf Ihre Website und verlangt keinen Zugang zu ihr. Wenn Sie gar keine Sitemap haben, bleibt die Zeichnung leer, und genau dieses Fehlen ist dann der Befund.

Methodik zuletzt geprüft am Fachlich geprüft von Simon Wilhelm, Co-Founder und CEO von scaile.

Simon, Co-Founder und CEO
SimonCo-Founder und CEO

Lücken gefunden, mit denen Sie nicht gerechnet haben?

Weitere kostenlose Tools

Die anderen laufen ebenfalls für sich. Ohne Registrierung, ohne Kreditkarte, ohne Gespräch.

Häufig gestellte Fragen

Sie brauchen mehr Details? Gespräch buchen

Brauche ich ein Konto?

Nein. Das Tool ist kostenlos und erfordert keine Anmeldung.

Wie lange dauert das?

Wenige Minuten. Der Crawl selbst ist meist in unter einer Minute fertig, der Report erreicht Sie als PDF, sobald er gerendert ist.

Wie viel meiner Website lesen Sie wirklich?

Ihre Sitemaps vollständig, bis zu 25.000 URLs, dazu einen Crawl von bis zu 400 Seiten. Bei einer größeren Website ist der Crawl eine Stichprobe, und der Report sagt das auch so, statt vollständige Abdeckung zu suggerieren. Was wir nicht sauber messen konnten, fließt nicht in den Score ein, statt geschätzt zu werden.

Was ist der Score?

Vier gewichtete Teile, die im Report stehen, damit Sie sie nachrechnen können: wie viele der angefragten Seiten lesbar zurückkamen (40 Prozent), wie weit die mittlere Seite von Ihrer Startseite entfernt liegt (20 Prozent), wie viel des Gecrawlten in Ihrer Sitemap steht (20 Prozent) und wie viel Ihrer Website die KI-Crawler abrufen dürfen (20 Prozent). Kein Modell bewertet etwas, dieselbe Website bekommt also immer denselben Score.

Kann ich einen Wettbewerber prüfen?

Ja. Das Tool funktioniert mit jeder öffentlich erreichbaren Website und beachtet deren robots.txt genauso wie Ihre.

Funktioniert das auf einer Staging-Seite?

Nein. Passwortgeschützte und Staging-Umgebungen lassen sich nicht crawlen.

Ist das dasselbe wie der Health Check?

Nein. Der Health Check bewertet, ob Ihre Seiten so gebaut sind, dass sie zitiert werden können. Dieses Tool stellt die Frage darunter: Kommt ein Crawler überhaupt hin, und was findet er dort vor?