Vom ersten Crawl bis zum unterschriftsreifen Kundenbericht — jede Funktion läuft lokal, erklärbar und ohne Abo-Zwang.
Crawling
Website crawlen
Ein Spider im Stil von Screaming Frog: folgt Links bis zur gewünschten Tiefe, beachtet robots.txt und Crawl-delay, liest XML-Sitemaps, verfolgt Weiterleitungsketten vollständig und wertet jede Seite auf über achtzig Signale aus — Titel und Description samt Pixelbreite, Überschriften, Canonicals, Hreflang, strukturierte Daten, Bilder, interne Verlinkung, Antwortzeiten.
SEO
SEO prüfen
Über hundert Prüfungen, jede mit deutscher und englischer Erklärung, Handlungsempfehlung und Verweis auf die maßgebliche Dokumentation — von fehlenden Titeln über Weiterleitungsschleifen und Hreflang-Reziprozität bis zur Near-Duplicate-Erkennung per SimHash.
GEO
GEO prüfen
Kann eine KI-Antwortmaschine die Seite abrufen, zerlegen, belegen und zuordnen? Mit KI-Crawler-Übersicht und der entscheidenden Unterscheidung zwischen Training- und Antwort-Crawlern.
KI
Sprachmodelle befragen
OpenAI, Claude, Gemini, Mistral und Grok beurteilen gecrawlte Seiten — Titel, Suchintention, Zitierfähigkeit. Kosten stehen vor dem Start, ein Limit greift, der Token-Verbrauch wird ausgewiesen.
Migration
Umstellungen absichern
Vor und nach dem Relaunch: Bestand aus Crawl, Sitemap, Search Console oder site:-Abfrage erheben, alte URLs den neuen zuordnen, jede Weiterleitung bewerten und die Befunde mit den tatsächlichen Klicks der alten URL gewichten. Eine kaputte URL ohne Traffic steht unter einer kaputten mit tausend Klicks im Monat.
Migration
Testumgebung gegen Live stellen
Beide Umgebungen crawlen und Seite für Seite vergleichen. Verschobenes wird über neun Stufen abnehmender Sicherheit gefunden — vom byte-gleichen Quelltext bis zum gewachsenen Slug — und als fertige Serverkonfiguration ausgegeben: .htaccess, nginx oder web.config, Unsicheres auskommentiert.
Segmente
Nach Segmenten aufschlüsseln
Shop, Blog, Karriere: Aus „412 Seiten ohne Description“ wird die Frage, welcher Bereich betroffen ist. Was auf keine Definition passt, bleibt sichtbar unter „Ohne Segment“.
Sitemap
Sitemap erzeugen
Aus dem Crawl eine sitemap.xml: alle internen, indexierbaren Seiten mit Status 200, ab 50.000 URLs als Index. Ein lastmod wird bewusst nicht erfunden.
Sitemap
Sitemaps prüfen & vergleichen
Eine oder zwei Sitemaps — als URL oder Datei, ein Index samt aller Teile — auf alles prüfen, was in den Dateien steht: Protokoll und Grenzen, jede URL, lastmod, changefreq, priority, hreflang. Zwei Bestände nebeneinander zeigen, welche Seiten nur die eine führt, welche nur die andere und was in beiden verschieden geschrieben steht — die frisch erzeugte gegen die live ausgelieferte, bevor Google den Unterschied bemerkt.
Suche
Texte auf den Seiten suchen
Grep für die Website: im Quelltext oder im sichtbaren Text, wörtlich oder als Regex, auch als Negativsuche — welche Seiten haben das nicht. Läuft auf dem geladenen Crawl.
Extraktion
Daten aus den Seiten holen
Beliebige Werte per CSS-Selektor, XPath oder Regex — Preise, Artikelnummern, Social-Tags. Ein falscher Selektor kostet keinen zweiten Crawl.
Struktur
Die Struktur zeichnen
Crawl-Diagramm mit Kräfte-Layout, Crawl-Baum nach Klicktiefe, Verzeichnisbaum nach URL-Struktur — einfärbbar nach Status, Indexierbarkeit, Tiefe oder Problemen.
Crawling
Hinter einem Login crawlen
JMX füllt das Login-Formular aus und crawlt mit der Sitzung; CSRF-Token gehen unverändert mit. Scheitert die Anmeldung, bricht der Lauf ab, statt still die Login-Seite zu spiegeln.
Crawling
Eine neue robots.txt vorher prüfen
Der Entwurf gilt für die gecrawlte Website statt der Live-Datei — samt Wirkung auf die KI-Crawler. Was er aussperrt, sieht man vor dem Einspielen.
Crawling
Als der richtige Crawler auftreten
Vorlagen für Googlebot, Bingbot, Applebot, KI-Crawler und echte Browser — für die Frage, ob Suchmaschinen anderes Markup bekommen als Besucher.
Rendering
JavaScript rendern
Gerendertes gegen ausgeliefertes HTML: welche Texte und Links erst nach JavaScript existieren — und welche Seite ihr noindex erst im Browser setzt.
Logs
Logdateien auswerten
Apache-, nginx- und IIS-Logs gegen den Crawl: Wofür geht das Crawl-Budget drauf, was hat nie ein Bot geholt? Als Bot zählt nur, was Reverse-DNS bestätigt.
Qualität
Rechtschreibung prüfen
Hunspell-basiert, je Seite in ihrer eigenen Sprache, sortiert nach Fehler-Wahrscheinlichkeit statt Häufigkeit. Ein zweites Wörterbuch entscheidet, was Fremdwort und was Fehler ist.
Qualität
Barrierefreiheit prüfen
Dreizehn Regeln für das, was am HTML nachweisbar ist — Formularfelder ohne Beschriftung, Icon-Buttons ohne Namen, doppelte IDs. Mit ehrlicher Ansage, was eine statische Prüfung nicht sehen kann.
Performance
Core Web Vitals messen
Über die PageSpeed-Insights-API, mit dem Unterschied, auf den es ankommt: Felddaten echter Besucher getrennt von Labordaten zur Fehlersuche.
Google
Search Console anbinden
OAuth-Anmeldung, Search-Analytics-Daten, URL-Prüfung für den echten Indexierungsstatus, Sitemap-Verwaltung.
Google
SERP-Daten über DataForSEO
Lizenzierter Zugang zu Google-Ergebnissen für site:-Abfragen und Indexprüfungen. Der Preis jedes Aufrufs wird ausgewiesen, ein Tageslimit greift vorher. Gescrapt wird nicht.
Analytics
Matomo anbinden
Kennzahlen, Besuchsverlauf, Kanäle und die Besuche aus KI-Antwortmaschinen als eigener Kanal — was einmal abgerufen wurde, wird nie wieder abgerufen.
Berichte
Kundenberichte zusammenstellen
Welche Abschnitte, in welcher Reihenfolge, unter welcher Überschrift — pro Kunde als Vorlage, mit Logo, Akzentfarbe und Vorbemerkung. Export nach HTML, CSV und Excel.
Bedienung
Von der Zahl zur Zeile
Jede Kachel und jede Zeile ist ein Absprung: „412 Seiten ohne Description“ öffnet genau diese Regel, die URL öffnet die Seite, der Pfeil führt zurück.
Bedienung
In den Ergebnissen suchen
Ein Suchfeld über jeder Ergebnisliste, wörtlich oder als regulärer Ausdruck, und es genügt ein passendes Feld: Wer „kontakt“ tippt, meint die Seite, ob das Wort in der Adresse oder im Titel steht.
Automation
Ohne Fenster laufen
jmx-cli ist dasselbe Werkzeug für Taskplaner, cron und CI: crawlen, prüfen, Bericht, Sitemap, Exporte — und --fail-on Critical lässt den Lauf rot enden, bevor es der Kunde tut.