↑ ↓ auswählen, Enter öffnen, Esc schließen

Interne Links einer Seite extrahieren und zählen

Werte anpassen, der Befehl aktualisiert sich live
user@server
curl -s https://example.com/ | tr '\n' ' ' | grep -oiE 'href="[^"]+"' | sed -E 's/^href="//I; s/"$//; s/#.*//' | grep -E '^(/|https?://(www\.)?example.com)' | sort | uniq -c | sort -rn

Zieht alle href-Ziele aus dem HTML, entfernt Sprungmarken und behält nur Links, die mit / beginnen oder auf die eigene Domain zeigen. Die Häufigkeit zeigt, welche Seiten aus Navigation und Footer besonders oft verlinkt werden. Auffällig sind Links auf http-Varianten, Staging-Domains oder alte URLs mit Weiterleitung.

Hinweis: Relative Links ohne führenden Schrägstrich fehlen, und Stylesheets aus <link href> erscheinen mit. Die Liste lässt sich an den Statuscode-Check aus der Sitemap-Prüfung weitergeben.

Auch gesucht als

  • alle Links einer Seite anzeigen
  • interne Verlinkung prüfen
  • welche Seiten werden verlinkt
  • Links aus HTML extrahieren

Verwandte Einzeiler

Alle aus SEO-Checks

Erst lesen, dann ausführen.

Die Befehle auf myline.de greifen direkt in Server, Dateien und Datenbanken ein. Ein falscher Pfad oder Platzhalter kann Daten unwiderruflich löschen oder einen Server unerreichbar machen.

  • Alle Befehle werden ohne Gewähr bereitgestellt und sind nicht auf jedem System getestet.
  • Vor dem Ausführen verstehen, was ein Befehl tut, und jeden Platzhalter prüfen.
  • Vorher ein Backup anlegen und möglichst zuerst auf einem Testsystem ausprobieren.
  • Die Ausführung erfolgt auf eigene Verantwortung. Eine Haftung für Schäden ist ausgeschlossen, soweit gesetzlich zulässig.