Kaputte Links einer Website mit wget --spider finden
defekte Links finden | Broken Link Check per Kommandozeile | 404 Links auf der Website suchen | Website crawlen und tote Links finden | wget | broken-links | 404 | crawling | seoLC_ALL=C wget --spider -r -l 2 -nd -nv -w 1 -o /tmp/spider.log https://example.com/; grep -A 100 'broken link' /tmp/spider.logFolgt allen Links bis zur angegebenen Tiefe, prüft sie nur auf Erreichbarkeit und schreibt das Protokoll in eine Datei. Am Ende stehen unter “Found N broken links” alle URLs, die nicht erreichbar waren. Interne 404er verschwenden Crawl-Budget und verschlechtern die Nutzererfahrung.
Hinweis: -w 1 wartet eine Sekunde zwischen Anfragen, bei großen Sites dauert das entsprechend. wget beachtet die robots.txt, gesperrte Bereiche werden nicht geprüft. LC_ALL=C sorgt für englische Meldungen, damit grep greift.
Auch gesucht als
- defekte Links finden
- Broken Link Check per Kommandozeile
- 404 Links auf der Website suchen
- Website crawlen und tote Links finden