robots.txt abrufen und Disallow-Regeln anzeigen
was sperrt die robots.txt | robots.txt prüfen | Disallow Regeln anzeigen | ist die Seite für Google gesperrt | curl | robots-txt | crawling | seocurl -s https://example.com/robots.txt | grep -iE '^\s*(user-agent|disallow|allow|sitemap):'Ruft die robots.txt ab und filtert Kommentare und Leerzeilen heraus. Schnell zu sehen ist so, ob versehentlich ein Disallow: / aus der Entwicklungsphase stehen geblieben ist und ob die Sitemap eingetragen ist. Die URL muss mit Schrägstrich enden.
Hinweis: Bei WordPress ohne physische Datei erzeugt WordPress die robots.txt dynamisch. Den Statuscode prüft curl -sI {{URL}}robots.txt, ein 5xx dort kann das Crawling ganz stoppen.
Auch gesucht als
- was sperrt die robots.txt
- robots.txt prüfen
- Disallow Regeln anzeigen
- ist die Seite für Google gesperrt