↑ ↓ auswählen, Enter öffnen, Esc schließen

robots.txt abrufen und Disallow-Regeln anzeigen

Werte anpassen, der Befehl aktualisiert sich live
user@server
curl -s https://example.com/robots.txt | grep -iE '^\s*(user-agent|disallow|allow|sitemap):'

Ruft die robots.txt ab und filtert Kommentare und Leerzeilen heraus. Schnell zu sehen ist so, ob versehentlich ein Disallow: / aus der Entwicklungsphase stehen geblieben ist und ob die Sitemap eingetragen ist. Die URL muss mit Schrägstrich enden.

Hinweis: Bei WordPress ohne physische Datei erzeugt WordPress die robots.txt dynamisch. Den Statuscode prüft curl -sI {{URL}}robots.txt, ein 5xx dort kann das Crawling ganz stoppen.

Auch gesucht als

  • was sperrt die robots.txt
  • robots.txt prüfen
  • Disallow Regeln anzeigen
  • ist die Seite für Google gesperrt

Verwandte Einzeiler

Alle aus SEO-Checks

Erst lesen, dann ausführen.

Die Befehle auf myline.de greifen direkt in Server, Dateien und Datenbanken ein. Ein falscher Pfad oder Platzhalter kann Daten unwiderruflich löschen oder einen Server unerreichbar machen.

  • Alle Befehle werden ohne Gewähr bereitgestellt und sind nicht auf jedem System getestet.
  • Vor dem Ausführen verstehen, was ein Befehl tut, und jeden Platzhalter prüfen.
  • Vorher ein Backup anlegen und möglichst zuerst auf einem Testsystem ausprobieren.
  • Die Ausführung erfolgt auf eigene Verantwortung. Eine Haftung für Schäden ist ausgeschlossen, soweit gesetzlich zulässig.