Robots.txt Generator
KOSTENLOSES WERKZEUG

Robots.txt Generator

Visuell Suchmaschinen-Crawler-Regeln konfigurieren 鈥?Standard-robots.txt-Dateien mit einem Klick generieren

馃敀 100% Lokale Verarbeitung 路 Daten Verlassen Niemals Ihren Browser 路 Sicher & Privat
Schnellvorlagen:
鈿欙笍 Grundeinstellungen
馃搵 Crawl-Regeln
馃搫 robots.txt Ausgabe

Verwandte Werkzeuge

馃摉 Robots.txt Generator Anleitung

Was ist Robots.txt?

Robots.txt ist eine Textdatei im Stammverzeichnis einer Website, die Suchmaschinen-Crawlern mitteilt, welche Seiten sie crawlen duerfen und welche nicht. Sie ist die grundlegende Art, wie Websites mit Suchmaschinen kommunizieren, und ein wesentlicher Bestandteil der SEO-Optimierung. Eine richtig konfigurierte robots.txt hilft Suchmaschinen, Ihre Website effizienter zu crawlen.

Hauptfunktionen

Haeufige Anwendungsfaelle

Neuer Website-Start: schnell eine Standard-robots.txt-Datei generieren. SEO-Optimierung: Crawl-Bereich kontrollieren, um Ranking-Gewicht zu konzentrieren. Admin-Schutz: Crawler von Admin- und sensiblen Seiten blockieren. Bandbreite sparen: Crawling von Bildern, CSS, JS und anderen statischen Ressourcen blockieren. Multi-Site-Verwaltung: schnell Konfigurationen fuer verschiedene Websites generieren.

So verwenden Sie es

Waehlen Sie den zu konfigurierenden Crawler (User-agent) 鈥?Standard sind alle Crawler. Fuegen Sie Disallow- (blockieren) oder Allow- (erlauben) Regeln hinzu und geben Sie Pfade ein. Optional koennen Sie Crawl-Verzoegerung und Sitemap-URL konfigurieren. Der robots.txt-Inhalt wird in Echtzeit rechts generiert. Klicken Sie auf "Kopieren" oder "Herunterladen", um die Datei zu erhalten und laden Sie sie in das Stammverzeichnis Ihrer Website hoch.

Profis Tipps

Haeufig gestellte Fragen

Wo platziere ich robots.txt?

Robots.txt muss im Stammverzeichnis Ihrer Website mit dem kleingeschriebenen Dateinamen robots.txt platziert werden. Zum Beispiel: https://www.example.com/robots.txt. Suchmaschinen-Crawler rufen diese Adresse automatisch ab, um Crawl-Regeln zu erhalten.

Was ist der Unterschied zwischen Disallow und Allow?

Disallow sagt Crawlern, dass sie bestimmte Pfade nicht crawlen sollen. Allow sagt Crawlern, dass sie bestimmte Pfade crawlen duerfen. Allow hat Vorrang vor Disallow, oft verwendet fuer "ganzes Verzeichnis blockieren aber eine Datei erlauben"-Szenarien. Z.B., Disallow: /admin/ aber Allow: /admin/login.php.

Kann robots.txt die Indizierung komplett verhindern?

Nein. Robots.txt sagt Crawlern, dass sie nicht crawlen sollen, aber wenn andere Seiten auf diese Seiten verlinken, koennen Suchmaschinen deren URLs trotzdem indizieren. Um die Indizierung komplett zu verhindern, verwenden Sie stattdessen das noindex-Meta-Tag oder den X-Robots-Tag-Antwort-Header.

Wozu dient Crawl-delay?

Crawl-delay sagt Crawlern, wie viele Sekunden sie zwischen jedem Abruf warten sollen, um die Serverlast zu reduzieren. Googlebot unterstuetzt diese Anweisung jedoch nicht 鈥?die Google-Crawl-Geschwindigkeit muss in der Search Console eingestellt werden. Andere Crawler wie Bing und Yandex unterstuetzen sie.

Unterstuetzen Pfade Wildcards?

Ja. * passt zu beliebigen Zeichenfolgen, $ passt zum Ende einer URL. Zum Beispiel blockiert Disallow: /*.pdf$ alle PDF-Dateien, Disallow: /?* blockiert URLs mit Abfrageparametern. Beachten Sie, dass nicht alle Crawler Wildcards vollstaendig unterstuetzen.