Erstellen Sie in Sekunden eine gültige robots.txt-Datei: User-Agent, gesperrte und erlaubte Pfade sowie Sitemap-URL eintragen, dann kopieren oder herunterladen.
Eine robots.txt ist eine kurze Textdatei im Stammverzeichnis Ihrer Website, die Suchmaschinen-Crawlern sagt, welche Bereiche sie nicht crawlen sollen. Sie gehört zu den ersten Dateien, die der Googlebot abruft, und eine einzige falsche Zeile kann Ihre ganze Website verstecken. Dieser Generator baut die Datei aus wenigen einfachen Feldern, sodass die Syntax immer stimmt.
* stehen, damit die Regeln für alle Crawler gelten, oder tragen Sie einen bestimmten Bot ein, etwa Googlebot oder Bingbot./admin/ oder /cart/./admin/admin-ajax.php.Laden Sie die Datei in die oberste Ebene Ihrer Domain hoch, sodass sie unter https://ihredomain.de/robots.txt erreichbar ist. Crawler suchen sie nirgendwo sonst, und jede Subdomain braucht ihre eigene Datei.
User-agent: * Disallow: /cart/ Disallow: /checkout/ Disallow: /account/ Disallow: /search Allow: /search/help Sitemap: https://example.com/sitemap.xml
Warenkorb, Kasse und Kundenkonto sehen für jeden Besucher anders aus und haben in Suchergebnissen keinen Wert, und interne Suchseiten können endlos viele URL-Kombinationen erzeugen, die Crawl-Zeit verschwenden. Alles andere, einschließlich Produkt- und Kategorieseiten, bleibt offen.
Disallow: / sperrt alles. Auf Testumgebungen ist das üblich und wird manchmal versehentlich auf die Live-Seite übernommen. Verschwinden Ihre Seiten plötzlich aus Google, prüfen Sie das zuerst.noindex-Meta-Tag./Admin/ und /admin/ sind zwei verschiedene Regeln.Bing und einige andere Crawler halten sich an Crawl-delay, aber der Googlebot ignoriert es. Google passt seine Crawl-Rate automatisch daran an, wie schnell Ihr Server antwortet. Setzen Sie eine Verzögerung nur, wenn ein bestimmter Bot Ihren Server überlastet.
Öffnen Sie Ihre robots.txt im Browser, um zu bestätigen, dass sie live ist. Prüfen Sie dann im robots.txt-Bericht der Google Search Console (Einstellungen → robots.txt), welche Version Google abgerufen hat und ob Fehler gefunden wurden. Testen Sie eine wichtige Seite mit dem URL-Prüftool, um sicherzugehen, dass sie nicht gesperrt ist.
Sie nutzen WordPress? Der WordPress robots.txt Generator startet mit WordPress-spezifischen Regeln. Prüfen Sie mit dem XML Sitemap Generator, ob die angegebene Sitemap gültig ist, und lesen Sie für weitere Beispiele den (englischen) Artikel How to Create the Perfect Robots.txt File for SEO.