Drücke Ctrl+D, um diese Seite als Lesezeichen zu speichern
Der Robots. txt-Generator ist ein kostenloses Online-Tool zur einfachen Erstellung von robots.
Wie benutzt man robots.txt-Generator?
Wählen Sie den User Agent (Crawler) aus.
Legen Sie Allow- und Disallow-Pfadregeln fest.
Fügen Sie die Sitemap-URL hinzu und kopieren Sie die generierte robots.txt.
Häufig gestellte Fragen zu robots.txt-Generator
Was ist robots.txt?
robots.txt ist eine Textdatei im Stammverzeichnis einer Website, die Suchmaschinen-Crawlern mitteilt, welche Seiten gecrawlt oder ignoriert werden sollen.
Kann robots.txt Seiten vollständig aus den Suchergebnissen ausblenden?
Nein. robots.txt steuert nur das Crawling — Seiten können weiterhin erscheinen, wenn sie von anderen Seiten verlinkt sind. Verwenden Sie ein noindex-Meta-Tag für vollständige Entfernung.
Wie verhindere ich, dass KI-Crawler meine Website zum Training nutzen?
Nennen Sie in der robots.txt den jeweils veröffentlichten Crawler – GPTBot, ClaudeBot, PerplexityBot und so weiter – und setzen Sie ein Disallow. Neuer ist der Ansatz Content-Signal, mit dem sich die Erlaubnis nach Zweck in einer Zeile angeben lässt, etwa search=yes, ai-train=no. Bedenken Sie: robots.txt ist eine Bitte, an die sich nur freiwillig gehorchende Crawler halten, keine technische Sperre – was wirklich nicht abgegriffen werden darf, gehört hinter einen Login.
Kann ein Fehler in robots.txt meine ganze Website aus der Suche werfen?
Ja – eine einzige Zeile Disallow: / nimmt die gesamte Website vom Crawling aus. Die robots.txt eines Testservers unverändert in die Produktion zu spielen und diese Zeile zu vergessen, passiert wirklich häufig. Öffnen Sie robots.txt nach jedem Deployment direkt im Browser und prüfen Sie Ihre wichtigsten Seiten mit dem robots.txt-Tester der Google Search Console. Sich von einer Deindexierung zu erholen dauert Tage bis Wochen, lange nachdem die Datei korrigiert ist.
Wie nutzt man robots.txt-Generator optimal?
robots.txt verhindert nur das Crawlen – aus dem Index nimmt Sie erst ein noindex-Meta-Tag.
Legen Sie Regeln pro User-agent an, etwa für GPTBot anders als für Googlebot.
Schließen Sie die Datei mit einer absoluten Zeile Sitemap: https://... ab.