Robots.txt-Dateigenerator

Erstellen Sie ganz einfach eine professionelle SEO-robots.txt-Datei für Ihre Website.

Geben Sie die Sitemap-URL Ihrer Website ein.
Geben Sie die URLs ein, die für Bots gesperrt werden sollen (eine pro Zeile).

Generierte robots.txt

Kostenloser Generator für robots.txt-Dateien

Unser kostenloser Robots.txt-Datei-Generator erstellt in Sekundenschnelle eine saubere und gültige robots.txt-Datei für Ihre Website. Fügen Sie Ihre Sitemap-URL hinzu, listen Sie die zu blockierenden Pfade auf und generieren Sie eine sofort einsatzbereite Datei zum Kopieren oder Herunterladen. Sie benötigen keine Syntaxkenntnisse, keine Registrierung und kein Risiko von Tippfehlern, die beim manuellen Erstellen der Datei unbemerkt zur Deindexierung einer Website führen können.

Eine robots.txt-Datei steuert, wie Suchmaschinen Ihre Website crawlen. Ein einziger Fehler kann dazu führen, dass Ihre gesamte Website ohne Vorwarnung von Google gesperrt wird. Dieser Generator beseitigt dieses Risiko, indem er die Datei anhand Ihrer Eingaben anstatt anhand von Freitext erstellt.

Was ist eine robots.txt-Datei?

 Die robots.txt-Datei ist eine einfache Textdatei im Stammverzeichnis Ihrer Domain, die Suchmaschinen-Crawlern mitteilt, welche URLs sie aufrufen dürfen. Sie befindet sich unter IhrerWebsite.de/robots.txt und ist die erste Datei, die die meisten Bots vor dem Crawling prüfen. Sie steuert das Crawling, nicht die Indexierung. Daher kann eine blockierte Seite weiterhin in den Suchergebnissen erscheinen, wenn andere Websites darauf verlinken.

Die Datei folgt dem Robots Exclusion Standard, einem Protokoll, das von allen großen Suchmaschinen respektiert wird. Googlebot, Bingbot und andere seriöse Crawler lesen sie, bevor sie weitere Anfragen an Ihre Website senden. Web-Scraper und Malware-Bots ignorieren sie oft vollständig, weshalb die robots.txt-Datei niemals ein Sicherheitsinstrument darstellt.

Laut Google kann eine in der robots.txt-Datei gesperrte Seite dennoch indexiert werden, wenn sie von anderen Seiten verlinkt wird. Sie erscheint dann üblicherweise ohne Beschreibung. Wenn Sie verhindern möchten, dass eine Seite in den Suchergebnissen erscheint, ist ein Noindex-Tag oder ein Passwortschutz die richtige Methode, nicht eine Disallow-Regel.

So verwenden Sie diesen Robots.txt-Generator

 Um eine robots.txt-Datei zu erstellen, geben Sie Ihre Sitemap-URL ein, fügen Sie alle zu blockierenden Pfade jeweils in einer eigenen Zeile hinzu und klicken Sie dann auf „Generieren“. Das Tool erstellt eine korrekt formatierte Datei, die Sie kopieren oder herunterladen können. Laden Sie diese in das Stammverzeichnis Ihrer Website hoch, sodass sie unter IhrerWebsite.de/robots.txt erreichbar ist, und testen Sie sie anschließend in der Google Search Console.

  1. Geben Sie Ihre Sitemap-URL ein. Dadurch werden Crawler direkt zu Ihren wichtigsten Seiten geleitet, zum Beispiel https://yoursite.com/sitemap_index.xml.
  2. Füge Pfade hinzu, die nicht zugelassen werden sollen. Geben Sie pro Zeile einen Pfad an, z. B. /wp-admin/ oder /cart/. Lassen Sie dieses Feld leer, um ein vollständiges Crawling zu ermöglichen.
  3. Klicken Sie auf Generieren. Das Tool erzeugt eine saubere, gültige robots.txt-Datei mit korrekter Syntax und korrekten Abständen.
  4. Datei kopieren oder herunterladen. Speichern Sie es als robots.txt mit UTF-8-Kodierung.
  5. Laden Sie es in das Stammverzeichnis Ihrer Website hoch. und überprüfen Sie, ob die Seite unter yoursite.com/robots.txt geladen wird, und testen Sie dann wichtige URLs in der Search Console.

Robots.txt-Syntax: Die Direktiven erklärt

 Eine robots.txt-Datei besteht aus vier Kernanweisungen. „User-agent“ zielt auf einen bestimmten Crawler ab, „Disallow“ blockiert einen Pfad, „Allow“ erlaubt einen Pfad innerhalb eines blockierten Ordners und „Sitemap“ verweist auf Ihre XML-Sitemap. Jede Regel steht in einer eigenen Zeile, Pfade unterscheiden Groß- und Kleinschreibung, und Crawler wenden die spezifischste passende Regel an, nicht die erste in der Liste.

Richtlinie

Was es bewirkt

Beispiel

Benutzeragent

Gibt den Crawler an, auf den ein Regelblock angewendet wird.

User-Agent: *

Nicht zulassen

Versperrt den Weg, sodass er nicht beklettert werden kann.

Verboten: /wp-admin/

Erlauben

Erlaubt einen Pfad innerhalb eines gesperrten Ordners

Zulassen: /wp-admin/admin-ajax.php

Sitemap

Teilt Crawlern mit, wo sich Ihre Sitemap befindet.

Sitemap: https://site.com/sitemap.xml

Kriechverzögerung

Verlangt von Bots, zwischen Anfragen zu warten (wird von Google ignoriert)

Kriechverzögerung: 10

Der Stern in User-Agent: * ist ein Platzhalter und bedeutet, dass alle Crawler angesprochen werden. Um einen bestimmten Bot anzusprechen, geben Sie ihn direkt an, z. B. User-Agent: GooglebotEin leerer Wert für „Disallow“ erlaubt alles, während Nicht zulassen: / blockiert die gesamte Website.

Was erlaubt und was verboten sein sollte

 Blockieren Sie Pfade ohne Suchwert, die Crawling-Budget verschwenden, wie z. B. Admin-Seiten, Warenkorb- und Checkout-URLs, interne Suchergebnisse und URLs doppelter Filter. Blockieren Sie niemals CSS-, JavaScript- oder Bildordner, die Suchmaschinen zum Rendern Ihrer Seiten benötigen, da eine Seite, die nicht korrekt gerendert werden kann, bei der Indexierung hinsichtlich ihrer Qualität falsch bewertet werden kann.

Häufige Pfade, die auf den meisten Websites blockiert werden sollten, sind:

  • /wp-admin/ unter Zulassung /wp-admin/admin-ajax.php
  • Interne Suchergebnisseiten wie /?s=
  • URLs für Warenkorb, Kasse und Konto in E-Commerce-Shops
  • Staging- oder Entwicklungsordner
  • Dankes- und Bestätigungsseiten ohne Suchabsicht

Suchmaschinen arbeiten mit einem Crawling-Budget, das die Anzahl der Seiten festlegt, die ein Bot in einem bestimmten Zeitfenster durchsucht. Das Blockieren von wenig relevanten Bereichen hilft den Crawlern, dieses Budget für Seiten zu nutzen, die tatsächlich Traffic generieren. Dies ist besonders wichtig, wenn eine Website wächst, da laut Google 91 % der Seiten keinen organischen Traffic von Google erhalten. AhrefsUnd Kriechkeller vergrößert diese Kluft nur noch.

Steuerung von KI-gestützten Crawlern im Jahr 2026

 Eine moderne robots.txt-Datei beschränkt sich nicht mehr nur auf Googlebot und Bingbot. Sie können nun KI-Crawler wie GPTBot, ClaudeBot, Google-Extended und PerplexityBot sowie SEO-Crawler wie AhrefsBot und SemrushBot zulassen oder blockieren. Jeder Crawler wird über einen eigenen User-Agent-Block gesteuert, sodass Sie genau festlegen können, welche Bots auf Ihre Inhalte zum Trainieren oder Indexieren zugreifen dürfen.

Wenn Sie einen bestimmten KI-Crawler daran hindern möchten, Ihre Inhalte zu verwenden, fügen Sie dafür eine separate Sperre hinzu:

  • User-Agent: GPTBot Dann Nicht zulassen: / blockiert den Crawler von OpenAI
  • User-Agent: Google-Extended Dann Nicht zulassen: / deaktiviert das KI-Training von Google, behält aber das normale Such-Crawling bei.
  • User-Agent: CCBot Dann Nicht zulassen: / blockiert den Common Crawl Bot, der von vielen KI-Datensätzen verwendet wird.

Das Blockieren dieser Dienste hat keine Auswirkungen auf Ihre normalen Suchergebnisse bei Google oder Bing, da diese separate User-Agents verwenden. Es handelt sich hierbei ausschließlich um eine Kontrolle über KI und den Datenzugriff von Drittanbietern.

Robots.txt für WordPress

 WordPress generiert automatisch eine virtuelle robots.txt-Datei, aber durch das Hochladen einer benutzerdefinierten Datei haben Sie die volle Kontrolle. Eine sichere WordPress-Konfiguration blockiert den Administrationsbereich und die interne Suche, während admin-ajax.php und die Sitemap angezeigt werden. Blockieren Sie niemals das gesamte Verzeichnis /wp-content/, da es Theme- und Plugin-Dateien enthält, die Google zum Rendern Ihrer Seiten benötigt.

Eine saubere Ausgangsvorlage für eine WordPress-Website sieht folgendermaßen aus:

User-Agent: *
Verboten: /wp-admin/
Verboten: /?s=
Zulassen: /wp-admin/admin-ajax.php
Sitemap: https://yoursite.com/sitemap_index.xml

Ersetzen Sie die URL durch Ihre eigene Sitemap, generieren Sie die oben genannte Datei und laden Sie sie in Ihr Stammverzeichnis hoch. Wenn Sie einen Online-Shop betreiben, fügen Sie die Pfade zu Warenkorb, Kasse und Kundenkonto zur Sperrliste hinzu.

Häufige Fehler in der robots.txt-Datei, die Sie vermeiden sollten

 Der schwerwiegendste Fehler in der robots.txt-Datei ist das Belassen von „Disallow: /“ in der Live-Datei, wodurch Ihre gesamte Website blockiert wird. Weitere häufige Fehler sind das Blockieren von CSS- und JavaScript-Dateien, das Auflisten sensibler Seiten, die dann öffentlich beworben werden, und die Annahme, robots.txt entferne Seiten aus dem Google-Index, obwohl es lediglich das Crawling steuert.

  • Der versehentliche Vollblock. Ein Streuner Nicht zulassen: / Weist alle Crawler an, Ihre gesamte Website zu ignorieren. Dies geschieht häufig, wenn während einer Migration eine Staging-Datei live geschaltet wird.
  • Blockiert renderkritische Dateien. Wenn Sie das CSS oder JS eines Themes unterbinden, kann Google Ihre Seite nicht mehr so ​​sehen wie ein Benutzer, was sich negativ auf das Ranking auswirken kann, insbesondere bei visuellen Seitenerstellern wie Elementor.
  • Verwendung von robots.txt für Datenschutzzwecke. Die Datei ist öffentlich, daher zeigt die Angabe eines sensiblen Pfads jedem an, wo sie sich befindet. Verwenden Sie stattdessen einen Passwortschutz oder die Option „noindex“.
  • Groß-/Kleinschreibung beachten. Pfade unterscheiden Groß- und Kleinschreibung, daher /Foto/ Und /Foto/ werden als unterschiedliche Verzeichnisse behandelt.

Durch die Verwendung eines Generators anstatt durch manuelles Schreiben der Datei werden fast alle diese Risiken beseitigt, da die Syntax jedes Mal korrekt aus Ihren Eingaben erstellt wird.

Robots.txt vs Sitemap vs Noindex

 Diese drei Elemente erfüllen unterschiedliche Funktionen. Die robots.txt-Datei steuert, auf welche Pfade Crawler zugreifen dürfen, eine Sitemap listet die URLs auf, die gecrawlt und indexiert werden sollen, und ein noindex-Tag verhindert, dass eine crawlbare Seite in den Suchergebnissen erscheint. Eine gut durchdachte technische SEO-Konfiguration verwendet robots.txt und Sitemap gemeinsam und reserviert noindex für Seiten, die von Google nicht erfasst werden sollen.

Ein häufiger Fehler besteht darin, diese Signale zu widersprechen, beispielsweise eine URL in der Sitemap aufzuführen, sie aber in der robots.txt-Datei zu blockieren. Wenn Sie eine Seite aus der Suche entfernen möchten, erlauben Sie das Crawling und fügen Sie ein noindex-Tag hinzu, da Google ein noindex-Tag auf einer Seite, die nicht gecrawlt werden darf, nicht lesen kann. Weitere Informationen finden Sie in unseren Anleitungen zu diesem Thema. SEO-Blog.

Warum eine korrekte robots.txt-Datei Ihrer Suchmaschinenoptimierung hilft

 Eine korrekt konfigurierte robots.txt-Datei verbessert die Suchmaschinenoptimierung (SEO), indem sie Crawler zu Ihren wertvollen Seiten lenkt und von weniger relevanten Seiten fernhält. Dadurch wird das Crawling-Budget geschont und wichtige Inhalte werden schneller indexiert. Obwohl die robots.txt-Datei kein direkter Rankingfaktor ist, beeinflusst die Crawling-Effizienz unmittelbar, wie schnell und vollständig Ihre Website verarbeitet wird.

Backlinks gehören nach wie vor zu den drei wichtigsten Rankingfaktoren von Google, doch all diese erworbene Autorität ist bedeutungslos, wenn Crawling-Probleme die korrekte Verarbeitung Ihrer besten Seiten verhindern. DomänenautoritätDer Moz-Score (1 bis 100), der hauptsächlich auf Backlink-Signalen basiert, wächst am schnellsten auf Websites, deren Crawling und Indexierung reibungslos funktionieren. Sobald Ihre robots.txt-Datei eingerichtet ist, überprüfen Sie Ihre Autorität mit unserem kostenloses DA PA-Tool und scannen Sie mithilfe unseres Massenprüfung defekter Links.

Häufig gestellte Fragen

Ist dieser robots.txt-Generator kostenlos?

Ja, unser Robots.txt-Dateigenerator ist komplett kostenlos und erfordert weder Anmeldung noch Einschränkungen. Geben Sie Ihre Sitemap ein, sperren Sie bestimmte Pfade, generieren Sie die Datei und kopieren oder laden Sie sie sofort herunter. Sie können jederzeit zurückkehren und eine aktualisierte Datei generieren, wenn sich Ihre Website-Struktur ändert – zusammen mit unserer gesamten Suite. kostenlose SEO-Tools.

Wohin speichere ich die robots.txt-Datei, nachdem ich sie generiert habe?

Laden Sie die Datei in das Stammverzeichnis Ihrer Website hoch, sodass sie unter IhrerWebsite.de/robots.txt aufgerufen werden kann. In einem Unterverzeichnis funktioniert sie nicht. Unter WordPress können Sie die Datei per FTP hochladen oder den Inhalt in den robots.txt-Editor Ihres SEO-Plugins, wie z. B. Yoast oder Rank Math, einfügen.

Entfernt die robots.txt-Datei meine Seiten aus den Google-Suchergebnissen?

Nein. Die robots.txt-Datei steuert nur das Crawling, nicht das Indexieren. Eine blockierte Seite kann weiterhin in den Suchergebnissen erscheinen, wenn andere Websites darauf verlinken, üblicherweise ohne Beschreibung. Um eine Seite aus den Suchergebnissen zu entfernen, verwenden Sie ein noindex-Tag auf einer crawlbaren Seite oder schützen Sie diese stattdessen mit einem Passwort.

Kann ich KI-Crawler wie GPTBot mit robots.txt blockieren?

Ja. Fügen Sie einen separaten User-Agent-Block für den Bot hinzu, z. B. GPTBot, ClaudeBot oder Google-Extended, gefolgt von „Disallow: /“, um ihn zu blockieren. Dadurch wird verhindert, dass der KI-Crawler auf Ihre Inhalte zugreift, ohne Ihre normalen Suchergebnisse bei Google oder Bing zu beeinträchtigen, da diese separate User-Agents verwenden.

Wie kann ich meine robots.txt-Datei nach dem Hochladen testen?

Öffnen Sie die Google Search Console und verwenden Sie das URL-Prüftool auf einigen wichtigen Seiten, um sicherzustellen, dass diese nicht unerwartet blockiert werden. Testen Sie immer vor und nach Änderungen, da ein einzelnes falsch platziertes Zeichen viel mehr Seiten blockieren kann als beabsichtigt. Ergänzen Sie dies mit einer schnellen Autoritätsprüfung mithilfe unseres Tools. Massenprüfung der Domainautorität.

Erstellen Sie jetzt Ihre robots.txt-Datei.

Scrollen Sie wieder nach oben, geben Sie Ihre Sitemap-URL und alle Pfade ein, die Sie blockieren möchten, und generieren Sie in Sekundenschnelle eine saubere, gültige robots.txt-Datei. Der Service ist kostenlos, erfordert keine Registrierung und eliminiert das Risiko von Tippfehlern, das beim manuellen Erstellen der Datei besteht. Sobald Ihre Crawling-Konfiguration korrekt ist, erkunden Sie unsere vollständiges Paket an SEO-Tools oder holen Sie sich eine zweite Meinung von unserem SEO-Expertenberater Service.



Brauchen Sie Hilfe?
Nach oben scrollen