
Die robots.txt ist eine kleine Datei, die Suchmaschinen sagt, welche Bereiche deiner Website sie anschauen dürfen und welche nicht. Wie ein Türsteher für Google und Co.
Manche Bereiche einer Website müssen nicht bei Google landen, zum Beispiel der Login oder interne Suchergebnisse. Die robots.txt hält die Bots da höflich raus. Für den normalen Betrieb ist sie schnell eingerichtet und dann vergessen.
Aber Vorsicht, hier steckt eine Falle. Eine einzige falsche Zeile, ein „Disallow: /“, und du sperrst aus Versehen deine ganze Website für Google. Von einem Tag auf den anderen unsichtbar, ohne dass die Seite selbst kaputt ist. Deshalb fasst man die Datei nicht blind an.

Eine typische robots.txt-Datei besteht aus sogenannten „User-agent“- und „Disallow“-Direktiven:
Beispiel einer einfachen robots.txt:
User-agent: *
Disallow: /admin/
Disallow: /private-info/
Diese Anweisungen bedeuten, dass alle Suchmaschinen-Crawler (User-agent: *) weder das Verzeichnis /admin/ noch /private-info/ crawlen sollen.
Weitere Direktiven und Beispiele:
Beispiel:
User-agent: *
Disallow: /intern/
Allow: /intern/blog/
Sitemap: https://www.beispielseite.de/sitemap.xml
Hier wird das Verzeichnis /intern/ gesperrt, mit Ausnahme des Unterverzeichnisses /intern/blog/, das explizit erlaubt wird. Zusätzlich wird auf die Sitemap verwiesen.
Ruf deinefirma.de/robots.txt auf und schau, ob da irgendwo „Disallow: /“ alleine steht. Wenn ja, blockierst du dich selbst. Ansonsten Finger weg, solange du nicht genau weißt, was jede Zeile bedeutet. Im Zweifel lieber einmal fachlich prüfen lassen.
Was passiert bei einem Fehler in der robots.txt?
Im schlimmsten Fall verschwindet deine ganze Website aus Google, obwohl sie technisch einwandfrei läuft. Ein falsches „Disallow“ reicht. Deshalb ist die Datei mit Vorsicht zu behandeln.
Brauche ich überhaupt eine robots.txt?
Die meisten Websites haben automatisch eine sinnvolle Grundeinstellung. Aktiv anfassen musst du sie selten, prüfen schadet aber nicht.
Wir prüfen und richten deine robots.txt sicher ein: SEO-Service von Signo Media.
Die robots.txt-Datei ist ein wichtiges Instrument zur Kontrolle des Crawl-Verhaltens von Suchmaschinen. Richtig eingesetzt, trägt sie dazu bei, die Indexierung relevanter Inhalte sicherzustellen, Ressourcen zu schonen und unerwünschte Seiten aus den Suchergebnissen fernzuhalten. Dennoch sollte man sich bewusst sein, dass die robots.txt lediglich eine Anweisung ist, an die sich seriöse Crawler halten – der wirksamste Schutz sensibler Inhalte erfolgt durch Zugangsbeschränkungen, Noindex-Tags oder Passwörter.
Datenschutzhinweis
Um dir ein optimales Nutzungserlebnis zu ermöglichen, setzen wir auf dieser Website Cookies und vergleichbare Technologien ein, um Geräteinformationen zu speichern und/oder darauf zuzugreifen. Mit deiner Einwilligung können wir personenbezogene Daten wie dein Nutzungsverhalten oder eindeutige Kennungen verarbeiten.
Die Datenverarbeitung kann auch außerhalb der EU erfolgen, z. B. durch Anbieter in den USA. Dabei besteht das Risiko, dass Behörden auf diese Daten zugreifen können, ohne dass dir dagegen wirksame Rechtsmittel zustehen.
Folgende Dienste können dabei zum Einsatz kommen – jeweils nur, wenn du zustimmst:
Calendly (Terminvereinbarung)
Facebook (Marketing, eingebettete Inhalte)
Google Fonts (Webschriftarten)
Google Maps (Kartendarstellung)
Google reCAPTCHA (Spamschutz)
Instagram (eingebettete Beiträge)
LinkedIn (eingebettete Inhalte, Tracking)
WhatsApp (Kontaktmöglichkeit)
YouTube (eingebettete Videos)
Wenn du keine Einwilligung erteilst oder diese später widerrufst, kann dies die Funktionalität der Website einschränken – z. B. werden eingebettete Inhalte blockiert.