{"id":25345,"date":"2025-03-07T00:00:00","date_gmt":"2025-03-07T00:00:00","guid":{"rendered":"https:\/\/alienroad.com\/google-bilgi-bankasi\/robots-refresher-robots-txt-a-flexible-way-to-control-how-machines-explore-your-website\/"},"modified":"2025-03-07T00:00:00","modified_gmt":"2025-03-07T00:00:00","slug":"robots-refresher-robots-txt-a-flexible-way-to-control-how-machines-explore-your-website","status":"publish","type":"ar_kb","link":"https:\/\/alienroad.com\/google-bilgi-bankasi\/robots-refresher-robots-txt-a-flexible-way-to-control-how-machines-explore-your-website\/","title":{"rendered":"Robots-Refresher: robots.txt \u2014 eine flexible Methode, um zu steuern, wie Maschinen Ihre Website durchsuchen."},"content":{"rendered":"<p class=\"gargardate\">Freitag, 7. M\u00e4rz 2025<\/p>\n<p>\n  Die robots.txt ist ein bew\u00e4hrtes Werkzeug f\u00fcr Website-Betreiber, das seit \u00fcber 30 Jahren im Einsatz ist und von Crawler-Betreibern (wie Tools f\u00fcr Website-Inhaber, Diensten und Suchmaschinen) umfassend unterst\u00fctzt wird. In dieser Ausgabe der <a href=\"https:\/\/alienroad.com\/google-bilgi-bankasi\/robots-refresher-introducing-a-new-series\/\">Robots-Refresher-Serie<\/a> werfen wir einen genaueren Blick auf die robots.txt als flexible Methode, um Bots mitzuteilen, was sie auf Ihrer Website tun (oder lassen) sollen.\n<\/p>\n<h2 id=\"getting-started-with-robots.txt\" tabindex=\"-1\">Erste Schritte mit der robots.txt<\/h2>\n<p>\n  Die Funktionsweise dieser Dateien ist simpel: Sie erstellen eine Textdatei namens &#8220;robots.txt&#8221; und laden diese auf Ihre Website hoch \u2013 falls Sie ein Content-Management-System (CMS) verwenden, ist es meist sogar noch einfacher. Sie k\u00f6nnen Ihre robots.txt-Datei leer lassen (oder gar keine verwenden), wenn Ihre gesamte Website gecrawlt werden darf, oder Sie f\u00fcgen Regeln hinzu, um das Crawling zu steuern. Um beispielsweise allen Bots (auch bekannt als Crawler, Robots, Spiders) mitzuteilen, dass sie Ihre &#8220;Warenkorb&#8221;-Seite meiden sollen, k\u00f6nnten Sie dies in Ihre robots.txt-Datei schreiben:\n<\/p>\n<div><\/div>\n<h2 id=\"more-specific-things-you-can-do-with-robots.txt\" tabindex=\"-1\">Spezifischere M\u00f6glichkeiten mit der robots.txt<\/h2>\n<p>\n  Die robots.txt ist das Schweizer Taschenmesser, um festzulegen, was verschiedene Bots auf Ihrer Website tun oder lassen sollen: Sie kann aus nur wenigen Zeilen bestehen oder komplex mit detaillierten Regeln f\u00fcr ganz spezifische URL-Muster sein. Sie k\u00f6nnen eine robots.txt-Datei zur L\u00f6sung technischer Probleme (wie <a href=\"https:\/\/alienroad.com\/google-bilgi-bankasi\/pagination-incremental-page-loading-and-their-impact-on-google-search\/#avoid-indexing-variations\">unn\u00f6tige paginierte Seiten<\/a>) oder aus redaktionellen oder pers\u00f6nlichen Gr\u00fcnden (etwa wenn bestimmte Inhalte nicht gecrawlt werden sollen) nutzen. Sie k\u00f6nnten zum Beispiel:\n<\/p>\n<table class=\"fixed\">\n<colgroup>\n<col width=\"50%\">\n<col>\n  <\/colgroup>\n<tr>\n<td>\n<p><b>Mehrere Bots (aber nicht alle) \u00fcber dieselbe Regel informieren<\/b><\/p>\n<p>\n        Diese Gruppe weist sowohl <code>examplebot<\/code> als auch <code>otherbot<\/code> an, den Pfad <code>\/search<\/code> zu meiden.\n      <\/p>\n<\/td>\n<td><span><\/span><\/p>\n<div><\/div>\n<\/td>\n<\/tr>\n<tr>\n<td>\n<p><b>Einen Bot anweisen, Pfade mit einem bestimmten Textbaustein zu meiden<\/b><\/p>\n<p>\n        Sie k\u00f6nnten zum Beispiel <code>documentsbot<\/code> anweisen, keine Dateien zu crawlen, die &#8220;.pdf&#8221; im Namen enthalten.\n      <\/p>\n<\/td>\n<td><span><\/span><\/p>\n<div><\/div>\n<\/td>\n<\/tr>\n<tr>\n<td>\n<p><b>Einem Bot erlauben, Ihren Blog zu crawlen, aber nicht die Entw\u00fcrfe<\/b><\/p>\n<\/td>\n<td><span><\/span><\/p>\n<div><\/div>\n<\/td>\n<\/tr>\n<tr>\n<td>\n<p><b>Einen Crawler von einem Teil Ihrer Website ausschlie\u00dfen, w\u00e4hrend andere Crawler Zugriff erhalten<\/b><\/p>\n<p>\n        Diese robots.txt-Datei untersagt dem genannten <code>aicorp-trainer-bot<\/code> den Zugriff auf alles au\u00dfer der Startseite, w\u00e4hrend andere Crawler (wie Suchmaschinen) die Website weiterhin aufrufen d\u00fcrfen.\n      <\/p>\n<\/td>\n<td><span><\/span><\/p>\n<div><\/div>\n<\/td>\n<\/tr>\n<tr>\n<td>\n<p><b>Einen Kommentar f\u00fcr Ihr zuk\u00fcnftiges Ich hinterlassen<\/b><\/p>\n<p>\n        Sie k\u00f6nnen eine Zeile mit <code>#<\/code> beginnen, um sich selbst daran zu erinnern, warum Sie eine bestimmte Regel dort eingef\u00fcgt haben.\n      <\/p>\n<\/td>\n<td>\n      <span><\/span><\/p>\n<div><\/div>\n<\/td>\n<\/tr>\n<\/table>\n<p>\n  F\u00fcr noch mehr Informationen k\u00f6nnen Sie unsere <a href=\"https:\/\/alienroad.com\/google-bilgi-bankasi\/how-to-write-and-submit-a-robots-txt-file\/#useful-robots.txt-rules\">Liste n\u00fctzlicher robots.txt-Regeln<\/a> einsehen.\n<\/p>\n<h2 id=\"making-changes-to-your-robots.txt-file-practically\" tabindex=\"-1\">\u00c4nderungen an Ihrer robots.txt-Datei (praktisch umgesetzt) <\/h2>\n<p>\n  Das <a href=\"https:\/\/datatracker.ietf.org\/doc\/rfc9309\/\" class=\"external-link\">Robots Exclusion Protocol (REP)<\/a> funktioniert, indem Regeln (&#8220;<span>allow<\/span>&#8221; oder &#8220;<span>disallow<\/span>&#8220;) zusammengestellt und die Bots spezifiziert werden, f\u00fcr die diese Regeln gelten. Sie m\u00fcssen nicht programmieren lernen oder mit komplizierten Tools hantieren; Sie k\u00f6nnen diese Regeln einfach in eine Textdatei schreiben und auf Ihre Website hochladen.\n<\/p>\n<p>\n  F\u00fcr die meisten Websites ist es sogar noch einfacher! Wenn Sie ein CMS verwenden, ist meist bereits eine Funktion integriert, die Ihnen bei der Bearbeitung Ihrer robots.txt-Datei hilft. Einige CMS erm\u00f6glichen es beispielsweise, die robots.txt-Datei \u00fcber Kontrollk\u00e4stchen oder ein einfaches Formular anzupassen, und viele bieten Plugins, die Sie beim Erstellen und Schreiben von Regeln f\u00fcr Ihre robots.txt-Datei unterst\u00fctzen. Um zu pr\u00fcfen, was in Ihrem CMS m\u00f6glich ist, suchen Sie einfach nach dem Namen Ihres CMS + &#8220;robots.txt-Datei bearbeiten&#8221;.\n<\/p>\n<p>\n  Sobald alles eingerichtet ist, k\u00f6nnen Sie testen, ob Ihre Datei wie gew\u00fcnscht funktioniert. Es gibt viele von der Web-Community entwickelte Test-Tools, die dabei helfen, wie das <a href=\"https:\/\/tamethebots.com\/tools\/robotstxt-checker\" class=\"external-link\">robots.txt-Test-Tool von TametheBot<\/a> und dieser <a href=\"https:\/\/www.realrobotstxt.com\/\" class=\"external-link\">robots.txt-Parser<\/a>, die auf der <a href=\"https:\/\/github.com\/google\/robotstxt\" class=\"external-link\">Open-Source-Parser-Bibliothek f\u00fcr robots.txt<\/a> basieren.\n<\/p>\n<p>\n  Wenn Sie Fragen zur robots.txt haben, finden Sie uns auf <a href=\"https:\/\/www.linkedin.com\/showcase\/googlesearchcentral\/\" class=\"external-link\">LinkedIn<\/a> oder k\u00f6nnen sich mit gleichgesinnten Experten in <a href=\"https:\/\/support.google.com\/webmasters\/community\" class=\"external-link\">unseren Community-Foren<\/a> austauschen.\n<\/p>\n<p class=\"byline-author\">Ver\u00f6ffentlicht von <a href=\"https:\/\/developers.google.com\/search\/blog\/authors\/martin-splitt\">Martin Splitt<\/a><br \/>\n  und <a href=\"https:\/\/developers.google.com\/search\/blog\/authors\/john-mueller\">John Mueller<\/a>,<br \/>\n  Search Relations Team<\/p>\n<hr class=\"full-width\">\n<h2 id=\"check-out-the-rest-of-the-robots-refresher-series:\" tabindex=\"-1\">Entdecken Sie den Rest der Robots-Refresher-Serie:<\/h2>\n","protected":false},"excerpt":{"rendered":"<p>Freitag, 7. M\u00e4rz 2025 Die robots.txt ist ein bew\u00e4hrtes Werkzeug f\u00fcr Website-Betreiber, das seit \u00fcber 30 Jahren im Einsatz ist und von Crawler-Betreibern (wie Tools f\u00fcr Website-Inhaber, Diensten und Suchmaschinen) umfassend unterst\u00fctzt wird. In dieser Ausgabe der Robots-Refresher-Serie werfen wir einen genaueren Blick auf die robots.txt als flexible Methode, um Bots mitzuteilen, was sie auf [&hellip;]<\/p>\n","protected":false},"menu_order":79846,"template":"","meta":{"footnotes":""},"ar_kb_kategori":[665],"ar_kb_etiket":[],"class_list":["post-25345","ar_kb","type-ar_kb","status-publish","has-post-thumbnail","hentry","ar_kb_kategori-blog"],"_links":{"self":[{"href":"https:\/\/alienroad.com\/wp-json\/wp\/v2\/ar_kb\/25345","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/alienroad.com\/wp-json\/wp\/v2\/ar_kb"}],"about":[{"href":"https:\/\/alienroad.com\/wp-json\/wp\/v2\/types\/ar_kb"}],"version-history":[{"count":0,"href":"https:\/\/alienroad.com\/wp-json\/wp\/v2\/ar_kb\/25345\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/alienroad.com\/wp-json\/wp\/v2\/media\/27465"}],"wp:attachment":[{"href":"https:\/\/alienroad.com\/wp-json\/wp\/v2\/media?parent=25345"}],"wp:term":[{"taxonomy":"ar_kb_kategori","embeddable":true,"href":"https:\/\/alienroad.com\/wp-json\/wp\/v2\/ar_kb_kategori?post=25345"},{"taxonomy":"ar_kb_etiket","embeddable":true,"href":"https:\/\/alienroad.com\/wp-json\/wp\/v2\/ar_kb_etiket?post=25345"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}