- Robots.Txt по-русски - -
Теория и практика работы с robots.txt
Posted By GlebMarkov On 18.03.2010 @ 3:22 дп In | No Comments
Следует отметить, что все эти методы не дают стопроцентной гарантии. Некоторые роботы могут попросту не обращать на них внимание.
Стандарт исключений для роботов [3] был принят в 1994 году и с тех пор не менялся. Стандарт описывает общие принципы написания robots.txt. Вкратце — при заходе на сайт робот запрашивает файл robots.txt, чтобы посмотреть, какие разделы и документы на сайте запрещены для него.
Важно помнить, что стандарт является необязательным, и его придерживаются только «вежливые и культурные» роботы. Врядли вы сможете при помощи него запретить, например, доступ для роботов ворующих у вас контент.
Подробнее о написании robots.txt и о том, что означают различные правила, можно узнать из руководства по использованию robots.txt [4].
МЕТА-тег «Robots» [5] позволяет создателям страниц указывать Роботам, можно ли индексировать данную страницу и можно ли использовать ссылки, приведенные на странице. Этот тег указывается на каждой конкретной странице, доступ к которой требуется ограничить.
Не предусмотреные стандартом [6] средства ограничения доступа к содержимому сайта. В первую очередь тег и аттрибут rel="nofollow".
Article printed from Robots.Txt по-русски:
URL to article: /robotsexclusion
URLs in this post:
[1] rel="nofollow":
[2] при помощи тега <noindex>:
[3] Стандарт исключений для роботов: /robotsexclusion/spec
[4] руководства по использованию robots.txt: /robotsexclusion/guide
[5] МЕТА-тег «Robots»: /robotsexclusion/meta
[6] Не предусмотреные стандартом: /robotsexclusion/noindex
Click here to print.
Copyright © 2026–2011 Robots.Txt по-русски (/). All rights reserved.