- Robots.Txt по-русски - -
Методы управления поведением робота Яндекса
Posted By Atabekov On 29.11.2012 @ 8:22 дп In | No Comments
Мета-теги позволяют вебмастерам указывать метаданные о странице сайта. Ряд мета-тегов также используется роботами поисковых систем. Робот Яндекса учитывает содержание следующих тегов:
Также робот Яндекса учитывает указания в тегах:
В атрибуте name вместо значения robots можно использовать значение yandex, чтобы указать директивы только для робота Яндекса, например:
<meta name="yandex" content="all"/>
Робот не узнает о документах, если ссылки на них стоят со страницы, содержащей мета-тег со значением nofollow, тем не менее, они могут быть проиндексированы, если где-либо еще на них указаны ссылки без nofollow.
Если мета-теги не указаны, робот считает, что они имеют положительное значение (index, follow, archive). Если робот обнаруживает конфликт между тегами, выбирается именно положительное значение.
Пример:
<meta name="robots" content="all"/> <meta name="robots" content="noindex, follow"/> <!—Робот выберет значение all, текст и ссылки будут проиндексированы.—>
Исключение — атрибут all не влияет на noarchive:
<meta name="robots" content="all"/> <meta name="robots" content="noarchive"/> <!—Текст и ссылки будут проиндексированы, но в результатах поиска не будет ссылки на сохраненную копию страницы.—>
Для запрета индексирования служебных участков текста вы можете использовать тег. Тег работает аналогично мета-тегу noindex, но распространяется только на контент, заключенный внутри тега в формате:
<noindex>текст, индексирование которого нужно запретить</noindex>
Тег noindex не чувствителен к вложенности (может находиться в любом месте html-кода страницы). При необходимости сделать код сайта валидным возможно использование тега в следующем формате:
<!--noindex-->текст, индексирование которого нужно запретить<!--/noindex-->
Атрибут rel="nofollow" используется в теге <a> в формате:
<a href="url" rel="nofollow">текст ссылки</a>
Атрибут работает аналогично мета-тегу со значением nofollow, но распространяется только на ссылку, для которой указан.
Если на сайте присутствуют группы схожих по контенту страниц, вебмастер может указать для каждой страницы группы предпочитаемый (канонический) адрес, который будет участвовать в поиске. Например, страница доступна по двум адресам:
Если предпочитаемый адрес — /blog, это нужно отразить в коде страницы /pages?id=2:
<link rel="canonical" href="https://"/>
Робот считает ссылку с атрибутом rel="canonical" не строгой директивой, а предлагаемым вариантом, который учитывается, но может быть проигнорирован.
Например, робот может не использовать указанный вами адрес, если:
Также не рекомендуется создавать цепочки канонических адресов: не должно получаться так, что канонический адрес для — , в то время как для указан канонический адрес .
Article printed from Robots.Txt по-русски:
URL to article: /rurobots/yandex/yandex-robot-control
URLs in this post:
[1] Мета-теги: #-
[2] Тег <noindex>: #ltnoindexgt
[3] Атрибут rel="nofollow" тега <a>: #relquotnofollowquot__ltagt
[4] Атрибут rel="canonical" тега <link>: #relquotcanonicalquot__ltlinkgt
Click here to print.
Copyright © 2026–2011 Robots.Txt по-русски (/). All rights reserved.