Правильнее спросить «а как оно получается?»
ну вбивают в форму поиска такое...
Это нормальные UTF-8 ч/б
к ним уже привыкли. Они даже гуглятся...
А вас по такой херне искать будут или нет?
А может сервак отвечает 200 на любую хрень в урле?
А что сначала — ПФ или в Гугле?
И даже денег вам дали бы, если предложите действенный метод очистки выдачи...
Заинтересованы они не в борьбе с воровством.
В поисковую или адресную?
Ну это не то наверное.
Задачей древней фильтрации по сниппетам является нечто типа избавления выдачи от очевидных дублей... но текстовый фрагмент может измениться и от смены тайтла.
Тогда мне показалось, что не «клеят» их боты, а просто не пускают в (основной) индекс (в данном случае это не дубли, просто сервак специально был настроен так странно). А в ЯВМ давно не заглядывал... дабы не сомневаться.
301 нужен в любом случае просто для минимизации лишней суеты ботов. Ведь им чтобы что-то оценить — нужно это получить по HTTP... а только потом оценивать на дублирование контента, rel=canonical и пр. Т.е. в итоге боты конечно признаки разумности проявят, но лимит обращений к вашему сцайту израсходуют (именно поэтому дубли и замедляют [пере]индексацию).
За какой сниппет зафильтровало — наверное лучше в выдаче и посмотреть.
Своего подопытного проверяйте по =товар url:домен/страница=
( но не =товар site:домен/страница= )
Править сниппет можно и... сменой содержимого <title> как ни странно.
А первоисточников/дублей искалки не определяют, им бы “решить задачу разнообразия выдачи” © садовско-колмановские.
А пример — типа давнее упоминание по теме. Сам попал под сабж...
А вы именно так проверяете?
Некоторые юристы вообще живут исключительно на взыскании неустоек. Недавно читал много страниц их правильно подобранных доводов... было чего позаимствовать.
Про доступность (ответ 200) по всем возможным роботсам (при 301 по остальным урлам) по вашей сцылке нету (см. процитированное в #6).
Да и сплошной 200 ОК
http://yandex.ru/robots.txt
https://yandex.ru/robots.txt
http://www.yandex.ru/robots.txt
https://www.yandex.ru/robots.txt (при 301 по некоторым зеркалам при запросе не-robots.txt)
не то что у гула (идущего по 301 и в случае с /robots.txt )
с доменной зоной .yandex как-то неправильно
https://www.yandex/robots.txt
http://www.yandex/robots.txt